扩散模型由于其众多优点已成为一种流行的图像生成和重建方法。然而,大多数基于扩散的逆问题解决方法仅处理二维图像,即使是最近发表的三维方法也没有充分利用三维分布先验。为了解决这个问题,我们提出了一种新方法,使用两个垂直的预训练二维扩散模型来解决三维逆问题。通过将三维数据分布建模为不同方向切片的二维分布的乘积,我们的方法有效地解决了维数灾难。我们的实验结果表明,我们的方法对于三维医学图像重建任务非常有效,包括 MRI Z 轴超分辨率、压缩感知 MRI 和稀疏视图 CT。我们的方法可以生成适合医疗应用的高质量体素体积。代码可在 https://github.com/hyn2028/tpdm 获得
生成模型的最新进展导致了模型,这些模型既可以为大多数文本输入产生现实和相关的信息。这些模型每天都用于生成数百万张图像,并具有巨大影响诸如生成艺术,数字营销和数据增强等领域。鉴于它们的影响力,重要的是要确保生成的内容反映全球的伪影和周围环境,而不是过分代表世界的某些地区。在本文中,我们使用众包研究的研究衡量了通过dall·e 2产生的普通名词(例如房屋)的地理代表,以及稳定的扩散模型,其中包括27个国家 /地区的540名参与者。为了有意地指定没有国家名称的意见,生成的图像最反映了美国之后是印度的周围,而顶级世代很少反映出所有其他国家的周围环境(平均得分少于5分中的3个)。在输入中指定国家名称的代表性增加了1。平均在5-点李克特(Dall)的李子量表上为44点。75对于稳定的扩散,许多国家的超高分数仍然很低,这突出了将来模型在地理上更具包含的需求。最后,我们研究了量化使用用户研究的产生图像的地理代表性的可行性。1
生成模型的最新进展引起了人们对统计差异作为模型比较手段的研究兴趣。常用的评估方法,例如 Fréchet 初始距离 (FID),与样本的感知质量有很好的相关性,并且对模式下降很敏感。然而,这些指标无法区分不同的失败案例,因为它们只产生一维分数。我们提出了一种新的分布精度和召回率定义,将差异分解为两个独立的维度。所提出的概念直观,保留了理想的属性,并自然而然地产生了一种可用于评估生成模型的有效算法。我们将这个概念与总变异以及最近的评估指标(如初始分数和 FID)联系起来。为了证明所提出方法的实用性,我们对生成对抗网络和变分自动编码器的几种变体进行了实证研究。在大量实验中,我们表明所提出的指标能够将生成样本的质量与目标分布的覆盖范围区分开来。
摘要。鉴于对最近的基于视觉模型的大规模多模式培训及其概括能力,因此了解其鲁棒性的程度对于他们的现实世界部署至关重要。在这项工作中,我们的目标是评估当前基于视觉模型的弹性,以应对不同的对象到后环上下文变化。大多数鲁棒性评估方法都引入了合成数据集,以引起对物体特征(观点,比例,颜色)的变化或实际图像上使用的图像转换技术(对抗性变化,常见的损坏),以模拟分离中的变化。最近的作品探索了利用大型语言模式和di!使用模型来产生背景变化。但是,这些方法要么缺乏对要进行的更改或扭曲对象语义的控制,从而使它们不适合任务。另一方面,我们的方法可以诱导各种对象兼容地面变化,同时保留对象的原始语义和对象的真实性。为了实现这一目标,我们利用文本对图像,图像到文本和图像对段的生成能力自动生成广泛的对象到背景的变化。我们通过修改文本提示或优化文本模型的潜伏期和Textual嵌入来引起自然和对抗背景的变化。这使我们能够量化背景上下文在理解深神经网络的鲁棒性和一般性中的作用。我们生产了各种版本的标准视觉数据集(Imagenet,Coco),将多样的和相同的背景纳入图像中,或在背景中引入颜色,纹理和对抗性变化。我们进行了彻底的实验,并对基于视觉模型的鲁棒性与对象之间的背景环境之间的鲁棒性进行了深入的分析。我们的代码和评估基准将在https://github.com/muhammad-huzaifaa/ObjectCompose上找到。
为流体力学学生项目制作风洞模型的替代方法摘要基于项目的工程教育方法使得学生希望在流体力学课程中创建功能性风洞模型来测试原始设计。本文根据成本、生产时间、易用性以及设备和材料的可及性,比较了几种快速原型 (RP) 方法与用于制造流体动力学模型的传统模具/铸造技术。考虑的 RP 技术包括立体光刻 (SLA)、选择性激光烧结 (SLS)、熔融沉积成型 (FDM)、3D 打印和 CNC 加工。这些方法从数字格式的原始设计开始,而传统方法(例如使用硅橡胶或藻酸盐模具铸造)至少需要粗略的物理原型。还讨论了 RP 模型的涂层和精加工工艺。背景和介绍 德克萨斯大学奥斯汀分校机械工程系已开展了 6 年的综合计划,旨在在整个本科课程中实施基于项目的方法 [1]。该计划的一个要素包括与流体力学入门课程同时进行的风洞测试。本科流体力学实验室有两个风洞,分别有 12"x12" 和 24"x24" 的测试部分。目前,学生仅使用风洞进行经典实验,使用现成的模型(例如横流中的圆柱体和翼型)以及进行流动可视化演示。被测试的对象形状简单,提供有限的创造性实验机会。我们希望通过为学生提供设计和测试原始空气动力学模型(例如汽车车身形状)的机会来增强这种体验。这促使人们研究快速生产原始设计风洞模型的替代方法。考虑了两种根本不同的方法:(1)从粗糙的物理原型开始成型/铸造模型和(2)从数字图像创建功能性物理模型。成型/铸造技术能够生产所有尺寸和几何公差的模型。这些方法可以利用各种不同的材料进行模具制作和铸造,包括热熔胶、乳胶、硅橡胶、聚硫橡胶、聚氨酯、藻酸盐、塑料树脂、环氧树脂、蜡、泡沫、粘土和水基石膏或混凝土。设备和该多步骤过程可能很长,并且需要一定的技能来形成可重复使用的模具和铸造模型。快速原型 (RP) 是指直接从 CAD 文件制造物理对象的过程。此类原型技术包括立体光刻 (SLA)、选择性激光烧结 (SLS)、熔融沉积成型 (FDM)、3D 打印和 CNC 加工等工艺。这些工艺中的每一个都会产生耐用、持久的模型,并且可以通过各种二次表面处理来增强其性能。
➢这是一个欺骗深神经网络(DNN)的实验:在第二和第四张图像中,工程师仅保留了系统用于识别吉他和企鹅的系统的元素,并更改了其余的所有内容,以使系统仍然像吉他和企鹅一样“看到”他们。➢Goodfellow等人的作品。(2014)从普遍的扰动开始打开了进一步发展的大门(Moosavi-Dezfooli等人。2017)最近的一个像素攻击,该攻击显示了如何通过在输入图像中更改一个像素来欺骗神经网络。笔记本在这里一张像素攻击原始纸
不仅包括隐性偏见或个人歧视,还包括鼓励和助长这种歧视的规则和实践结构。1 结构性种族主义的一个定义是“社会通过相互加强的住房、教育、就业、收入、福利、信贷、媒体、医疗保健和刑事司法系统助长种族歧视的全部方式”。3 衡量种族主义具有挑战性。它不仅可能是主观的,而且还可能带有政治色彩,并且基于难以收集的数据。尽管如此,为了监测变化和设定目标,有一个可衡量的结果至关重要。出于这个原因,出现了许多衡量种族主义的方法,包括感知歧视量表。3
A. 互联网 互联网的发展可以说是过去 60 年中最重大的工程成就,如今它将数十亿人彼此连接在一起,并将他们与数十亿台设备连接在一起,能够快速交换不同格式的数字信息。互联网建立在 19 世纪初电报的基础之上。如此复杂的系统,不断被修改和添加,被如此多的人用于关键服务,怎么会表现得如此出色?互联网协议套件 [3] 是其主要构建模块之一,它将互联网抽象为四层。从下往上,这些层称为链路层、网络层、传输层和应用层。每一层都提供连接机器和人的服务。特定层的服务被上一层的服务使用,反过来也使用下一层的服务。
自动驾驶汽车的未来在于以人为中心的设计和先进的AI Capabilies。未来的自动驾驶汽车不仅会跨乘客,而且还将互动并适应他们的欲望,从而使旅程变得舒适,有效且令人愉悦。在本文中,我们提出了一个新颖的框架,该框架利用大型语言模型(LLMS)来增强自动驾驶汽车的决策过程。通过整合LLMS的自然语言能力和上下文理解,专业工具使用,协同推理,并与自动驾驶汽车的各种模块进行作用,该框架旨在将LLMS的先进语言和推理能力无缝整合到自动驾驶中。拟议的框架具有革新自动驾驶汽车运行方式,提供个性化援助,持续学习和透明决策的潜力,最终为更安全,更有效的自动驾驶技术做出了贡献。
摘要:社会企业包含不同的逻辑,因此寻找能够调和经济和社会目标冲突的商业模式非常复杂。我们认为数字技术可以帮助社会企业家克服这一困难。事实上,本文旨在通过对这些不同研究流派进行系统的文献综述,全面介绍(1)商业模式创新、(2)社会企业和(3)基于人工智能的创造力支持工具的文献现状。我们的目的不是对这三种文献进行全面回顾,而是确定将它们联系起来的主要主题和子主题。在此基础上,我们提出了一种新的观点,即复杂的商业模式创新(例如处理社会企业混合模式的创新)如何通过基于人工智能的创造力支持工具得到推动,并制定了扩大对这一有希望的联系的研究议程。
