用户控制图片(亮度,对比度,清晰度,背部,色彩,颜色,降噪,选择,低蓝光,低光,颜色温度,颜色控制,颜色控制,超级,图片重置),屏幕(缩放模式,自定义缩放,屏幕重置),音频(balance,balance,balance,traleble,treble,bass,bass,bass,audio nof(line out out(line),最高),最大volume, mute, audio reset, audio out sync, speaker setting), configuration 1 (Android launcher, switch on state, Touch lock, Touch mode, mouse mode, panel saving, RS232 routing, boot on source, WOL, conf.1 reset, factory reset), configuration 2 (OSD timeout, OSD H position, OSD V position, system rotation, info OSD, logo and animation, logo setting, animation设置,监视ID,监视信息,HDMI版本,conf2重置),高级选项(售货亭模式,侧栏,无信号图像,电动支架,电动控制,电源LED照明,风扇,关闭计时器,时间表,带有一根电线的HDMI,带有一线电线的HDMI,一根电线,故障转移,语言,OSD透明度,电源节省,电源节省,高级选项,高级选项重置)
最近在操纵和运动领域取得了显着进展,但移动操作仍然是一个长期以来的挑战。与运动或静态操纵相比,移动系统必须在非结构化和动态环境中可行的多种长距离任务。尽管应用程序广泛且有趣,但在开发这些系统(例如基础和手臂之间的协调)时,有很多挑战,依靠在船上感知到感知和与环境互动,最重要的是,同时整合了所有这些部分。先前的作品使用模块化技能来解决问题,以使其动机和操纵被微不足道地捆绑在一起。这引起了多个限制
摘要。人类计算机的交互已从命令行演变为图形,直至有形的用户界面(TUI)。tuis代表了将物理对象纳入数字环境中的新范式,以便为用户提供更丰富,更自然和直观的互动手段。本文回顾了TUIS在认知人体工程学,教育和行业中的应用,并特别强调了TUI在减少认知负荷以及改善保留率和增强解决问题的行为方面可能产生的潜在影响。它涵盖了TUI认知益处的各种案例研究,分布式和体现的认知,可伸缩性和可访问性问题的框架,减少技术障碍以及用户不情愿的方法以及TUI与IoT合并的方式。作者还讨论了TUI如何在智能环境中的网络和控制方面看到巨大的改进。从上述内容中,尽管Tuis承诺与常规GUI有关的巨大好处,但在不同应用程序中的全面利用要求解决成本,适应性和包容性的广泛使用。
摘要 - 为了充分利用移动操纵机器人的功能,必须在大型未探索的环境中自主执行的长途任务。虽然大型语言模型(LLMS)已显示出关于任意任务的紧急推理技能,但现有的工作主要集中在探索的环境上,通常集中于孤立的导航或操纵任务。在这项工作中,我们提出了MOMA-LLM,这是一种新颖的方法,该方法将语言模型基于从开放式摄影场景图中得出的结构化表示形式,随着环境的探索而动态更新。我们将这些表示与以对象为中心的动作空间紧密地交织在一起。重要的是,我们证明了MOMA-LLM在大型现实室内环境中新型语义交互式搜索任务中的有效性。最终的方法是零拍摄,开放式摄影库,并且可以易于扩展到一系列移动操作和家用机器人任务。通过模拟和现实世界中的广泛实验,与传统的基线和最新方法相比,我们证明了搜索效率的显着提高。我们在http://moma-llm.cs.uni-freiburg.de上公开提供代码。
在过去的30年中,环境和气候灾难加剧,通过加剧性别不平等并威胁其权利,生计,健康和健康,对妇女和女孩产生了不成比例的影响。尽管在保护生物多样性,在土地上工作以及有效的环境和气候治理方面的作用至关重要,但在决策中,妇女的人数仍然不足。妇女和女孩,特别是来自土著社区和地方社区的妇女和女孩,通常没有充分的保护或资源,领导环境宣传。为了实现可持续发展,必须确保妇女平等参与绿色,蓝色和护理经济体,并显着增加对性别响应性的气候融资。
最近进步[20,29,30]中的2D图像结构,以方法为例,例如在广泛的文本图像配对数据集中受过训练的扩散模型(例如,Laion-series [31]),在与文本提示符的一致性图像中取得了显着的前进。尽管取得了成功,但实现对图像产生的精确控制以满足复杂的用户期望仍然是严重的挑战。ControlNET [38]通过在特定条件数据集上进行微调修改Foun-odation-2D扩散模型来解决此问题,从而提供由用户特异性输入引导的微妙控制机制。另一方面,尽管有希望的进展[27,35],但与2D图像生成中遇到的那些相比,3D对象的生成更为复杂。al-尽管从透视感中观察到了进步,包括直接3D数据集[10,25]上的3D扩散模型,以及将2D扩散率提升到3D复位(例如NERF [21])通过SDS损失的技术优化[27],没有完全对生成Ob-Ob-ob-ob-ob-jects的控制。对初始文本提示或2D参考图像的依赖严重限制了发电的可控性,并且通常会导致质量较低。文本提示缺乏准确传达复杂3D设计的特异性;尽管2D参考图像可以告知3D重建,但它们并没有捕获3D结构的完整深度,可能导致各种意外的人类。此外,基于2D图像的个性化缺乏直接3D操纵可以提供的灵活性。这些障碍表明需要采取不同的策略。实现可控制的3D发电的直接想法是将控制网络调整为3D生成。但是,该策略遇到了重大障碍:(i)3D的控制信号本质上更为复杂,这使得与2D范式相比,有条件的3D数据集对构成的3D数据集进行了挑战; (ii)3D域中没有强大的基础模型,例如2D [20]的稳定扩散,阻碍了此时开发微调技术的可能性。结果,我们倾向于
细胞自动机 (CA) 是数学的一个分支,它探索控制自主单元(称为细胞)行为的简单规则如何导致复杂的突发模式。计算领域的先驱约翰·冯·诺依曼在 CA 的发展中发挥了重要作用。尽管冯·诺依曼以现代计算机的基础架构(“冯·诺依曼架构”)而闻名,但他晚年对 CA 着迷不已。他死后出版的著作《计算机与大脑》深入探讨了他对简单、分散的规则如何产生类似于生物过程的智能行为的思考。
过去五年来呈现了一系列全球紧急情况,这对妇女的经济福祉产生了不成比例的影响。朝着增加妇女参与劳动力的进步已经停滞不前,在妇女赋予妇女经济能力的其他方面的进步也减慢甚至逆转。的回应尚未得到充分的保护并保留了近几十年来的性别平等增长,这些趋势在低收入国家中令人震惊,这些国家继续面临诸如高债务水平,缺乏财政空间,外国援助和停滞经济的挑战。
摘要 光标、头像、虚拟手或工具以及其他渲染的图形对象使用户能够与 PC、游戏机或虚拟现实系统等计算机进行交互。我们从用户的角度在“用户表征”的统一概念下分析这些不同对象的作用。这些表征是虚拟对象,它们人为地延伸了用户的身体,使他们能够通过执行不断映射到其用户表征的运动动作来操纵虚拟环境。在本文中,我们确定了一组与不同用户表征相关的概念,并对用户表征的控制和主观体验背后的多感官和认知因素进行了多学科回顾。这些概念包括视觉外观、多模态反馈、主动感、输入法、近体空间、视觉视角和身体所有权。我们进一步为这些概念提出了研究议程,这可以引导人机交互社区从更广泛的视角了解用户如何通过他们的用户表征进行感知和交互。
简介 十一年前,马希尔 (Maher) 问道:“谁在创造?” (Maher 2012),并提出了几个创造性应用的分析空间,包括构思和互动两个维度。马希尔的问题引出了乔丹诺斯 (Jordanous) 的 PPP 视角框架,其中创造行为可以由人类或人工智能 (Jordanous 2016) 执行,以及坎托萨洛 (Kantosalo) 和塔卡拉 (Takala) 的 5C 框架,其中创造行为由人类和人工智能共同组成的集体执行 (Kantosalo and Takala 2020)。1然而,对于人与人工智能互动中创造力的位置,人们的共识较少。混合主动性创造性界面方法提出了一组基本的细粒度活动,这些活动可以由人类或人工智能以某种结构化对话的形式执行(Deterding 等人,2017 年;Spoto 和 Oleynik,2017 年),随后扩展到生成应用(Muller、Weisz 和 Geyer,2020 年),针对特定算法方法进行了改进(Grabe、Duque 和 Zhu,2022 年),并针对其他算法方法进行了批评(Zheng,2023 年)。虽然这些方法生成了重叠的分析动作词汇,但它们并没有解决创造力在何处发生(以及由谁或什么通过这些动作发生)的问题。在这篇短文中,我们提供了对该问题的一个答案的几个例子。我们重新利用 Kantosalo 和 Takala (2020) 的 5C 中的集体概念,提出一种类型的创造力可能会在以下互动空间中不对称地出现 (Rezwana and Maher 2022)
