得益于 Google DeepMind 的“思考人工智能”,机器人的智能得到了显着提升,这两个模型可以帮助机器理解世界

两种新的人工智能模型使机器人能够以前所未有的方式执行复杂的多步骤任务。

来源:LiveScience

谷歌 DeepMind 推出了一对人工智能 (AI) 模型,使机器人能够以以前不可能的方式执行复杂的一般任务和推理。

人工智能

今年早些时候,该公司发布了 Gemini Robotics 的第一次迭代,这是一个基于 Gemini 大语言模型 (LLM) 的人工智能模型,但专门用于机器人技术。这使得机器能够在物理空间中推理并执行简单的任务。

新模型被称为 Gemini Robotics 1.5 和 Gemini Robotics-ER 1.5,极大地扩展了原始版本处理多步骤、“长期”任务的能力,是机器人在现实世界用例中协助人们的一个重要里程碑。

Google 指出的基线示例是香蕉测试。最初的人工智能模型能够接收简单的指令,例如“将香蕉放入篮子中”,并引导机械臂完成该命令。

在这两个新模型的支持下,机器人现在可以挑选水果并根据颜色将它们分类到单独的容器中。在一次演示中,一对机械臂(该公司的 Aloha 2 机器人)准确地将香蕉、苹果和酸橙分拣到三个相应颜色的盘子上。此外,机器人在执行任务时会用自然语言解释它正在做什么以及为什么这样做。

Gemini Robotics 1.5:边行动边思考 - YouTube 观看

“我们让它能够思考,”DeepMind 的高级研究科学家 Jie Tan 在视频中说道。 “它可以感知环境,一步步思考,然后完成这个多步骤的任务。虽然这个例子看起来很简单,但它背后的想法确实很强大。同样的模型将为更复杂的人形机器人提供动力,以完成更复杂的日常任务。”

揭谭

未来人工智能驱动的机器人

将世界上最迷人的发现直接发送到您的收件箱。

这两个模型比之前的版本能力更强,可以使用 Google 搜索等工具来完成任务。

声明