Google DeepMind 发布 Gemini Robotics:AI 物理世界交互的里程碑

Google DeepMind 发布了 Gemini Robotics——把大模型放进机器人里。

演示场景

在发布会上,研究人员对机器人说「帮我收拾一下桌子,把垃圾扔掉,把杯子放进洗碗机」,机器人自主完成了: - 识别桌上的不同物品(食物残渣 vs 杯子) - 规划行动路径 - 执行精细操作(拿起易碎的杯子) - 处理异常(垃圾桶满了,它换了一个)

全程不需要预设程序,靠大模型的语义理解和推理能力。

为什么重要

以前的机器人需要为每个任务单独编程。有了大模型,机器人可以「理解」自然语言指令,适应新场景。

这相当于给机器人装了一个「大脑」。

挑战

  • 安全性:AI 控制的机器人如果出错,后果很严重
  • 可靠性:大模型有时候会产生幻觉
  • 速度:实时物理交互对延迟要求极高

产业影响

制造业、物流、家政服务可能最先被改变。Google 说他们会先跟物流公司合作做仓库机器人。

物理世界的 AI 化可能比我们想象的更快。


参考来源:

关于 Zihao Zhang

后端开发工程师。关注 Java/Spring Boot/Redis/MySQL 技术栈,分布式系统,OLAP 数据库,AI Agent 开发与应用。

评论

评论已关闭。