Google DeepMind 发布了 Gemini Robotics——把大模型放进机器人里。
演示场景
在发布会上,研究人员对机器人说「帮我收拾一下桌子,把垃圾扔掉,把杯子放进洗碗机」,机器人自主完成了: - 识别桌上的不同物品(食物残渣 vs 杯子) - 规划行动路径 - 执行精细操作(拿起易碎的杯子) - 处理异常(垃圾桶满了,它换了一个)
全程不需要预设程序,靠大模型的语义理解和推理能力。
为什么重要
以前的机器人需要为每个任务单独编程。有了大模型,机器人可以「理解」自然语言指令,适应新场景。
这相当于给机器人装了一个「大脑」。
挑战
- 安全性:AI 控制的机器人如果出错,后果很严重
- 可靠性:大模型有时候会产生幻觉
- 速度:实时物理交互对延迟要求极高
产业影响
制造业、物流、家政服务可能最先被改变。Google 说他们会先跟物流公司合作做仓库机器人。
物理世界的 AI 化可能比我们想象的更快。
参考来源:
评论
评论已关闭。