介绍
简介
Gemini Robotics 是 Google DeepMind 推出的先进机器人 AI 模型家族,基于 Gemini 2.0 大语言模型,专为真实物理环境中的机器人而设计。它让机器人具备「感知—推理—行动」的统一能力,能够理解语言、分析场景并执行高精度动作,是迈向通用型机器人的重要一步。
应用场景
- 家庭与生活服务
执行叠衣、收纳、分类、整理等多步骤家务指令,让机器人作为真正的家庭助理。 - 工业与制造业
在生产线或仓储场景中执行抓取、搬运、组装等任务,并能适应不同物品与布局变化。 - 实验室与教育研究
作为通用机器人智能平台,帮助研究机构和开发者快速测试新的机器人形态与功能。 - 多机器人协作
通过统一的任务规划模型,让不同类型的机器人协同工作,共同完成复杂流程。
技术架构
- VLA 模型(Gemini Robotics 1.5)
专注视觉理解与动作控制,负责直接操纵机器人执行任务。 - ER 模型(Gemini Robotics-ER 1.5)
专注任务规划、逻辑推理和步骤生成,是机器人的“高层大脑”。 - 统一的数据训练体系
在基础大模型的通识能力上,通过大量机器人动作数据和多平台数据进行微调,使模型具备“想得明白、看得清楚、做得准确”的综合能力。 - 安全体系与责任机制
内置对错误动作、危险行为的限制逻辑,并结合规划推理机制减少潜在风险。
最新进展
- 发布 Gemini Robotics 1.5 与 Gemini Robotics-ER 1.5,显著提升推理能力与任务稳定性。
- 推出 On-Device 版本,支持离线运行和低延迟控制。
- 已进入与多家机器人公司的合作阶段,并在实际机器人中进行验证。