谷歌正以一套不同于特斯拉等公司的思路切入机器人赛道:不急于打造旗舰硬件,而是优先发展机器人背后的模型和软件能力,并借助合作伙伴扩大应用范围。
据 The Information 近日报道,谷歌 DeepMind 首席执行官 Koray Kavukcuoglu 上周首次较为详细地公开谈及机器人战略。他表示,谷歌的核心优势在于模型,而非机器人底盘本身。与此同时,谷歌推出 Gemini Robotics ——针对物理控制场景优化的 Gemini 模型版本——并已与 Boston Dynamics 等机器人公司展开合作。
这种模式与谷歌当年推广安卓颇为相似:由谷歌提供核心软件,再通过不同厂商的硬件实现规模化扩张,而不是从一开始就依赖自有设备。这也使谷歌与特斯拉及 OpenAI 支持的 Figure 形成明显区别——后两者均将打造旗舰人形机器人作为重要方向。对谷歌而言,机器人更像是 Gemini 能力向现实世界延伸的新应用场景。
软件优先,复制安卓扩张路径
Kavukcuoglu 在 The Information 举办的 AI Agenda Live 活动上表示,谷歌希望 " 与其他机器人公司合作,让它们使用这套系统,从而以安全、良好的方式将智能注入所有机器人 "。
这一策略与谷歌当年推广安卓的路径如出一辙。报道指出,2007 至 2008 年间,谷歌联合创始人 Sergey Brin 也曾以类似思路回应谷歌是否会自建手机的问题。当时谷歌正与 T-Mobile 和 HTC 合作推出安卓设备,之后才逐步发展出 Pixel 硬件业务。
目前,Kavukcuoglu 并未完全排除谷歌未来打造人形机器人的可能性,但强调现阶段重点仍是模型能力和合作生态。
Gemini 走向物理世界,模型竞争升温
谷歌的机器人布局也是其 AGI 战略的延伸。Kavukcuoglu 将 Gemini Robotics 视为 Gemini 多模态架构向物理控制领域的自然延伸:同一套能够处理文本、视觉和音频的底层模型,正在进一步用于机器人控制,而非针对不同任务分别开发专用模型。
他将 Waymo 自动驾驶视为这一思路的重要验证案例,称自动驾驶是展示物理 AI 规模化落地的 " 非常、非常安全的方式 "。如果 Gemini 架构能够支撑 Waymo 实现商业化运营,那么其向其他物理场景迁移的可行性也将获得进一步验证。
与此同时,谷歌本周宣布向部分企业客户率先发布 Gemini 4 Argon,重点用于网络安全防御,并计划近期向更广泛用户开放。随着新模型进入应用阶段,谷歌能否进一步缩小与 Anthropic、OpenAI 的能力差距,也将成为市场观察其 AI 竞争力的重要窗口。