
谷歌 DeepMind 负责人科雷?卡武库奥卢
作者:Jessica E. Lessin
上周采访谷歌的科雷?卡武库奥卢时,我有种似曾相识的感觉。
这是卡武库奥卢就任谷歌 DeepMind 首席执行官之后的首次深度专访。在访谈中,他对公司机器人业务的发展方向,以及谷歌与行业其他玩家的路线差异,给出迄今为止最详尽的表态。
OpenAI 投资的 Figure、埃隆?马斯克旗下的特斯拉,都在全力打造一款标杆人形机器人;但卡武库奥卢表示,谷歌的核心思路本质上是押注软件与智能能力。
我追问谷歌是否计划自研人形机器人。他并未完全排除这种可能性,但明确表示,谷歌的竞争优势在于模型层,而非机器人机身硬件。
这一幕让我瞬间回想起 2007 或 2008 年,我采访谷歌联合创始人谢尔盖?布林,问谷歌会不会做手机。彼时谷歌正与 T?Mobile、宏达电合作打造安卓设备,但谷歌要不要自己造手机?
布林当时踩着轮滑穿过谷歌食堂(绝非夸张),告诉我:只有迫不得已时才会自研手机。这句话为谷歌自研手机埋下伏笔。后来谷歌先是和宏达电合作,再逐步独立推出 Pixel 系列手机。如果要我押注,我认为,在很久之后的未来,谷歌同样会走向垂直整合,推出自家的人形类机器人。
如今谷歌正在复刻安卓模式的第一步:对外合作。谷歌推出了Gemini Robotics,这是基于核心 Gemini 大模型专门适配实体设备控制能力的版本。谷歌的策略是,把这套智能能力部署到波士顿动力等第三方厂商生产的各类机器人之上,而不是把全部筹码押在自研单一硬件平台。
卡武库奥卢在上周《The Information》AI Agenda 现场活动中表示:“我们希望和其他机器人企业合作,让他们用上这套能力,以可靠、安全的方式,把 AI 智能赋能给各式各样的机器人。”(你可以观看完整深度访谈)
卡武库奥卢还将机器人业务布局,和谷歌通用人工智能的宏大目标绑定:这套处理文本、图像、音频的多模态 Gemini 架构,同样要具备现实物理世界的泛化能力。也就是说,行人识别、翻译、机器人控制全部由一套系统完成,而不是为每一项任务单独开发专用模型。
他还举了 Waymo 作为目前最有力的实例,称自动驾驶是 “非常安全的实践场景”,能够大规模验证实体世界人工智能的能力。
说到 Gemini,谷歌于周三面向一小批客户开放了Gemini 4 Argon,这批客户主要将该模型用于网络防御领域,正式大规模发布尚待时日。这意味着我们很快就能看到,在通用大模型综合实力上,谷歌是否缩小了与两大头部 AI 企业 Anthropic、OpenAI 之间的差距。
头条推荐!牛牛房卡哪里有卖的旺旺大厅/房卡正版如何购买:http://ic.tdroid.net/bandaoti/420772.html