熱門資訊> 正文
2026-10-02 17:59
作者:Jessica E. Lessin
上周採訪谷歌的科雷・卡武庫奧盧時,我有種似曾相識的感覺。
這是卡武庫奧盧就任谷歌 DeepMind 首席執行官之后的首次深度專訪。在訪談中,他對公司機器人業務的發展方向,以及谷歌與行業其他玩家的路線差異,給出迄今為止最詳盡的表態。
OpenAI 投資的 Figure、埃隆・馬斯克旗下的特斯拉,都在全力打造一款標杆人形機器人;但卡武庫奧盧表示,谷歌的核心思路本質上是押注軟件與智能能力。
我追問谷歌是否計劃自研人形機器人。他並未完全排除這種可能性,但明確表示,谷歌的競爭優勢在於模型層,而非機器人機身硬件。
這一幕讓我瞬間回想起 2007 或 2008 年,我採訪谷歌聯合創始人謝爾蓋・布林,問谷歌會不會做手機。彼時谷歌正與 T‑Mobile、宏達電合作打造安卓設備,但谷歌要不要自己造手機?
布林當時踩着輪滑穿過谷歌食堂(絕非誇張),告訴我:只有迫不得已時纔會自研手機。這句話為谷歌自研手機埋下伏筆。后來谷歌先是和宏達電合作,再逐步獨立推出 Pixel 系列手機。如果要我押注,我認為,在很久之后的未來,谷歌同樣會走向垂直整合,推出自家的人形類機器人。
如今谷歌正在復刻安卓模式的第一步:對外合作。谷歌推出了Gemini Robotics,這是基於核心 Gemini 大模型專門適配實體設備控制能力的版本。谷歌的策略是,把這套智能能力部署到波士頓動力等第三方廠商生產的各類機器人之上,而不是把全部籌碼押在自研單一硬件平臺。
卡武庫奧盧在上周《The Information》AI Agenda 現場活動中表示:「我們希望和其他機器人企業合作,讓他們用上這套能力,以可靠、安全的方式,把 AI 智能賦能給各式各樣的機器人。」(你可以觀看完整深度訪談)
卡武庫奧盧還將機器人業務佈局,和谷歌通用人工智能的宏大目標綁定:這套處理文本、圖像、音頻的多模態 Gemini 架構,同樣要具備現實物理世界的泛化能力。也就是説,行人識別、翻譯、機器人控制全部由一套系統完成,而不是為每一項任務單獨開發專用模型。
他還舉了 Waymo 作為目前最有力的實例,稱自動駕駛是 「非常安全的實踐場景」,能夠大規模驗證實體世界人工智能的能力。
説到 Gemini,谷歌於周三面向一小批客户開放了Gemini 4 Argon,這批客户主要將該模型用於網絡防禦領域,正式大規模發佈尚待時日。這意味着我們很快就能看到,在通用大模型綜合實力上,谷歌是否縮小了與兩大頭部 AI 企業 Anthropic、OpenAI 之間的差距。