阿里 Qwen 連發兩份機器人技術報告:操作與導航
阿里巴巴的 Qwen 團隊在機器人方向一口氣放出兩份技術報告,把觸角從語言模型伸進實體 AI。第一份 Qwen-RobotManip 談機器人「操作」(manipulation),核心論點是「對齊解鎖規模化」(Alignment Unlocks Scale)——意思是把模型與機器人實際操作做好對齊後,能讓操作能力隨資料與算力放大而持續提升,突破過去機器人學習難以規模化的瓶頸。第二份 Qwen-RobotNav 則聚焦「導航」(navigation),定位是一個為代理(agent)場景設計、可擴展的導航模型,讓機器人在複雜環境裡自己找路、移動到目標。兩份報告合著看,等於 Qwen 想把「動手操作」與「移動導航」這機器人兩大基本能力都用大模型的方法重做一遍。把這條放進今天的機器人專題:南韓出錢、Proception 攻手、Vesta 做通用大腦,而中國這邊由阿里用 Qwen 的模型路線切入操作與導航——實體 AI 的競賽,已經是中美各大實驗室同場較勁。技術報告的真實水準仍需第三方復現,但 Qwen 持續往機器人投入,本身就是個訊號。當操作與導航都能套上大模型的方法論,過去機器人「換場景就要重訓」的老難題,有機會被「一套通用底座」逐步取代。
歸剛點評|語言模型大廠集體跨界做機器人,今天 Qwen 一次端出操作加導航兩份報告,是個明確訊號:實體 AI 不再是機器人公司的專利,做大模型的也全押進來了。對台灣產業的提醒是,下一輪較量不只在雲端跑分,而在「會動的東西」上——而中美的頂尖實驗室,已經在同一張牌桌上了。