8月17日,一台名為「Superman」的人形機器人打破短跑選手「閃電」博爾特(Usain Bolt)先前創下的跑速,隨後一頭撞上牆壁。這場勝利進一步炒熱了Superman製造商宇樹科技的聲勢。兩天後,宇樹科技在上海首度掛牌,股價暴漲460%。
然而,Superman這趟奔跑最後狼狽收場,也說明這項技術仍有漫漫長路要走。中國企業今年預計將售出5萬台人形機器人,數量是去年的3倍以上。他們大致已掌握這些機器背後的硬體技術,但軟體是另外一回事。
若要建立能讓機器人靈巧執行各種實用任務的基礎模型,必須蒐集海量資料。目前這一代人形機器人仰賴的模型,只有數十億個「參數」。但是,若要重現人體的運作方式,參數規模需要達到數千億個。
如此一來,這些模型的規模將接近驅動聊天機器人的大型語言模型。不同的是,聊天機器人可以利用網路上浩瀚的數位文本來訓練,但若要蒐集足以教會機器人辨識玻璃杯、拿起杯子,再倒入咖啡的資料,難度高得多。
機器人必須理解所有相關資訊,從自身所處的空間位置,到玻璃杯有多易碎、杯中液體有多黏稠。這些資訊只能從真實世界的經驗,或對這些經驗的細緻重建中挖掘出來。
國家買單的機器人「特訓營」
目前,人形機器人接收的是一鍋大雜燴般的資料,其中許多來自品質不佳的模擬環境。從真實世界蒐集而來的資料實用得多,如今也炙手可熱。其中最理想的是「實機」資料,也就是機器人在遠端操控下行動,或自行執行任務時產生的資料。另一個重要來源,是記錄人類完成任務過程的「第一人稱視角」資料,通常是讓人類戴上頭戴式裝置與觸覺感測手套,記錄動作。
中國正迅速成為實機資料競賽的領頭羊,很大程度要歸功於湖北人形機器人創新中心等訓練中心。
在武漢的大型設施裡,每天最多有100台機器人花數小時觀察並模仿人類。據顧問公司Interact Analysis的資料,武漢這座中心是中國53座專為探索人類動作奧祕而建造的設施之一,另有34座正在興建或規劃中。
這類訓練中心需要大片空間、眾多人力,以及一整批最先進的人形機器人;每台價格可能高達人民幣10萬元。滙豐銀行分析師估算,這類訓練每小時成本約為人民幣500至700元。
對宇樹科技等中國企業而言,幸運的是,這些中心的費用大多由政府買單。約五分之四的中心獲得國家資金支持。許多中心由民營企業與地方政府合作設立,由地方政府購買人形機器人,再把產出的資料賣給合作企業。各方估計不一,但2026年上半年,中國製造的人形機器人可能有多達七成流向這些訓練中心,總數約1.3萬台。
失業青年投入「數位打工」
與此同時,中國機器人製造商也在設法從龐大的製造業勞動力,以及為數眾多的失業青年身上蒐集第一人稱資料。
一批專門製作這類穿戴設備的小型業者應運而生,有些業者希望年輕人把在家穿戴設備蒐集資料當成兼職。不過,人類產生的第一人稱資料遠不如實機資料有用,原因在於人類的四肢與機械肢體在真實世界中的運動方式並不相同。
中國的人形機器人產業,不同於多數曾在當地蓬勃發展的製造業。未來幾年,中國預計將生產並銷售數十萬台價格高昂、卻多半派不上用場的機器人,寄望日後能製造出更便宜又真正可用的產品。
美國競爭者則仰賴成本較低的訓練方式。據傳,特斯拉是在自家倉庫訓練機器人,因而省下興建獨立訓練設施的費用。多家公司也利用人類動作影片訓練人形機器人。如今,美國的工廠工人已所剩無幾,難以再靠他們穿戴設備來蒐集第一人稱資料。為壓低成本,部份企業轉向工資比中國更低的貧窮國家,付費讓當地勞工配戴頭盔與觸覺手套工作。
不過,正如電腦視覺領域一樣,中國幾乎肯定會繼續在資料蒐集領域保持領先。問題是,代價有多高?以目前技術水準,以及改善技術仍需投入的時間來看,本世紀20年代內不太可能形成人形機器人商業市場。
摩根士丹利估計,到2030年,中國每年可能生產約45萬台人形機器人。其中許多仍會反應遲鈍、笨手笨腳,而且繼續一頭撞上牆壁。
(本文由「經濟學人」獨家授權轉載)
英國《經濟學人》獨家授權,天下精選翻譯,與國際財經趨勢同步
華文唯一授權,隔週三發送
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱