自從大型語言模型出現,人們便驚艷它們能達成的事情,像是寫程式、寫文章、回答問題等等。
但有許多基本任務,世界上最訓練有素的AI還無能為力,像是ChatGPT不能幫你買機票、訂外賣,或者其他需要更長時間段處理的事情。
不過,業界已經興起了一股浪潮,那就是「AI代理」,它能消除上述限制,真正幫人類做到「助理」的功能,而中國本月推出的Manus AI,就是此一領域強力的競爭者。
(看更多:為什麼Manus AI要離開中國?)
Manus AI有什麼特別?
Manus AI已成為全球熱門話題。西方科技界頗具影響力的人物,包括 Twitter 聯合創始人多西(Jack Dorsey)和Hugging Face產品負責人穆斯塔(Victor Mustar)都稱讚它的性能。
中國媒體大肆報導,稱Manus是「下一個」DeepSeek。
它的技術實力究竟如何?
首先,DeepSeek因為背後的R1推理模型,超越了OpenAI的推理模型GPT-o1和GPT-o3,被視為中國AI可能超越西方的關鍵跡象。
而Manus又比DeepSeek再往前一步,它能在無需人工提示的情況下,對不同領域的任務交付成果——該公司聲稱,在AI基準測試GAIA的三個難度級別中,Manus AI都超越了OpenAI的模型。
它使用多代理架構,其中的中央「執行者」代理,能與專門的子代理(例如規劃者或知識代理)協調,以分解和完成複雜的任務。
事實上,它不是一個模型,而是Anthropic的Claude 3.5 Sonnet模型和阿里巴巴Qwen模型的改進版本的集合。
它整合了29種工具和開源軟體,讓它能夠瀏覽網頁、與API互動、運行腳本,甚至獨立開發軟體——簡單來說,Manus能在幾乎無提示的狀況下,幫人類建立一個出色的個人網站、規劃一次詳盡的旅行(含訂票),或是製作中學課程的教案。
可以看出,Manus改變遊戲規則的一個要素是「不用用戶主動參與」。它會在後台運行任務,直到結果就緒時才會對用戶發送訊息——就像一個不用花太多時間管理的人類員工一樣。
目前Manus AI尚未公開發布,需要邀請碼才能使用,但它已經迅速席捲中國網路,導致流量暴增、官方網站崩潰、邀請碼變得稀缺。據報道,在網路上購買轉售的邀請碼,價格竟高達5萬元人民幣(約22萬台幣)。
過度炒作?
然而,Manus的突然爆紅,也引發質疑的聲音。
現階段只有少數用戶親身體驗過它,而批評者認為,渲染Manus是「DeepSeek第二」,只是炒作模型的「行銷狂潮」。
「Manus 的核心技術是能夠自動部署不同的工具和模型,這是其他公司還沒有實現的,」一位與該公司無關、不願透露姓名的AI工程師告訴《日經亞洲》,「但Manus在產業的準確度標準上,其實表現不高。」
實際試用過的科技媒體專家,也給出褒貶不一的評價。
《TechCrunch》記者威格斯(Kyle Wiggers)表示,「我與Manus的合作經驗並不是十分愉快,」在其中一個任務實驗中,他要求Manus處理一份快餐店的炸雞三明治,但是失敗兩次,最後也沒有提供結帳連結。
《麻省理工科技評論》的記者Caiwei Chen同樣在指派Manus三項任務(找出科技媒體同業名單、紐約房地產資訊、提名創新獎候選人)後,感到有些失望,「Manus可能會經常崩潰和系統不穩定,並可能在處理大量文字時遇到困難。」
但她仍給予一些好評,「總體而言, 我發現Manus是一種高度直覺好操作的工具,它提供比 ChatGPT的DeepResearch更好的結果,適合進行範圍有限的分析任務。」
她比喻,像是一名「熟練的人類實習生在一天的工作中可以完成的事」。
除了早期的運行失誤之外,對中國有疑慮的用戶更關注的是:自家資料是否會傳輸給中國公司?
「在你的電腦上安裝Manus,會讓它能夠存取你電腦的資料,但它不受美國責任法管轄,」《Vox》記者皮珀(Kelsey Piper)提醒,「獨立行動的AI代理是一件大事,它可能帶來重大的安全問題。」
然而,Manus確實帶來一定程度的威脅。
多年來,主流的AI敘事,都圍繞著美國大型科技公司——OpenAI、Google、Meta——如何開發更強大的語言模型版本。
《富比世》評論道,「人們總是假設,誰能製造出最複雜的聊天機器人,誰就能控制AI的未來,」「但Manus似乎推翻了這樣的假設,它不僅是一種新的智慧類別,而且完全是『中國製造』。」
Manus的崛起引發矽谷一波不安情緒。他們擔憂,若中國持續積極推動這類自主系統的發展,可能會讓該國在關鍵領域佔據先發優勢。
(資料來源:Nikkei, Forbes, TechCrunch, MIT Technology Review, Vox)