中國科技巨擘阿里巴巴集團宣布,計劃訓練一款參數規模介於5兆至10兆之間的全新人工智慧模型,展現其在AI領域的雄心壯志。
阿里巴巴執行長吳泳銘週二在杭州舉行的阿里雲年度「雲棲大會」上公布了這項計畫,同時勾勒出一項涵蓋AI模型、晶片與資料中心的全方位戰略布局。他表示,公司的Qwen團隊正持續投入模型架構與數據優化的研究,目標是完成「更複雜、更長週期的任務」,並朝人工超級智慧(Artificial Superintelligence,ASI)的方向邁進。
阿里巴巴在另一份聲明中指出,其下一代模型「Qwen 4」目前正在訓練中,並透露即將推出的Qwen 4.5與Qwen 5系列的參數規模,預計將擴大至5兆至10兆。參數是模型在訓練過程中所學習的變數,可作為模型規模的大致衡量指標。
相較之下,阿里巴巴目前的旗艦模型「Qwen 3.8 Max」擁有2.4兆參數,這意味著規劃中的新模型體積將約為現有模型的兩倍至四倍。
吳泳銘指出,阿里巴巴自主研發的M890 AI超節點已能處理超過2兆參數的模型推論任務,他強調這項能力在全球僅有「少數公司」具備。Qwen團隊在「遞歸自我改進」(recursive self-improvement)方面已取得「實質進展」,透過讓模型自行識別局限性、設計實驗並合成數據,以驅動自我演化的循環。
在硬體方面,阿里巴巴同場發表了旗下T-Head半導體部門研發的新一代AI晶片「真武V900」,吳泳銘稱其為「中國最強大的AI晶片」。他表示,該晶片效能為前代M890的三倍,單一叢集最多可支援50萬張卡,用於前沿模型的訓練與推論。
公司聲明指出,V900晶片預計將於2027年第一季進入量產並商業化上市。M890晶片則於今年五月推出。吳泳銘預期,年度AI晶片出貨量將出現「顯著成長」。
這次發布正值中國企業在美國出口管制壓力下,競相打造輝達(Nvidia)處理器的國產替代方案之際。
吳泳銘同時為阿里雲設定目標,計劃在2032年前將全球資料中心容量突破20GW(吉瓦)。他表示,客戶對AI的需求依然「極為強勁」,並持續推動阿里雲營收成長,但他也坦承,全球AI資料中心供應鏈的短缺正限制公司的擴張速度。
「產業的中長期需求遠超過我們的供應能力,」他說,並補充阿里雲將在本季開始以商業規模將其AI超節點上線運作。
吳泳銘將當前時刻定位為「機器智慧」(Machine Intelligence)時代的黎明,聲稱其重要性可比擬工業革命。他預測,機器最終將產出相當於全人類思考量1,000倍以上的「思維」,相較於目前的不到3%。
他將AI編碼比喻為電力時代的燈泡——屬於早期應用,而非突破性的產品。「機器智慧時代真正具有突破性的產品尚未問世,」他如此表示。