中國科技巨頭阿里巴巴於週一(8月3日)發布了旗下功能最強大的人工智慧模型「通義千問3.8-Max」(Qwen3.8-Max),這款模型擁有高達2.4兆個參數,具備文字、圖片與影片的多模態處理能力,並能一次性處理高達100萬個詞元(Token),在AI模型評測平台Arena.AI上迅速登上中國模型榜首,帶動阿里巴巴港股股價上漲7%。
「通義千問3.8-Max」採用「混合專家模型」(Mixture-of-Experts, MoE)架構,雖然總參數達2.4兆,但每次運算僅啟用約950億個參數,大幅降低運算成本與回應延遲。該模型預計下週透過阿里雲的Model Studio平台正式上線,阿里巴巴表示,此模型曾在16天內完成一項軟體工程專案,展現其實際應用潛力。
與此同時,中國AI新創「深度求索」(DeepSeek)於7月31日推出V4-Flash模型,持續推行低成本戰略。根據研究機構Artificial Analysis的數據,V4-Flash每百萬輸入詞元僅收費0.14美元,輸出為0.28美元,完成每項基準測試的平均成本僅0.03美元,遠低於Anthropic的Claude Fable 5(3.15美元)與OpenAI的GPT-5.6 Sol(1.86美元)。
值得注意的是,阿里巴巴與DeepSeek均採用「開放權重」(open-weight)模式,開放模型核心參數供開發者下載與微調,與OpenAI、Anthropic等封閉式模型形成對比。Omdia首席分析師蘇連傑指出,多數企業並不需要頂尖模型,而是追求性能足夠、價格合理且透明的解決方案,這正是開放權重模型的優勢所在。
在美國對中國實施晶片出口管制的背景下,中國企業正透過軟體架構創新與開放生態,突破硬體限制。阿里巴巴與DeepSeek的策略顯示,中國AI產業正以低成本、高效率與開放性,重塑全球AI競爭格局,尤其在B2B與開發者市場中建立強大吸引力。
FACT BOX · 重點整理
- 來源:PR Times
- 分類:新品
- 相關組織:月之暗面 / Anthropic / OpenAI
- 原文日期:8月3日 / 7月31日
- 產品、服務:通義千問3.8-Max / Model Studio