DeepSeek V4 Pro的正式版於週三(8月12日)上線。目前DeepSeek尚未發布任何推文,唯一跡象是官網API定價頁面上的一行文字變更:「deepseek-v4-pro」後的版本號從預覽版改為「DeepSeek-V4-Pro-0813」。
這也意味著自2026年4月起以預覽形式提供的旗艦模型,終於正式轉為生產版本。
DeepSeek V4 Pro是一款混合專家(MoE)模型,總參數量達1.6兆,每個token激活490億參數,上下文窗口為100萬token,最大可輸出38.4萬token,此規模在全球AI模型中位居第一梯隊。此前第三方測試主要使用預覽版本,相關模型在Hugging Face等平台已有大量下載。
正式版上線後的價格與非高峰時段價格保持一致。此價格其實是2026年5月永久降價至原價四分之一後的標準價格,具體而言,每百萬輸入token收費0.435美元,輸出收費0.87美元,快取命中的輸入僅需0.003625美元。
相比之下,Anthropic的Claude Fable 5每百萬輸入token收費10美元,輸出收費50美元。以輸出token價格計算,兩者相差近58倍,DeepSeek V4 Pro的價格還不到Claude Fable 5的2%。
若按完成單一任務的成本計算,差距可能更加明顯。有機構測試過,使用Claude Fable 5完成一個基準任務花費3.15美元,而使用DeepSeek V4 Flash僅需3美分,兩者相差100倍。至於DeepSeek-V4-Pro-0813版本的單任務成本,目前仍缺乏充分的第三方測試,但由於API價格體系未變,實際成本差距仍可能相當可觀。
如此巨大的價格差距,主要歸功於架構設計。DeepSeek V4 Pro採用了兩種注意力變體:壓縮稀疏注意力(Compressed Sparse Attention)與重度壓縮注意力(Heavily Compressed Attention)。
根據DeepSeek表示,此架構能將單token推理計算量降至V3.2的27%,KV快取則降至原來的10%。對於擁有100萬token上下文窗口的模型而言,節省的成本相當可觀。推理效率提升也為模型提供了更大的定價空間。
DeepSeek自身也進行了基準測試,在10項智能體評測中與Claude Fable 5進行比較。排除差距最大的一項(Humanity"s Last Exam,DeepSeek V4 Pro落後10.6個百分點)後,其餘9項中DeepSeek平均落後2.8%,其中有2項表現勝出。
然而,這些數據是DeepSeek自行測試的結果,使用的是尚未對外開放的評測框架,且相關內部測試集亦無公開排行榜可供驗證。因此,DeepSeek-V4-Pro-0813版本的實際表現仍有待第三方評測進一步確認。上述數據目前僅能說明DeepSeek認為V4 Pro在部分測試中已接近Claude Fable 5,尚不能視為兩者整體性能相當。
DeepSeek V4 Pro的API提供不同程度的推理模式,包括非思考及不同推理強度的設定。其中較高的推理模式可進一步提升模型的推理能力。API同時支援OpenAI與Anthropic兩種格式介面,先前已在這兩個生態系統中開發的開發者無需大幅修改程式碼即可切換使用,並支援工具呼叫、結構化JSON輸出等功能。
隨著DeepSeek V4 Pro正式上線,DeepSeek V4系列的產品結構變得更加清晰:Flash版本負責高頻、高併發的使用場景,主打低價格;Pro版本則將更多算力集中在複雜推理、長上下文編碼及智能體任務上。部分AI開發公司已開始搭配使用兩種版本。
不過,DeepSeek的定價頁面也已預告,近期將進行一次「顯著的價格調整」。至於具體漲幅以及何時調整,目前尚未公布,因此目前這個低價窗口還能維持多久,仍有待觀察。
同時,多家聚合平台的數據顯示,2026年7月DeepSeek模型的Token調用量已位居全球AI模型第一梯隊,在部分榜單中僅次於Anthropic的模型。DeepSeek的業務增長主要依託開發者的實際API調用,迄今為止也沒有舉辦大型媒體發布會,主要透過公眾號宣布產品消息,有時也會發布技術博客。
眾所周知,DeepSeek的算力儲備相較海外AI頭部企業並不算大。根據7月流出的投資人交流會內容,梁文鋒曾提到,當時DeepSeek擁有約2萬張H100等效算力。這個數字與海外AI頭部大廠動輒幾十萬甚至上百萬張GPU的集群相比,確實不在同一量級。
不過,梁文鋒也表示這個數字是動態的,DeepSeek一直在努力採購更多算力,並計畫「在合理價格內能買多少卡就買多少卡」。與此同時,DeepSeek據報也在規劃GW級的自建算力基礎設施,近期針對內蒙古資料中心相關職位的招聘,也被外界視為其擴充算力布局的跡象。
DeepSeek還與華為合作。根據流出的投資人交流會內容,DeepSeek獲得華為約1.6萬張昇騰950算力卡的配置,用於軟體生態驗證與落地。另有第三方機構已在中國國產算力集群(昇騰910C)上完成DeepSeek V4 Pro的全參數後訓練,這顯示國產算力正在逐步承擔更重的AI模型訓練任務。
目前DeepSeek V4系列採用MIT授權的開放權重模式。至於DeepSeek-V4-Pro-0813正式版權重的公開進度,仍需以官方後續公告為準。按照V4 Flash「API先跑、權重隨後跟上」的節奏,市場仍在等待正式版權重的進一步消息。
第三方評測機構目前也正在陸續測試DeepSeek-V4-Pro-0813版本。待更多獨立評測數據公布後,才能更清楚判斷DeepSeek V4 Pro這次的性能提升幅度,以及它與Claude Fable 5等頂級模型之間的實際差距。
FACT BOX · 重點整理
- 來源:PR Times
- 分類:新品
- 相關組織:Anthropic / 華為
- 原文日期:2026年4月 / 2026年5月
- 產品、服務:DeepSeek V4 Pro / DeepSeek V4 Flash