DeepSeek V4 Pro 結束預覽突襲上線 API 平台,支援百萬 Token 上下文與 MoE 架構



2026年8月12日深夜,中國 AI 大廠 DeepSeek 無預警更新了官方 API 平台的文件與價格頁面,將旗艦模型的代號正式變更為 DeepSeek-V4-Pro-0813。這項變動意味著該模型已經結束先前的預覽版測試階段,正式上線提供服務。目前官方的產品更新公告仍停留在 7 月底推出的 V4 Flash,尚未針對此次 V4 Pro 的正式上線發布新聞稿或更新日誌,屬於 API 文件與服務版本率先在後台完成切換的突襲式更新。


1.6 兆參數規模與百萬 Token 處理能力

在技術規格方面,DeepSeek-V4-Pro 延續並優化了混合專家(Mixture-of-Experts, MoE)架構。根據官方文件顯示,該模型的總參數規模高達 1.6 兆,而在實際運算時啟動的活躍參數則維持在約 490 億,藉此在模型能力與運算效率之間取得平衡。針對長文本與複雜任務的處理需求,V4 Pro 具備支援 100 萬 Token 上下文長度的能力,並且將最高輸出限制提升至 38.4 萬 Token,為開發者處理大規模資料分析與長篇內容生成提供了更寬廣的操作空間。

為了提升開發者的使用體驗與系統整合便利性,DeepSeek-V4-Pro 在 API 介面設計上提供了高度的彈性:

  • 支援思考與非思考兩種運作模式,讓開發者可依據任務複雜度自由切換。
  • 介面全面相容於 OpenAI 及 Anthropic 的 API 格式,大幅降低現有應用程式的遷移成本。
  • 提供 Tool Calls 與 Responses API 等進階功能,強化模型與外部工具互動的能力。

基準測試表現與 API 定價策略

在效能表現上,DeepSeek-V4-Pro-0813 在多項代理人(Agent)基準測試中展現了顯著的進展。已知數據顯示,該模型在 Terminal Bench 2.1 測試項目中取得了 87.9 分的成績,與競爭對手 Anthropic Fable 5 的 88.0 分僅有微小差距。與此同時,技術社群近期也流傳一份效能對比表,指出 V4 Pro 在 DeepSWE 測試中的分數從預覽版的 12.8 分躍升至 62.7 分,而在 Cybergym 測試中也達到了 83.3 分。然而,這些社群流傳的具體測試成績,目前仍需等待 DeepSeek 官方發布完整的技術報告才能獲得最終核實。

在 API 服務的收費標準上,DeepSeek 官方英文文件明確標示了以美元計價的費率結構。當輸入請求命中快取時,收費為每百萬 Token 0.003625 美元;若未命中快取,輸入價格則為每百萬 Token 0.435 美元;至於模型輸出的價格則設定在每百萬 Token 0.87 美元。雖然 API 服務已經正式上線並確立了收費標準,但關於正式版模型權重的具體更新細節,以及未來是否會延續開源策略與確切的開源時程,目前尚未有官方的正式宣布。