APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 最新科技

DeepSeek V4.1 Flash 正式發佈:552B MoE 因果編碼器-解碼器架構,每百萬 Token 低於 $0.01,亞太股市震盪

2026年9月11日0 瀏覽
DeepSeek V4.1 Flash 正式發佈:552B MoE 因果編碼器-解碼器架構,每百萬 Token 低於 $0.01,亞太股市震盪
DeepSeek
大型語言模型
AI定價
亞太AI
混合專家模型

DeepSeek V4.1 Flash 正式發佈:552B MoE 因果編碼器-解碼器架構,每百萬 Token 低於 $0.01,亞太股市震盪

2026年9月10日,中國 AI 研究機構 DeepSeek 正式發佈旗下最新模型 DeepSeek-V4.1-Flash,以全新的因果編碼器-解碼器(Causal Encoder-Decoder)架構、超低推理成本及原生多模態能力,再度引發全球 AI 市場震動。此次發佈不僅在技術層面帶來重大突破,更在亞太金融市場掀起波瀾,多家香港及韓國 AI 相關企業股價單日大幅下挫。

技術架構:因果編碼器-解碼器的革新

DeepSeek-V4.1-Flash 是 DeepSeek 全新架構家族中的首款模型,也是目前規模最小的成員。其核心技術亮點包括:

混合專家模型(MoE)設計

  • 總參數量:552B(5,520億)
  • 推理時激活參數:預填充(Prefill)階段激活 8B,解碼(Decode)階段激活 16B
  • 稀疏激活機制:每次推理僅調用極小比例的參數,大幅降低計算成本

因果編碼器-解碼器架構

這是 DeepSeek 首次採用因果編碼器-解碼器設計,相較於傳統純解碼器架構,帶來以下優勢:

  • 壓縮稀疏注意力(Compressed Sparse Attention):優化 KV 快取效率
  • FP4 KV 快取:進一步壓縮記憶體佔用
  • KV 快取需求:僅需前代模型四分之一的高頻寬記憶體(HBM)
  • SSD 儲存需求:僅需前代模型八分之一的固態硬碟空間

多模態與長上下文能力

  • 上下文視窗:支援 100 萬 Token(最大輸出 384K Token)
  • 原生視覺理解:從零訓練的圖像理解能力,非後期接入
  • 可控推理強度:1至100的推理努力(Reasoning Effort)調節設定

基準測試表現

DeepSeek 公佈的官方基準數據顯示,V4.1 Flash 在多項評測中超越前代 V4 Pro:

基準測試 V4.1 Flash 得分
GPQA Diamond 90.9
Codeforces 3471
DeepSWE v1.1 74.2
HLE(含工具) 63.9

DeepSeek 表示,內外部測試均顯示 V4.1 Flash 在速度、成本及整體性能上全面超越 V4 Pro,尤其在編程、推理及代理任務方面表現突出。

定價策略:每百萬 Token 低於 $0.01

V4.1 Flash 的定價策略是此次發佈最具衝擊力的部分:

非高峰時段定價(UTC 時間)

  • 快取輸入 Token:每百萬 $0.003
  • 非快取輸入 Token:每百萬 $0.15
  • 輸出 Token:每百萬 $0.60

高峰時段定價

高峰時段(週一至週五 UTC 01:00-04:00 及 06:00-10:00)費率為非高峰的兩倍。

API 過渡安排

  • 自2026年9月10日 UTC 04:00 起,新定價正式生效
  • 舊版 API 名稱(deepseek-v4-flashdeepseek-v4-flash-vision-exp)暫時作為別名路由至 V4.1 Flash
  • 自2026年9月14日北京時間12:00起,所有 deepseek-v4-pro 請求自動路由至 V4.1 Flash,並按 Flash 較低定價計費

這一定價策略被業界分析師解讀為 DeepSeek 刻意向競爭對手施壓,同時激勵企業採用 AI 代理執行長時間複雜任務。

亞太市場震盪:香港及韓國股市受衝擊

V4.1 Flash 的發佈對亞太金融市場造成即時衝擊,尤其是香港上市的 AI 相關企業:

香港市場(2026年9月10日)

  • MiniMax Group Inc.:單日跌幅逾 8%
  • Z.AI:單日跌幅逾 8%
  • 阿里巴巴集團:跌幅逾 2%

半導體板塊

  • SK Hynix(美股):跌幅達 5.8%
  • Micron Technology(美股):跌幅達 5.3%

市場反應反映投資者對 AI 記憶體需求經濟學轉變的憂慮——若 AI 推理成本持續下降,對高頻寬記憶體(HBM)的需求增長或不如預期。

對亞太 AI 生態的深遠影響

對本地 AI 企業的挑戰

DeepSeek V4.1 Flash 的超低定價對亞太地區的 AI 初創企業構成直接競爭壓力。香港、新加坡及台灣的 AI 服務供應商若依賴 API 轉售模式,利潤空間將進一步收窄。

對企業用戶的機遇

對於亞太地區的企業用戶而言,V4.1 Flash 的低成本意味著:

  • 代理工作流程成本大降:長時間運行的 AI 代理任務成本可降低60-80%
  • 多模態應用普及:原生視覺理解降低了多模態應用的開發門檻
  • 本地化部署可行性提升:較低的記憶體需求使本地部署更具可行性

對台積電及半導體供應鏈的影響

DeepSeek 的高效架構持續引發市場對 AI 晶片需求的重新評估。若更多 AI 模型採用類似的稀疏激活設計,對先進製程晶片的需求增長或趨於平緩,對台積電、三星等晶圓代工廠的長期訂單預測帶來不確定性。

技術社群反應

DeepSeek V4.1 Flash 的開放權重(MIT 授權)已在 Hugging Face 上線,引發全球開發者社群廣泛討論:

  • 開源社群:MIT 授權允許商業使用,吸引大量企業評估自部署可行性
  • 研究人員:因果編碼器-解碼器架構的創新設計引發學術界關注
  • 競爭對手:OpenAI、Anthropic 及 Google 等主要競爭對手面臨定價壓力

結語:AI 定價戰進入新階段

DeepSeek V4.1 Flash 的發佈標誌著 AI 定價戰進入新階段。每百萬 Token 低於 $0.01 的定價,不僅挑戰了現有市場格局,更迫使整個行業重新思考 AI 服務的商業模式。對於亞太地區的企業決策者而言,如何在低成本 AI 工具的浪潮中找到差異化競爭優勢,將是未來數月的核心議題。

隨著 DeepSeek 計劃推出 V4.1 Pro 等後續模型,AI 能力與成本的競賽仍將持續。亞太地區的 AI 生態系統正面臨深刻重塑,無論是投資者、企業用戶還是 AI 開發者,都需要密切關注這一快速演變的格局。

常見問題

相關文章