
DeepSeek V4.1 Flash 正式發佈:552B MoE 因果編碼器-解碼器架構,每百萬 Token 低於 $0.01,亞太股市震盪
2026年9月10日,中國 AI 研究機構 DeepSeek 正式發佈旗下最新模型 DeepSeek-V4.1-Flash,以全新的因果編碼器-解碼器(Causal Encoder-Decoder)架構、超低推理成本及原生多模態能力,再度引發全球 AI 市場震動。此次發佈不僅在技術層面帶來重大突破,更在亞太金融市場掀起波瀾,多家香港及韓國 AI 相關企業股價單日大幅下挫。
技術架構:因果編碼器-解碼器的革新
DeepSeek-V4.1-Flash 是 DeepSeek 全新架構家族中的首款模型,也是目前規模最小的成員。其核心技術亮點包括:
混合專家模型(MoE)設計
- 總參數量:552B(5,520億)
- 推理時激活參數:預填充(Prefill)階段激活 8B,解碼(Decode)階段激活 16B
- 稀疏激活機制:每次推理僅調用極小比例的參數,大幅降低計算成本
因果編碼器-解碼器架構
這是 DeepSeek 首次採用因果編碼器-解碼器設計,相較於傳統純解碼器架構,帶來以下優勢:
- 壓縮稀疏注意力(Compressed Sparse Attention):優化 KV 快取效率
- FP4 KV 快取:進一步壓縮記憶體佔用
- KV 快取需求:僅需前代模型四分之一的高頻寬記憶體(HBM)
- SSD 儲存需求:僅需前代模型八分之一的固態硬碟空間
多模態與長上下文能力
- 上下文視窗:支援 100 萬 Token(最大輸出 384K Token)
- 原生視覺理解:從零訓練的圖像理解能力,非後期接入
- 可控推理強度:1至100的推理努力(Reasoning Effort)調節設定
基準測試表現
DeepSeek 公佈的官方基準數據顯示,V4.1 Flash 在多項評測中超越前代 V4 Pro:
| 基準測試 | V4.1 Flash 得分 |
|---|---|
| GPQA Diamond | 90.9 |
| Codeforces | 3471 |
| DeepSWE v1.1 | 74.2 |
| HLE(含工具) | 63.9 |
DeepSeek 表示,內外部測試均顯示 V4.1 Flash 在速度、成本及整體性能上全面超越 V4 Pro,尤其在編程、推理及代理任務方面表現突出。
定價策略:每百萬 Token 低於 $0.01
V4.1 Flash 的定價策略是此次發佈最具衝擊力的部分:
非高峰時段定價(UTC 時間)
- 快取輸入 Token:每百萬 $0.003
- 非快取輸入 Token:每百萬 $0.15
- 輸出 Token:每百萬 $0.60
高峰時段定價
高峰時段(週一至週五 UTC 01:00-04:00 及 06:00-10:00)費率為非高峰的兩倍。
API 過渡安排
- 自2026年9月10日 UTC 04:00 起,新定價正式生效
- 舊版 API 名稱(
deepseek-v4-flash、deepseek-v4-flash-vision-exp)暫時作為別名路由至 V4.1 Flash - 自2026年9月14日北京時間12:00起,所有
deepseek-v4-pro請求自動路由至 V4.1 Flash,並按 Flash 較低定價計費
這一定價策略被業界分析師解讀為 DeepSeek 刻意向競爭對手施壓,同時激勵企業採用 AI 代理執行長時間複雜任務。
亞太市場震盪:香港及韓國股市受衝擊
V4.1 Flash 的發佈對亞太金融市場造成即時衝擊,尤其是香港上市的 AI 相關企業:
香港市場(2026年9月10日)
- MiniMax Group Inc.:單日跌幅逾 8%
- Z.AI:單日跌幅逾 8%
- 阿里巴巴集團:跌幅逾 2%
半導體板塊
- SK Hynix(美股):跌幅達 5.8%
- Micron Technology(美股):跌幅達 5.3%
市場反應反映投資者對 AI 記憶體需求經濟學轉變的憂慮——若 AI 推理成本持續下降,對高頻寬記憶體(HBM)的需求增長或不如預期。
對亞太 AI 生態的深遠影響
對本地 AI 企業的挑戰
DeepSeek V4.1 Flash 的超低定價對亞太地區的 AI 初創企業構成直接競爭壓力。香港、新加坡及台灣的 AI 服務供應商若依賴 API 轉售模式,利潤空間將進一步收窄。
對企業用戶的機遇
對於亞太地區的企業用戶而言,V4.1 Flash 的低成本意味著:
- 代理工作流程成本大降:長時間運行的 AI 代理任務成本可降低60-80%
- 多模態應用普及:原生視覺理解降低了多模態應用的開發門檻
- 本地化部署可行性提升:較低的記憶體需求使本地部署更具可行性
對台積電及半導體供應鏈的影響
DeepSeek 的高效架構持續引發市場對 AI 晶片需求的重新評估。若更多 AI 模型採用類似的稀疏激活設計,對先進製程晶片的需求增長或趨於平緩,對台積電、三星等晶圓代工廠的長期訂單預測帶來不確定性。
技術社群反應
DeepSeek V4.1 Flash 的開放權重(MIT 授權)已在 Hugging Face 上線,引發全球開發者社群廣泛討論:
- 開源社群:MIT 授權允許商業使用,吸引大量企業評估自部署可行性
- 研究人員:因果編碼器-解碼器架構的創新設計引發學術界關注
- 競爭對手:OpenAI、Anthropic 及 Google 等主要競爭對手面臨定價壓力
結語:AI 定價戰進入新階段
DeepSeek V4.1 Flash 的發佈標誌著 AI 定價戰進入新階段。每百萬 Token 低於 $0.01 的定價,不僅挑戰了現有市場格局,更迫使整個行業重新思考 AI 服務的商業模式。對於亞太地區的企業決策者而言,如何在低成本 AI 工具的浪潮中找到差異化競爭優勢,將是未來數月的核心議題。
隨著 DeepSeek 計劃推出 V4.1 Pro 等後續模型,AI 能力與成本的競賽仍將持續。亞太地區的 AI 生態系統正面臨深刻重塑,無論是投資者、企業用戶還是 AI 開發者,都需要密切關注這一快速演變的格局。


