APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 最新科技

智譜 AI GLM-5.3-Flash 揭秘:「Ox Alpha」神秘模型正體曝光,320B MoE 架構每日7000萬請求創紀錄

2026年8月30日4 瀏覽
智譜 AI GLM-5.3-Flash 揭秘:「Ox Alpha」神秘模型正體曝光,320B MoE 架構每日7000萬請求創紀錄
智譜AI
GLM-5.3-Flash
開源AI模型
混合專家架構
中國AI

智譜 AI GLM-5.3-Flash 揭秘:「Ox Alpha」神秘模型正體曝光

2026年8月26日,中國 AI 公司智譜 AI(Z.ai)正式向彭博社確認:在 OpenRouter 上以「Ox Alpha」身份匿名測試一週的神秘模型,正是其最新旗艦模型 GLM-5.3-Flash。這一揭秘終結了 AI 社群長達一週的猜測,也揭示了一種新型 AI 模型發佈策略的全貌。

Ox Alpha 的神秘登場

2026年8月20日,一個名為 stealth/ox-alpha 的匿名模型悄然出現在 AI 模型路由平台 OpenRouter 上。這個模型的特點令人矚目:

  • 完全免費:無需付費即可使用
  • 超大上下文窗口:支援 1,048,576 個 Token(約100萬 Token)
  • 強大的代理編程能力:迅速成為 Claude Code、Hermes Agent 等 AI 代理的首選工具

消息在開發者社群中迅速傳播。早期測試顯示,該模型在 DeepSWE 基準測試中聲稱達到 80% 的得分,顯著超越當時的競爭對手。然而,後續更全面的社群測試將其性能定位為「前沿模型中等水平」,而非絕對頂尖。

使用量爆炸式增長

Ox Alpha 的免費策略取得了驚人效果。到2026年8月24日,該模型的每日請求量已突破 7,000萬次,成為 OpenRouter 平台上使用量最高的模型之一。

這一數字背後是 AI 開發者對高性能、低成本推理服務的強烈需求。然而,在匿名測試期間,模型的提示詞和回應內容均被運營方保留,雖然聲明不用於訓練,但缺乏正式數據處理協議的情況引發了安全分析師的警告:不應將敏感或生產級數據用於此模型。

GLM-5.3-Flash 技術規格

正式揭秘後,智譜 AI 公佈了 GLM-5.3-Flash 的完整技術規格:

規格項目 詳情
架構 混合專家(MoE)架構
總參數量 320B
活躍參數量 18B
上下文窗口 1,048,576 Token(約100萬)
多模態支援 文字、圖像、視頻輸入
開源授權 MIT 授權
發佈平台 Hugging Face(zai-org/GLM-5.3-Flash
定價 輸入 $0.15/百萬 Token,輸出 $0.50/百萬 Token

GLM-5.3-Flash 是 GLM-5 系列中首個原生多模態模型,支援文字、圖像和視頻的混合輸入,大幅擴展了其應用場景。

國產晶片的重要里程碑

智譜 AI 特別強調,在 Ox Alpha 匿名測試階段,模型完全運行於國產中國 AI 晶片之上。這一聲明具有重要的戰略意義。

在美國對中國 AI 晶片出口實施嚴格限制的背景下,智譜 AI 能夠以國產晶片支撐每日7,000萬次的高並發請求,展示了中國 AI 基礎設施的實際能力。這不僅是技術成就,更是對外界質疑中國 AI 算力的有力回應。

GLM-5.3 家族:兩款不同定位的模型

值得注意的是,GLM-5.3-Flash 與同期發佈的 GLM-5.3 是兩款定位截然不同的模型:

GLM-5.3(2026年8月14日發佈):

  • 743B/744B 參數規模
  • 專注於網絡防禦和安全任務
  • CyberGym 基準得分 84.5%,AutomationBench 得分 48.2%
  • 採用分階段、受控的開源策略(截至8月底尚未完全開放)

GLM-5.3-Flash(2026年8月26日發佈):

  • 320B 總參數 / 18B 活躍參數 MoE 架構
  • 面向廣泛代理應用場景
  • 即時以 MIT 授權完全開源
  • 更低的推理成本,適合大規模部署

「隱身發佈」策略的啟示

Ox Alpha 的發佈方式代表了一種新興的 AI 模型推廣策略:通過匿名、免費的方式在真實生產環境中收集大規模評估數據,同時建立開發者心智份額,再在積累足夠數據後正式發佈付費版本。

這種策略的效果顯而易見:在正式發佈前,GLM-5.3-Flash 已在全球開發者社群中建立了廣泛的知名度和使用基礎。

對亞太地區 AI 生態的影響

GLM-5.3-Flash 的開源發佈對亞太地區 AI 生態具有重要意義。根據 CSIS 的分析,亞太地區多個國家正在積極推進「主權 AI」戰略,尋求減少對美國 AI 技術的依賴。

GLM-5.3-Flash 的 MIT 授權開源策略,使亞太地區的企業和研究機構能夠:

  • 在本地部署高性能 AI 模型,無需依賴境外雲服務
  • 根據本地需求進行定制和微調
  • 降低 AI 應用的整體成本

結語

智譜 AI GLM-5.3-Flash 的揭秘不僅是一個技術發佈事件,更是中國 AI 產業實力的一次集中展示。從國產晶片支撐的高並發服務,到 MIT 授權的完全開源,再到創紀錄的使用量,GLM-5.3-Flash 正在重塑全球開源 AI 模型的競爭格局。對於亞太地區尋求 AI 技術多元化的企業而言,這是一個值得密切關注的重要發展。

常見問題

相關文章