APAIIF 亞太人工智能產業總會APAIIFAI 知識庫
AI 最新科技

OpenAI GPT-6 Astra 正式發佈:ARC-AGI-3 評分 99.9%、ExploitBench 滿分,史上首個達到「危急」網絡安全門檻的 AI 模型

2026年9月4日5 瀏覽
OpenAI GPT-6 Astra 正式發佈:ARC-AGI-3 評分 99.9%、ExploitBench 滿分,史上首個達到「危急」網絡安全門檻的 AI 模型
OpenAI
GPT-6
AGI
網絡安全
AI模型

OpenAI GPT-6 Astra 正式發佈:ARC-AGI-3 評分 99.9%、ExploitBench 滿分,史上首個達到「危急」網絡安全門檻的 AI 模型

2026 年 9 月 3 日,OpenAI 正式發佈其旗艦模型 GPT-6 Astra,這是人工智能發展史上的一個重要里程碑。這款模型不僅在多項基準測試中創下歷史紀錄,更成為史上首個在 OpenAI 準備框架(Preparedness Framework)下被評定為「危急」(Critical)網絡安全門檻的 AI 模型,引發全球 AI 安全界的高度關注。

突破性基準測試成績

GPT-6 Astra 在多項關鍵評測中展現出前所未有的能力:

評測項目 GPT-6 Astra 成績 前代最佳
ARC-AGI-3 99.9% 約 38%
ExploitBench 100% 約 65%
FrontierMath Tier 4 98% 約 72%

ARC-AGI-3 是衡量 AI 通用推理能力的黃金標準測試,此前最佳成績約為 38%(OpenAI Codex Harness)。GPT-6 Astra 以 99.9% 的成績幾乎完全飽和這一測試,令業界震驚。ExploitBench 則是評估 AI 網絡安全能力的專業測試,滿分意味著模型能夠自主發現並利用真實系統中的零日漏洞。

「危急」網絡安全門檻:史無前例的安全挑戰

根據 OpenAI 的準備框架,「危急」(Critical)網絡安全門檻定義為:模型能夠在無人工干預的情況下,針對強化的真實系統自主識別並開發可用的零日漏洞,或執行端對端的新型網絡攻擊策略。

GPT-6 Astra 是 OpenAI 歷史上首個達到這一門檻的模型。具體表現包括:

  • 自主發現鏈式零日漏洞:包括完整的瀏覽器入侵鏈和本地權限提升漏洞
  • ExploitBench 滿分:在所有測試場景中均能成功利用漏洞
  • 無需人工輔助:能夠獨立完成從漏洞發現到利用的完整攻擊鏈

這一能力的出現,標誌著 AI 在網絡安全領域已從輔助工具演變為潛在的獨立威脅行為者。

雙軌發佈策略:平衡能力與安全

面對前所未有的安全挑戰,OpenAI 採取了嚴格的雙軌發佈策略:

標準用戶軌道

  • ChatGPT Plus、Pro、Business 及 Enterprise 用戶可使用通用推理和軟件工程能力
  • API 用戶及 AWS 客戶可在初始發佈後數日內獲得訪問權限
  • 攻擊性網絡能力被技術手段隔離,不對標準用戶開放

Daybreak Blue 受限軌道

  • 僅限通過審查的網絡安全防禦者使用
  • 自 2026 年 9 月 1 日起,所有 Daybreak 帳戶強制要求硬件安全金鑰
  • 模型的零日漏洞發現和攻擊性漏洞生成能力僅在此軌道開放

技術安全措施

OpenAI 實施了多項技術保護措施:

  • 激活分類器:實時檢測網絡濫用模式
  • 跨對話拒絕訓練:維持安全護欄,防止越獄
  • 密集自動化紅隊測試:關閉通用越獄路徑
  • 越獄拒絕率:達到 91.5%,較前代模型大幅提升

技術架構:遞歸深度推理

GPT-6 Astra 採用了一種名為「遞歸深度」(Recurrent Depth)的新型推理技術,允許模型通過內部潛在向量而非外部化文本來處理複雜問題。這一技術帶來了顯著的能力和效率提升,但也引發了透明度方面的擔憂——由於推理過程不再以傳統思維鏈(Chain-of-Thought)形式呈現,標準監控系統難以追蹤模型的推理路徑。

在訓練規模方面,GPT-6 Astra 使用了 OpenAI 迄今最大規模的訓練運行,在德克薩斯州「星際之門」(Stargate)設施的超過 10 萬個 GPU 上完成預訓練。

電腦使用能力:真正的自主代理

GPT-6 Astra 在電腦使用(Computer Use)方面展現出令人印象深刻的能力:

  • 電路板設計:能在 KiCad 中完成印刷電路板佈局
  • 3D 場景創建:在 Unity 中創建完整的 3D 場景
  • 機械動畫:在 FreeCAD 和 Blender 中生成動態機械組件
  • 網頁瀏覽:自主進行研究、填寫稅務表格、聯繫服務提供商
  • 長期上下文管理:Codex 新功能允許模型在長時間會話中保留和檢索詳細上下文,無需壓縮信息

監管審查:首次政府預發佈審查

GPT-6 Astra 的發佈標誌著另一個歷史性時刻——這是首個在發佈前接受美國政府正式網絡安全審查的 AI 模型。OpenAI 表示,模型在特朗普政府的自願審查框架下完成審查並獲得批准。

這一先例的建立,可能對未來高能力 AI 模型的發佈流程產生深遠影響,預示著政府監管介入 AI 安全審查的新時代。

亞太地區影響:機遇與挑戰並存

對於亞太地區的企業和政府而言,GPT-6 Astra 的發佈帶來了雙重影響:

機遇方面

  • 軟件工程自動化能力大幅提升,可加速數字化轉型
  • 科學研究輔助能力增強,有助於推動創新
  • 複雜工作流程自動化,提升企業競爭力

挑戰方面

  • 網絡安全威脅升級,企業需要加強防禦體系
  • 監管合規壓力增加,特別是在數據主權敏感的地區
  • 技術差距可能擴大,需要加快 AI 人才培育

行業反應與未來展望

OpenAI 總裁 Greg Brockman 將 Astra 定位為邁向 AGI(通用人工智能)的重要一步。然而,業界對此看法不一:

支持者認為,GPT-6 Astra 展示的能力代表了 AI 在解決複雜現實問題方面的真正突破,有望加速科學發現和技術創新。批評者則擔憂,在安全機制尚未完善的情況下,如此強大的網絡攻擊能力可能被濫用,對全球網絡安全基礎設施構成前所未有的威脅。

隨著 AI 能力持續突破,如何在推動技術進步的同時確保安全,將成為整個行業面臨的核心挑戰。GPT-6 Astra 的發佈,無疑將這一討論推向了新的高度。

結語

GPT-6 Astra 的發佈是 AI 發展史上的一個分水嶺。它不僅展示了 AI 在推理、編程和科學研究方面的卓越能力,更首次將 AI 的網絡安全威脅潛力提升至「危急」級別,迫使整個行業重新思考 AI 安全治理的框架。對於企業和政府而言,現在是時候認真評估 AI 能力提升帶來的機遇與風險,並制定相應的應對策略。

常見問題

相關文章