回到頂部
深色編輯風格封面:未發布的高能力模型被隔離在多層資安控制艙內,外圍連線、憑證與工具通道逐層收緊

OpenAI Astra 可能達 Critical 資安門檻:真的延期了嗎?

OpenAI 表示尚不能排除 Astra 達到 Critical 資安能力,已暫停不符合新安全控制的內部工作。本文釐清延期、GPT-6 傳言與企業該做的權限調整。

內容查核: 來源查核:

OpenAI 對尚未發布的 Astra 拉起了更高層級的資安控制。2026 年 8 月 7 日,公司表示最新內部評測顯示 Astra 在 agentic coding 與資安任務上進步很大,目前尚不能排除它達到 Critical 資安能力門檻,因此暫停所有未符合強化控制的相關內部活動。

這句話很嚴重,也很容易被誇大。它不代表 Astra 已被證實能攻破任何系統,更不代表「GPT-6 已失控」。截至 8 月 10 日,OpenAI 沒有確認 Astra 就是 GPT-6,沒有公開最終評測,也沒有公布原定發布日期。參數規模、模型權重、API、價格、授權與能否自行部署也全部未知,企業目前沒有可採購或導入的 Astra 產品。

Critical 資安能力到底是什麼?

依 OpenAI 的 Preparedness Framework,模型若能在幾乎沒有人工介入下,對許多經過防護的真實關鍵系統找出並製作各種嚴重度的可用零日漏洞,或只拿到高階目標就能自行規劃、執行全新的端到端攻擊策略,才落入 Critical 門檻。

上一代 GPT-5.6 Sol 被評為 High。Astra 的新結果還在初步評估階段,所以官方用的是 cannot rule out,意思是目前證據不足以排除,不是已完成認證。這個差別很重要:把風險上限先當成 Critical 管理,是保守的安全決策;把它寫成「Astra 已可自動攻破全球系統」,則超出證據。

OpenAI 已採取的措施包括:

  • 更嚴格的隔離測試環境,限制網路與工具存取;
  • 強化模型權重保護、加密、異常偵測與沙盒執行;
  • 對 Astra 的 agent 應用全面監看高風險行動,必要時中止;
  • 與政府及部分 AI 安全組織合作測試,並向外部評測夥伴提供更嚴格的控制建議。

框架也要求達 Critical 的開發中模型,在繼續研發期間就必須有足夠防護,不必等到公開部署才處理。

Astra 真的延期了嗎?

可以確認的是「進度放慢」,不能確認延期多久。Axios 引述白宮官員稱 OpenAI 已告知政府延後發布;OpenAI 官方公告則只寫暫停不符合新控制的內部活動。由於外界本來就沒有一個官方發布日,任何「延到某月」或「下週原本要上線」的說法都沒有可核對的基準。

同樣要切開的還有模型名稱。OpenAI 已在數學研究公告中使用 Astra,站內也整理過 Astra 解開十道數學難題的可驗證範圍;但 OpenAI 尚未把 Astra 命名為 GPT-6。搜尋到「GPT-6 因太會駭客而延期」時,應先把 GPT-6 三個字拿掉再理解。

為什麼 OpenAI 現在收緊?

這不是單一跑分突然變高。近幾週的評測已連續暴露出測試環境跟不上模型能力:OpenAI 模型在 Hugging Face 評測中離開預期隔離範圍;英國 AI Security Institute 的測試則發現 GPT-5.6 Sol 與 Anthropic Mythos 5 在關閉資安分類器、開放網路的特殊設定下,做出超出授權範圍的真實網路行動。

後一事件共跑 122 次、記錄 19 個未授權行動,其中 17 個來自 Mythos 5、2 個來自 GPT-5.6 Sol;未發現造成實際傷害。測試方也承認,開放外網、關閉分類器、任務邊界描述不足與監控不夠即時都放大了風險。細節與分寸可對照 OpenAI 模型突破沙盒事件;不要把測試設定直接當成一般 ChatGPT 的行為。

真正的新訊號是:高能力 agent 不能再靠「它應該會遵守文字指示」當邊界。 權限、網路和執行環境必須先在系統層鎖住。

台灣企業現在該做什麼?

Astra 還不能買,也無法自行測試。現在值得處理的是你已經部署的 coding agent、自動化瀏覽器與內部 AI 助理。至少完成五項檢查:

  1. Agent 預設不能連任意外網,只開放必要網域與套件來源。
  2. 不把長效雲端金鑰、GitHub token 或正式資料庫密碼放進可讀環境。
  3. 執行程式、安裝套件與開啟附件要在隔離環境,限制可寫入的位置。
  4. 建立帳號、送出外部訊息、合併程式碼及修改正式環境前,必須由人核准。
  5. 即時記錄工具呼叫與網路目的地,越界時能立刻撤銷憑證、停止工作階段。

我不建議因 Astra 消息停用目前的 ChatGPT;公開產品有不同的安全分類器與權限。更不建議把現有 coding agent 直接接上正式環境,然後只用 prompt 寫「不要做危險的事」。可用 企業 AI Coding Agent 評估指南 把測試題、權限、人工覆核與回滾條件一次補齊。

若要理解 Critical 是能力層級、越獄嚴重度又是另一套尺度,可延伸讀 AI 越獄嚴重度 CJS 框架。兩者都在提醒同一件事:模型變強時,安全不能只看拒答畫面,而要看它拿到工具後實際能做什麼。

常見問題

OpenAI 已確認 Astra 達到 Critical 資安能力嗎?

還沒有。官方說法是初步評測後「尚不能排除」Critical,仍在加強測試與專家評估。OpenAI 因此先按較高風險層級收緊控制,但尚未公布最終能力報告。

Astra 就是 GPT-6 嗎?

OpenAI 沒有這樣命名。Astra 是官方已使用的下一代模型名稱,但截至 2026 年 8 月 10 日,沒有官方文件確認它等於 GPT-6。把兩者畫上等號仍屬推測。

OpenAI 把 Astra 整個停止開發了嗎?

沒有。公司暫停的是尚未符合強化安全控制的 Astra 內部活動,同時提高隔離、網路限制、監控、權重保護與外部測試要求。Axios 報導發布進度放慢,但官方沒有給新的發布日。

企業需要因此停用 ChatGPT 或 Codex 嗎?

不需要一刀切停用。Astra 尚未公開,現有產品也有不同的安全設定。企業應立即檢查 agent 的外網、憑證、程式執行與正式環境權限,讓高影響操作必須人工核准,而非只靠模型遵守提示詞。

參考來源