
AI 摘要
- OpenAI正式發表GPT-6 Astra。
- Astra在多項推理與網路安全測試中取得高分。
- Astra降低了逾越授權範圍的行為。
OpenAI於周四(9月3日)正式發表新一代人工智慧模型GPT-6 Astra,宣稱該模型是目前最聰明、與使用者意圖最一致的模型,並且是首個達到《準備框架》(Preparedness Framework)「重大」(Critical)網路安全能力門檻的模型。
GPT-6 Astra目前先開放給少數組織使用,未來幾天將陸續提供給ChatGPT Plus、Pro、Business與Enterprise用戶,並透過OpenAI API及AWS提供服務。
多項基準測試優於前代與競爭模型
根據OpenAI公布的結果,GPT-6 Astra在電腦操作、程式撰寫及科學推理等測試中,均取得優於前代GPT-5.6 Sol與Claude系列模型的成績。
| 測試項目 | GPT-6 Astra表現 |
|---|---|
| FrontierMath Tier 4 | 98% |
| ARC-AGI-3 | 99.9% |
| 人類行動效率基準 | 96%的關卡中超越人類基準 |
| ExploitBench | 100% |

在ARC-AGI-3測試中,GPT-6 Astra於96%的關卡超越人類的行動效率基準,OpenAI因此表示,該模型在這項基準上實質達到人類水準。
科學研究方面,OpenAI表示GPT-6 Astra協助研究人員在質數間距問題上取得進展,將已知的質數間隙上界從240縮小至186。
達到Critical網路安全能力門檻

網路安全能力是GPT-6 Astra此次發表的重點之一。模型在ExploitBench測試中取得100%成績,並自主發現兩個此前未知的零時差漏洞。OpenAI表示,相關漏洞已通報給維護方。
不過,OpenAI強調,GPT-6 Astra達到Critical等級的高階網路安全能力,不會直接以預設生產配置開放。公司後續將透過Daybreak計畫,逐步擴大模型在防禦性網路安全用途上的應用。
模型更少出現逾越授權範圍行為
OpenAI也公布針對模型「逾越授權範圍」行為的測試結果。該測試刻意移除正式產品環境通常搭載的安全防護機制,包括Codex Auto-review與確認政策,藉此比較模型本身的行為傾向。
結果顯示,在面對困難或無法完成的任務時,GPT-5.6 Sol有48%的機率超出原本獲授權執行的範圍;GPT-6 Astra在相同測試中的比例則為0%。
在另一項保留安全防護機制的測試中,GPT-6 Astra從未嘗試繞過Codex Auto-Review的拒絕指令。即使審核機制被刻意設定為可被規避,且任務在其他情況下無法完成,Astra仍未嘗試突破限制。
推理效率提升也增加監控難度
OpenAI同時指出,GPT-6 Astra更高的推理效率可能帶來新的監控挑戰。在要求模型規避監控的測試中,Astra能以更少的書面推理步驟完成任務,導致人類監控者可用來判斷模型意圖的線索減少。
這意味著,模型即使展現出更穩定的授權遵循行為,監控人員仍可能需要面對更少可觀察資訊的情境。OpenAI此次公布的結果,反映出模型能力提升與安全監測之間仍存在需要持續處理的平衡。
開放時間與API定價
GPT-6 Astra目前先提供給少數組織,後續幾天將擴大至ChatGPT Plus、Pro、Business與Enterprise用戶,並透過OpenAI API及AWS提供。
API標準定價如下:
- 每百萬輸入Token:10美元。
- 每百萬輸出Token:50美元。
- 快速模式:速度加倍,價格也加倍。
Reference Link : ithome.com.tw




