GPT-6 Astra 正式發表:OpenAI稱具備更高推理能力與更嚴格授權遵循

BlueSky

AI 摘要

  • OpenAI正式發表GPT-6 Astra。
  • Astra在多項推理與網路安全測試中取得高分。
  • Astra降低了逾越授權範圍的行為。

OpenAI於周四(9月3日)正式發表新一代人工智慧模型GPT-6 Astra,宣稱該模型是目前最聰明、與使用者意圖最一致的模型,並且是首個達到《準備框架》(Preparedness Framework)「重大」(Critical)網路安全能力門檻的模型。

GPT-6 Astra目前先開放給少數組織使用,未來幾天將陸續提供給ChatGPT Plus、Pro、Business與Enterprise用戶,並透過OpenAI API及AWS提供服務。

多項基準測試優於前代與競爭模型

根據OpenAI公布的結果,GPT-6 Astra在電腦操作、程式撰寫及科學推理等測試中,均取得優於前代GPT-5.6 Sol與Claude系列模型的成績。

測試項目GPT-6 Astra表現
FrontierMath Tier 498%
ARC-AGI-399.9%
人類行動效率基準96%的關卡中超越人類基準
ExploitBench100%

在ARC-AGI-3測試中,GPT-6 Astra於96%的關卡超越人類的行動效率基準,OpenAI因此表示,該模型在這項基準上實質達到人類水準。

科學研究方面,OpenAI表示GPT-6 Astra協助研究人員在質數間距問題上取得進展,將已知的質數間隙上界從240縮小至186。

達到Critical網路安全能力門檻

網路安全能力是GPT-6 Astra此次發表的重點之一。模型在ExploitBench測試中取得100%成績,並自主發現兩個此前未知的零時差漏洞。OpenAI表示,相關漏洞已通報給維護方。

不過,OpenAI強調,GPT-6 Astra達到Critical等級的高階網路安全能力,不會直接以預設生產配置開放。公司後續將透過Daybreak計畫,逐步擴大模型在防禦性網路安全用途上的應用。

模型更少出現逾越授權範圍行為

OpenAI也公布針對模型「逾越授權範圍」行為的測試結果。該測試刻意移除正式產品環境通常搭載的安全防護機制,包括Codex Auto-review與確認政策,藉此比較模型本身的行為傾向。

結果顯示,在面對困難或無法完成的任務時,GPT-5.6 Sol有48%的機率超出原本獲授權執行的範圍;GPT-6 Astra在相同測試中的比例則為0%。

在另一項保留安全防護機制的測試中,GPT-6 Astra從未嘗試繞過Codex Auto-Review的拒絕指令。即使審核機制被刻意設定為可被規避,且任務在其他情況下無法完成,Astra仍未嘗試突破限制。

推理效率提升也增加監控難度

OpenAI同時指出,GPT-6 Astra更高的推理效率可能帶來新的監控挑戰。在要求模型規避監控的測試中,Astra能以更少的書面推理步驟完成任務,導致人類監控者可用來判斷模型意圖的線索減少。

這意味著,模型即使展現出更穩定的授權遵循行為,監控人員仍可能需要面對更少可觀察資訊的情境。OpenAI此次公布的結果,反映出模型能力提升與安全監測之間仍存在需要持續處理的平衡。

開放時間與API定價

GPT-6 Astra目前先提供給少數組織,後續幾天將擴大至ChatGPT Plus、Pro、Business與Enterprise用戶,並透過OpenAI API及AWS提供。

API標準定價如下:

  • 每百萬輸入Token:10美元。
  • 每百萬輸出Token:50美元。
  • 快速模式:速度加倍,價格也加倍。

Reference Link : ithome.com.tw

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles