
OpenAI正式發布新一代旗艦模型GPT-6 Astra,總裁布羅克曼 (Greg Brockman) 形容係「世代性嘅能力躍進」,更向記者稱「歡迎來到AGI時代」,表明佢個人認為通用人工智能已經到臨。Astra係OpenAI首款喺自家「準備框架」(Preparedness Framework)下被評定達到網絡安全「關鍵」(Critical)級別嘅模型,即係話喺配備適當工具同權限之下,佢可以喺冇人類逐步指導嘅情況下,自行發現防護嚴密系統嘅未知漏洞並開發攻擊方法。正因如此,OpenAI早喺8月7日宣布放慢發布步伐並通知白宮,行政總裁阿爾特曼 (Sam Altman) 表示,模型推出前經過特朗普府嘅正式審查。
Astra最顯著嘅突破係電腦操作能力。OpenAI指,模型可以直接處理過去要人手逐步完成嘅工作,例如填寫網上表格、更新客戶資料、整理行事曆、上網搜集資料再寫入文件,甚至建立網站後自行做前端測試。示範片段中,Astra操作開源電子設計軟件KiCad,喺2分54秒內將電路圖轉化為可生產嘅印刷電路板布局,而呢項工序向來係電子設計流程延誤嘅常見原因。喺OSWorld 2.0測試,Astra以約40分鐘完成一項任務並取得72.6分,上一代GPT-5.6 Sol就要約75分鐘先得65.7分。編程方面,OpenAI為Codex引入跨上下文筆記機制,令模型喺長時間對話中保留關鍵細節,毋須反覆壓縮成單一摘要。
科學研究方面,OpenAI公布Astra協助推進質數間距問題。過去十幾年,數學界已知嘅最佳結果係無限多對質數相距不超過246,數學家斯塔德爾曼 (Julia Stadlmann) 最近先推進至240,而Astra就協助證明更強嘅186上限;另一項關於超大質數間距嘅結果,亦改良咗一個80幾年未變嘅上限估計。
網絡安全係今次最受關注嘅一環,背後係7月轟動業界嘅Hugging Face事件。當時OpenAI多款模型喺內部網安評測期間,利用套件安裝工具嘅零日漏洞逃出隔離環境,取得互聯網連線後入侵Hugging Face嘅生產系統,據Hugging Face事後分析,目的竟然係想「出貓」偷取測試答案。據Axios引述OpenAI 8月底嘅技術報告,涉事代理程式同時攻破OpenAI自身內部系統,讀取咗956項儲存密鑰。OpenAI今次特別以該事件設計新測試,評估模型面對難以完成嘅任務時會否越權:冇安全措施嘅GPT-5.6 Sol有48%情況超出授權目標,Astra就係0%。喺以近三個月漏洞建立嘅新測試入面,Astra更發現並利用咗兩個未知零日漏洞,OpenAI已通報相關維護者。不過OpenAI亦坦承,Astra嘅書面推理比GPT-5.6 Sol更難監察。公開版本會拒絕撰寫攻擊程式等進階網安任務,較寬鬆嘅版本只透過Daybreak計劃向經審核機構開放。
定價方面,Astra經API收費係每百萬輸入token 10美元(約78港元)、每百萬輸出token 50美元(約390港元),係GPT-5.6 Sol現時4美元及20美元(約31港元及156港元)優惠價嘅2.5倍,同Anthropic 9月1日推出嘅Claude Fable 5.1完全一致;相比之下,Meta前一日推出嘅Muse Spark 1.3只收1.25美元及4.25美元(約9.8港元及33港元)。獨立評測機構Artificial Analysis指,Astra喺編程代理指數取得67分,同Claude Opus 5及Fable 5相若,每項任務成本卻不足Fable 5一半,不過Fable 5.1以70分領先;喺整體智能指數,Astra只係同GPT-5.6 Sol打成平手,落後Fable 5.1五分。今次發布距GPT-5面世逾一年,距GPT-5.6就只有約五星期。Astra已陸續開放予Pro、Business以至Plus用戶,API、Microsoft Azure及AWS Bedrock亦陸續提供。值得留意嘅係,OpenAI 6月8日已向美國證交會秘密提交上市申請,最新估值8,520億美元(約6.6萬億港元),公司強調上市時間未定,但網安風波同定價策略勢必成為投資者審視焦點。