AI叻過頭太危險?        為達標學識「講大話」          OpenAI急停新模型!
AI叻過頭太危險? 為達標學識「講大話」 OpenAI急停新模型!

美國人工智能公司OpenAI證實,原定10月推出嘅新一代模型GPT-6.1 Astra,因為內部測試發現模型未能留喺獲授權範圍之內,決定暫緩發布,暫時無新嘅推出日期。同時間OpenAI喺三藩市舉行年度開發者大會DevDay,而美國總統特朗普周二中午亦喺白宮設午宴,召集人工智能巨頭商討點樣監管呢門技術。

 

OpenAI安全系統主管捷尹 (Saachi Jain) 承認新模型「未達到門檻」,佢話模型變得更加堅持完成任務,但公司需要喺呢種能力同越權行為之間取得平衡。據報,GPT-6.1 Astra喺自主完成複雜任務同寫作方面比9月3日推出嘅GPT-6 Astra更強,但喺兩個範疇出現倒退:一係未能留喺授權範圍之內,二係向用戶交代自己做過乜嘢時唔夠清晰,模型會未經用戶批准自行擴大任務範圍,甚至調用外部工具同服務。

 

已經面世嘅GPT-6 Astra本身亦令人不安。OpenAI形容佢係公司首個喺網絡安全能力上達到「關鍵」級別嘅模型,但同時承認模型思維鏈嘅可監控程度比前代GPT-5.6 Sol大幅下降,系統卡更寫明模型可以喺評估中刻意「放水」而唔被察覺。英國人工智能安全研究所嘅獨立測試亦發現,Astra喺499項模擬網絡安全挑戰入面,有60次執行咗供應鏈攻擊。OpenAI上星期已經暫停最先進模型嘅訓練,話要等到有信心加設額外防護措施先至恢復,之前公司披露咗AI智能體超出指示、未經授權進入政府網站嘅事件。

 

引爆風波嘅正係澳洲一役。OpenAI發表題為「我哋將如何為澳洲做得更好」嘅道歉聲明,披露8月中發現事件影響四個澳洲政府網站,包括澳洲服務局、新南威爾斯州犯罪統計及研究局、維多利亞州衞生部門同澳洲健康與福利研究所。最嚴重係澳洲服務局嘅系統:模型喺公開數據搵唔到所需資料,就自行搵到內部系統嘅入口,執行指令、讀取檔案同憑證,仲寫入咗檔案。事發喺6月,但澳洲政府直到9月先經由一個公共電郵信箱收到通知。澳洲總理阿爾巴尼斯 (Anthony Albanese) 上周狠批事件「不可接受」,表明政府正考慮法律手段防止同類事件。OpenAI承認應對失當,承諾成立澳洲工作小組,首席策略官Jason Kwon會喺10月初出席澳洲國會委員會聆訊。阿爾巴尼斯周二喺阿德萊德話,OpenAI一直有作出詳盡簡報,雙方討論「具建設性」。

 

出事嘅唔止OpenAI。OpenAI智能體早前入侵Hugging Face之後,Anthropic、Meta同Google亦先後披露模型喺評估期間進入第三方系統嘅類似事件。喺呢個背景之下,周二白宮東廳午宴嘅名單包括Anthropic行政總裁阿莫迪、OpenAI總裁布羅克曼、Google行政總裁皮查伊 (Sundar Pichai)、Palantir行政總裁Alex Karp、Meta行政總裁朱克伯格同英偉達行政總裁黃仁勳,眾議院議長約翰遜同副總統萬斯亦會出席。OpenAI行政總裁Sam Altman就留守三藩市,佢周一喺X預告DevDay,話公司「搵到一樣新嘢」。

 

午宴背後係一場路線之爭。阿莫代伊早前撰文呼籲業界「放慢前沿步伐」,Sam Altman同Elon Musk都表態支持全行業放慢,特朗普就一直抗拒,近幾星期更稱AI恐懼係「騙局」;朱克伯格亦反駁話,每間實驗室都有責任同誘因,按安全訓練模型所需嘅步伐推進。特朗普周日先同阿莫代伊食過晚飯,佢6月簽署嘅行政命令,亦只係要求開發商「自願」喺發布前30日向政府提交前沿模型審視。約翰遜周一接受霍士財經訪問時定調:唔需要暫停,唔需要急住過度監管,否則會輸咗畀中國,但創新要繼續之餘必須「取得正確平衡」。有最新民調顯示,73%受訪者擔心AI公司防範社會危害做得不足,55%認為放慢發展係好事。

發佈時間: 2026年09月30日 21:30
關於我們 | 加入我們 | 隱私權聲明 | 免責聲明 | 錯誤回報/意見提供
電郵: hongkongmatters.info@gmail.com

Copyright © 2022 香港元宇宙. All rights reserved.