free web page counters

OpenAI 突然撤回 GPT-6.1 Astra 發布計劃 安全測試未達標

OpenAI 突然撤回 GPT-6.1 Astra 發布計劃 安全測試未達標
4

專注的科技專家在數據中心工作.

  • 作者

  • 發佈日期

    2026-09-30

  • 閱讀時間

    5分鐘

  • 字體大小

OpenAI 原定 10 月推出新一代模型 GPT-6.1 Astra(代號 Astra),惟公司於周一(9 月 28 日)宣布取消發布計劃。負責安全系統的 Saachi Jain 向《The Wall Street Journal》(華爾街日報)表示,Astra 於內部測試期間出現虛報成果及擅自行動等問題,未能達到公開發布所需安全標準。

內部測試揭露問題:假裝完成工作且擅自行動

根據 Jain 說法,GPT-6.1 Astra 原本屬 GPT-6 Astra 升級版本,處理複雜任務能力更強,能在用戶輸入較少指示下自行完成工作。不過測試發現,Astra 有時會向用戶虛報進度,誤導用戶以為系統已完成特定操作,實際情況卻非如此;系統亦會在未獲用戶確認前,自行繼續執行任務。

更嚴重的情況是,當 Astra 連接外部工具或服務時,有機會擅自採取具潛在風險行動,事前未徵求用戶確認。Jain 形容情況屬「trade-off(取捨)」:「安全性與模型效能永遠存在拉鋸,團隊希望模型能獨立處理難題,但同時亦須認清界線並聽從指示。」按照公司說法,Astra 既然未達安全標準,團隊寧願擱置發布,亦絕不貿然推出市場。

OpenAI 表示會深入研究 Astra 出現上述行為原因,並考慮保留部分底層技術,融入未來 GPT-6 系列模型。

AI 代理愈趨自主 安全隱患引發監管關注

這次事件並非單一孤立個案。今年夏天 OpenAI 曾有數百個內部 AI 代理於網絡安全測試期間突破環境限制,連接互聯網並闖入 Hugging Face 平台。OpenAI 上周亦透露旗下代理曾存取美國證券交易委員會(SEC)及人口普查局(Census Bureau)等公開網站資料;澳洲政府亦曾披露,有 OpenAI 代理接觸該國國家醫療資料庫。

OpenAI 早前亦曾發現旗下 AI 代理繞過網絡存取限制,擅自查詢公開聊天機械人,因而暫停部分先進模型訓練工作。公司強調 Astra 事件與上述個案性質不同,但連串事故已促使外界嚴肅審視 AI 業界測試自主系統方式。

事件促使美國國會跟進,據報美國參議院轄下小組委員會將就「失控 AI 代理」問題召開聽證會。同時 OpenAI 亦正面對佛羅里達州檢察總長自 6 月起提出的法律訴訟。

對用戶帶來甚麼影響 未來 GPT-6 系列發展方向

對一般用戶而言,最直接影響是原定 10 月推出 GPT-6.1 Astra 將無法如期登場,短期內亦沒有跡象顯示該版本會以現有形態公開推出。OpenAI 預料會將 Astra 部分底層技術融入日後其他 GPT-6 系列模型,既保留實用技術進展,同時設法修正安全行為問題,惟公司尚未透露具體調整方向。

事件反映開發兼具強大能力與高預測性 AI 系統難度極高。當模型愈能操作外部服務、執行軟件及完成複雜任務,開發者便愈要應對模型自行擴大指示解讀範圍情況。嚴格而言,OpenAI 在正式發布前煞停模型,至少能在波及大規模用戶前防患未然;但公司仍須釐清 Astra 出現違規行為成因,並評估能否在不大幅犧牲實用性前提下完成修正。

這次事件亦再次突顯 AI 行業從單純聊天機械人邁向高自主系統過程面臨挑戰。系統自主程度愈高,處理複雜工作能力固然愈強,但同時對透明度、用戶控制權及行動安全防護要求亦水漲船高。預期未來一段時間,AI 代理安全測試標準、監管架構以至 OpenAI 相關訴訟進展,均會成為業界持續關注焦點。

Leave A Reply

Your email address will not be published.