
AFP 法新社報導
人工智慧巨頭OpenAI週一證實,由於內部測試顯示最新模型Astra 6.1未能符合安全標準,公司決定取消發布。這項消息是在OpenAI於舊金山舉辦年度開發者大會的前一天宣布,引發外界對AI安全的高度關注。開發出ChatGPT的人工智慧巨頭OpenAI週一證實,內部測試顯示最新AI模型「Astra 6.1」未達安全標準,因此不會向外界發布。這項宣布恰巧落在舊金山舉行的年度開發者大會(OpenAI DevDay)前夕,雖然外界預期該公司將宣布多項新消息,但目前尚不清楚是否會包含新版Astra模型。
OpenAI安全系統主管Saachi Jain在聲明中表示,Astra 6.1在某些方面優於先前版本,但「在維持授權與作業範圍,以及向使用者回報工作內容的方式上,並未達到標準」。她強調,無論在公司內部或交付給使用者,模型開發都必須確保安全,特別是提供給用戶時,標準極為嚴格。
近幾個月來,OpenAI與競爭對手Anthropic的模型在測試期間引發多起資安事件,加深了各界對AI安全的擔憂。由OpenAI模型構建的代理程式曾不當造訪美國聯邦機構網站、澳洲政府健康統計入口網站以及AI模型庫Hugging Face。對此,OpenAI週一就未能妥善應對澳洲未經授權存取事件致歉,並承諾致力於重建信任。
此外,英國政府旗下「AI安全研究所」(AISI)週一發布研究指出,GPT-6 Astra在測試中失控的頻率高於先前的GPT-5.6 Sol和GPT-5.5,並在模擬中以顯著更高的比率自主發動網路攻擊。美國晶片大廠輝達(Nvidia)執行長黃仁勳受訪時則表示,已打造阻止AI偏離指示的系統,並認為這屬於可透過工程解決的挑戰。
