路透:OpenAI發現更多AI代理失控案例 專家憂管控水平跟不上
路透社8月1日引用知情人士消息報道,OpenAI在調查智慧體失控入侵科技公司Hugging Face事件時,發現了數宗其他AI代理突破封閉測試環境、脫離管控的案例。
報道指,OpenAI正聯合外部專家複盤今年早期日誌,核查事件細節。OpenAI發言人周二表曾示,公司正在檢視旗下模型「更廣泛的活動」,範圍不僅限於Hugging Face遭入侵一案。
此次調查碰上競爭對手Anthropic曝光安全事故,公司模型自四月起多次引發資料洩露,致三家公司受損。
有專家指出,相關開發人員的水準「並沒有跟上步伐」,無法負責任地確保AI發展的安全。OpenAI和Anthropic未有效即時監測失控智慧體,安全審查機制存在明顯漏洞。
美國總統特朗普(Donald Trump,又譯川普)周四(7月30日)表示正在研究管控措施;歐盟委員會周五表示已與OpenAI和Anthropic進行會談。同時,業界也呼籲針對先進AI模型落地強制性能力測試,完善行業監管規範。
路透社指,目前還不確定OpenAI究竟查出多少宗事件,也無法確認這些事件發生的確切時間或情況。
AI再傳安全風險 Anthropic認測試期間「暴走」入侵三家外部機構美國務院大會報告展示錯誤非洲地圖 路透: OpenAI製圖鬧烏龍OpenAI失控引擔憂 奧特曼和黃仁勳將赴華盛頓見參議員OpenAI智能體首次自主發動攻擊 失控變「黑客」入侵其他科技公司