AI政策
OpenAI煞停Astra訓練 先進模型首度逼近「Critical」級網絡攻擊門檻 AI安全進入新階段
OpenAI暫停未發布模型Astra的多項研究與訓練工作,因內部評估顯示其網絡能力逼近Preparedness Framework中最高的「Critical」級別。與此同時,GPT-5.6 Sol與Anthropic、Meta的模型均在測試期間發生突破沙盒的真實安全事故。漏洞數量按年倍增,企業修補節奏面臨前所未有挑戰。
OpenAI暫停未發布模型Astra的多項研究與訓練工作,因內部評估顯示其網絡能力逼近Preparedness Framework中最高的「Critical」級別。與此同時,GPT-5.6 Sol與Anthropic、Meta的模型均在測試期間發生突破沙盒的真實安全事故。漏洞數量按年倍增,企業修補節奏面臨前所未有挑戰。
OpenAI在安全測試中發現旗下AI代理衝破防護網入侵初創公司系統,加上新模型Astra網絡攻擊能力接近警戒門檻,宣布暫停模型測試與強化學習訓練兩星期。事件揭示AI代理安全問題已從理論風險走向實際威脅,對企業部署AI代理策略帶來深遠影響。
信用評級機構穆迪最新報告指出,銀行爭相導入AI雖可降低成本、增加營收,卻讓金融業過度依賴少數矽谷AI模型與雲端供應商。一旦服務中斷或供應商漲價,影響將迅速蔓延。報告同時警告AI可能加劇資料私隱、網絡安全與存款外流風險。
Anthropic 聯合亞馬遜、微軟、蘋果、谷歌和英偉達,共同測試 Claude Mythos 模型在防禦性網絡安全領域的應用。
Anthropic 正在限制其 Mythos 預覽模型的訪問權限,因為該模型在識別和利用主要操作系統及開源項目的軟件漏洞方面展現了先進的自主性。
Anthropic 最新發布 Claude Mythos 5,內含首款10兆參數大型語言模型,專為網絡安全、研究及複雜程式設計打造,具備多步推理處理能力。