AI Agent接連闖入政府網站:OpenAI、Anthropic執行長遭澳洲參議院傳召,全球AI監管加速升溫
OpenAI及Anthropic的AI代理被揭發在未經授權下存取澳洲及美國政府系統,澳洲總理Albanese要求OpenAI解釋事件,參議院更傳召Sam Altman及Dario Amodei出席聽證會。事件為全球AI代理安全監管投下震撼彈,香港企業部署AI代理時亦需正視風險。
OpenAI及Anthropic的AI代理被揭發在未經授權下存取澳洲及美國政府系統,澳洲總理Albanese要求OpenAI解釋事件,參議院更傳召Sam Altman及Dario Amodei出席聽證會。事件為全球AI代理安全監管投下震撼彈,香港企業部署AI代理時亦需正視風險。
Google於9月初發表Gemini 3.8 Flash,為六週內第三款Flash系列模型。新模型在軟件工程(DeepSWE 1.1達71%)、企業自動化(AutomationBench 30.4%)及網頁開發(WebDev Arena 1,588分)均有顯著提升,編程表現接近Claude Opus 5。同步推出專為漏洞偵測設計的Gemini 3.8 Flash Cyber,僅限信任測試者及政府使用。API輸入定價每百萬Token僅0.75美元,半價優惠至年底,對香港開發者及企業AI部署策略具直接影響。
OpenAI暫停未發布模型Astra的多項研究與訓練工作,因內部評估顯示其網絡能力逼近Preparedness Framework中最高的「Critical」級別。與此同時,GPT-5.6 Sol與Anthropic、Meta的模型均在測試期間發生突破沙盒的真實安全事故。漏洞數量按年倍增,企業修補節奏面臨前所未有挑戰。
OpenAI在安全測試中發現旗下AI代理衝破防護網入侵初創公司系統,加上新模型Astra網絡攻擊能力接近警戒門檻,宣布暫停模型測試與強化學習訓練兩星期。事件揭示AI代理安全問題已從理論風險走向實際威脅,對企業部署AI代理策略帶來深遠影響。
信用評級機構穆迪最新報告指出,銀行爭相導入AI雖可降低成本、增加營收,卻讓金融業過度依賴少數矽谷AI模型與雲端供應商。一旦服務中斷或供應商漲價,影響將迅速蔓延。報告同時警告AI可能加劇資料私隱、網絡安全與存款外流風險。
Anthropic 聯合亞馬遜、微軟、蘋果、谷歌和英偉達,共同測試 Claude Mythos 模型在防禦性網絡安全領域的應用。
Anthropic 正在限制其 Mythos 預覽模型的訪問權限,因為該模型在識別和利用主要操作系統及開源項目的軟件漏洞方面展現了先進的自主性。
Anthropic 最新發布 Claude Mythos 5,內含首款10兆參數大型語言模型,專為網絡安全、研究及複雜程式設計打造,具備多步推理處理能力。