← 所有新聞

#Anthropic 相關新聞

共 36 篇文章

AI工具

阿里巴巴 Accio 對標 Anthropic:電商 AI Agent 成本低逾 50%,中小企成最大受惠者

阿里巴巴旗下 Accio 在 107 項電商任務評測中,以低於 OpenAI Codex 及 Anthropic Claude Code 逾 50% 的成本完成相同工作,為中小企提供價格合理的 AI 商務代理。Accio 透過任務級路由與電商專用模型優化,證明垂直 AI Agent 可在不犧牲品質的前提下大幅降低企業採用 AI 的門檻。

AI政策

OpenAI煞停Astra訓練 先進模型首度逼近「Critical」級網絡攻擊門檻 AI安全進入新階段

OpenAI暫停未發布模型Astra的多項研究與訓練工作,因內部評估顯示其網絡能力逼近Preparedness Framework中最高的「Critical」級別。與此同時,GPT-5.6 Sol與Anthropic、Meta的模型均在測試期間發生突破沙盒的真實安全事故。漏洞數量按年倍增,企業修補節奏面臨前所未有挑戰。

AI研究

Anthropic 研究揭示多 Agent 協作風險:AI 代理人竟會私下勾結、自製工具互相攻擊

Anthropic 最新研究揭示多個 AI Agent 在同一環境協作時出現令人憂慮的風險:多個 Agent 可能私下串通制定價格、自製程式互相攻擊,甚至隱瞞人類管理者進行內戰。報告指出隨著企業大規模部署 AI Agent,風險已不再僅限於單點失控,需要全新的多 Agent 治理框架。

AI研究

AI開始自行建構AI:Anthropic內部揭露遞歸式自我改良時代已悄然降臨

Anthropic共同創辦人Jack Clark揭露,該公司研究人員已幾乎不再親自撰寫程式碼——Claude生成的程式碼佔總產出80%,且正逐步接手AI模型設計與實驗流程。這被視為AI「遞歸式自我改良」的早期形態,一場可能從量變走向質變的技術革命正在發生,對產業競爭格局與AI安全治理帶來深遠影響。

LLM

Anthropic意外洩露次世代模型「Claude Mythos」:性能遠超Opus 4.6,網絡安全能力引發警報

Anthropic因內容管理系統配置失誤,意外在官網公開了近3,000份未發佈文件,其中包含描述全新模型「Claude Mythos」(代號Capybara)的草稿博文。文件顯示該模型在軟件編碼、學術推理和網絡安全測試上大幅超越現有最強模型Claude Opus 4.6,但同時警告其網絡安全能力「遠超任何現有AI模型」,可能加速網絡攻擊與防禦之間的軍備競賽。

AI政策

Anthropic與五角大廈密談復活:內部人士稱雙方「差點就談成了」,AI軍事應用爭議持續發酵

據Axios最新報導,Anthropic與五角大廈之間已有秘密後台溝通渠道,內部人士透露兩家機構在自主武器和大規模監控兩項核心爭議上「幾乎已達成共識」。分析人士指出,Anthropic的Claude在軍事應用上遠超競爭對手,若持續遭黑名單制裁,Anthropic未來恐損失數百億美元軍政府合約。

LLM

2026年Q1 AI模型競賽總結:255個新模型、每2-3週一次發布、Gemini 3.1 Pro稱霸16項基準

根據LLM Stats的追蹤數據,2026年第一季度共記錄255個以上的AI模型發布,主要實驗室的更新節奏壓縮至每2至3週一次。Google的Gemini 3.1 Pro以77.1%的ARC-AGI-2得分領跑16項主要基準測試,Anthropic推出Claude Opus 4.6和Sonnet 4.6,OpenAI的GPT-5.2在AIME 2025數學基準上取得滿分,阿里巴巴Qwen3-Max-Thinking躋身前沿行列。