所有 AI 新聞
第 15 頁,共 40 頁 · 共 398 篇文章
LLM
DeepSeek-V4 開放權重並支援百萬 Token 長上下文,強化代理式工作流
DeepSeek-V4 以混合注意力與壓縮 KV cache 的設計,把長上下文帶入可用成本範圍,並釋出多個開放權重模型。
AI研究
Google TurboQuant:以極端量化壓縮 KV cache,提升長上下文推論效率
Google 提出 TurboQuant 量化方法,以低位元壓縮 KV cache 並維持準確度,目標是降低長上下文推論的記憶體與運算成本。
AI硬體
Meta 與 Broadcom 共研自訂 AI 晶片:MTIA 路線圖瞄準推薦與生成式推論
Meta 擴大與 Broadcom 的合作,共同開發多代自訂加速器與網路技術,提升 AI 叢集效率與成本表現。
AI工具
Google更新Gemini體驗:Search Live全球擴展與Personal Intelligence強化個人化
Google整理近期AI更新,包含Search Live擴展、AI Mode新功能與更深度的個人化資料連結。