LLM
DeepSeek V4 發布:1兆參數MoE模型,訓練成本低至520萬美元
新一代大型語言模型 DeepSeek V4 亮相,採用1兆參數稀疏專家模型(MoE),開放 Apache 2.0 授權權重,訓練花費僅520萬美元,展現與美國前沿模型媲美的競爭力。
第 25 頁,共 36 頁 · 共 353 篇文章
新一代大型語言模型 DeepSeek V4 亮相,採用1兆參數稀疏專家模型(MoE),開放 Apache 2.0 授權權重,訓練花費僅520萬美元,展現與美國前沿模型媲美的競爭力。
Google DeepMind 最新推出 Gemini 3.1 系列,旗艦版本 Gemini 3.1 Ultra 在 GPQA Diamond 基準測試中獲得94.3%高分,並新增原生多模態推理功能,同時發表效能更快的 Gemini 3.1 Flash-Lite。
Google 最新 TurboQuant 演算法在記憶體管理領域帶來重大革新,實現鍵值快取記憶體使用量同比降低6倍,注意力機制計算速度提升8倍,且無任何準確度損失。
OpenAI 全新 GPT-5.4「Thinking」版本正式亮相,引入持續計算能力,提升系統於操作系統層面解決複雜問題的表現,在 OSWorld-Verified 原生電腦操作測試中取得75.0%成績。
太空探索科技公司 SpaceX 宣布以2500億美元收購人工智慧新創公司 xAI,後者旗下 Grok 4.20 採用四代理協作系統,非幻覺率達78%,此舉將重塑AI產業格局。