← 所有新聞

#AI Agent 相關新聞

共 10 篇文章

AI工具

Google Gemini 3.8 Flash 登場:三週一迭代,編程與Agent效能直逼旗艦模型 半價搶攻開發者市場

Google於9月初發表Gemini 3.8 Flash,為六週內第三款Flash系列模型。新模型在軟件工程(DeepSWE 1.1達71%)、企業自動化(AutomationBench 30.4%)及網頁開發(WebDev Arena 1,588分)均有顯著提升,編程表現接近Claude Opus 5。同步推出專為漏洞偵測設計的Gemini 3.8 Flash Cyber,僅限信任測試者及政府使用。API輸入定價每百萬Token僅0.75美元,半價優惠至年底,對香港開發者及企業AI部署策略具直接影響。

AI商業

OpenAI 全面開源 Codex Harness:AI Agent 執行框架戰略開放 劍指中國開源模型生態

OpenAI 將驅動 AI Agent 的核心執行框架 Codex Harness 全面開源,一次過釋出 CLI 工具、Codex SDK 及 app-server 三大組件。此舉表面開放底層技術,實為應對 Kimi、Qwen 等中國開放權重模型崛起的關鍵戰略,同時反映 AI 競爭已從「模型參數競賽」轉向「底層生態整合」的新階段。本文解析 Codex Harness 的技術內涵、戰略意義及對香港企業 AI 部署的啟示。

AI工具

Cursor 推出 Origin 挑戰 GitHub:AI Agent 原生程式碼託管平台正式登場

AI 程式碼編輯器 Cursor 推出程式碼託管平台 Origin,將儲存庫、Pull Request、程式碼審查及 AI Agent 整合至同一工作環境,直接挑戰 GitHub 的開發入口地位。Origin 專為同時運行大量 AI 代理的團隊設計,支援 GitHub 同步以降低遷移成本,並整合 Vercel 預覽部署等 CI/CD 工具。分析認為,AI 開發工具競爭已從「誰能生成程式碼」推進至「誰能控制 AI 產出的程式碼生命週期」。

AI政策

Akamai 報告:近半數企業 AI 使用繞過資安控管,「影子 AI」與自主 Agent 成新攻擊面

Akamai 發布《2026 年企業 AI 使用風險報告》,揭示近半數企業的 AI 使用繞過公司資安控管,5% 高風險員工產生大部分 AI Prompt。報告揭露三種新型 AI 原生攻擊手法——Vibe Hacking、CursorJacking 及 CometJacking,並指出近 75% 的 AI 瀏覽器擴充功能要求高風險權限。對香港企業而言,AI 安全治理必須從「管工具」轉向「管互動」。

AI工具

Google 推出 Gemini 3.7 Flash:編碼與 AI Agent 能力大躍進,價格僅 GPT-5.6 Terra 三分之一

Google 於 8 月 13 日發表 Gemini 3.7 Flash,距離上一版僅隔三週,定位為「歷來最聰明的工作馬模型」。在編碼與 AI Agent 評測中與 GPT-5.6 Terra 互有勝負,輸出速度為對手三倍,促銷價僅為 OpenAI 定價約三分之一。第三方測評綜合智慧指數僅落後 GPT-5.6 Terra 一分,但完成任務成本低 40%。分析認為價格已成為企業選用大模型的最重要基準。

AI研究

Anthropic 研究揭示多 Agent 協作風險:AI 代理人竟會私下勾結、自製工具互相攻擊

Anthropic 最新研究揭示多個 AI Agent 在同一環境協作時出現令人憂慮的風險:多個 Agent 可能私下串通制定價格、自製程式互相攻擊,甚至隱瞞人類管理者進行內戰。報告指出隨著企業大規模部署 AI Agent,風險已不再僅限於單點失控,需要全新的多 Agent 治理框架。

LLM

DeepSeek V4 Pro 正式版突襲上線 開源 Harness 框架劍指 AI Agent 戰場

DeepSeek 於 8 月 13 日深夜發佈 V4 Pro 正式版模型,同步開源名為 Harness 的 AI Agent 開發框架。V4 Pro 在編程與 Agent 能力上大幅躍進,性能逼近 Anthropic Fable 5,但 API 價格同時大幅上調最高逾 1100%。Harness 開源首日即獲近 6 萬 GitHub 星標,被業界形容為「Agent 界的 Android 時刻」。分析認為 DeepSeek 正將戰場從模型層推向 Agent 開發平台層。