AI 戰情報告 (2026-04-06)
昨日 AI 重點新聞
OpenAI 與 Anthropic 財務文件曝光:推理成本超過營收 50% ref-6
OpenAI 與 Anthropic 近期向投資者展示的盈利預測顯示,龐大的算力支出仍是主戰場。儘管營收持續成長,但推理成本(Inference costs)已佔據營收的一半以上,這迫使兩家公司在融資時必須提供包含與不含訓練成本的兩種利潤版本,以說服市場其商業模式的可持續性。
Anthropic 意外揭露旗艦模型 Claude Mythos,隨即爆發源碼洩漏事故 ref-86, ref-6
Anthropic 誤在官網顯露其研發中最強模型 Claude Mythos,雖然官方迅速撤下,但已引發業界對「Mythos」是否為超越 Sonnet 系列的旗艦期待。不幸的是,數日後 Anthropic 又發生編程工具的原始碼外洩事件,延續了昨日報告中提到的企業安全隱患,對其商譽造成連鎖打擊。
Cursor 3 正式發布:從「AI 編輯器」轉型為「代理編排主控台」 ref-3, ref-4
年營收突破 20 億美元 的 Cursor 發表了全新 Cursor 3(代號 Glass)。該版本將 IDE 的傳統編輯功能降級為「備選選項」,主介面全面轉向代理管理 (Agent Orchestration),讓工程師像管理艦隊一樣調度 AI 代理跨多個 Repo 運作,正式向 Claude Code 發起全面反攻。
Google 推出 AI Edge Gallery:Gemma 4 模型在 iPhone 實現高速本地推理 ref-18, ref-3, ref-80
Google 發布了官方 App「AI Edge Gallery」,這是主流模型廠商首次在 iOS 平台提供完整的本地運作體驗。Gemma 4 模型(2B 與 4B 尺寸)在 iPhone 上展現了驚人的速度,並具備圖像問答、語音轉錄及與 HTML 插件互動的工具調用能力。
Perplexity 發表 Personal Computer 雲端代理,實現 Mac 端的全自動操作 ref-84, ref-1
AI 搜尋巨頭 Perplexity 發表了一款運行於 Mac 的雲端 AI 代理。該代理能跨軟體執行任務,與 Anthropic 的「Computer Use」機制競爭,旨在將傳統電腦操作轉化為對話式代理導向的工作流。
Microsoft Maia 200 AI 晶片問世,全面挑戰 Nvidia 資料中心主導權 ref-102
微軟 發表自研 Maia 200 晶片,專為大型模型推理與訓練優化。此舉被視為減少對 Nvidia 依賴的關鍵戰略,並宣稱在自家的 Azure 資料中心環境下,效能與成本效益已逼近現有的頂級 GPU。
Netflix 推出 VOID 視覺語言模型,實現影片物件的物理感知編輯 ref-32
Netflix 釋出 VOID 模型,其特色在於「物理感知」。當模型從影片中擦除某個物件時,它能模擬剩餘物件在物理規律下的後續行為(例如撤除重物後地面的反應),顯著提升了影片後製的自然度與自動化潛力。
Nvidia 預計 2027 年 AI 營收將達 1 兆美元,Rubin 架構明年接棒 ref-92, ref-65
Nvidia 宣稱其 AI 相關收入將在 2027 年突破 1 兆美元。隨著 Blackwell 架構普及與明年 Rubin 架構的推出,Nvidia 正在將戰場從純 GPU 擴展到軟硬體整合的 AI 代理生態系。
DeepMind 警示「AI 代理陷阱」:研究指出駭客可將代理武器化 ref-74, ref-75
DeepMind 發表最新論文探討 AI Agent Traps,揭露攻擊者如何誘導 AI 代理執行惡意指令。這與 Drift 遭受的 2.85 億美元 社交工程攻擊邏輯不謀而合,再次拉高了企業對代理權限管理的資安預警。
德國警方偵破 REvil 與 GandCrab 勒索軟體集團核心成員身份 ref-67, ref-68
德國聯邦警察 (BKA) 成功識別出代號為 UNKN 的主謀 Daniil Shchukin。該集團曾主導超過 130 起勒索攻擊,此次跨境偵查的成功被視為網路犯罪打擊的里程碑,但也揭示了這些駭客過去數年如何利用 AI 工具精進其攻擊手段。
Alibaba 發表新型 Agentic AI 專用晶片,瞄準邊緣端自主代理市場 ref-104
雖然面臨市場信任危機,阿里巴巴 持續推動硬體革新,發布專為代理任務設計的晶片。此晶片旨在優化「決策與工具調用」的反應速度,但投資者對其在安全合規下的盈利能力仍持觀望態度。
Target 警告:AI 購物代理的錯誤成本將由消費者負擔 ref-100
零售巨頭 Target 在其 AI 購物助理的服務條款中加入免責聲明。若 AI 代理在購物建議或下單過程中產生昂貴錯誤,公司不予承擔。這顯示出 B2C 企業在推動代理化時,仍難以完全克服模型的幻覺責任問題。
富士通 Rapidus 將於日本生產 1.4nm 全國產 AI 晶片 ref-103
Fujitsu 計畫由日本半導體國家隊 Rapidus 代工生產 1.4nm AI 晶片。此計畫旨在建立完全脫離外部地緣政治干擾的「主權 AI 供應鏈」,確保日本在下一代算力競賽中的領先地位。
Foxconn 投資比利時 Magnax,布局 AI 驅動的電動馬達技術 ref-71
鴻海 (Foxconn) 參與了 Magnax 3550 萬歐元的融資。此舉不僅是為了電動車,更計畫將其軸向磁通馬達技術應用於 AI 資料中心的熱能管理與機器人系統,顯示 AI 基礎設施的硬體競爭已深入基礎零件層。
Mercor 證實 100 億美元規模的數據外洩案,波及 OpenAI 與 Anthropic ref-6
數據供應商 Mercor 承認發生重大資安事故。由於其數據涉及眾多主流模型的微調與工程偏好,此事件引發了 AI 訓練供應鏈的二次信任危機,加劇了企業對數據外派的疑慮。
市場洞察
1. 「代理編排」取代「模型介面」成為軟體開發的新主戰場 ( ) ref-88, ref-3, ref-4
延續前日對 Claude Code 原始碼外洩的觀察,今日 Cursor 3 的發布 (ref-91) 確認了一個重大趨勢:軟體開發工具的價值正從「產出程式碼」移向「編排與管理代理 (Agent Management)」。當開發者花費 80% 的時間在審核代理產出時,IDE 已不再是編輯器,而是控制平面 (Control Plane)。這與前日提到代理轉向「作業系統層級」的脈絡一致 (ref-47, ref-91)。
2. 推理成本的「利潤懸崖」推動邊緣 AI (On-device) 加速落地 ( ) ref-6, ref-97, ref-1
OpenAI 與 Anthropic 推理成本佔營收過半的現實 (ref-1),是廠商迫切將負擔轉嫁至「用戶端硬體」的根本動力。Google AI Edge Gallery (ref-25) 的成功證明,2B 到 4B 規模的小模型已能在移動端執行具備工具調用 (Tool use) 能力的複雜任務。市場正從「大模型解決一切」轉向「雲端決策、邊緣執行」的混合架構。
3. AI 代理安全從「軟體防護」延伸至「社交工程與物理防禦」 ( ) ref-75, ref-77, ref-84
昨日提到的中東資料中心安全問題 (ref-15, ref-80),今日演變為對 AI 代理本身的攻擊研究 (ref-26)。Drift 遭北韓社交工程攻擊 (ref-72) 顯示,即便技術防線再強,針對「開發者與代理權限」的攻擊已能造成數億美元損失。這預示著代理身分驗證 (Agent Identity) 將成為 2026 年企業資安的硬性標配。