AI 戰情報告 (2026-04-08)
昨日 AI 重點新聞
Anthropic 發表 Claude Mythos,因具備毀滅性漏洞挖掘能力拒絕公開 ref-77, ref-0, ref-4, ref-1
Anthropic 正式確認 Claude Mythos Preview 模型的存在,但宣稱其能力「過於強大」以至於無法 GA 發佈。該模型在測試中自動發現了數千個零日漏洞 (Zero-day),包含 OpenBSD 中隱藏 27 年 的 Bug,並能自主鏈接漏洞實現 Root 權限獲取。為此 Anthropic 啟動 Project Glasswing,僅限 Apple、Cisco 等少數夥伴用於防禦性掃描。
Anthropic 營收跑率突破 300 億美元,並鎖定 3.5GW 算力供應 ref-93, ref-81, ref-40
Anthropic 宣佈其 ARR 從三月的 190 億美元激增至四月的 300 億美元,成長速度驚人。同時,該公司與 Broadcom 及 Google 擴大合作,確保 2027 年起擁有 3.5GW 的 TPU 算力產能,顯示 AI 巨頭對底層能源與算力資源的爭奪已達電網級別。
OpenAI 推廣「裝具工程」,實現百萬行代碼無人類審核 ref-9, ref-30
OpenAI 工程師 Ryan Lopopolo 詳述了 OpenAI Frontier 團隊的運作模式:透過「裝具工程 (Harness Engineering)」,團隊管理超過 100 萬行 由 AI 撰寫的代碼,且 0% 人類審核。該系統每日消耗 10 億個 Token 進行自我驗證,宣稱「不使用 AI 進行大規模開發是失職的」。
Perplexity ARR 突破 4.5 億美元,受益於代理工具與計費轉型 ref-57
AI 搜尋平台 Perplexity 在三月實現 50% 的營收增長,ARR 達到 4.5 億美元。這主要歸功於其新推出的代理搜尋工具(Agent tool)以及從單一訂閱轉向更具彈性的按量計費 (Usage-based pricing) 模式,成功吸引大量企業級用戶。
Amazon S3 Files 發表:為 AI 代理打造雲端原生文件系統 ref-39
AWS 推出 S3 Files,解決了長期以來對象儲存 (Object Store) 不利於 AI 代理操作的問題。透過支持 NFS v4.1,AI 代理現在能以 1ms 的延遲直接對 S3 數據進行原地編輯、重新命名與文件鎖定,這對處理大規模代碼分析與資料流水線的代理至關重要。
代理資安新創 Trent AI 與 Narwhal Labs 合計融資逾 3500 萬美元 ref-124, ref-108
Trent AI(1300 萬美元)與 Narwhal Labs(2290 萬歐元)宣佈獲投,專注於解決代理安全 (Agentic Security)。Narwhal Labs 推出的 DeepBlue OS 採用「玻璃盒架構 (Glass Box)」,確保 AI 代理的所有通訊與決策路徑均可被人類審計、追蹤。
Z.ai GLM-5.1 正式上線:挑戰長程複雜任務能力 ref-18, ref-31, ref-23
中國模型廠商 Z.ai (智譜 AI) 推出 GLM-5.1 (754B),並同步調漲 API 價格約 8%。該模型在 Vercel AI Gateway 上線,主打「長航程自主任務」,能持續數小時進行規劃、執行與自我修正,並能生成高品質的 SVG 動畫與 Office 文檔。
Intel 加入馬斯克 Terafab 計劃,合建 200 億美元 AI 晶片廠 ref-87, ref-37, ref-142, ref-140
Intel 宣佈加入由 SpaceX、Tesla 與 xAI 主導的 Terafab 計畫,將在德州建造巨型半導體廠。目標是實現 1 Terawatt 等級的 AI 晶片產出,為未來的機器人大軍與太空資料中心提供硬體支持。
Google 發表離線 AI 聽寫 App,利用 Gemma 實現本地隱私 ref-34
Google 低調推出一款基於 Gemma 模型的 iOS 聽寫 App,主打 100% 離線運作。這顯示 Google 正利用其端側模型優勢,直接挑戰如 Wispr Flow 等需連網的 AI 產品,強化用戶隱私保護。
xAI Grok 4.20 上線 Vercel:推出多代理編排變體 ref-22
xAI 的旗艦模型 Grok 4.20 已在 AI Gateway 提供三種版本:推理型、非推理型與多代理型 (Multi-Agent)。其中多代理版本專為代理間的協作與衝突解決設計,展現極強的工具調用精確度。
Spotify 2025 Wrapped 利用 AI 生成 14 億份個人化報告 ref-67
Spotify 工程團隊透露,其 2025 年的年度回顧系統已能為 3.5 億 用戶生成總計 14 億份 具備敘事性的個人化報告。此案例展示了 AI 在極大規模數據下如何實現「敘事化洞察 (AI Narratives)」,同時也引發隱私追蹤的廣泛討論。
PyTorch 基金會接納 Safetensors 作為安全模型執行標準 ref-115
為應對模型權重中潛藏的惡意代碼風險,PyTorch 宣佈將 Safetensors 納入正式貢獻專案。這將推動企業全面淘汰易受攻擊的 Pickle 格式,確保 AI 代理在加載模型時的底層安全。
市場洞察
1. AI 攻防失衡:防禦性 AI 聯盟成為企業必需品 ( ) ref-77, ref-0, ref-4, ref-1
延續昨日對代理權限管理的討論,今日 Anthropic Claude Mythos 的出現 (ref-13) 證明了 AI 挖掘零日漏洞的能力已超越人類。這導致「防禦視窗」極速縮小,企業若不加入如 Project Glasswing (ref-108) 之類的 AI 協同防禦體系,將面臨極高的供應鏈風險。這與過去 7 天提到的資安漏洞激增趨勢高度吻合。
2. 軟體工程的「黑燈工廠化」:從寫代碼轉向寫驗證 ( ) ref-133, ref-137, ref-16
OpenAI 展示的 100 萬行代碼無人審核案例 (ref-50),以及 Vercel 提到利用代理提升效能 96% 的過程 (ref-140),預示著開發者角色將徹底轉變。未來工程師不再是「作家」,而是「裝具設計師」。這與前日提到 Cursor 3 轉型為代理控制台 (ref-3) 的邏輯一致:核心競爭力在於如何建立能自動約束、測試 AI 產出的「驗證框架」。
3. 計費模式與 ROI 的重新對齊:轉向按量與價值計費 ( ) ref-17, ref-57, ref-93, ref-29
Perplexity ARR 的飆升 (ref-25) 與 Z.ai 的漲價 (ref-17) 顯示出市場已接受「代理創造價值」的溢價。當 AI 能自主完成任務(如 Claude Opus 4.6 Fast Mode (ref-147)),企業寧可支付 6 倍費用以換取即時結果。這呼應了前日提到的「利潤懸崖」問題:高效能代理服務正逐漸脫離低價補貼,進入價值導向的商業成熟期。