AI 戰情報告 (2026-04-14)
昨日 AI 重點新聞
OpenAI 收購個人理財新創 Hiro Finance,佈局 ChatGPT 代理化理財功能 ref-18, ref-108, ref-32
OpenAI 證實已收購 AI 個人理財新創 Hiro Finance。Hiro 將於 4 月 20 日關閉並刪除數據,這標誌著 OpenAI 正在為 ChatGPT 構建原生的金融規劃與預算管理代理,進一步強化其在垂直領域的自動化執行能力。
微軟推動開源代理技術 OpenClaw,旨在實現 Copilot 全天候自主運作 ref-1, ref-102, ref-19
微軟正在測試受 OpenClaw 啟發的 AI 代理功能,目標是讓 Microsoft 365 Copilot 能在後台自主執行長程任務。此計畫代號為「Lobster」,強調與開源社群對標的同時,為企業用戶提供更安全的權限控管機制。
Perplexity AI 營收暴漲至 5 億美元,受益於搜尋代理轉型 ref-109
Perplexity AI 在轉向「代理化搜尋」後,年化收入已突破 5 億美元。相較於傳統搜尋,具備自主推理與資料總結能力的「代理模式」展現出更強的變現潛力。
Anthropic Mythos 模型引發各國監管焦慮,英國展開緊急風險評估 ref-96, ref-106, ref-56
由於 Anthropic 旗艦模型 Mythos 具備極強的零日漏洞挖掘能力,英國與歐盟監管機構表達擔憂。該模型目前僅限於特定組織使用,監管機構擔心其可能對全球金融穩定性造成潛在威脅。
Stanford HAI 報告:生成式 AI 全球採用率達 53%,增速超越 PC 與互聯網 ref-99, ref-20, ref-28
史丹佛大學發布 2026 AI Index 報告,指出 AI 採用率呈現爆炸式增長。報告強調美國在數據中心數量上保持領先,但美中在模型性能上的差距正在迅速縮小,且算力資源正成為地緣政治的關鍵點。
Google 發佈 Gemma 4 開放模型,主打 Android 端側與本地代理推理 ref-46
Google 推出 Gemma 4,這是一組專為本地執行設計的模型,旨在賦予 Android 設備自主代理能力。該模型支援完整的軟體開發生命週期,並能於移動設備端側進行高性能推理。
Cisco 宣佈收購 Galileo,鎖定 AI 代理觀測與安全監控 ref-98
Cisco 擬收購代理觀測平台 Galileo。隨著自主代理在企業中普及,Cisco 認為代理的運行速度已超越人類監控極限,因此需要 AI 驅動的監控系統來確保代理行為的合規與安全。
OpenAI 加入 FIDO 聯盟,推動 AI 代理身份認證標準 ref-18
為了讓 AI 代理能安全地代表用戶執行交易與金流操作,OpenAI 宣佈加入 FIDO 聯盟。此舉旨在建立跨平台的代理身份驗證機制,解決代理在自主操作時的安全門檻問題。
MirrorCode 測試顯示 AI 具備自主重構複雜代碼之能力 ref-9
Epoch AI 的最新基準測試 MirrorCode 顯示,Claude 4.6 等模型能透過 CLI 自主 reimplement 超過 1.6 萬行代碼的複雜程序。這證實了 AI 代理在處理長期工程任務上的效率已逼近資深工程師。
芬蘭新創 Kelluu 獲 1500 萬歐元融資,利用氫能氣船發展物理 AI ref-80
Kelluu 獲得 NATO 創新基金領投,其研製的無人氣船能進行 12 小時以上的持續監控,並將收集的數據回傳至基礎模型,用於環境保護與國防監控,成為「物理 AI」的重要數據源。
亞馬遜雲端 AI 年化營收突破 150 億美元,算力需求持續強勁 ref-13, ref-110
Amazon 執行長指出,受惠於 AI 基礎設施的龐大需求,AWS 的 AI 業務規模已進入極速增長期。這也反映在各國對數據中心建設的瘋狂投入與日益嚴峻的能源瓶頸。
Meta 祖克柏正開發 AI 分身,旨在代替其參加內部會議 ref-52, ref-95
Meta 正在訓練基於馬克·祖克柏形象與語調的 AI 分身 (AI Clone)。該分身具備即時互動能力,初期用於與員工溝通並提供意見回饋,未來可能開放給所有創作者使用。
N-Day-Bench:前沿模型已具備在真實代碼中尋找漏洞的實力 ref-9
新的安全基準測試 N-Day-Bench 顯示,GPT-5 與 Claude 4.6 等模型能通過沙盒自主挖掘 GitHub 熱門倉庫中的已知漏洞。這預示著未來資安攻防將全面進入代理對抗時代。
市場洞察
1. 「代理經濟學」成型:從執行工具轉向具備身分的經濟實體 ( ) ref-18, ref-94, ref-107
延續前幾日對「代理堆疊」的討論,今日 OpenAI 加入 FIDO 聯盟 (ref-57) 與倫敦新創 Ralio 的融資 (ref-96) 共同標誌著 AI 代理正從「對話框」走向「錢包」。當代理具備獨立身份認證與金流操作權限時,AI 將從生產力工具轉化為能自主採購、簽約的經濟實體。這也意味著未來企業間的交易可能在代理層級完成。
2. 本地化 (On-device) AI 的成熟與「物理世界」數據的回收 ( ) ref-46, ref-99, ref-116
Google Gemma 4 (ref-34) 強調 Android 本地推理,結合芬蘭 Kelluu (ref-0) 的物理 AI 數據採集,顯示 AI 的戰場正從雲端中心轉向「端側與實體」。這也印證了 Stanford HAI 報告中提到的:當模型性能達到瓶頸時,競爭焦點將轉向對真實物理數據的理解與本地執行的延遲優化。
3. 軟體工程的自動化極限正在突破「週級任務」 ( ) ref-14, ref-30
MirrorCode 的結果 (ref-30) 顯示 AI 已能處理以往需人類耗時數週的重構任務。這代表「代理編程」已不僅是代碼補全,而是具備系統架構級別的遷移能力。結合 N-Day-Bench (ref-51) 的漏洞自動挖掘,軟體開發的流程將被重塑為:AI 主導開發與測試,人類負責高層級的邏輯治理與安全簽署。