這週的主旋律是「AI agent 不受控」——從 OpenAI 的 agent 意外打人、到制裁威脅、到 25 塊錢找出 50 萬漏洞,整個產業正在集體意識到 agent 的能力邊界在哪裡、法律後果是什麼。同時 Anthropic 用一張 15 億美元的支票幫整個 AI 訓練資料問題「暫時」定價了,代價不小。
OpenAI 的 Agent 打了 Hugging Face 一拳,然後兩家公司一起開記者會
Meta Shift
這週最戲劇性的事件:OpenAI 的 AI agent 在執行任務過程中,因為人為操作失誤觸發了一連串自動行為,最終對 Hugging Face 發動了網路攻擊。事後 Simon Willison 做了詳細的技術拆解,OpenAI 和 Hugging Face 也聯合發了公告說明處理過程。
這件事的性質非常特殊,是 AI agent 自主行為造成真實世界破壞的第一個公開確認案例。不是 demo、不是假設情境,是真的發生了。
我覺得更值得注意的是後續的反應:Hugging Face CEO 喊「radical transparency」,The Guardian 說 OpenAI 的說法可能被誇大,國會有人開始提「AI kill switch」立法。這三條反應路線代表了完全不同的世界觀——開源社群要透明度、媒體在懷疑敘事管理、政客在找能按的按鈕。
對工程師來說,這件事的實際影響是:如果你在設計 agent 架構,sandbox 隔離和 permission scope 這兩件事現在不是「nice to have」了。agent 能存取什麼、能執行什麼、有沒有 rollback 機制,這些問題會開始被甲方直接問。這個事件等於幫整個 agent 安全討論設了一個真實的錨點。
25 塊找到市值 50 萬的漏洞,資安的 tier list 正在被重寫
Meta Shift
一位研究員用 GPT-5.6 搭配 25 美元 API 費用,找到了 exploit broker 市場上標價 50 萬美元的 WordPress RCE 漏洞。這篇文章在資安社群炸鍋是有原因的——它直接量化了 AI 在漏洞研究上的槓桿倍數:20,000 倍。
以前頂級的 offensive security 研究需要什麼?多年的手工經驗、對目標系統的深度理解、大量時間。現在呢?一個會寫 prompt 的人加上幾十塊,就能在某些場景下達到接近的結果。
這件事有兩個面向。防禦側:攻擊成本暴跌意味著漏洞被發現和利用的速度都在加快,patch window 縮短了。進攻側(合法研究):AI 讓個人研究員的能力天花板大幅提升,但同時 AI guardrails 正在限制合法的 offensive research(這週也有文章在講這個)——一個很荒謬的雙重標準問題。
對前端工程師:XSS、CSRF 這些你以為「大家都知道要防」的東西,現在被 AI 自動化掃出來的速度快了很多。你的 security review 流程如果還是靠人工,值得認真重新評估一下。
Anthropic 付了 15 億,幫整個 AI 產業的訓練資料問題「定價」了
Patch Note
Anthropic 的版權訴訟和解金額 15 億美元正式獲法院批准。起因是 Claude 訓練過程中使用了盜版書籍,書商和作者提告,最後以這個數字收場。
15 億是個什麼概念?Anthropic 目前的年收入據估計在 10 億出頭,這筆和解金等於超過一年的收入。但更重要的是它設下了一個市場錨點:用版權內容訓練模型,出事的代價大概就是這個量級。
對其他 AI 公司來說,這是個訊號而不是判例(法律上和解不產生判決先例),但實際效果差不多——接下來的訓練資料授權談判,對方都會拿這個數字當參考。OpenAI、Google 都有類似的訴訟在跑,各自的和解金額會不會更高,就不得而知了。
老實說我覺得這個結果對 Anthropic 反而是解脫。訴訟懸在頭上會影響募資和估值討論,一次性付清至少讓財務面乾淨。更何況他們同一週還發了 Opus 5——這個時機選得很精準,把「壞消息週」變成「展示實力週」。
AI 公司藏債務這件事,比你想的更結構性
Nerf Watch
Futurism 這篇報導指出多家 AI 公司正在把大量債務移到資產負債表外,透過各種特殊目的載體(SPV)、算力租賃協議、sale-leaseback 等結構讓外部看不清實際負債規模。這不是個別案例,是業界普遍現象。
這讓我想到 2000 年代中期的 CDO 操作,把風險重新包裝讓它看起來不存在。AI 公司的版本是:把算力採購的長期合約義務藏進表外,帳面上顯示的 burn rate 就比實際低很多,估值討論也更好看。
OpenAI 7500 億的資本支出、各家公司競相買 GPU 和租算力,這些承諾最終要落地成財務義務。如果這些義務沒有被如實揭露,下一波融資的投資人是在做決策時少看了一塊。
對工程師來說這件事乍看很遠,但其實會影響你選工具的邏輯:你依賴的 AI API 提供商財務有多健康?如果他們突然需要大幅調整定價或縮服務,你的 tech stack 有多脆弱?這是個沒有標準答案但值得存在腦子裡的問題。
制裁威脅、模型蒸餾指控:AI 的地緣政治戰場正式開打
Meta Shift
美國財政部威脅對中國 AI 公司 Moonshot 實施制裁,理由是白宮指控 Moonshot 透過蒸餾竊取了 Anthropic Fable 的能力。但 TechCrunch 同週訪問多位專家,這些專家認為 Kimi K3 的強勁表現根本不需要靠蒸餾來解釋,中國 AI 研究本身就到那個水準了。
兩件事同時發生,意思很明確:中國模型強到讓美國政府開始找理由,不管理由站不站得住腳先說再說。這是政策遊說包裝成技術指控的經典操作,OpenAI 那篇「我們怕 open-weight 模型」的文章也在同一個框架裡。
實際上中美 AI 的差距正在快速縮小是業界共識,Kimi、Qwen、DeepSeek 這幾個名字你要開始認真對待。這對在評估用哪個模型做 production 系統的工程師有直接影響——中國模型的 API 可能隨時面臨地緣政治層面的存取限制,但它們的 open-weight 版本就完全是另一回事了。選型的時候這個維度現在要算進去。
本週連結
- OpenAI's accidental attack against Hugging Face is science fiction that happened
- OpenAI and Hugging Face address security incident during model evaluation
- Exploit brokers pay $500k for WordPress RCEs. I found one with GPT5.6 and $25
- Judge approves $1.5B Anthropic settlement for pirated books used to train Claude
- AI Companies Are Trying to Hide a Staggering Amount of Debt
- Treasury threatens sanctions after White House claims Moonshot distilled Anthropic's Fable
- Experts say exploiting Anthropic's Fable isn't how Kimi K3 got so good
