
Anthropic 不靠新模型,靠 workflow 來搶科學家市場 — 這招對嗎?
Anthropic 賭的不是更強的模型,是 workflow
> Meta Shift
Anthropic 上週發布了 Claude Science,但這次沒有新模型、沒有新 benchmark、沒有更強的生物推理能力。官方直接說清楚:「這不是一個新的 AI 模型,也不是更強的生物模型,它跑的是所有人都已經能用的 Claude 模型(包含 Claude Opus 4.8),沒有特殊 access、沒有任何 gating。」
這段聲明其實很有意思。在 AI 軍備競賽打得最激烈的時間點,Anthropic 選擇用 workflow 而不是模型本身來切入科學家市場。這個決定背後,藏著一個比模型能力更有趣的商業判斷。
Claude Science 是一個給科學研究用的 AI workbench,整合了超過 60 個科學資料庫,有預建好的 toolkit 針對基因組學(genomics)、蛋白質結構、化學等領域,還有一個內建的 fact-checker agent 負責在送出論文前確認引用和計算的正確性(來源:TechCrunch)。架構上是 multi-agent:一個主 AI 當 project manager,可以拆解任務給 sub-agent,或轉交給使用者自己建的 custom expert assistant。
跑在機構自己的 infrastructure 上、不把資料送到 Anthropic server,這個設計對科研環境來說基本上是必要條件,不是加分項。
這件事為什麼重要?因為它代表 Anthropic 正在複製 Claude Code 的邏輯 — 先在某個垂直領域做到成為「operating layer」,而不是繼續在通用 benchmark 上跟 OpenAI、Google 拚數字。這是策略轉向的訊號,不只是產品更新。
商業模式拆解:賣 workflow,不賣算力
先講 Anthropic 現在的整體局面。根據多份報導,Anthropic 2025 年的 ARR 估計超過 30 億美元(來源:多份財經媒體報導),目前估值約 610 億美元,但燒錢速度也快,模型訓練的成本壓力是真實存在的。在這個背景下,往垂直市場走是很合理的財務決策 — 垂直 SaaS 的利潤率通常比通用 API 高,客戶黏著度也高很多。
Claude Science 鎖定的是科學研究機構、藥廠、生技公司。這些客戶有幾個特點:
- 預算大,enterprise 合約動輒百萬美元年費
- 對資料安全敏感,願意為 on-prem 或 private deployment 付溢價
- workflow 一旦建好、pipeline 一旦跑通,換供應商的成本極高
從早期用戶來看,Allen Institute 的神經科學家用 Claude Science 建了 multi-agent 的 computational review pipeline,UCSF Brain Tumor Center 用它把 glioma 的 germline analysis 壓縮到原本時間的一小部分(來源:TechCrunch)。這種 case study 的敘事方向很清楚:賣的是效率,而且是可量化的效率。
定價目前沒有公開數字,但參考 Claude Code 的企業方案以及市場上類似科研 AI 平台(例如 Benchling 的 enterprise tier 約 $50K-$200K/year),估計 Claude Science 的企業合約落在同等量級,甚至更高,因為整合了資料庫 access 和 multi-agent orchestration 這層複雜度。
護城河不在模型,在整合深度。連接 60 個科學資料庫、預建各領域 toolkit、支援機構自有 infrastructure — 這些東西複製起來要花時間,而且需要對科研 domain 有很深的理解。對競爭對手來說,光有更強的模型並不夠。
競爭格局:大家都在往垂直走
這場仗不只 Anthropic 在打。
OpenAI 方向類似但打法不同 — 他們的策略是大量跟 enterprise 做客製化合作(跟麥肯錫、Salesforce 的整合),還有針對研究用途的 ChatGPT Edu。但 OpenAI 目前還沒有一個專門針對生命科學研究 workflow 的整合平台。
Google DeepMind 其實在這個領域有最強的 domain asset — AlphaFold 已經是蛋白質結構預測的業界標準,最近的 AlphaFold 3 又擴展到更多分子類型。但 DeepMind 的科學工具更像研究成果輸出,不是讓科學家自己拿來用的 workbench。
Benchling 是這個領域的老玩家,專注在生命科學研究的 data management 和 workflow。它的強項是 lab notebook、inventory、分子設計,已經在藥廠深度整合。Claude Science 要跟它競爭的話,打的是 AI-native 的優勢。
粗略比較:
| 模型能力 | 科研 domain 整合 | Workflow 深度 | 資料安全 | |
|---|---|---|---|---|
| Claude Science | ★★★★ | ★★★★ | ★★★★ | ★★★★ |
| OpenAI Enterprise | ★★★★★ | ★★★ | ★★★ | ★★★ |
| Google DeepMind | ★★★★★ | ★★★★★ | ★★ | ★★★ |
| Benchling | ★★ | ★★★★ | ★★★★★ | ★★★★★ |
Claude Science 的定位比較像是結合了 AI 能力和 Benchling 的 workflow 整合,但還在早期。
Meta 判讀:這是 AI 市場的 role specialization 時刻
用電競的框架來說,這不是 patch note,這是 meta shift。
過去兩年,AI 公司的競爭框架是「誰的 benchmark 高」— MMLU、HumanEval、GPQA,數字高就代表模型強,模型強就能賣更多 API。這個邏輯現在開始出現裂縫。
原因很簡單:benchmark 的邊際差距對大部分實際應用來說已經不重要了。Claude 4 跟 GPT-4o 在大多數企業 use case 裡,使用者其實感受不到決定性的差別。這時候,workflow 的深度、整合的廣度、domain 的專業性,才是真正的差異化。
歷史上類似的轉折點:Salesforce 當年做的事情。CRM 本身不是 Salesforce 發明的,但它做成了 SaaS 的 operating layer,把整個銷售 workflow 包進去。現在 Salesforce 的護城河不是資料庫技術,是幾千個企業在上面跑的流程和資料。
Anthropic 在賭的是同一件事 — 如果科學研究的 workflow 是在 Claude Science 上跑的,那就算未來有更強的模型出現,遷移成本也足夠高到讓客戶留下來。
這對「通用 AI 模型廠商」的定義是一個很實質的挑戰。OpenAI 和 Google 如果繼續打模型能力的仗,Anthropic 就在旁邊悄悄把 workflow 層吃掉。
如果站在投資人的角度評估:Claude Science 這個方向如果成功,能帶來的不只是更高的 ARR,是更高的 NRR(Net Revenue Retention)。科研機構一旦把 pipeline 建在上面,續約率會很高。這對估值的意義比單次拿到大合約更長遠。但早期階段、domain 整合的複雜度、以及跟 DeepMind 這種有深厚科學背景的競爭對手之間的差距,都是風險。現在說 Anthropic 在科研市場穩了,還太早。
工程師該怎麼看
如果你在做 B2B SaaS 或 enterprise tool,Claude Science 這個案例給了一個很清楚的訊號:AI 競爭的下一個戰場是 domain workflow,不是通用能力。
技術選型上,multi-agent orchestration 是值得現在開始搞清楚的東西。Claude Science 的架構 — 一個 orchestrator agent 管多個 sub-agent、有 fact-checker 做 QA — 這個 pattern 會在越來越多的垂直產品裡出現。LangGraph、AutoGen、或是直接用 Claude 的 tool use API 自己實作,都是可以開始熟悉的方向。
職涯方向上,如果你對生命科學或任何科研領域有興趣,現在是一個不尋常的視窗期。懂 domain 的工程師 + 懂 AI agent 的能力組合,市場上真的很稀缺。不需要是生物學家,能夠跟科學家溝通、理解他們的 workflow 痛點、然後用 AI 工具解決,就已經很值錢了。
Side project 方向:拿一個你自己熟悉的領域(不一定是科學,可以是法律文件、財務分析、工程 spec review),試著建一個 multi-agent workflow,跑一個 fact-checker 或 QA agent 在最後。這個 pattern 的應用空間比你想的大很多。
延伸閱讀
Waiting7777
WoW Arena 冠軍轉前端,用電競 meta 思維拆解技術趨勢。
相關文章
AIAI 時代悲劇:爬蟲吃光內容 最後誰來餵 AI?
從遊戲設計角度看這個問題:一個讓所有玩家都想當 free rider 的機制設計,最後一定崩潰。分析 AI 公司、內容創作者、讀者三方的利益衝突,以及可能的出路長什麼樣。
2026年8月14日 · HW SHU · 7 分鐘閱讀
繼續閱讀 →
創業創投+4YC 裡越來越多二次創業者 — AI 時代為什麼老手反而更吃香
為什麼 AI 時代反而讓「老手」更吃香?從 YC 的數據看 repeat founder 的優勢在哪,以及這對第一次創業的人有什麼啟示。
2026年8月12日 · Waiting7777 · 7 分鐘閱讀
繼續閱讀 →
AI Agents開發工具+5OpenChamber:專為 AI Agent 設計的開發環境,跟 IDE 的差別在哪?
拆解 OpenChamber 的設計邏輯:為什麼 agent 需要專屬的開發環境、跟直接在 terminal 跑 Claude Code 有什麼本質差異,以及這個方向的商業潛力在哪。
2026年8月11日 · Waiting7777 · 8 分鐘閱讀
繼續閱讀 →這篇文章對你有幫助嗎?
每週一篇 — 技術趨勢背後的商業邏輯
AI 產業在變什麼、工程師該注意什麼——拆清楚寄到你的信箱。