BridgeCraft logobridgecraft
週報顧問服務作品集關於聯絡登入
聯絡

bridgecraft

從資料視覺化到 AI Agent,一直在找下一個 meta

文章主題指南週報顧問服務Labs作品集系統架構關於聯絡RSS

© 2026 BridgeCraft — Waiting7777. All rights reserved.

← 所有文章
Claude 4.7 偷偷改了什麼?拆解 system prompt 看 Anthropic 的調教手法

Claude 4.7 偷偷改了什麼?拆解 system prompt 看 Anthropic 的調教手法

2026年4月20日 · Waiting7777 · 6 分鐘閱讀

ClaudeAIAnthropicsystem prompt
📂 Claude 系列📂 AI 系列📂 Anthropic 系列📂 system prompt 系列

Claude 改 system prompt 看行為微調:Anthropic 的 AI 訓練師手法

> Patch Note

最近 Simon Willison 拆解了 Claude Opus 4.6 到 4.7 版本間的 system prompt 變化,基本上就是 Anthropic 的「調參師日記」。這件事有趣的地方是,現在只有 Anthropic 會公開他們的 system prompt,其他家都藏起來。看這些變化,就像看遊戲的 patch note — 哪個職業被 buff、哪個技能被 nerf、新增了什麼機制。

對工程師來說,這是很好的 prompt engineering 教材。對產業來說,這反映了 AI 公司怎麼透過「調教」來改變使用者體驗,而不是重新訓練模型。

架構概覽:System Prompt 是什麼

System prompt 就是 AI 的「人設設定檔」,告訴它該怎麼表現、什麼能做什麼不能做。想像成遊戲角色的 config 檔,裡面定義了這個 NPC 的行為模式。

Claude 的 system prompt 結構大概長這樣:

  • 身份設定:我是 Claude,由 Anthropic 開發
  • 能力範圍:我能做什麼、有哪些 tools
  • 行為規範:怎麼回話、什麼不該做
  • 安全條款:兒童安全、有害內容的處理方式
  • 互動風格:要簡潔還是詳細、要不要主動問問題

這次 4.6 到 4.7 的改動,基本上就是在這幾個區塊做微調。Anthropic 透過這種方式,不用重新訓練模型就能改變 AI 行為 — 就像改遊戲設定檔一樣,成本低但效果明顯。

從架構角度看,這反映了現代 AI 系統的「雙層設計」:底層是預訓練模型(很貴,不常改),上層是 prompt engineering(便宜,隨時能調)。

核心機制深入:三個關鍵改動

1. Tool 生態系統升級

最明顯的變化是 tool 列表更新了。4.6 版本提到「Claude in Chrome 和 Claude in Excel」,4.7 新增了「Claude in PowerPoint」。更重要的是,新增了 tool_search 機制:

Before concluding Claude lacks a capability — access to the person's location, memory, calendar, files, past conversations, or any external data — Claude calls tool_search to check whether a relevant tool is available but deferred.

這個設計很聰明。以前 Claude 會直接說「我沒有這個能力」,現在會先查查看是不是有 tool 可以用。這背後的商業邏輯是:讓使用者感覺 Claude 「更能幹」,而不用真的提升模型能力。

這讓我想到 App Store 的策略 — 平台本身不做所有功能,但讓生態系夥伴做,然後統一整合到使用者體驗裡。

2. 安全機制大升級

兒童安全部分從小段落變成獨立的 <critical_child_safety_instructions> 區塊,還新增了「一刀切」規則:

Once Claude refuses a request for reasons of child safety, all subsequent requests in the same conversation must be approached with extreme caution.

這個改動反映了監管壓力。歐盟的 AI Act、美國各州的兒童網路安全法案,都讓 AI 公司必須在安全上做更多投資。從產品角度看,這是 defensive move — 寧可誤殺一百,不可放過一個。

Trade-off 就是使用者體驗變差。但對 Anthropic 來說,商業風險比使用者抱怨更重要。

3. 互動模式調整

新增的 <acting_vs_clarifying> 區塊是最有趣的:

When a request leaves minor details unspecified, the person typically wants Claude to make a reasonable attempt now, not to be interviewed first.

這解決了 AI 助手的「過度客服化」問題。以前 Claude 會一直問問題確認需求,現在改成「先做再說」。這個改變很關鍵,因為它改變了人機互動的節奏感。

同時也新增了「要簡潔」的指令:

Claude keeps its responses focused and concise so as to avoid potentially overwhelming the user

這兩個改動組合起來,就是要讓 Claude 變得更「執行導向」,少廢話多做事。

商業背景:為什麼 Anthropic 要公開這些

Anthropic 是目前唯一會公開 system prompt 的大廠。OpenAI、Google、Meta 都不會告訴你他們的 prompt 長什麼樣。這個策略選擇背後有幾個考量:

  1. 差異化競爭:當大家都在比模型能力的時候,Anthropic 選擇比透明度
  2. 開發者生態:公開 prompt 讓開發者更容易理解 Claude 的行為邊界,降低接入成本
  3. 監管友好:歐美監管都在推 AI 透明度,提前佈局比較安全

從商業模式看,Anthropic 的營收主要來自 API 調用和 Claude Pro 訂閱。據報導,Claude Pro 月費 $20,企業版更貴(來源:Anthropic 官網)。公開 prompt 可能會讓競爭對手抄襲,但好處是建立技術權威形象,吸引更多企業客戶。

這個策略有點像 Tesla 公開專利 — 看起來在幫競爭對手,實際上是在建立生態系標準。

Meta 判讀:Patch Note 級別的優化

這次 system prompt 更新屬於標準的 Patch Note 級別。不是革命性的改變,但確實優化了使用者體驗:

  • Tool 整合:讓 Claude 看起來更「全能」,實際上是生態系擴張
  • 安全強化:應對監管壓力,避免公關危機
  • 互動優化:減少無謂的來回確認,提升效率感

從電競角度看,這就像是版本更新時的「平衡性調整」— 沒有新英雄、新機制,但調整了現有角色的數值,讓遊戲體驗更順暢。

對整個 AI 產業來說,這反映了一個趨勢:模型能力提升放緩,產品層面的微調變得更重要。當大家的底層模型能力差不多的時候,prompt engineering 和產品整合就成了關鍵戰場。

實戰建議:怎麼學習和應用

對工程師來說,Anthropic 的 system prompt 是很好的學習資源。幾個觀察重點:

  1. 結構化思維:用 XML tags 組織不同功能區塊,清晰易維護
  2. 優先級設定:安全規則用 <critical> 標籤強調,讓模型知道什麼最重要
  3. 行為微調:用具體的例子和反例,而不是抽象的描述

如果你在做自己的 AI 產品,可以參考這個 pattern:

  • 先定義身份和能力邊界
  • 再設定安全和合規要求
  • 最後調整互動風格和回應模式

注意的坑是,system prompt 太長會影響性能和成本。Claude 的 prompt 估計有幾千 tokens,對小公司來說可能負擔不起。要學會取捨,把最重要的規則留下來。

另外,prompt injection 攻擊也要考慮。公開 prompt 雖然透明,但也讓攻擊者更容易找到繞過方式。這是透明度的代價。

總的來說,這次 Claude 的 system prompt 更新,展現了 AI 產品「軟體化」的趨勢 — 透過配置改變行為,而不是重新訓練。這個方向對整個產業都有參考價值。

延伸閱讀

  • Claude 4.7 新 tokenizer 實測 — 開發者成本到底漲了多少?
  • Anthropic 不開源 Mythos 是為賺錢?
  • Claude Code 權限升級 — AI 寫程式的安全邊界在哪?

每週一篇 — 技術趨勢背後的商業邏輯

分享:

Waiting7777

WoW Arena 冠軍轉前端,用電競 meta 思維拆解技術趨勢。

關於作者

相關文章

AI 大老們喊了幾年「管管我們吧」,然後呢?一份帶點諷刺的時間軸AI監管+3

AI 大老們喊了幾年「管管我們吧」,然後呢?一份帶點諷刺的時間軸

從「說一套做一套」的角度切入:AI 高管喊監管不是新鮮事,但每次都有具體的時機背景。整理這條時間軸背後的商業動機 — 喊監管,往往是為了鞏固自己的護城河。

2026年9月18日 · HW SHU · 5 分鐘閱讀

繼續閱讀 →
Snap 又在推 AR 眼鏡 AI 功能了 — 這次有機會嗎?SnapAI Agents+13

Snap 又在推 AR 眼鏡 AI 功能了 — 這次有機會嗎?

從「Snap 為什麼還在賭 AR 硬體」的角度切,分析 Specs + AI 這個策略對 Snap 的商業意義,以及在 Apple Vision Pro 和 Meta Ray-Ban 夾擊下,這條路還走不走得通。

2026年9月18日 · HW SHU · 6 分鐘閱讀

繼續閱讀 →
設計師用 AI Agent 自己刻網站了 — 工程師的邊界在哪裡?AI Agents工作流程+5

設計師用 AI Agent 自己刻網站了 — 工程師的邊界在哪裡?

從「設計師用 AI 直接幹工程師的活」這個角度切入——這不只是工具使用心得,而是職涯角色邊界正在模糊的真實案例。

2026年9月16日 · HW SHU · 7 分鐘閱讀

繼續閱讀 →

這篇文章對你有幫助嗎?

每週一篇 — 技術趨勢背後的商業邏輯

AI 產業在變什麼、工程師該注意什麼——拆清楚寄到你的信箱。