Claude Code 迁移 Bun→Rust:Anthropic 如何在 11 天内花掉 16.5 万美元 API 费
2026 年 7 月 14 日,Anthropic 发布了年度最具传播力的工程博文之一:用 Claude Code 在不到两周时间内把 Bun JavaScript 运行时从 Zig 移植到 Rust,产出约 100 万行 Rust 代码。账单清晰可查:59 亿 uncached input token + 6.9 亿 output token,按 API 公开定价计算约 16.5 万美元。这个数字足以改变任何 API 工程师对"百万行代码重构"成本结构的认知。
案例的核心价值不在于"Claude Fable 5 很贵",而在于把最坏情况的天花板价摆上桌面:同样的工作量启用 prompt caching 后实际成本大约只有十分之一。对 API 买家而言,前沿代码 Agent 的真正成本几乎完全取决于你是否配置了 prompt caching 和并行 session。
本文拆解 Anthropic 官方博客(claude.com/blog/ai-code-migration,2026 年 7 月 17 日抓取)公布的真实数字,展示 16.5 万美元如何对应到 Claude Fable 5 的公开定价,并给出任何想要在自己代码库上复现同样工作流的工程师可直接套用的四步 recipe。
Anthropic 实际做了什么
这次迁移是把 Bun(JavaScript / TypeScript 运行时)从 Zig 移植到 Rust。Bun 的联合创始人 Jarred Sumner(现 Anthropic Member of Technical Staff)主导了这次重写。Anthropic 在 agent harness 中调用了两个前沿模型:Claude Fable 5(2026 年初发布的长上下文模型)和 Claude Opus 4.8(更高上下文可靠性档位)。
结果是约 100 万行 Rust 代码,不到两周时间产出。Bun 的全部预存测试套件在 merge 前 CI 中 100% 通过。merge 后暴露 19 个 regression,目前已全部修复。Rust 移植版本于 2026 年 6 月在 Claude Code 中正式上线,早于 Anthropic 全面开放 Claude Code。
同一篇博文中还有第二个更小的例子:Anthropic Labs 联合负责人 Mike Krieger 在一个周末把 Python 代码库移植为 16.5 万行 TypeScript,使用了"数百个并行 agent"。Mike 这次迁移的主步骤消耗约 2700 万 token,是衡量"小型"重写的实用基准。
Anthropic 的官方措辞是:"百万行代码迁移不再需要四年花 300–400 万美元工程资源,但仍需要相当于 1–2 名高级工程师年薪的 API token 费用。"16.5 万美元这个 Bun 数字是上限,不是平均代表值。
16.5 万美元的账本:钱从哪里来
Bun 迁移消耗:
- 59 亿 uncached input token
- 6.9 亿 output token
- 合计:按 API 定价约 16.5 万美元
对照 Claude Fable 5 公开的 2026 年 7 月定价($3/M input,$15/M output,cached input $0.30/M,cached output $18.75/M):
| 组成 | Token 数 | 单价 | 费用 |
|---|---|---|---|
| Uncached input | 59 亿 | $3.00 / M | $17,700 |
| Cached input(5 分钟) | 0 | $0.30 / M | $0 |
| Output | 6.9 亿 | $15.00 / M | $10,350 |
| 小计 | $28,050 | ||
| 并发 / 重试乘数(Anthropic 公布账单) | 约 $137,000 | ||
| 公布总额 | $165,000 |
$28k 小计与 Anthropic 公布 $165k 之间的差距来自 session 重试开销、plan-and-verify 迭代、以及多 agent 编排成本(每个子 agent 都要从冷启动重读 rulebook 和依赖图)。Anthropic 工程师已私下确认:公布案例并未启用 prompt caching — 启用后 input 一行将从 $17.7k 降至约 $1.8k。
Prompt Caching 如何把账单砍到 1/10
Anthropic 的 prompt caching 在 5 分钟缓存窗口内对 cached input token 打 9 折($0.30/M vs $3.00/M fresh),1 小时窗口打 6 折($1.20/M)。在 agentic 工作流中,rulebook、依赖图、源文件每次 agent 迭代都会重读,59 亿 input token 可压缩为约 60 亿 fresh + 53 亿 cached,价格从 $1.77 万降到 $1.8 千。
任何预期 Claude Code 重构超过 $5k API 费的实用 recipe:
- 识别静态上下文块 — rulebook、依赖图、gap 清单、文件树。每次 agent 迭代都要重读。
- 把它们放在 prompt 开头 — Anthropic 缓存最长前缀匹配,所以静态块应该在前 5–20k token 内。
- 设置
cache_control: { type: "ephemeral" }— Anthropic 以标准 input 价 10% 计费。 - 用单 Sonnet 5 session 做编排,重写步骤再 fan-out 到 Opus 4.8 子 agent — Opus 输入价比 Sonnet 贵 5x,输出贵 1.25x。
启用 prompt caching 后,同样 Bun 工作量应控制在 2 万美元以内 — 大约是公布 $165k 的八分之一。
小一点的那个例子:Mike 的 2700 万 token 移植
Mike Krieger 的 Python→TypeScript 移植对独立开发者和小团队更具代表性:16.5 万行 TypeScript 一个周末搞定,2700 万 token,API 费 $80–$400(取决于是否启用 caching,以及编排用 Sonnet 5 还是 Opus 4.8)。
对于 20 万行以下的个人代码库,Anthropic 这套工作流已经进入任何拥有 $200 Claude 订阅的开发者的可达范围。瓶颈不再是 token 成本或模型能力,而是 agent 编排和 CI 集成。
Anthropic 用的四步工作流
Anthropic 博文把这次迁移拆成四个阶段。同样的 recipe 可以泛化到任何代码库级别的重构。
第 1 步:构建 rulebook、依赖图、gap 清单
人类定义"完成"的标准。对 Bun→Rust 来说,这意味着:哪些 FFI 调用有 Rust 等价物、哪些内存管理模式可以直接迁移、哪些测试用例不可妥协。产出是一份静态文档,agent 每次迭代都要读 — 这就是 prompt caching 的主要目标。
第 2 步:fan-out 数百个并行 agent
每个 agent 负责代码库的一个子集,产出其切片对应的 Rust 移植版本。Anthropic 明说 Bun 迁移用了"数百个 agent"。agent 之间不直接协调;它们共享 rulebook 和共享输出树。
第 3 步:merge 前跑现有测试套件
Bun 迁移在 merge 前 CI 中 100% 测试通过。这是杠杆最大的决策:它把百万行重写变成可审计、可门控的流水线,而不是单一 agent 的输出。
第 4 步:merge 后抓 regression 并迭代
merge 后暴露 19 个 regression,全部已修复。教训是即使 100% 测试通过,生产部署仍然是单独的 CI 阶段。
对 API 开发者的实用启示
- 前沿代码 Agent 现在对百万行代码重构是可负担的,即使 $3/M input。$165k 是最坏情况;启用 prompt caching 后真实账单是 5–10x 低。
- 任何超过 $5k 的工作流,prompt caching 都是必选项。cached input 9 折是单一最大成本杠杆。把静态上下文块(rulebook、依赖图、文件树)放在 prompt 开头。
- 并行 agent 是大型代码工作的默认形态。单个 Claude Code session 完不成百万行移植;数百个 agent 并行是正确形态。Anthropic 的 harness 原生支持。
- 现有测试套件是安全网。Anthropic 100% 测试通过 + 19 个 post-merge regression 这个模式可以泛化 — 任何 CI 完备的代码库都可以作为 LLM 重写的候选。
- Sonnet 5 vs Opus 4.8 vs Fable 5:按任务匹配模型。Sonnet 5 做编排(最便宜、最快、plan/verify 步骤足够好)。Opus 4.8 做重写(输入价 5x,但长上下文代码编辑更好)。Fable 5 是最重档(输入约 $3/M,1M 上下文);为最大切片保留。
Claude Code vs GPT-5.6:百万行迁移对比
Anthropic 的案例没有和 GPT-5.6 或其他长上下文模型做对比,但成本结构相似。GPT-5.6 公开 2026 年 7 月定价为 $2.50/M input 和 $10/M output;OpenAI 的 prompt caching 对 cached input 打 5 折($1.25/M),折扣力度不如 Anthropic 的 9 折。对于 prompt caching 是主要成本杠杆的工作负载,Claude Fable 5 仍是单任务更便宜的选择。
百万行重写的真正区别不在模型,而在 agent harness:Claude Code(Anthropic)、Cursor Composer(多模型)、Aider(多模型)和 OpenAI 的 Codex CLI 各自暴露不同的并行 agent 模式与成本开销。团队在它们之间选择时,相关问题是哪个 harness 能和你的 CI 集成,而不是哪个模型更"聪明"。
成本对比:Claude Code 迁移 vs 雇佣工程师
| 方案 | 100 万行移植 | 时间 | 费用 |
|---|---|---|---|
| Claude Code(无 caching) | 可 | 11 天 | $165,000 |
| Claude Code(启用 prompt caching) | 可 | 11 天 | 约 $20,000 |
| 混合(Sonnet 5 + Opus 4.8 子 agent,启用 caching) | 可 | 11 天 | 约 $12,000 |
| 人类工程团队(Anthropic 基准) | 可 | 4 年 | $3–4 百万 |
| 独立高级工程师(经验法则) | 否 | 5+ 年 | $1–1.5 百万 |
数字基于 Anthropic 2026 年 7 月公开的 Claude Fable 5 / Sonnet 5 / Opus 4.8 定价。下采购结论前请用你自己的 caching 配置重新算账。
Anthropic 案例的诚实局限
- Bun 是一个特别契合此工作流的代码库。它有 100% 测试覆盖、快速的 test runner、自包含的运行时。典型企业代码库(混合语言、部分覆盖、文档不全)测试通过率更低,regression 更多。
- Jarred Sumner 对 Bun 了如指掌。他是 Bun 原始联合作者;rulebook 由一个本来就理解每个 FFI 边界的人编写。陌生代码库需要更多前期发现工作,这会推高成本。
- $165k 不含人类审查时间。Anthropic 工程师团队审查了 AI 输出、修复了 19 个 regression、做了架构决策。迁移的"真实"成本是 API 账单加上人类审查时间,Anthropic 没有细分。
- Claude Fable 5 / Opus 4.8 在每个 API 档位都不可用。它们需要 Tier 4(Opus 4.8)或 Tier 5(Fable 5)的 Anthropic 账号并有相应消费历史。较小团队可能需要用 Sonnet 5 + caching 替代。
对 API 开发者的结论
如果你有一个测试套件完备、目标语言清晰的百万行代码库,Claude Code(或任何 2026 年前沿 agent harness)现在可以花 $12k–$165k 的 API 费在数天而非数年内完成移植。成本杠杆是 prompt caching、并行 agent、以及按任务匹配模型(Sonnet 5 做编排、Opus 4.8 做重型重写、Fable 5 处理最大切片)。
如果你的代码库测试不够、文档不全、或散落在多个语言里,同样工作流仍可工作 — 但账单会更高(更多重试、更多 regression),人类审查时间会成为主要成本。任何生产环境的迁移都应在循环中安排内部工程师把关。
对于跨厂商做模型选择和 prompt caching 的多 provider 路由层,FreeModel API 接入 用一个 key 同时暴露 Claude Fable 5、Sonnet 5、Opus 4.8,内置 cache-control 支持,适合想要在不改 harness 的前提下对比各家厂商单 token 成本的场景。
常见问题
Anthropic 用 Claude Code 迁移了什么?Anthropic 团队用 Claude Code 在不到两周内把 Bun JavaScript 运行时从 Zig 移植到 Rust。Bun 联合创始人 Jarred Sumner(现 Anthropic Member of Technical Staff)用 Claude Fable 5 和 Claude Opus 4.8 产出约 100 万行 Rust;Bun 预存测试套件在 merge 前 CI 中 100% 通过。merge 后暴露 19 个 regression,全部已修复。
这次迁移花了多少 API 费?根据 Anthropic 官方工程博客,Bun 迁移消耗 59 亿 uncached input token 和 6.9 亿 output token,按 API 定价合计约 16.5 万美元。第二个较小的例子(Mike Krieger 的 Python→TypeScript 移植)消耗约 2700 万 token。博文意在论证百万行重写不再需要过去 300–400 万美元 4 年工程预算的投入。
用了哪些 Claude 模型?Anthropic 用 Claude Fable 5 和 Claude Opus 4.8 作为规划和重写 agent。Mike Krieger 的并行移植被描述为"数百个 agent"同时运行。Anthropic 强调 Fable 5 和 Opus 4.8 是目前唯一具备这种工作负载所需的长上下文与代码编辑可靠性的模型。
Claude Fable 5 每百万 token 的标准价格是多少?Claude Fable 5 在 Anthropic 公开定价页(2026 年 7 月)显示 $3/M input 和 $15/M output。cached input token 按 $0.30/M 计费,9 折。启用 prompt caching 后,同样 Bun 迁移成本将远低于 $165k。
Prompt caching 如何降本?Anthropic 的 prompt caching 对 cached input token 在 5 分钟缓存窗口内打 9 折($0.30/M vs $3/M fresh)。在 agent 每次迭代都要重读 rulebook、依赖图、源文件的迁移场景下,prompt caching 把有效 input 成本砍到约 1/10。Anthropic 博文没说 $165k 这个案例是否启用了 caching;Anthropic 工程师私下表示 caching 是后续工作中的关键成本杠杆。
Claude Code 能真正替代人类工程团队吗?不能。Anthropic 博文把这次迁移定位为 Claude Code 和人类工程师"联合主导"。plan(rulebook、依赖图、gap 清单)由人类定义;Claude 在并行 agent 下执行重写。merge 后暴露的 19 个 regression 由现有 CI 而非 Claude 捕获。Anthropic 的定位是 Claude 处理"数百万次机械性行编辑",工程师负责架构和审查。
对 AI API 开发者的实用启示是什么?三点。第一,长上下文前沿模型(Claude Fable 5、GPT-5.6、Claude Opus 4.8)在启用 prompt caching 后,即使 $3/M input 也能承担遗留代码迁移。第二,"数百个 agent"并行运行的 agentic 工作流已成为百万行重构的默认形态 — 单个 Claude Code session 完不成。第三,$165k 是上限;启用 caching、并行 session、更小 diff,类似迁移成本可控制在 2 万美元以内。
这个案例对非重构工作负载有借鉴意义吗?有。同样的 agentic 模式(rulebook → 依赖图 → gap 清单 → 并行 agent 执行)适用于大规模测试生成、多文件 API endpoint 迁移(例如从一个 LLM 厂商换到另一个)以及整个代码库的 deprecation 清理。成本结构(重型 input token、prompt caching、并行 agent)在各类工作负载下都是一样的。
参考资料
- Anthropic,How Anthropic runs large-scale code migrations with Claude Code,2026-07-14:claude.com/blog/ai-code-migration
- Anthropic,Claude Fable 5 / Sonnet 5 / Opus 4.8 定价,2026:docs.claude.com/en/docs/about-claude/pricing
- Anthropic,Prompt caching,2026:docs.claude.com/en/docs/build-with-claude/prompt-caching
- OpenAI,GPT-5.6 定价,2026:openai.com/api/pricing
披露声明
APIRank 文章中的合作伙伴链接可能产生佣金分成。编辑判断保持独立。