返回今日选题

已核验 · Aug 24, 2026

已独立佐证

Fable 的成本终结了 agentic 编程的「免费午餐」:按任务路由,不要只选一个模型

2 个信源

Drew Breunig 2026-08-23 的博文「Fable 与免费午餐的终结」认为,Fable 的高成本终结了 agentic 编程的「免费午餐」时代 —— 那种用一个贵模型解决所有任务的年代。博文报告 GLM 5.2 成本约为 Fable 的 1/9、Opus 5 的 1/5,并把更便宜的替代品定性为「在拿到良好上下文时对机械编码完全足够」,把 Fable 留给设计与审稿工作。文章还指出下降的推理成本也会抬升较小的开放权重模型,而不是让一切回到最大的前沿模型,从而把这一转变定性为持久性的。这是 Breunig 的框架而非经核实的厂商定价。对创作者的启示:按任务挑选模型而不是按天选模型;关键工作在于脚手架与上下文策略,而非模型选型。

为什么现在讲

今天的 Anthropic 故障让这个故事有了二阶时效:当旗舰前沿产品面(Fable 5)降级 ~2.75 小时,那些已经做好模型路由的创作者是根本没注意到的。Breunig 的框架就是这个运营现实的编辑性视角。

推荐理由

演示空间:5 分钟讲解「免费午餐结束」的实操含义 —— 如何把机械编码路由到 GLM 5.2 / Qwen / 开放权重模型,把 Fable / Opus 5 留给设计工作;成本比率框定为 Breunig 报告而非经核实的定价。

依据

dbreunig.com 博文 2026-08-23 + HN 首页讨论

Fable 的成本终结了 agentic 编程的免费午餐 —— Drew Breunig 的论点:「一个贵模型解决所有任务」的时代结束了,工作重心回到了脚手架和上下文策略。

切入角度

把 Breunig 的博文作为今天 Anthropic 故障运营教训的编辑视角。把成本比率当作 Breunig 报告的框架而非经核实的定价;可操作的钩子是路由纪律(机械任务交给便宜+好上下文、设计工作交给贵),而非成本比率本身。

形式

长视频讲解

演示想法

录一段 5 分钟讲解:1 分钟讲「免费午餐」是什么(一个模型解决所有任务);2 分钟讲成本比率(GLM 5.2 ~1/9 Fable,~1/5 Opus 5,框定为 Breunig 报告);1 分钟讲路由纪律在实操中是什么样子(机械任务交给便宜+好上下文,设计工作交给贵);1 分钟讲 Anthropic 故障的二阶教训(做好路由的创作者没注意到 UTC 04:50-07:36 窗口)。

平台注意

把成本比率表述为「Breunig 报告」而非经核实的定价。在对外表述具体成本比率前,请从 Anthropic 和智谱 / Z.ai 重新提取每 token 价格。文章只发布比率,不发布具体每 token 价格。

可用说法

  • Drew Breunig 2026-08-23 的博文「Fable 与免费午餐的终结」中报告 GLM 5.2 成本约为 Fable 的 1/9、Opus 5 的 1/5,并把 Fable 的高成本框定为 agentic 编程的「免费午餐」结束(文章援引 Herb Sutter 的「免费午餐」文作为类比)。

证据链

拆解

Drew Breunig 2026-08-23 的博文报告 GLM 5.2 成本约为 Fable 的 1/9、Opus 5 的 1/5,并把「一个贵模型解决所有任务」的时代定性为结束。成本比率是 Breunig 的框架,不是厂商定价 —— 在对外引用前请重新提取。可操作的钩子是路由纪律(机械任务交给便宜+好上下文,设计工作交给贵),而非成本比率本身。

风险

  • 引用这些比率时表述为「Breunig 报告」而非已核实的定价。在对外表述具体成本比率前,请重新从 Anthropic、智谱 / Z.ai 等厂商定价页提取每 token 价格。

演示思路

  • 路由决策卡片:「机械编码 → GLM 5.2 / Qwen / 开放权重;设计工作 → Fable / Opus 5;中间是脚手架策略」—— 锚定在 Breunig 框架。
  • 成本比率核对卡片:~1/9 Fable,~1/5 Opus 5(Breunig)—— 不是厂商定价;用作框架,不作用预算。
  • 故障即教训卡片:「今天如果你已经做好路由,Anthropic UTC 04:50-07:36 窗口对你无影响」—— 二阶运营教训。