OpenRouter 杰文斯悖论:GPT-5.6 折扣数据深度解读
OpenRouter 2026 年 8 月 25 日发布的 insights 博客丢出一组 GPT-5.6 Terra + Luna 折扣窗口(7-27 至 8-14)的杰文斯悖论数据:Terra 日 token 量增长 5.6 倍,Luna 增长 13.8 倍,同窗口未打折的 Sol 仅录得 1.11 倍。这一三向对比是公开 LLM API 市场迄今最干净的价格弹性自然实验。本文拆解数据、Luna 13.8 倍 vs Terra 5.6 倍的成因、Terra/Luna 抢下的 7.8% 份额到底从谁那里来、折扣结束后的留存曲线、以及促销窗口结束两周后榜单变成什么样。所有数字来自 OpenRouter insights 博客、OpenAI 定价页、OpenRouter /api/v1/models + /api/frontend/v1/rankings/models 2026-08-29 实时数据。
数据:前 / 折扣 / 结束 三段窗口
OpenRouter 定义三段窗口。Pre:7-8 至 7-26(19 天)。Program:7-27 至 8-14(19 天)。Post:8-15 至 8-20(6 天,分析发布于 8-25,post 窗口尚不完整)。头条数字:
- Terra tokens:折扣窗口日均 5.6 倍于前窗口。
- Luna tokens:折扣窗口日均 13.8 倍于前窗口。
- Sol tokens:1.11 倍,作为对照组的"温和提升"。
- 其他 OpenAI 模型:窗口期间 token 量"略降"(内部替代)。
- OpenAI 以外:其他模型"温和上涨"——Anthropic 是唯一 token 量未上涨的主要厂商。
杰文斯悖论的框架之所以重要,是因为对任何折扣项目最直接的批评就是"你只是把开销挪了个位置"——本来要用 GPT-5.5 的客户现在用半价 Terra,收入不涨、利润压缩。博客的贡献是证明这不是事实。Token 总量涨 5–13 倍,而本可以被同一批客户选用的 Sol 几乎没动。需求本来是潜在的,价格把它释放出来了。
Luna 13.8 倍而 Terra 只有 5.6 倍的原因
Luna 是 GPT-5.6 家族的便宜档。官方原价输入 $1.00/M、输出 $6.00/M。OpenRouter 折扣砍 50% 至 $0.50/M、$3.00/M。7-30 OpenAI 又在自身列表上砍 Luna 80%,上游价格降到 $0.20/M、$1.20/M。两轮叠加,7-30 之后 Luna 在 OpenRouter 上的有效价格是输入 $0.10/M、输出 $0.60/M——相对原始列表打 9 折(90% off)。
Terra 是 GPT-5.6 的中档。原始列表输入 $2.50/M、输出 $15.00/M。OpenRouter 砍 50% 至 $1.25/M、$7.50/M。OpenAI 7-30 再砍 20%,上游到 $2.00/M、$12.00/M。两轮叠加,7-30 之后 Terra 有效价格输入 $1.00/M、输出 $6.00/M——60% off。
两个有效价格点解释非对称性。Luna 是其原始列表的 1/10,也比 Terra 折扣后价(约 $1.00/M 输入)便宜 10 倍。弹性非线性:90% 砍价 → 13.8 倍量;60% 砍价 → 5.6 倍量;0% 砍价 → 1.11 倍量。如果把价格弹性建模成近似 log-linear,那么每 1% 砍价产生约 0.1–0.15% 量增,与博客脚注里给出的数字一致。
Terra/Luna 抢下的 7.8% 份额从谁那里来
Terra + Luna 在 OpenRouter 全部 token 中从 0.7% 涨到 7.8%——7.1 份额点净增。博客拆解了这部分份额的来源:
- 5.3 点来自 OpenAI 以外的竞品(OpenRouter 上的其他厂商模型)。
- 1.9 点来自 OpenAI 家族内部替代(旧 GPT-5.x 等其他 OpenAI 模型)。
约四分之三的净增来自 OpenAI 之外。整个 OpenAI 家族份额从 7.1% 涨到 12.4%,期间单日峰值"偶尔冲过 15%"。所以竞争故事是:OpenRouter 的 50% 折扣从 Claude、Gemini、DeepSeek、Qwen 客户那里拉到了已经在评估 GPT-5.6 档模型的需求,价格让他们换了。GPT-5.6 折扣并没有按"愤世嫉俗"的读法那样只是把同批客户从一个 OpenAI 模型挪到另一个。
一个没进头条的脚注:Anthropic 是窗口期间唯一 token 量未上涨的主要厂商。Anthropic 客户显然对 Claude 粘性极强——单靠价格撬不动。如果你的路由层有"失败自动 fallback 到 Claude"的模式,这就是证据:Claude 客户是那种你不应该主动让他们流失的人群,他们会扛过价格波动,只在能力差距出现时才离开。
折扣叠加问题
OpenRouter 博客对买家真正重要的一个机制一笔带过:折扣会叠加。OpenRouter 7-27 砍 50%。三天后 OpenAI 在自家 Luna 列表上砍 80%、Terra 砍 20%。两轮叠加,7-30 之后 Luna 有效折扣 90%,Terra 有效折扣 60%。从买家角度看,这是在一个已经在跑的折扣窗口里又来了一轮意料之外的降价。从 OpenRouter 角度看,页面没撒谎——两个折扣都是真的且同时存在——但"50% off"的头条实际上低估了渠道实际收费。
| 档位 | 原始列表(每 M) | OpenRouter 折扣(每 M) | + OpenAI 7-30 砍价(每 M) | 有效总折扣 |
|---|---|---|---|---|
| Luna | $1.00 / $6.00 | $0.50 / $3.00 (-50%) | $0.10 / $0.60 (-90%) | 90% off |
| Terra | $2.50 / $15.00 | $1.25 / $7.50 (-50%) | $1.00 / $6.00 (-60%) | 60% off |
| Sol | $5.00 / $30.00 | 无折扣 | 无列表砍价 | 0%(对照组) |
以上数字均对照 OpenAI 定价页(platform.openai.com/docs/pricing)与 OpenRouter /api/v1/models 端点 2026-08-29 验证。缓存输入与缓存写入价格 OpenAI 定价表里有,但不属于杰文斯分析范围——头条的 5.6x / 13.8x / 1.11x 数字仅指非缓存 prompt + completion。
折扣结束之后发生了什么
留存数据对考虑把生产流量放到折扣档模型的决策者是最重要的数字。OpenRouter 用两种方式测量:
- 按客户数:折扣期间用过 Terra 或 Luna 的 10 万+ 客户中,约 32% 在 post-program 的 6 天内保留了一些用量,18% 用量达到或超过折扣期间水平。
- 按 token 量:post-program 期间 Terra + Luna 日均 token 量反而是折扣期间 1.38 倍——意味着留下来的账户用量远大于中位试用客户。
这是有意义的区别。如果只看客户数,你会得出"三分之二的试用客户在促销结束时流失,这只是折扣驱动的尖峰"。按客户数这没错。但按 token 量,折扣后实际比折扣期间更多——因为留下来的 32% 用量重于中位试用客户。从路由层视角看:促销结束之后,cheap tier 在桌面上的位置仍然在,哪怕你失去了大部分随意的试用流量。博客明确标注 post-period 是"6 days so far vs a 19-day program, so the story may change as more data comes in"——所以 1.38 倍是初步数字,但定性模式(小而重的留存核心 + 大量随意试用流量流失)是成功折扣项目的典型形态。
Sol 作为对照组
博客明确拿 Sol 当对照。Sol 是 GPT-5.6 家族的旗舰——同一上线日期(2026-07-09),同一 OpenAI 家族,同一 OpenRouter 渠道——并且在 Terra/Luna 窗口内未被折扣。Sol 录得 1.11 倍 token 量提升。脚注解释为什么会有这个提升:Sol 在 Terra/Luna 项目期间日均 79.1B token,前期间 71.2B/天,实际上是一个平的对照组。然而上方图表从 8-17 开始的阴影区域是 Sol 自己的 50% 折扣。Sol 立刻跳起来,重现了 Terra/Luna 的模式。
翻译:Sol 8-17 一拿到自己的折扣,立刻按同样的模式跳起来。这在同一家族内复现了杰文斯效应,排除了另一种解释——"窗口内所有 OpenAI 模型都在涨,那是因为品牌动能"。品牌动能不是变量。价格是。
折扣结束两周后的榜单
拉 OpenRouter /api/frontend/v1/rankings/models?window=week 2026-08-29(post-program 6 天,Sol 自己的折扣也在跑),日榜按 prompt token 量前 6 名都是中国开源权重模型:
- z-ai/glm-5.3-flash-20260826——4.43T prompt token(免费标准档)。
- tencent/hy4-preview-20260827——1.89T prompt token。
- MiniMax-M3(free)——1.81T prompt token。
- MiniMax-M2.7(free)——136B prompt token。
- inclusionai/ling-3.0-flash-fin-20260827(free)——127B prompt token。
- qwen/qwen3.8-flash-20260826——47B prompt token。
GPT-5.6 全系无一进入 2026-08-29 日榜前 15。这是头条博客没明说的二阶发现:杰文斯暴涨真实但短暂。折扣窗口结束、且只有 Sol 在自家促销上之后,累积量榜单被列表价远低(或免费)的模型主导。折扣释放了潜在需求,但需求在相对价格差距收窄后重新分配给了当时最便宜的可用选项。
对你的路由层意味着什么
给所有跑多模型 LLM 栈的人三条具体启示:
- 价格弹性大但非线性。90% 砍 → 13.8 倍量;60% 砍 → 5.6 倍量;0% 砍 → 1.11 倍量。价格降幅与量增幅的关系够陡,你的路由层上一点相对价格的调整就能挪动相当比例的流量。如果你的网关把 GPT-5.6 Luna 和 Qwen3.8 Flash 当作可互换的 cheap-tier 选项,日榜显示 Luna 在促销时会尖峰,促销结束时会塌。
- 促销叠加检测很重要。OpenRouter 的"5 折"低估了 Luna 客户在 7-30 OpenAI 列表砍价之后实际拿到的 9 折。如果你的成本监控告警按 OpenRouter 促销页面触发、又不每天重新拉上游 OpenAI 列表,你会至少在几天内低估实际折扣。
- post-program 1.38 倍是容量规划的真实数字。不要按 13.8 倍 in-program 峰值规划容量;按 1.38 倍 post-program 基线加合理余量来规划。13.8 倍是瞬态。1.38 倍代表主动选择留在更高价格的客户基础,并且只要模型仍具竞争力就会是长期尾量。
路由 failover 怎么接
杰文斯数据支持的模式:把 cheap tier 路由过一个网关,价格消息出来时能在不改代码的情况下换模型。今天两条最便宜的路径是 Cloudflare AI Gateway(把 OpenRouter 作为 Unified Billing 暴露出来,让你能在 dashboard 里重指向一个路由)与 Portkey(让你按路由设模型 fallback、按环境设价格档)。对一个 7-27 至 8-14 跑 GPT-5.6 Luna 的工作负载,post-program 最便宜的等价选项是上面 top-5 之一的开源权重模型,处理切换的路由逻辑也会处理下一轮折扣窗口。
跨多家提供商跑这套路由层、实时盯价格消息? FreeModel 把 OpenRouter、直连 OpenAI、Anthropic、Gemini、Cloudflare Workers AI、DeepSeek、Qwen 装在一个 OpenAI 兼容 API 后面,配每日价格异动告警与按路由 fallback——下次折扣窗口开的时候,一小时内翻转 cheap-tier 路由,不用等下一个部署周期。
怎么保持数据新鲜
本文头条数字由 OpenRouter 2026-08-25 发布。post-period 观测窗口是 8-15 至 8-20(6 天)。要随 post-program 数据补齐而更新视图,三个端点值得书签:
- OpenRouter 杰文斯悖论 insights 帖——原始方法论与上面章节数字提取自的图表。
/api/frontend/v1/rankings/models——每日榜单,每个 UTC 日更新。/api/v1/models——OpenRouter 上每个模型的当前价,包括标记促销窗口的discount字段。
如果你依赖某一档处于促销中,每周重拉一次榜单、每天重拉一次 models 端点。OpenRouter 博客明确标注 6 天 post-period 是初步的——等 8-31 周榜落地,预期会有一篇带更长 post-program 窗口的跟进帖。
结论
OpenRouter 的杰文斯数据是迄今最干净的证据,证明 prompt 价格是 API 采用的一阶变量。13.8x / 5.6x / 1.11x 这个三件套是价格弹性阶梯,不是品牌故事。留存曲线表明成功的折扣项目会留下一小批用量很重的核心,超过项目期间中位日量——这就是耐久的收入。post-program 榜单显示 cheap-tier 王座由所有低于 $1/M prompt 的开源权重模型轮流坐,所以下一轮杰文斯窗口大概属于砍列表价最快的那个,不是跑最大促销的那个。
对 API 买家,行动跟上个季度一样:cheap tier 留在一个能一小时重路由的网关里,每周看一次 OpenRouter 榜单,不要把生产流量锁在单一折扣档模型而不留 fallback 到 $1/M prompt 以下的开源权重等价物。