AI 模型定价战:OpenAI 降价 80%、Anthropic 冻结价格,Agent 成本正在重构
过去三周,前沿模型的定价几乎是在"没有公告的降价"和"取消涨价的公告"之间反复横跳。两个信号值得单独拿出来看:
- 7 月 30 日:OpenAI 把最便宜的 GPT-5.6 Luna 价格下调 80%($0.20/$1.2 每百万 token),中端 Terra 下调 20%($2/$12),官方归因于底层推理效率提升。
- 8 月 10 日:Anthropic 宣布 Claude Sonnet 5 的 $2/$10 首发价永久生效,取消原定 9 月 1 日涨到 $3/$15 的计划。
为什么降价反而是坏消息的信号
表面看是利好,背后是开源权重模型的挤压。硅谷数据显示,7 月中旬以来企业推理 token 支出正在从闭源流向开源权重模型,DoorDash、Airbnb、Coinbase 等已确认用中国开源模型处理部分生产负载。OpenRouter 这类路由服务把"换模型"的成本降到了几乎为零。
Anthropic 的定价文档写得很直白:Sonnet 5 不仅对标 GPT-5.6 Terra($2.50/$15),输出价格还便宜三分之一——这已经不是能力竞争,而是运营成本竞争。
对 Agent 应用意味着什么
Agent 应用消耗 token 的方式与聊天完全不同:一次用户请求可能要多次读文件、看工具结果、改方案、生成代码,一个循环就是十几次 API 调用。所以:
- 按任务成本而非单价评估模型。Luna 降价 80%,但若任务需要更高推理能力,Terra/Sonnet 才是实付成本最低的选择。
- 注意 tokenizer 差异。Anthropic 明确 Sonnet 5 同输入会产生约 1~1.35 倍的 token,名义降价不等于实际省钱。
- 议价能力上升。多家可路由的供应商 + 免费开源选项,让企业在采购谈判中首次有了"不买账"的底气。
小结
这轮价格战的前奏是开源的崛起,落点是 Agent 时代的单位经济模型重构。对开发者来说,好消息是"按任务成本"做选型第一次真正可行了。
评论