#tokens
共 6 篇相关内容 · 安全漏洞、AI动态、技术文章
技术文章 5
Agent 成本控制进入会话级:Anthropic 与 AWS 的硬预算实战
8 月 6-7 日,AWS Bedrock AgentCore 与 Anthropic Managed Agents 相继上线会话级硬预算,成本控制从"月度账户上限"下沉到"单次运行"。本文对比各家方案的粒度、边界与超支行为。
AI 模型定价战:OpenAI 降价 80%、Anthropic 冻结价格,Agent 成本正在重构
7 月底 OpenAI 将 GPT-5.6 Luna 降价 80%、Terra 降价 20%;8 月 Anthropic 宣布 Sonnet 5 的 $2/$10 首发价永久化。开源权重模型的竞争让前沿模型定价进入下行通道,Agent 应用的token经济学被彻底改写。
OpenAI 商业化加速:$125 Premium Seats 与 $8 重置配额
OpenAI 为 ChatGPT Business 推出 $125 Premium Seats,并测试 $8 付费重置配额。本文解读 OpenAI 用量变现策略与企业的预算启示。
GPT-5.6 Luna 降价 80%:AI 推理成本下行的连锁反应
OpenAI 将 GPT-5.6 Luna 价格下调 80%、Terra 下调 20%。本文解读降价动因、对开发者与 Agent 应用的影响。
模型 API 涨价信号:Anthropic/OpenAI 商业化分水岭
OpenAI 与 Anthropic 的定价策略从"补贴扩张"转向"用量变现"。本文解读商业化信号对企业预算与选型的影响。
情报动态 1
GitHub 🟢
caveman — Claude Code skill that cuts 65% of tokens by talking like caveman
🪨 A Claude Code skill that reduces token consumption by 65% through caveman-style prompting. 70K+ stars in 2 months. Uses fewer tokens to achieve the same output quality, saving significant API costs for Claude Code users.