来源信息
- 文档类型:阅读笔记 · 整理日期 2026-10-07
- 原文:《What a task costs on Opus 5.5》 · 作者 Addy Osmani · 发布于 claude.dev · 发布日期 2026-09-25
- 原文地址:https://claude.dev/blog/what-a-task-costs-on-opus-5-5/
- 本文为阅读整理,观点与数据以原文为准;原文不提供的事实均已标注为整理者说明。
阅读范围
- 全文,含成本因素、版本变化、比较、effort、模型路由、提示审计、缓存压缩、自测和结语。
成本单位是完成任务
费用受回合数、缓存读取、输出和模型单价共同影响。每轮重送历史,累计输入可远大于上下文长度;思考也计入输出。省 token 若增加返工,完整任务可能更贵。
2026-09-25 原文采用 Opus 5.5 每百万输入 4、输出 20、缓存读 0.20 美元的 API 目录价。同 token 的示意会话是 200 万缓存读、20 万新输入、6 万输出:Opus 5 为 3.50 美元,5.5 为 2.40 美元,未计缓存写、折扣。约 31% 差额只反映这组价格与用量,非实测用户节省。
文章另述默认负载约少花 40% 的估计,包含价格和模型用量变化,不是每 token 降价 40%。订阅额度与 API 计费也不能混同。
调整与缓存压缩
先提供可运行的验证,再评估提高 effort 或换模型。查找可交给小模型,复杂判断留在主模型,但误读资料会造成额外绕路;子代理与团队各自用量也需计入。提示审计的客服案例仅是一个样本。
稳定前缀与持续会话有利于缓存;过期、换模型、工具变化和部分平台的 effort 变化可增加写入。压缩可降低以后重送成本,却消耗一次总结且可能丢信息;无关任务重开,连续任务在自然节点总结。文中还讨论初始项目说明、延迟加载、fast mode、批处理与团队费用。
自测与限制
文章建议在真实任务比较回合、输出、缓存占比与完成结果,查看 usage 及团队报告;订阅中的美元估算不是账单。目录价、缓存时效、预览倍率和企业平均值均属发布时条件,不能当当前报价或个人预算。
本文完整读取正文与图示说明,但未操作交互滑块、运行命令或产生费用;没有用户实测数据。
游戏开发应用建议
以下为整理者建议,非原文实测,也不表示已经实施。
可用 NPC 小功能、资源冲突修复与跨系统改动组成成本样本,统一验收后记录全部尝试,包括失败重试和人工补救。只比较成功会话会低估难任务成本;探索阶段的有用反馈也应单独评估。
把生产逻辑、场景截图和日志按需提供,保留关键种子、状态版本和约束。总结前列出必须保留的证据,不能为了省输入删掉复现线索。机械修改可测试低投入,复杂验证提高投入,但结论要由样本支持。
预算可分模型费用、环境费用和人的时间,避免把 API 估算当作开发总成本。先测小批负载,再讨论是否调档或换模型,不采用文章比例直接预测项目账单。
小结
比较的是可靠完成任务的总成本;价格、用量、返工与验证需分开记录,再用自己的任务判断。
参考来源
- 原文:What a task costs on Opus 5.5(claude.dev,2026-09-25)
- Claude Code 官方文档:费用
- Claude Code 官方文档:用量监控
- Claude 平台文档:模型定价
- Claude 平台文档:Prompt caching