| 快速模式(输入) | $10 |
| 快速模式(输出) | $50 |
| 缓存写入(5 分钟) | $6.25 |
| 缓存写入(1 小时) | $10 |
| 缓存命中/刷新 | $0.50 |
API 费用按你发送给模型的 tokens(输入)和模型生成的 tokens(输出)分别计算 。这是纯粹的按用量付费模式,没有固定的月费套餐
。该模型支持100 万 tokens 的上下文窗口,按标准价格计费,无额外加价
。
Opus 4.8 的快速模式运行速度约为标准模式的 2.5 倍 。价格为输入每百万 tokens $10,输出每百万 tokens $50
。Anthropic 指出,Opus 4.8 的快速模式比之前的模型便宜了三倍
。
合理使用提示缓存可显著降低成本。缓存命中的价格仅为每百万 tokens $0.50 ,而标准缓存写入则根据存储时长从 $6.25 到 $10 不等
。总体而言,使用缓存最高可节省高达 90% 的输入成本
。批量处理则能再节约 50% 的费用
。