模型价格
DDTokens 按实际 Token 用量计费。不同模型、供应商、缓存命中情况和用户权益等级都会影响最终费用。
价格如何计算
一次请求的费用通常由三部分组成:
- 输入 Token:用户消息、系统提示词和上下文。
- 缓存 Token:命中提示词缓存时,部分模型可能使用更低价格。
- 输出 Token:模型生成的内容。
最终费用可以理解为:
text
请求费用 = 标准模型价格 × 实际 Token 用量 × 权益折扣具体折扣以你的账户等级和价格页展示为准。
示例价格
以下价格仅用于说明计费字段。正式价格以控制台或实时价格页为准。
| 模型 | 输入价格 | 输出价格 | 单位 |
|---|---|---|---|
| GPT-4o | $2.50 | $10.00 | 每百万 Token |
| GPT-4o Mini | $0.15 | $0.60 | 每百万 Token |
| Claude 3.5 Sonnet | $3.00 | $15.00 | 每百万 Token |
| Gemini 1.5 Flash | $0.075 | $0.30 | 每百万 Token |
用户等级和折扣
用户等级可能影响:
- 模型价格折扣。
- 调用速率。
- 免费模型容量。
- 高并发或企业场景的支持方式。
查看权益体系了解 DDTokens 如何组织等级和权益。
同一模型为什么可能价格不同
同一个模型名可能由不同上游供应商提供。不同供应商的成本、容量、响应格式和可用性可能不同,因此价格也可能不同。
如果你不指定供应商,DDTokens 会使用默认路由。默认路由更适合大多数场景。如果你需要固定供应商或稳定响应差异,可以阅读渠道与路由。
查看用量和费用
登录控制台后,查看调用日志和账单明细。排查费用时,重点关注:
- 请求模型和实际处理模型。
- 输入、缓存和输出 Token。
- 折扣前费用和实际费用。
- 请求耗时和上游耗时。