Skip to content

模型价格

DDTokens 按实际 Token 用量计费。不同模型、供应商、缓存命中情况和用户权益等级都会影响最终费用。

价格如何计算

一次请求的费用通常由三部分组成:

  • 输入 Token:用户消息、系统提示词和上下文。
  • 缓存 Token:命中提示词缓存时,部分模型可能使用更低价格。
  • 输出 Token:模型生成的内容。

最终费用可以理解为:

text
请求费用 = 标准模型价格 × 实际 Token 用量 × 权益折扣

具体折扣以你的账户等级和价格页展示为准。

示例价格

以下价格仅用于说明计费字段。正式价格以控制台或实时价格页为准。

模型输入价格输出价格单位
GPT-4o$2.50$10.00每百万 Token
GPT-4o Mini$0.15$0.60每百万 Token
Claude 3.5 Sonnet$3.00$15.00每百万 Token
Gemini 1.5 Flash$0.075$0.30每百万 Token

用户等级和折扣

用户等级可能影响:

  • 模型价格折扣。
  • 调用速率。
  • 免费模型容量。
  • 高并发或企业场景的支持方式。

查看权益体系了解 DDTokens 如何组织等级和权益。

同一模型为什么可能价格不同

同一个模型名可能由不同上游供应商提供。不同供应商的成本、容量、响应格式和可用性可能不同,因此价格也可能不同。

如果你不指定供应商,DDTokens 会使用默认路由。默认路由更适合大多数场景。如果你需要固定供应商或稳定响应差异,可以阅读渠道与路由

查看用量和费用

登录控制台后,查看调用日志和账单明细。排查费用时,重点关注:

  • 请求模型和实际处理模型。
  • 输入、缓存和输出 Token。
  • 折扣前费用和实际费用。
  • 请求耗时和上游耗时。

© 2026 DDTokens