价格说明

价格说明

适用角色:主用户、子用户 更新日期:2026-07-22

这篇用最简单的方式说清楚:平台怎么收费、一次调用花多少积分、去哪查价格。


一、最简版:三句话说清楚

充值 → 调用 → 按实际用量扣积分。

  • 没有月费、没有最低消费,用多少扣多少。
  • 充的人民币 1:1 变成积分(1 元 = 1 积分),调用时按量扣积分。
  • 每个模型有一套官方积分价,你选的分组(服务档位)在这个价上打个折,最终按折后价扣费。

二、什么是积分

积分是平台统一的计费和余额单位,和人民币的关系非常简单:

1 元 = 1 积分,这个比例永远不变。

你充 100 元,账户里就有 100 积分;每次调用扣掉相应积分,剩下的就是可用余额。登录控制台,在仪表盘首页即可看到当前余额。

"积分"和"余额"本质是一回事:充值时叫"余额",扣费时扣"积分",数值完全一致。

关于不同模型的价格来源,你只需要知道一句话:不同模型的官方定价来源不一样,平台会统一把它们折算成积分,所以你在页面上看到的价格、扣的费用,永远是积分,不需要自己做任何换算。


三、调一次模型要花多少积分

计费的四个维度

一次调用的费用最多由四部分组成:

维度 是什么 价格特点
输入 你发给模型的内容 基准价
输出 模型回复的内容 通常比输入贵不少(Claude 系列约为输入的 5 倍)
缓存写入 第一次把一段重复内容存进缓存 略高于输入;分"5 分钟""1 小时"两档有效期
缓存读取 后续命中缓存、直接复用的部分 最便宜,约为输入价的十分之一

不是每次都四项全有:不支持缓存的模型只有输入、输出两项;这次调用没写入/没命中缓存,对应项就是 0。

基本公式(全程都用积分算)

本次费用(积分)= 输入 + 输出 + 缓存写入 + 缓存读取
 
每一项 = 该维度 Token 数 ÷ 100 万 × 该维度积分单价 × 分组折扣

输入和输出分开计价;缓存那两项只有模型支持缓存、且这次真的写入/命中了才产生。

模型积分价 + 分组折扣

每个模型有一套官方积分价(输入 / 输出 / 缓存 各一个价)。你选的分组在官方价上乘一个折扣系数

你的实际单价 = 官方积分价 × 分组折扣

折扣系数是 0 到 1 之间的数,1 表示原价、不打折,数值越小越便宜:

  • 折扣 1.0 = 原价
  • 折扣 0.7 ≈ 打七折
  • 折扣 0.571 ≈ 打 5.7 折(越低越省)

说明:早期版本用过"倍率 ×N"的说法,现已统一为"折扣系数",不再有加价倍率的概念。 你不用自己算——模型广场和调用指南显示的价格,就是你所选分组的折后最终价,直接看那个数就行。

缓存三个价的固定比例(同一模型内)

以该模型的输入价为基准:

  • 缓存写入(5 分钟有效期)≈ 输入价 × 1.25
  • 缓存写入(1 小时有效期)≈ 输入价 × 2
  • 缓存读取 ≈ 输入价 × 0.1

所以重复上下文越多、命中缓存越多,越省钱。

长上下文档位(少数模型才有)

少数模型(如 Claude Sonnet 4 / 4.5 系列)有"长上下文档位":当单次请求的 Token 量超过某个阈值时,输入 / 输出 / 缓存的单价会自动切换到更贵的"长档价"。你不用做任何操作,系统自动判档,费用明细里会如实体现。大多数模型没有这个档位,只有一套价。

一个简单例子(示意)

假设某模型在你所选分组下:输入 20 积分/百万 Token、输出 100 积分/百万 Token(示意数字,实际以模型广场为准)。你发了 800 Token、模型回了 1200 Token:

输入 = 800 ÷ 100万 × 20 = 0.016 积分
输出 = 1,200 ÷ 100万 × 100 = 0.12 积分
 
合计 = 0.136 积分 ≈ 1 毛 4

四、费用明细:每一笔都能看到怎么算的

在「使用记录」里,把鼠标停在某条记录的"费用"上,会弹出这次调用的费用明细

  • 分维度的实付积分(输入 / 输出 / 缓存读 / 缓存写 各多少)
  • 每个维度的单价(积分/百万 Token)
  • 这次用的折扣(如"约 5.7 折")
  • 划线的标准合计(不打折时的原价积分)和实付总额

折扣是计费当刻冻结的——就算之后平台调了价,这条历史记录里的折扣和原价也不会跟着变,方便你对账。


五、什么是分组

分组可以理解为"服务档位"。同一个模型,平台通过不同分组提供,每个分组的价格和稳定性不同。打个比方:就像坐高铁有二等座和一等座,目的地一样,但舒适度和价格不同。

分组档位 折扣特点 适合谁
经济型 折扣力度大、最便宜,可能偶有波动 个人学习、测试开发、对稳定性要求不高
标准型 折扣适中、稳定性好 日常业务使用
高级型 折扣小(接近原价)、通道最稳 生产环境、对可用性要求严格

说明:

  • 分组名称和具体价格以控制台「模型广场」或「调用指南」实际展示为准,上表仅示意。
  • 你在创建 API 密钥时会绑定一个分组,之后通过这把密钥的调用都按该分组的价格计费。
  • 追求低成本选经济型,追求稳定选高级型,由你决定。
  • 国外模型和国内模型都走同一套分组折扣机制,区别只是各自的官方积分价不同。

六、哪里查最新价格

你想了解的 去哪里看
某个模型在各分组下的积分单价 控制台 → 模型广场
当前可用的模型和分组 控制台 → 调用指南
充值和购买积分 控制台 → 兑换 / 购买
历史扣费明细(含"费用明细"弹窗) 控制台 → 使用记录
当前余额 控制台 → 仪表盘首页

模型价格可能随供应商调价或平台策略调整而变化,请以控制台实际显示为准。

我的订阅页面:

我的订阅


七、常见问题

Q:100 元大约能用多久?

A:取决于你用什么模型、用多少。以中等价位模型的一次普通对话(约 800 输入 + 1200 输出 Token)粗估,单次约 0.1 积分上下,100 积分可以进行上千次这样的简单对话。长文档处理或大量代码生成会明显更费,实际次数相应减少。日常轻度使用,100 元能用很久。

Q:积分和余额有什么区别?

A:没有区别,是同一个东西的不同叫法。充值时显示"余额",扣费时扣"积分",1 积分 = 1 元,数值完全相同。

Q:Token 是什么?

A:Token 是模型处理文本的基本单位。粗略理解:1 个中文汉字约 1~2 个 Token,1 个英文单词约 1 个 Token。你不用自己数,平台会自动计算并在使用记录里展示。

Q:为什么同一个模型在不同分组价格不同?

A:因为不同分组背后的服务通道不同,给的折扣力度也不同。折扣接近原价的分组通常通道更稳定、服务保障更好,所以更贵;折扣力度大的分组更便宜,但稳定性可能稍差。按你的业务场景选合适的即可。

Q:折扣是什么?

A:折扣是每个分组在模型官方积分价上打的折,是一个 0~1 之间的系数:1 = 原价,越小越便宜(比如 0.571 ≈ 5.7 折)。你不用记这些数字,模型广场里展示的价格已经是折后最终价。(早期的"倍率 ×N"说法已废弃。)

Q:什么是"长上下文档位"?会不会突然变贵?

A:少数模型(如 Claude Sonnet 4/4.5 系列)在单次请求特别长时,会自动切换到更贵的"长档价"。这是模型本身的定价规则,系统自动判断、无需你操作,费用明细里会如实显示。大多数模型只有一套价,不涉及这个。

Q:什么是缓存?能省多少钱?

A:部分模型(如 Claude 系列)支持提示缓存。如果你的调用里有大段重复的上下文(比如固定的系统提示),模型会自动缓存这部分。命中缓存后,这部分 Token 按远低于普通输入的价格计费(约十分之一)。重复调用越多越划算,详见 计价举例

Q:注册后有没有免费额度?

A:是否赠送免费积分取决于当前运营活动。如果注册时用了促销码或兑换码,对应积分会直接充入账户。具体以注册页面提示为准。

Q:充值后能退款吗?

A:如有退款需求,请联系平台客服团队协商处理。