价格说明
价格说明
适用角色:主用户、子用户 更新日期:2026-07-22
这篇用最简单的方式说清楚:平台怎么收费、一次调用花多少积分、去哪查价格。
一、最简版:三句话说清楚
充值 → 调用 → 按实际用量扣积分。
- 没有月费、没有最低消费,用多少扣多少。
- 充的人民币 1:1 变成积分(1 元 = 1 积分),调用时按量扣积分。
- 每个模型有一套官方积分价,你选的分组(服务档位)在这个价上打个折,最终按折后价扣费。
二、什么是积分
积分是平台统一的计费和余额单位,和人民币的关系非常简单:
1 元 = 1 积分,这个比例永远不变。
你充 100 元,账户里就有 100 积分;每次调用扣掉相应积分,剩下的就是可用余额。登录控制台,在仪表盘首页即可看到当前余额。
"积分"和"余额"本质是一回事:充值时叫"余额",扣费时扣"积分",数值完全一致。
关于不同模型的价格来源,你只需要知道一句话:不同模型的官方定价来源不一样,平台会统一把它们折算成积分,所以你在页面上看到的价格、扣的费用,永远是积分,不需要自己做任何换算。
三、调一次模型要花多少积分
计费的四个维度
一次调用的费用最多由四部分组成:
| 维度 | 是什么 | 价格特点 |
|---|---|---|
| 输入 | 你发给模型的内容 | 基准价 |
| 输出 | 模型回复的内容 | 通常比输入贵不少(Claude 系列约为输入的 5 倍) |
| 缓存写入 | 第一次把一段重复内容存进缓存 | 略高于输入;分"5 分钟""1 小时"两档有效期 |
| 缓存读取 | 后续命中缓存、直接复用的部分 | 最便宜,约为输入价的十分之一 |
不是每次都四项全有:不支持缓存的模型只有输入、输出两项;这次调用没写入/没命中缓存,对应项就是 0。
基本公式(全程都用积分算)
本次费用(积分)= 输入 + 输出 + 缓存写入 + 缓存读取
每一项 = 该维度 Token 数 ÷ 100 万 × 该维度积分单价 × 分组折扣输入和输出分开计价;缓存那两项只有模型支持缓存、且这次真的写入/命中了才产生。
模型积分价 + 分组折扣
每个模型有一套官方积分价(输入 / 输出 / 缓存 各一个价)。你选的分组在官方价上乘一个折扣系数:
你的实际单价 = 官方积分价 × 分组折扣折扣系数是 0 到 1 之间的数,1 表示原价、不打折,数值越小越便宜:
- 折扣 1.0 = 原价
- 折扣 0.7 ≈ 打七折
- 折扣 0.571 ≈ 打 5.7 折(越低越省)
说明:早期版本用过"倍率 ×N"的说法,现已统一为"折扣系数",不再有加价倍率的概念。 你不用自己算——模型广场和调用指南显示的价格,就是你所选分组的折后最终价,直接看那个数就行。
缓存三个价的固定比例(同一模型内)
以该模型的输入价为基准:
- 缓存写入(5 分钟有效期)≈ 输入价 × 1.25
- 缓存写入(1 小时有效期)≈ 输入价 × 2
- 缓存读取 ≈ 输入价 × 0.1
所以重复上下文越多、命中缓存越多,越省钱。
长上下文档位(少数模型才有)
少数模型(如 Claude Sonnet 4 / 4.5 系列)有"长上下文档位":当单次请求的 Token 量超过某个阈值时,输入 / 输出 / 缓存的单价会自动切换到更贵的"长档价"。你不用做任何操作,系统自动判档,费用明细里会如实体现。大多数模型没有这个档位,只有一套价。
一个简单例子(示意)
假设某模型在你所选分组下:输入 20 积分/百万 Token、输出 100 积分/百万 Token(示意数字,实际以模型广场为准)。你发了 800 Token、模型回了 1200 Token:
输入 = 800 ÷ 100万 × 20 = 0.016 积分
输出 = 1,200 ÷ 100万 × 100 = 0.12 积分
合计 = 0.136 积分 ≈ 1 毛 4四、费用明细:每一笔都能看到怎么算的
在「使用记录」里,把鼠标停在某条记录的"费用"上,会弹出这次调用的费用明细:
- 分维度的实付积分(输入 / 输出 / 缓存读 / 缓存写 各多少)
- 每个维度的单价(积分/百万 Token)
- 这次用的折扣(如"约 5.7 折")
- 划线的标准合计(不打折时的原价积分)和实付总额
折扣是计费当刻冻结的——就算之后平台调了价,这条历史记录里的折扣和原价也不会跟着变,方便你对账。
五、什么是分组
分组可以理解为"服务档位"。同一个模型,平台通过不同分组提供,每个分组的价格和稳定性不同。打个比方:就像坐高铁有二等座和一等座,目的地一样,但舒适度和价格不同。
| 分组档位 | 折扣特点 | 适合谁 |
|---|---|---|
| 经济型 | 折扣力度大、最便宜,可能偶有波动 | 个人学习、测试开发、对稳定性要求不高 |
| 标准型 | 折扣适中、稳定性好 | 日常业务使用 |
| 高级型 | 折扣小(接近原价)、通道最稳 | 生产环境、对可用性要求严格 |
说明:
- 分组名称和具体价格以控制台「模型广场」或「调用指南」实际展示为准,上表仅示意。
- 你在创建 API 密钥时会绑定一个分组,之后通过这把密钥的调用都按该分组的价格计费。
- 追求低成本选经济型,追求稳定选高级型,由你决定。
- 国外模型和国内模型都走同一套分组折扣机制,区别只是各自的官方积分价不同。
六、哪里查最新价格
| 你想了解的 | 去哪里看 |
|---|---|
| 某个模型在各分组下的积分单价 | 控制台 → 模型广场 |
| 当前可用的模型和分组 | 控制台 → 调用指南 |
| 充值和购买积分 | 控制台 → 兑换 / 购买 |
| 历史扣费明细(含"费用明细"弹窗) | 控制台 → 使用记录 |
| 当前余额 | 控制台 → 仪表盘首页 |
模型价格可能随供应商调价或平台策略调整而变化,请以控制台实际显示为准。
我的订阅页面:

七、常见问题
Q:100 元大约能用多久?
A:取决于你用什么模型、用多少。以中等价位模型的一次普通对话(约 800 输入 + 1200 输出 Token)粗估,单次约 0.1 积分上下,100 积分可以进行上千次这样的简单对话。长文档处理或大量代码生成会明显更费,实际次数相应减少。日常轻度使用,100 元能用很久。
Q:积分和余额有什么区别?
A:没有区别,是同一个东西的不同叫法。充值时显示"余额",扣费时扣"积分",1 积分 = 1 元,数值完全相同。
Q:Token 是什么?
A:Token 是模型处理文本的基本单位。粗略理解:1 个中文汉字约 1~2 个 Token,1 个英文单词约 1 个 Token。你不用自己数,平台会自动计算并在使用记录里展示。
Q:为什么同一个模型在不同分组价格不同?
A:因为不同分组背后的服务通道不同,给的折扣力度也不同。折扣接近原价的分组通常通道更稳定、服务保障更好,所以更贵;折扣力度大的分组更便宜,但稳定性可能稍差。按你的业务场景选合适的即可。
Q:折扣是什么?
A:折扣是每个分组在模型官方积分价上打的折,是一个 0~1 之间的系数:1 = 原价,越小越便宜(比如 0.571 ≈ 5.7 折)。你不用记这些数字,模型广场里展示的价格已经是折后最终价。(早期的"倍率 ×N"说法已废弃。)
Q:什么是"长上下文档位"?会不会突然变贵?
A:少数模型(如 Claude Sonnet 4/4.5 系列)在单次请求特别长时,会自动切换到更贵的"长档价"。这是模型本身的定价规则,系统自动判断、无需你操作,费用明细里会如实显示。大多数模型只有一套价,不涉及这个。
Q:什么是缓存?能省多少钱?
A:部分模型(如 Claude 系列)支持提示缓存。如果你的调用里有大段重复的上下文(比如固定的系统提示),模型会自动缓存这部分。命中缓存后,这部分 Token 按远低于普通输入的价格计费(约十分之一)。重复调用越多越划算,详见 计价举例。
Q:注册后有没有免费额度?
A:是否赠送免费积分取决于当前运营活动。如果注册时用了促销码或兑换码,对应积分会直接充入账户。具体以注册页面提示为准。
Q:充值后能退款吗?
A:如有退款需求,请联系平台客服团队协商处理。
