全站只有一种价钱:人民币(元)。充值是元,余额是元,扣费也是元,账单里不会出现任何看不懂的内部单位。
模型广场里展示的价格是每百万 token 的人民币单价(写作「x.xx 元/百万」),与上游官方价签的口径一致。金额计算保留 6 位小数,所以再便宜的模型也能算清费用,不会因为四舍五入被抹成 0。
一次对话调用的费用(按 token 计费的模型):
上游成本 = 可计费输入/1000000 × 输入单价
+ 输出/1000000 × 输出单价
+ 缓存命中/1000000 × 缓存单价
+ 缓存写入/1000000 × 缓存写入单价
应付 = 四个分项各自乘上「自己的时段倍率」后求和,再 × 站点倍率 × 折扣
单价就是模型广场上标的「元/百万 token」。举例:某模型输入 2 元/百万、输出 8 元/百万,
一次调用输入 3000 token、输出 800 token,应付 = 3000/1000000×2 + 800/1000000×8 = 0.0124 元
(再乘时段倍率、站点倍率和折扣)。
其中:
| 项 | 说明 |
|---|---|
| 可计费输入 | prompt_tokens - cache_tokens,命中缓存的部分不再按全价收 |
| 缓存命中价 | 模型没单独填缓存价时,按「输入价 × 全局缓存系数」(默认 0.25)兜底 |
| 缓存写入价 | 模型没单独填缓存写入价时,按「输入价 × 全局缓存写入系数」(默认 1.25)兜底;只有 Anthropic 系会报这个量 |
| 时段倍率 | 运营按时段给四路分别配的倍数,没配的那一路就是 ×1(见下);它只影响我们收多少,不影响统计里的上游成本 |
| 站点倍率 | 站点按用户等级/套餐定价的系数(见下) |
| 折扣 | 模型自身的促销折扣,1 表示不打折 |
绘图、语音、视频等按次计费的模型:单次价 × 次数,不走 token。按次计费的模型同样吃当前时段的输入倍率(没有单独为「次」配一路倍率)。联网搜索也是按次计费的一项,见下一节。
有些模型支持联网搜索:回答之前先去网上查一圈,再把查到的内容写进答案。这项能力由模型服务方执行,按次数单独收费,是和我们按 token 收的那部分并行的另一笔账。
三种接口格式的开启写法:
OpenAI 格式
{
"model": "你的模型名",
"messages": [{"role": "user", "content": "今天有什么科技新闻?"}],
"web_search_options": {}
}
Anthropic 格式
{
"model": "你的模型名",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "今天有什么科技新闻?"}],
"tools": [{"type": "web_search_20250305", "name": "web_search"}]
}
Gemini 格式
{
"contents": [{"parts": [{"text": "今天有什么科技新闻?"}]}],
"tools": [{"google_search": {}}]
}
几点要注意的:
同一份上游价格,不同用户可以有不同的售价。取值优先级从高到低:
模型广场/详情页显示的价格已经把倍率和折扣算进去了,列表页上看到的就是你要付的价(列表价不含时段倍率,因为它随时刻变化)。
除了上面那套「按人定价」的站点倍率,运营还可以配一套「按时间定价」的倍率:把一天切成若干时段,每个时段单独给输入 / 输出 / 缓存命中 / 缓存写入四路各配一个倍数。高峰期 ×2、夜间 ×0.8 这类玩法都靠它。
站点倍率与时段倍率是两层,同时存在时相乘。页面上没标「当前时段」的价格一律不含时段倍率 —— 想按小时对账,以调用日志里的实际扣费为准。
输入很长时,很多上游会涨价。本站支持按单次请求的输入长度分段定价:超过阈值的那部分按更高的单价算(阈值与价格由运营在后台配置,模型详情页会列出所有分段)。没配置分段的模型一律使用基础单价。
分段的另一个用处是覆盖模型规格:每个分段可以顺带指定该档的「上下文窗口」与「最大输出」。比如某模型基础上下文 200K,但输入超过 128K 时上游只保证 32K 输出,运营就可以在对应分段上写清这两项 —— 详情页「规格与表现」里显示的就是它。没配就沿用模型本身的单值规格。
billing.overdraw),不会从你账户里追扣;| 位置 | 内容 |
|---|---|
| 控制台「总览」 | 今日/近 7 天的请求数与消费、余额趋势 |
| 控制台「调用日志」 | 每一次请求的模型、端点、输入/输出/缓存命中/缓存写入 token、费用、耗时、是否流式、状态码、IP、错误信息 |
| 控制台「API 密钥」 | 每个密钥的累计消费(额度上限用满即停) |
| 后台 | 全站消费、各渠道成本与上游消耗 |
「缓存写入」那一列只有 Anthropic 系模型会产生数值,其余格式恒为 0,所以它在日志明细里是按需出现的(没有这个量就不占一行)。
按天汇总的数据来自每日聚合表,日志明细按调用逐条记录。网关给每个响应都带了 X-Request-Id 响应头,用它可以在日志里精确定位一次调用。
部分上游(尤其是流式响应)不返回 usage。此时网关按「1 token ≈ 4 字符」估算输入输出长度后计费,估算值会写进日志,可能有 ±10% 的偏差。
被邀请人每次消费,邀请人按站点配置的比例获得返利(按实收金额计算)。返利规则与比例以控制台「邀请返利」页面显示为准。