AIAPIZZ 登录 免费注册

计费与用量

共 14 篇

计费单位

全站只有一种价钱:人民币(元)。充值是元,余额是元,扣费也是元,账单里不会出现任何看不懂的内部单位。

模型广场里展示的价格是每百万 token 的人民币单价(写作「x.xx 元/百万」),与上游官方价签的口径一致。金额计算保留 6 位小数,所以再便宜的模型也能算清费用,不会因为四舍五入被抹成 0。

费用怎么算

一次对话调用的费用(按 token 计费的模型):

上游成本 = 可计费输入/1000000 × 输入单价
         + 输出/1000000 × 输出单价
         + 缓存命中/1000000 × 缓存单价
         + 缓存写入/1000000 × 缓存写入单价

应付 = 四个分项各自乘上「自己的时段倍率」后求和,再 × 站点倍率 × 折扣

单价就是模型广场上标的「元/百万 token」。举例:某模型输入 2 元/百万、输出 8 元/百万,

一次调用输入 3000 token、输出 800 token,应付 = 3000/1000000×2 + 800/1000000×8 = 0.0124 元

(再乘时段倍率、站点倍率和折扣)。

其中:

项说明
可计费输入prompt_tokens - cache_tokens,命中缓存的部分不再按全价收
缓存命中价模型没单独填缓存价时,按「输入价 × 全局缓存系数」(默认 0.25)兜底
缓存写入价模型没单独填缓存写入价时,按「输入价 × 全局缓存写入系数」(默认 1.25)兜底;只有 Anthropic 系会报这个量
时段倍率运营按时段给四路分别配的倍数,没配的那一路就是 ×1(见下);它只影响我们收多少,不影响统计里的上游成本
站点倍率站点按用户等级/套餐定价的系数(见下)
折扣模型自身的促销折扣,1 表示不打折

绘图、语音、视频等按次计费的模型:单次价 × 次数,不走 token。按次计费的模型同样吃当前时段的输入倍率(没有单独为「次」配一路倍率)。联网搜索也是按次计费的一项,见下一节。

联网搜索(按次计费)

有些模型支持联网搜索:回答之前先去网上查一圈,再把查到的内容写进答案。这项能力由模型服务方执行,按次数单独收费,是和我们按 token 收的那部分并行的另一笔账。

  • 价格在模型广场的模型卡片和模型详情页的计费说明里都标着,写作「x.xxx 元/次」,已包含当前倍率与折扣;
  • 实际搜了几次就收几次。次数以模型服务方回传的结果为准,我们不会拿你请求里带的参数去猜 —— 回答时没有联网,就不产生这笔费用;
  • 和绘图、语音那些按次计费的模型一样,按次费吃当前时段的输入倍率,没有单独为「次」配的一路倍率;
  • 模型广场上没有标出「联网搜索」的模型,就是不支持这项能力(或者运营没有给它定价),调用它不会产生这笔费用。

三种接口格式的开启写法:

OpenAI 格式

{
  "model": "你的模型名",
  "messages": [{"role": "user", "content": "今天有什么科技新闻?"}],
  "web_search_options": {}
}

Anthropic 格式

{
  "model": "你的模型名",
  "max_tokens": 1024,
  "messages": [{"role": "user", "content": "今天有什么科技新闻?"}],
  "tools": [{"type": "web_search_20250305", "name": "web_search"}]
}

Gemini 格式

{
  "contents": [{"parts": [{"text": "今天有什么科技新闻?"}]}],
  "tools": [{"google_search": {}}]
}

几点要注意的:

  • 联网搜索要按模型所支持的格式去调。换了格式用不了时,把联网搜索那一段参数去掉就能照常调用,不会报错,也不会产生这笔费用;
  • 能不能用取决于该模型的服务方有没有开通这项能力,同一个模型名换一条线路,支持情况也可能不同;
  • 上游对不支持的参数通常会回一个 4xx,看到这类报错时先去掉联网搜索参数再试一次;
  • 计费明细里,联网搜索会单独占一列(后台是「几次 × 每次多少钱」的写法),用量里也能看到「搜索了几次」。

倍率是怎么定的

同一份上游价格,不同用户可以有不同的售价。取值优先级从高到低:

  1. 你当前生效的 VIP 套餐里,该模型所属分组的专属倍率;
  2. VIP 套餐的默认倍率;
  3. 模型自身设定的倍率;
  4. 站点全局默认倍率(默认 1)。

模型广场/详情页显示的价格已经把倍率和折扣算进去了,列表页上看到的就是你要付的价(列表价不含时段倍率,因为它随时刻变化)。

分时段倍率

除了上面那套「按人定价」的站点倍率,运营还可以配一套「按时间定价」的倍率:把一天切成若干时段,每个时段单独给输入 / 输出 / 缓存命中 / 缓存写入四路各配一个倍数。高峰期 ×2、夜间 ×0.8 这类玩法都靠它。

  • 四路互相独立:只配了输入 ×2、输出留空,那么这次调用只有输入那一项翻倍,输出还是原价;
  • 留空 = ×1,不是免费。所以「没配过时段倍率」的模型与「配了但全留空」的模型,收的钱完全一样;
  • 倍率乘在绝对价之后:先按「基础价 → 长度分段 → 分时绝对价」定出这一单的单价,四个分项各自乘自己的时段倍率,最后再乘站点倍率和折扣;
  • 它只作用于应收,不进「上游成本」那一栏。所以后台看到的渠道成本与毛利润不会被时段倍率放大,加价的部分干干净净地记在利润里;
  • 模型详情页会把分时段倍率整张表列出来,并标出当前时刻生效的是哪一段。

站点倍率与时段倍率是两层,同时存在时相乘。页面上没标「当前时段」的价格一律不含时段倍率 —— 想按小时对账,以调用日志里的实际扣费为准。

分段计价

输入很长时,很多上游会涨价。本站支持按单次请求的输入长度分段定价:超过阈值的那部分按更高的单价算(阈值与价格由运营在后台配置,模型详情页会列出所有分段)。没配置分段的模型一律使用基础单价。

分段的另一个用处是覆盖模型规格:每个分段可以顺带指定该档的「上下文窗口」与「最大输出」。比如某模型基础上下文 200K,但输入超过 128K 时上游只保证 32K 输出,运营就可以在对应分段上写清这两项 —— 详情页「规格与表现」里显示的就是它。没配就沿用模型本身的单值规格。

余额、扣费与欠费

  • 余额存在账号上,余额小于等于 0 时网关直接拒绝请求并返回 402;
  • 有团队的账号有两个钱包:自己的余额与团队的余额,两本账永远不会互相转入。先用哪个由你自己在控制台里设(「我的团队」页和「个人设置」页各有一个同样的开关,默认先用团队的)。详见《认证与密钥》里的「团队账号与两个钱包」;
  • 每次调用完成后结算,扣费在数据库事务里完成,先锁余额行再扣,不会扣成负数;
  • 极少数并发场景下(余额刚好见底时同时发出的请求)可能出现「应扣多于实扣」,这部分差额会记在后台的操作日志里(billing.overdraw),不会从你账户里追扣;
  • 充值实时到账,到账后无需重新建密钥,下一次请求就能用。团队成员充值进的是自己的余额,不会计入团队。

用量在哪里看

位置内容
控制台「总览」今日/近 7 天的请求数与消费、余额趋势
控制台「调用日志」每一次请求的模型、端点、输入/输出/缓存命中/缓存写入 token、费用、耗时、是否流式、状态码、IP、错误信息
控制台「API 密钥」每个密钥的累计消费(额度上限用满即停)
后台全站消费、各渠道成本与上游消耗

「缓存写入」那一列只有 Anthropic 系模型会产生数值,其余格式恒为 0,所以它在日志明细里是按需出现的(没有这个量就不占一行)。

按天汇总的数据来自每日聚合表,日志明细按调用逐条记录。网关给每个响应都带了 X-Request-Id 响应头,用它可以在日志里精确定位一次调用。

上游没给用量怎么办

部分上游(尤其是流式响应)不返回 usage。此时网关按「1 token ≈ 4 字符」估算输入输出长度后计费,估算值会写进日志,可能有 ±10% 的偏差。

返利与邀请

被邀请人每次消费,邀请人按站点配置的比例获得返利(按实收金额计算)。返利规则与比例以控制台「邀请返利」页面显示为准。

你的接口地址是 https://aiapizz.com/v1。 注册后即可在控制台创建密钥。
AIAPIZZ  · 模型广场  · 接口文档  · 服务条款  · 隐私政策
This website is independently developed and operated by the AIAPIZZ team. It is not affiliated with, authorized by, endorsed by, or otherwise associated with any other AI website, platform, brand, or service provider.
© 2026 AIAPIZZ