返回管理后台

GPT 请求费用计算说明

价格快照:2026-09-06,版本 `apimart-gpt-2026-09-06-v1`。

来源:[APIMart 定价中心](https://apimart.ai/zh/pricing),切换 LLM 后搜索 GPT,采用“我们的价格”。

记账单位与费用性质

页面按 Credits / 百万 token 报价,旁边的美元价格只是另一种显示。沿用本账户所有者确认的口径:1 Credit 在本后台记为 1 元;这不是美元兑人民币汇率,也不代表所有 APIMart 账户的充值成本相同。页面价格已经含 20% 优惠,不再乘一次 0.8。

文字计算结果是价目表估算,保存在 estimated_cost_cny;上游返回或人工核对的实际费用保存在 cost_cny。两者分列展示,不覆盖、不相加,也不会自动扣减用户钱包。专属渠道折扣、调价、额外工具调用费用可能使实际账单不同。

每次请求如何复算

1. 使用提交给 APIMart 的精确模型 ID 查价,不用响应中可能被映射的模型名替换,也不模糊匹配未知版本。

2. 从 usage 读取输入总数 I、输出总数 O、缓存命中 R、缓存写入 W。标准 OpenAI 协议中 R 和 W 属于输入总数,普通输入 U = I - R - W。

3. 以完整输入总数 I(包含缓存)选择档位:I ≤ 272000 用普通档,I > 272000 用长输入档。跨档后整次请求使用该档单价,不仅给超出部分加价。

4. 费用(Credits)= (U × 输入单价 + R × 缓存输入单价 + W × 缓存写入单价 + O × 输出单价) / 1000000。按本账户口径得到元。

5. 各项先精确相加,最后一次四舍五入到小数点后 8 位。系统使用 BigInt 定点计算,避免浮点累积误差。

例如 gpt-5.6-sol:I=10000、R=6000、W=1000、O=2000,则 U=3000。

`(3000×32 + 6000×3.2 + 1000×40 + 2000×160) / 1000000 = 0.47520000 元`

同样 I=10000、O=2000,但无任何缓存,则为 `0.64000000 元`。

长输入示例 I=273000、O=2000、无缓存:`(273000×64 + 2000×240)/1000000 = 17.95200000 元`。

用量字段与边界

- Chat Completions:I=prompt_tokens,O=completion_tokens,R=prompt_tokens_details.cached_tokens,W=prompt_tokens_details.cache_write_tokens。

- Responses:I=input_tokens,O=output_tokens,R=input_tokens_details.cached_tokens,W=input_tokens_details.cache_write_tokens(若上游提供)。

- Messages:input_tokens 通常不含缓存;系统先加 cache_read_input_tokens 和 cache_creation_input_tokens 得到 I,再拆分三个输入类别。

- reasoning_tokens 已包含在输出总数中,不额外加一次;total_tokens 仅供统计,不可再单独计费。

- 流式响应采用最后一份累计 usage,不能把每个事件的累计数相加。重复事件不会重复计算。

- 缓存字段缺失时,以 0 估算,并在 pricing_details.warnings 明确记录假设;不把缺失值宣称为真实的零。

- 如果已知有缓存命中/写入,但价目表没公布相应单价,保持待核实;不擅自借用另一模型或 OpenAI 官方价格。

- 输入、输出或缓存数量异常;缓存之和超过输入;未知模型;非默认服务档;已识别的图片/音频 token;额外计费工具或搜索模型:不生成完整费用估算,记录原因。

- 请求中断但已有 usage 时可记录估算,同时保留“请求结果不确定”提示;失败且无 usage 的请求不算作零元。

- 这里仅收录 GPT/ChatGPT 文字模型。Realtime、语音转写、图片模型不套用文字公式;图片/视频任务仍按上游最终 credits_cost 记录实际费用。

在后台和程序中查看

后台“调用记录”同时显示实际扣费、估算费用。点击请求 ID 查看 pricing_details:包括价格版本、来源、模型、原始计费用量、拆分数量、选定档位、单价和假设。CSV 导出也包含这些字段。

鉴权后的 GET /api/me/usage 可查询自己的记录;管理接口 GET /admin/api/requests/:id 可查看某次请求的完整计算依据。原模型响应协议保持兼容。

本地复算(在 api-gateway 目录运行,Node.js 24):


node ops/calculate-price.mjs gpt-5.6-sol 10000 2000 6000 1000

参数顺序为模型、输入总数、输出总数、缓存输入数、缓存写入数;缓存参数省略会留下“假设为零”的提示。

历史记录与调价

旧记录只保存了输入/输出总数,无法恢复真实缓存明细。补算使用本次价格快照并明确标注“历史用量按当前价目表估算、缓存按零假设”,不可当作历史实际账单。没有 usage 的记录仍待核实。已有实际金额不受影响。

更新 src/gpt-prices.json 时必须重新核对来源、递增 version、更新日期、执行定价测试并部署。新请求使用新快照;已完成请求保存的单价和版本不会因调价而变化。本次没有启用自动抓价,避免上游页面变化直接改动账本。

提取的完整文字价表

单位:Credits / 百万 token。“—”表示页面未公布该项,并非免费。仅使用“我们的价格”,不重复折扣。

核对 APIMart 最新价格

模型 ID输入档位输入缓存输入缓存写入输出
gpt-5-nano全部0.43.2
gpt-5-nano-2025-08-07全部0.43.2
gpt-4.1-nano全部0.83.2
gpt-4.1-nano-2025-04-14全部0.83.2
gpt-4o-mini全部1.24.8
gpt-5.4-nano全部1.610
gpt-5-mini全部216
gpt-5-mini-2025-08-07全部216
gpt-5.1-codex-mini全部216
gpt-4.1-mini全部3.212.8
gpt-4.1-mini-2025-04-14全部3.212.8
gpt-3.5-turbo全部48
gpt-3.5-turbo-0125全部48
gpt-5.4-mini全部636
gpt-3.5-turbo-1106全部816
gpt-5全部1080
gpt-5-2025-08-07全部1080
gpt-5-chat-latest全部1080
gpt-5-codex全部1080
gpt-5-search-api全部1080
gpt-5-search-api-2025-10-14全部1080
gpt-5.1全部1080
gpt-5.1-2025-11-13全部1080
gpt-5.1-chat-latest全部1080
gpt-5.1-codex全部1080
gpt-5.1-codex-max全部1080
gpt-3.5-turbo-0613全部1224
gpt-3.5-turbo-instruct全部1215.96
gpt-5.2全部14112
gpt-5.2-chat-latest全部14112
gpt-5.2-codex全部14112
gpt-5.3-codex全部14112
gpt-4.1全部1664
gpt-4.1-2025-04-14全部1664
gpt-4-32k全部2080
gpt-4-32k-0613全部2080
gpt-4-vision-preview全部2080
gpt-4o全部2080
gpt-4o-2024-11-20全部2080
gpt-3.5-turbo-16k全部2472
gpt-3.5-turbo-16k-0613全部2472
chatgpt-4o-latest全部40120
gpt-4o-2024-05-13全部40120
gpt-4-0125-preview全部80160
gpt-4-1106-preview全部80160
gpt-5-pro全部120960
gpt-5-pro-2025-10-06全部120960
gpt-5.2-pro全部1681344
gpt-4.5-preview全部6001200
gpt-4.5-preview-2025-02-27全部6001200
gpt-5.6-luna≤2720001.60.1629.6
gpt-5.6-luna>2720003.20.32414.4
gpt-5.6-terra≤272000161.62096
gpt-5.6-terra>272000323.240144
gpt-5.6-sol≤272000323.240160
gpt-5.6-sol>272000646.480240
gpt-5.4≤272000202120
gpt-5.4>272000404180
gpt-5.5≤272000404240
gpt-5.5>272000808360
gpt-5.4-pro≤2720002401440
gpt-5.4-pro>2720004802160