AI API 成本对比:GPT、Grok、Gemini、DeepSeek 与 Kimi 怎么算账
用同一个假设 token 用量计算请求成本,并分清缓存、长上下文、推理输出、峰谷与促销价格。数字均附官方出处,未核验的报价留空,不混入聊天会员月费。

本文基于官方资料整理,核对日期为 2026-09-03;并非原文全文翻译,也不是同条件模型实测。正文区分文档事实与编辑建议,来源可通过编号查阅。
SOURCE NOTES
对比要点
关键差异对照
窄屏可左右滑动查看完整表格。
| 模型/条件 | 输入单价 | 输出单价 | 示例请求成本 | 来源 |
|---|---|---|---|---|
| GPT-5.6 Sol · 短输入 | $4.00 | $20.00 | $0.08000 | [1] |
| Grok 4.6 · 短输入 | $2.00 | $6.00 | $0.03200 | [2] |
| Gemini 3.8 Flash · 介绍价 | $0.75 | $3.75 | $0.01500 | [3] |
| DeepSeek V4-Pro · 峰时 | $1.32 | $3.96 | $0.02112 | [4] |
| DeepSeek V4-Pro · 谷时 | $0.66 | $1.98 | $0.01056 | [4] |
| DeepSeek V4-Flash · 峰时 | $0.44 | $1.32 | $0.00704 | [4] |
| Kimi K3 | 未核验 | 未核验 | 暂不计算 | [5] |
模享解读 · 非原文观点
最便宜的 token 不一定产生最便宜的完成任务
上表示例按“输入 token ÷ 一百万 × 输入单价 + 输出 token ÷ 一百万 × 输出单价”计算。假设各家产生相同用量只是为了统一算术条件;真实任务中,分词方式、推理长度和失败重试都可能不同。
建议按成功交付一次结果的总花费来比较。批量抽取可以重点观察缓存命中和无效输出;复杂修复还应统计重试轮数、人工检查时间以及搜索工具成本。把输出上限设得很低虽然省钱,却也可能把正确解答截断。
可以从这份清单开始
- 保存当日价格和促销截止日。
- 分别统计未缓存输入、缓存输入与计费输出。
- 同时记录成功率、重试次数及总账单。
- 对长输入、工具调用与峰谷时段单独测试。
来源与说明
以下为本次实际查阅的官方资料。核对日期不是每份文档的发布日期;规格及价格是当日快照。文中的用途建议、算例与实践清单为模享整理,不代表来源机构立场。
- GPT-5.6 Sol · 模型规格与价格(官方来源,新窗口)
OpenAI · 核对于 2026-09-03
- Grok 4.6 · 模型规格(官方来源,新窗口)
xAI · 核对于 2026-09-03
- Gemini 3.8 Flash · 推理档位与促销价格(官方来源,新窗口)
Google · 核对于 2026-09-03
- Models & Pricing · V4 模型与峰谷价格(官方来源,新窗口)
DeepSeek · 核对于 2026-09-03
- Kimi K3 Pricing · 计费与搜索更新说明(官方来源,新窗口)
Moonshot AI · 核对于 2026-09-03
资料核对日期:2026-09-03。本文为官方文档的中文对照与编辑分析,并非同条件模型实测;规格、可用性与价格可能变化,不代表聊天会员套餐权益。 Gemini 介绍价截至 2026-12-31,之后文档列出 $1.50/$7.50。GPT 当前优惠至少持续至 2026-11-21。DeepSeek 峰时为周一至周五 UTC 01:00–04:00、06:00–10:00,其余时段为谷时;实际计费以服务方为准。