返回 Agent 博客
模型对比官方资料对照 · 非实测排名

AI API 成本对比:GPT、Grok、Gemini、DeepSeek 与 Kimi 怎么算账

用同一个假设 token 用量计算请求成本,并分清缓存、长上下文、推理输出、峰谷与促销价格。数字均附官方出处,未核验的报价留空,不混入聊天会员月费。

玻璃算盘、计量盘与 token 圆片,象征 AI API 用量与成本核算
模享概念配图 · 非原文截图

本文基于官方资料整理,核对日期为 2026-09-03;并非原文全文翻译,也不是同条件模型实测。正文区分文档事实与编辑建议,来源可通过编号查阅。

SOURCE NOTES

对比要点

  • 下表只比较 API 文本 token 的公开报价,不含会员月费。缓存、工具、长上下文、税费与重试应另算。[1][2][3][4][5]
  • GPT-5.6 Sol 的长输入存在倍率计费;Grok 4.6 也提示长上下文采用不同价格。Gemini 3.8 Flash 当前为限时介绍价,不能直接当成永久价格。[1][2][3]
  • DeepSeek V4 需要区分峰时与谷时。Kimi K3 的所读价格页没有可核验的数字表格,因此本次不填入估计值。[4][5]

关键差异对照

窄屏可左右滑动查看完整表格。

USD/百万 token;输入未命中缓存。示例为 10,000 输入 + 2,000 计费输出 token,仅用于算账,不是相同任务实测
模型/条件输入单价输出单价示例请求成本来源
GPT-5.6 Sol · 短输入$4.00$20.00$0.08000[1]
Grok 4.6 · 短输入$2.00$6.00$0.03200[2]
Gemini 3.8 Flash · 介绍价$0.75$3.75$0.01500[3]
DeepSeek V4-Pro · 峰时$1.32$3.96$0.02112[4]
DeepSeek V4-Pro · 谷时$0.66$1.98$0.01056[4]
DeepSeek V4-Flash · 峰时$0.44$1.32$0.00704[4]
Kimi K3未核验未核验暂不计算[5]

模享解读 · 非原文观点

最便宜的 token 不一定产生最便宜的完成任务

上表示例按“输入 token ÷ 一百万 × 输入单价 + 输出 token ÷ 一百万 × 输出单价”计算。假设各家产生相同用量只是为了统一算术条件;真实任务中,分词方式、推理长度和失败重试都可能不同。

建议按成功交付一次结果的总花费来比较。批量抽取可以重点观察缓存命中和无效输出;复杂修复还应统计重试轮数、人工检查时间以及搜索工具成本。把输出上限设得很低虽然省钱,却也可能把正确解答截断。

可以从这份清单开始

  1. 保存当日价格和促销截止日。
  2. 分别统计未缓存输入、缓存输入与计费输出。
  3. 同时记录成功率、重试次数及总账单。
  4. 对长输入、工具调用与峰谷时段单独测试。

来源与说明

以下为本次实际查阅的官方资料。核对日期不是每份文档的发布日期;规格及价格是当日快照。文中的用途建议、算例与实践清单为模享整理,不代表来源机构立场。

  1. GPT-5.6 Sol · 模型规格与价格(官方来源,新窗口)

    OpenAI · 核对于 2026-09-03

  2. Grok 4.6 · 模型规格(官方来源,新窗口)

    xAI · 核对于 2026-09-03

  3. Gemini 3.8 Flash · 推理档位与促销价格(官方来源,新窗口)

    Google · 核对于 2026-09-03

  4. Models & Pricing · V4 模型与峰谷价格(官方来源,新窗口)

    DeepSeek · 核对于 2026-09-03

  5. Kimi K3 Pricing · 计费与搜索更新说明(官方来源,新窗口)

    Moonshot AI · 核对于 2026-09-03

资料核对日期:2026-09-03。本文为官方文档的中文对照与编辑分析,并非同条件模型实测;规格、可用性与价格可能变化,不代表聊天会员套餐权益。 Gemini 介绍价截至 2026-12-31,之后文档列出 $1.50/$7.50。GPT 当前优惠至少持续至 2026-11-21。DeepSeek 峰时为周一至周五 UTC 01:00–04:00、06:00–10:00,其余时段为谷时;实际计费以服务方为准。