热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > ai资讯 >Kimi_K3_API费用怎么算?

Kimi_K3_API费用怎么算?

来源:互联网 更新时间:2026-07-25 08:12

Kimi 公布 K3 API 详细计费规则:输入按缓存状态分两档,输出统一 100 元/百万 token,上下文按实际传入量计费

月之暗面(Moonshot AI)为其大语言模型 Kimi K3 的 API 制定了详细的计费方案。要准确预估单次调用成本,需同时考虑输入 token、输出 token、缓存命中状态和上下文窗口长度四个变量,遗漏任意一项都可能导致账单偏差超过 200%。

输入费用由缓存命中状态决定

K3 API 的输入费用分为两档,取决于请求是否命中系统自动管理的 KV 缓存。缓存机制由 Mooncake 架构自动管理,开发者无法手动开关,但可通过稳定前缀和静态 system message 提升命中率。

  • 缓存命中时

    :输入按

    2 元/百万 token

    计费。编程类工具中该状态占比常超过 90%,10 万 token 输入约需 0.2 元。
  • 缓存未命中时

    :输入按

    20 元/百万 token

    计费。冷启动对话、随机 prompt、频繁变更系统指令会触发此档,2 万 token 输入费用为 0.4 元。

输出费用统一计价

所有生成内容,包括思考链(reasoning trace)、中间步骤和最终回答,均计入输出 token 总量。输出单价固定为

100 元/百万 token

(约合 15 美元),每生成 1000 token 费用为 0.1 元。

若配置 max_completion_tokens=131072(默认上限),满额输出对应成本约 1.31 元;若拉满至 100 万 token,单次输出费用达 10 元。

上下文窗口费用按实际传入量计费

Kimi K3 支持完整 1M token 上下文,但这项能力不额外加收“长文本费”。计费方式为:按实际传入的上下文 token 数乘以单价 20 元/百万 token(与输入未命中档一致)。例如传入 50 万 token 文档,上下文费用为 1 元。

注意:只要传入上下文即开始按量计费,即使只读取其中部分内容。

真实账单计算示例

单次调用总成本由以下四项叠加计算:

  1. 实际输入 token 数(不含上下文)乘以对应缓存状态单价;
  2. 实际输出 token 数乘以 100 元/百万;
  3. 实际传入的上下文 token 总数(含文档、历史消息等)乘以 20 元/百万;
  4. 三项费用相加。

示例:20 万上下文 + 2000 输入(未命中)+ 2000 输出,成本 = (2000×20÷1000000) + (2000×100÷1000000) + (200000×20÷1000000) = 0.04 + 0.2 + 4 = 4.24 元。

本文信息基于原始资料记录时的状态,模型版本、产品功能、价格、企业合作和政策可能继续变化,实际情况以相关主体最新公开信息为准。

热门手游

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc