Kimi K3 API 定价:输入 $3.00、输出 $15.00/1M(2026)

Kimi K3 的输入价是 $3.00 / 百万 token(缓存未命中),命中缓存时 $0.30 / 百万 token,输出 $15.00 / 百万 token。上下文窗口 1,048,576 token。最让人意外的数字是:K3 的推理按输出价计费,我们实测它占总输出 token 的 43–77%——所以一条回答的实际成本,是回答本身长度的好几倍。

费率引自官方定价页,读取于 2026-07-20。开销数字由我们实测——测量方法。

官方费率

读取自月之暗面(Moonshot AI)官方定价页,时间 2026-07-20。价格只引该页并附日期戳;做预算前请再核对一次。

项目费率说明

输入——缓存未命中$3.00 / 1M每次首调都按此计费。冷调用永远不会部分命中缓存。

输入——缓存命中$0.30 / 1M便宜 10 倍。前缀重复出现时按 256 token 的块粒度生效。

输出$15.00 / 1M包含推理 token——见下文。

上下文窗口1,048,576单次约 50 万 token 输入的完整调用,$1.49、52 秒。

默认 max_completion_tokens131,072压低它可能让你为空响应买单。

$3.00/1M 的输入价在整个 1,048,576 token 的窗口内一律平价——没有长上下文加价档。

通过 EvoLink 调用,付的也是这套费率——kimi-k3 不收任何网关加价。所以其实没什么可纠结的:同一个模型、同一个价格,但一把 key 还能顺带调用 GPT、Claude 和 Gemini,也不用再单独注册一个月之暗面账号。

费率横向对照

一个可核实的参照点:Anthropic 官方给 Claude Sonnet 5 的标价与此相同——输入 $3.00/1M、输出 $15.00/1M,2026-08-31 前另有 $2.00/$10.00 的促销价(引自 Anthropic 官方定价页,读取于 2026-07-20)。我们只列自己对照过官方定价页核实的比较。

推理到底花你多少钱

K3 的推理没有关闭开关。每个响应都带一个 reasoning_content 字段,里面的每个 token 都按 $15.00 的输出价计费——和你真正读到的文字同价。所以值得关心的不是费率本身,而是账单里你永远看不见的那部分占了多少。

我们在 2026-07-16 实测了三条提示词:

每条各跑一次,kimi-k3。仅示意量级,不是基准测试——见测量方法。

提示词推理总输出推理占比

"What is 2+2? Answer with the number only."

324867%

"Explain in one paragraph why prompt caching lowers API cost."

71593077%

一道两列火车相遇的应用题,要求展示推理过程

22051843%

问 K3 二加二等于几,它要先花 32 个 token 斟酌,才产出一个字符的答案。这行账单里,三分之二是思考。

反直觉的是,最难的那条提示词推理占比反而最低(43%)。三个数据点画不出曲线,我们也不打算装作画得出——真正有用的是量级,不是公式:每条提示词都按回答长度的好几倍预留输出 token 预算,再简单的问题也不例外。

算一笔真实的账

假设一个 agent 带着 50,000 token 的固定前缀,每天处理 200 个请求——即每天 10M 输入 token。只看输入这一项:

场景费率每天每 30 天

每次请求都未命中$3.00 / 1M$30.00$900.00

前缀保持预热$0.30 / 1M$3.00$90.00

差额—$27.00$810.00

按 2026-07-20 官方费率计算,只含输入 token。便宜的那行是理想化的:每个冷却期的第一次调用照样按 $3.00 计费,末尾最多 255 个 token 永远不会命中缓存。而输出无论如何都按 $15.00/1M 计费——在这种负载下,光推理开销就很可能超过整个输入账单。把这两行当作提示词布局能在其间移动的天花板和地板,而不是报价单。

钱到底花在哪

短提示词下,输出是大头。输出价是输入价的 5 倍,再叠上占输出 43–77% 的推理,提示词短、对话密的负载,问题出在输出账单上。缓存帮不了你。

长上下文下,输入是大头。单次约 50 万 token 的调用,K3 还没写一个字就已经 $1.49。这正是缓存发挥价值的地方——最大的一项开销直接砍到 1/10。

空响应照样扣费。推理预算陷阱会按全额输出价收你的钱,却一个字符都不给。这是账单上唯一纯属浪费的一行。

定价常见问题

Kimi K3 API 收费多少?

按官方定价页 2026-07-20 的数字:缓存未命中的输入 $3.00 / 百万 token,缓存命中 $0.30 / 百万 token,输出 $15.00 / 百万 token。

Kimi K3 的推理 token 计费吗?

计费,按 $15.00 / 百万 token 的输出价——和回答本身同价。我们在三条提示词上实测,推理占总输出 token 的 43–77%,而且即使响应里一个字都没有,也照样计费。若月之暗面调整费率或计费行为,我们会重新盖日期戳,并记录在更新日志里。

Kimi K3 有免费额度吗?

月之暗面自己的条款以其平台为准。通过 EvoLink,新账号注册即送 10 个免费额度——足够跑完快速开始,端到端确认你的第一次调用。

怎么拿到缓存命中的输入价?

重复一段足够长、逐字节一致的前缀,把会变化的部分放在最后。缓存是自动生效的——不需要任何参数。细节和实测机制见提示词缓存页。

我的世界联机模式新手入门教程
‘形象崩塌’陆毅:婚内与众女星传绯闻,遭章子怡替身揭底
Copyright © 2022 全球游戏最新活动中心 All Rights Reserved.