Kimi API 正式公布 K3/K2.7-Code 等模型定价与缓存分层策略
Kimi API Officially Publishes Pricing and Cache Tiering for K3 and K2.7-Code Models
EVENT SUMMARY
事件摘要
Moonshot 更新 Kimi 开放平台定价页面,正式列出 kimi-k3、kimi-k2.7-code 及 kimi-k2.7-code-highspeed 等模型的详细计费与上下文窗口数据。其中 kimi-k3 输出价格达 ¥100.00/百万 tokens,但缓存命中价格仅 ¥2.00/百万 tokens,上下文支持 1M tokens;kimi-k2.7-code 系列则形成速度阶梯差异化定价。高输出价格与极低的缓存命中价格暗示平台通过缓存策略激励高频复用场景(如客服、RAG),但推理/生成密集型应用成本将显著上升。缓存命中率 SLA 及生效条件暂未披露。
ANALYST VIEW
中立分析
为什么重要
Kimi K3 输出价格 ¥100/1M tokens 在国产大模型平台中处于较高水平,缓存命中价格 ¥2 则极具竞争力,暗示平台通过缓存策略激励高频复用场景。K2.7-code-highspeed 定价为普通版两倍,形成「速度阶梯」差异化。
影响对象
影响所有 Kimi API 开发者:高输出价格意味着推理/生成密集型应用成本将显著上升;缓存命中低价利好重复上下文场景如客服、RAG。
证据说明
来源为 Moonshot 官方定价页面 diff,直接显示了当前模型定价表格和上下文窗口数据,已移除旧的计费调整通知。
不确定性
未披露缓存命中率保障 SLA 及缓存生效条件;未说明 kimi-k3 是否处于限时优惠或推广期;kimi-k3 输出价格 ¥100 是否对标特定竞品不明。
SOURCES
1 个来源 · 4 条记录
以下记录均来自同一来源,不构成多来源相互印证。
来源原文:对于 K3 系列模型,缓存写入按 TTL 档位(5min / 1h)单独计费;缓存命中的输入仅按缓存命中价格计费,不再重复收取缓存写入费用。
来源原文:K3 系列模型...缓存写入(TTL 5min)¥20.00...缓存写入(TTL 1h)¥40.00...输入价格(缓存命中)¥2.00...命中后缓存有效期自动续期,不再收取缓存写入费用。
来源原文:kimi-k2.7-code-highspeed | 1M tokens | ¥2.60 | ¥13.00 | ¥54.00 | 262,144 tokens
来源原文:kimi-k3: 1M tokens, 输入价格(缓存命中)¥2.00, 输入价格(缓存未命中)¥20.00, 输出价格 ¥100.00, 上下文窗口 1,048,576 tokens; kimi-k2.7-code: 缓存命中 ¥1.30, 未命中 ¥6.50, 输出 ¥27.00; kimi-k2.7-code-highspeed: 缓存命中 ¥2.60, 未命中 ¥13.00, 输出 ¥54.00; kimi-k2.6: 缓存命中 ¥1.10, 未命中 ¥6.50, 输出 ¥27.00