月之暗面 Kimi (Moonshot AI Kimi)
💰 Token 价格
| 类型 | 价格 | 备注 |
|---|---|---|
| 输入 (Input) | K3: ¥2/M cached, ¥20/M uncached; K2.7/K2.6: ¥1.10-¥1.30/M cached, ¥6.50/M uncached | 每百万 tokens |
| 输出 (Output) | K3: ¥100/M; K2.7/K2.6: ¥27/M | 每百万 tokens |
| 缓存读取 | K3: ¥2/M; K2.7: ¥1.30/M; K2.6: ¥1.10/M | 享折扣 |
新用户 ¥15 代金券不可用于 Kimi K3;需充值后体验
🤖 支持模型(共 3 个)
✨ 优势
- ✓ Kimi K3:2.8 万亿参数、1M token 上下文、原生视觉
- ✓ K3 支持 Tool Calls、tool_choice、动态加载工具和 JSON Schema
- ✓ 自动上下文缓存,适合长程 Coding Agent
- ✓ K2.7 Code / K2.6 提供更低输出成本的 256K 选项
⚠️ 不足
- × K3 输出价格高(¥100/M)
- × K3 始终开启思考,当前 reasoning_effort 仅支持 max
- × 联网搜索官方文档提示正在升级,暂不建议生产使用
- × K3 新用户 ¥15 代金券不可用
🎯 适合场景
需要 1M 上下文、视觉和长程 Agent 的中国开发者;长文档与仓库级代码任务
💰 价格与方案
| 模型 | 输入(缓存命中) | 输入(未命中) | 输出 | 上下文 |
|---|---|---|---|---|
| Kimi K3 | ¥2/百万 | ¥20/百万 | ¥100/百万 | 100万 tokens |
| Kimi K2.7 Code | ¥1.30/百万 | ¥6.50/百万 | ¥27/百万 | 256K |
| Kimi K2.6 | ¥1.10/百万 | ¥6.50/百万 | ¥27/百万 | 256K |
🔧 API 与开发者体验
- •API 风格: 兼容 OpenAI 的 REST 端点并支持流式输出;platform.kimi.com 控制台接受标准 Chat Completions 数据格式,大多数 OpenAI/Anthropic SDK 与封装层只需更换 base-url 即可接入。
- •上下文缓存: 平台自动进行上下文缓存——反复出现的 system prompt、工具定义和长文件片段按折扣后的缓存命中价计费(K3 缓存命中 ¥2/百万 vs 未命中 ¥20/百万),无需手动维护缓存 key。
- •工具调用与 Agent: K3 支持 Tool Calls、tool_choice、动态加载工具和 JSON Schema 输出;专为在单个 100 万 token 会话中穿插多次工具调用的长程 Coding Agent 设计。
- •推理控制: K3 始终内部推理;当前 reasoning_effort 仅支持 max,暂无低延迟的不思考模式——需要即时响应的团队可考虑 K2.7/K2.6。
- •视觉与多模态: K3 原生支持视觉输入(含文本),可在同一 100 万 token 上下文窗口处理图像+代码混合任务(截图、图表、UI 原型)。
- •SDK 与生态: 提供官方 Python/Node SDK 及 OpenAI 兼容客户端支持;Moonshot 同时开源 Kimi K2 权重,形成庞大的自托管社区与工具生态。
- •地区与计费: 以人民币计费;面向中国大陆直连。¥15 新用户代金券不适用于 K3——生产使用前需充值账户。
🎯 长上下文 Agent 与编码(百万 token Kimi K3)
Kimi 的核心优势在于长上下文的 Agent 式编码。Kimi K3 以 2.8 万亿参数、100 万 token 上下文窗口和原生视觉整合于单一模型,其自动上下文缓存让仓库级推理在经济上可行:一个 50 万 token 的代码库缓存在命中的情况下仅按 ¥2/百万输入计费(未命中 ¥20/百万),因此编码 Agent 可以在长时间会话中把整个 monorepo 留在上下文里、发出数百次工具调用而无须重建 prompt。这与常见的 128K-256K 模型是截然不同的运行点——K3 将整仓库与长文档工作流(多文件重构、全代码库审计、跨多步的 Agent 循环)视为一等公民用例。代价是始终开启的推理模式(reasoning_effort 仅支持 max)和 ¥100/百万的高输出价格。对于瓶颈在于上下文深度与 Agent 持久性、而非原始 token 成本的团队,K3 目前是国内最强势的选择之一。
🌐 中国访问与延迟
月之暗面是一家总部位于北京的公司,Kimi 是原生面向中国大陆的产品:platform.kimi.com API 无需代理即可直连,无 GFW 规避需求,也无跨境出口费用。从中国大陆数据中心访问 Moonshot 国内端点,API 延迟通常为个位数到十几毫秒的 RTT;并且以人民币计费,免去了其他国际厂商带来的货币与开票摩擦。这使得 Kimi 成为中国大陆生产团队在需要长上下文或 Agent 式编码时最容易上手的选择之一:用大陆手机号注册、人民币充值、直接调用国内端点。主要区域注意事项是常见的国内云问题——冗余与 SLA 绑定于 Moonshot 的大陆基础设施,国际体验(英文文档、海外延迟)相对于国内重心属于次要地位。