Moonshot AI
月之暗面面向长周期软件工程、Kimi Code 和 Kimi API 工作流的开放权重编程智能体模型。
Kimi K2.7 Code 是月之暗面于 2026 年 6 月 16 日发布的编程智能体模型。官方资源将其定位为开源模型,针对长周期编程和智能体任务执行优化,并相比 K2.6 平均减少约 30% 思考 Token。Hugging Face 模型卡列出其 MoE 架构:1T 总参数、每 Token 激活 32B 参数、384 个专家、每 Token 选择 8 个专家、256K 上下文、MLA 注意力、SwiGLU 激活,以及 400M 参数 MoonViT 视觉编码器。它支持文本、图像和视频输入,强制启用思考模式,并要求多步工具调用保留推理内容。托管 HighSpeed 版本标称约 180 Token/秒,短上下文最高 260 Token/秒,但月之暗面提示当前资源有限。
专题指南基于来源梳理 Kimi K3、K2.7 Code、Kimi API、Kimi Code、Kimi Claw、WebBridge 和效率创作入口。
编辑结论
适合评估开放权重编程模型的团队,用于仓库级 Agent、Kimi Code 工作流或 OpenAI 兼容 API 集成。
如果需要非思考模式、轻量自部署模型,或更偏通用助手而非编程优化的模型,则不应优先选择。
K2.7 Code 拥有独立开放权重、架构、评测、API 价格和 Kimi Code 默认模型行为,因此应与 Kimi Code 和更宽泛的 Kimi API 分开跟踪。
Open weights on Hugging Face; Kimi API is $0.19/1M input tokens cache hit, $0.95/1M input cache miss and $4.00/1M output tokens
Open weights, Kimi Code plans, Kimi API pay-as-you-go, Enterprise sales
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
用于需要持续推理的仓库重构、多文件功能开发和调试会话。
Kimi 表示 K2.7 Code 现在是 Kimi Code 的默认模型,并默认启用思考。
通过 Kimi API 将其用于编程 Agent、开发者工具、ToolCalls 和 JSON Mode 工作流。
通过 vLLM、SGLang、KTransformers 等支持的推理引擎评估本地或私有部署。
已于 2026 年 6 月 21 日核验。HighSpeed 当前资源有限且速度可能波动。Kimi Code 套餐价格、API 费率、参数约束、许可条款、评测方法和支持的推理引擎可能变化;采购或部署前请重新核验官方来源。
qwen
deepseek-v4-api
zhipu-glm
minimax-m3
官方 · EN · 核验于 2026-08-04
确认发布日期、定位、评测表、架构、接入路径、Kimi Code 套餐和 API 价格表。
官方 · EN · 核验于 2026-06-17
确认开放权重、Modified MIT 许可、架构、评测、部署引擎和使用细节。
价格 · EN · 核验于 2026-06-17
记录 API 模型说明、HighSpeed 版本、上下文缓存、ToolCalls、JSON Mode 和 Partial Mode。
文档 · EN · 核验于 2026-06-21
确认托管模型 ID、256K 上下文、默认 32K 输出、HighSpeed 吞吐、强制思考、固定采样值和多模态工具结果行为。
最后核验: 2026-08-04
暂无已审核的评论。