Moonshot AI
Kimi K2.7 Code 是月之暗面于 2026 年 6 月 16 日发布的编程智能体模型。官方资源将其定位为开源模型,针对长周期编程和智能体任务执行优化,并相比 K2.6 平均减少约 30% 思考 Token。Hugging Face 模型卡列出其 MoE 架构:1T 总参数、每 Token 激活 32B 参数、384 个专家、每 Token 选择 8 个专家、256K 上下文、MLA 注意力、SwiGLU 激活,以及 400M 参数 MoonViT 视觉编码器。它支持文本、图像和视频输入,强制启用思考模式,并要求多步工具调用保留推理内容。托管 HighSpeed 版本标称约 180 Token/秒,短上下文最高 260 Token/秒,但月之暗面提示当前资源有限。
编辑结论
适合评估开放权重编程模型的团队,用于仓库级 Agent、Kimi Code 工作流或 OpenAI 兼容 API 集成。
如果需要非思考模式、轻量自部署模型,或更偏通用助手而非编程优化的模型,则不应优先选择。
K2.7 Code 拥有独立开放权重、架构、评测、API 价格和 Kimi Code 默认模型行为,因此应与 Kimi Code 和更宽泛的 Kimi API 分开跟踪。
Open weights on Hugging Face; Kimi API is $0.19/1M input tokens cache hit, $0.95/1M input cache miss and $4.00/1M output tokens
Open weights, Kimi Code plans, Kimi API pay-as-you-go, Enterprise sales
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
用于需要持续推理的仓库重构、多文件功能开发和调试会话。
Kimi 表示 K2.7 Code 现在是 Kimi Code 的默认模型,并默认启用思考。
通过 Kimi API 将其用于编程 Agent、开发者工具、ToolCalls 和 JSON Mode 工作流。
通过 vLLM、SGLang、KTransformers 等支持的推理引擎评估本地或私有部署。
已于 2026 年 6 月 21 日核验。HighSpeed 当前资源有限且速度可能波动。Kimi Code 套餐价格、API 费率、参数约束、许可条款、评测方法和支持的推理引擎可能变化;采购或部署前请重新核验官方来源。
qwen
deepseek-v4-api
zhipu-glm
minimax-m3
official · en · verified 2026-08-04
确认发布日期、定位、评测表、架构、接入路径、Kimi Code 套餐和 API 价格表。
official · en · verified 2026-06-17
确认开放权重、Modified MIT 许可、架构、评测、部署引擎和使用细节。
pricing · en · verified 2026-06-17
记录 API 模型说明、HighSpeed 版本、上下文缓存、ToolCalls、JSON Mode 和 Partial Mode。
docs · en · verified 2026-06-21
确认托管模型 ID、256K 上下文、默认 32K 输出、HighSpeed 吞吐、强制思考、固定采样值和多模态工具结果行为。
最后核验: 2026-08-04