继上周推出 kimi 2.7 code 大模型后,月之暗面于今晚再度加码,正式发布该模型的“高速版”。新版本在全面继承原模型核心能力的基础上,实现了生成速度的跨越式升级,致力于为开发者带来更流畅、更高效的代码创作体验。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

极速响应,显著降低等待延迟
据官方实测数据,Kimi 2.7 Code 高速版的推理吞吐量可达标准版的 5–6 倍。在典型编程任务中,平均输出速率约为 180 Token/s;而在上下文较短的轻量级场景下,峰值速度更可突破至 260 Token/s。
在商业化层面,高速版 API 的定价仅为普通版的 2 倍,以可控的成本增幅换取数倍的性能跃升。当前,Kimi Code Plan 用户已可通过参与“抢先体验计划”,第一时间在 Kimi Code 客户端中启用并体验这一全新高速编码能力。
将小说章节转换为电影分镜剧本。用户上传txt/md/docx文本,AI分析场景、角色、情绪、镜头语言,输出专业分镜脚本。适用于用户提及“分镜”“storyboard”“小说转分镜”“影视改编”“镜头脚本”或需要将小说改编为分镜的场景。
思考模式:释放高性能的必要前提
为确保高速版模型稳定发挥最优性能,用户在调用 Kimi 2.7 Code 全系列模型时,必须启用“思考模式”。目前,Kimi API 与 Kimi Code 客户端均已默认开启该功能;若用户手动关闭,API 将直接返回错误,系统则自动降级至 Kimi 2.6 版本以保障基础可用性。
随着底层算力资源持续扩容,月之暗面将分阶段扩大高速版的开放权限。预计自今年 7 月起,该版本将逐步向 Allegretto 及更高级别会员开放,届时其在 Kimi Code Plan 中的配额消耗系数将调整为普通版的 3 倍。

















