K2.8 Preview 月之暗面 Kimi 推出的新一代主力模型
K2.8 Preview是什么
Kimi K2.8 Preview 是月之暗面在 Kimi Code 和 Kimi Work 全量上线的主力模型,官方称综合性能接近旗舰 Kimi K3,编码与 Agent 能力提升,思考效率较 K2.7 显著改善。模型支持 low/high/max 三档思考和图片、视频输入,1M 超长上下文向全会员开放。

K2.8 Preview的主要功能
- 代码生成与补全 :定位日常开发主力,优化代码补全、修改等明确边界的任务。
- Agent 能力 :编码与智能体能力较 K2.7 Code 全面提升,可自主推进多步工程任务。
- 三档思考强度 :支持 low / high / max 三档 reasoning effort,与 K3 思考等级对齐,默认 max。
- 多模态输入 :支持图片和视频输入,可处理视觉类开发素材。
- 1M 超长上下文 :全部会员档位开放最高 100 万 token 上下文,可一次性处理大规模代码库。
- 无感升级 :Model ID 仍为 kimi-for-coding ,客户端与第三方工具无需改配置。
- 智能路由 :K3 系列关闭 thinking 后,请求自动转交 K2.8 无思考版本处理。
K2.8 Preview的技术原理
- 分档推理控制 :通过 reasoning effort 机制在推理预算上做取舍——low 档牺牲思考深度换速度,max 档投入更多思考 token 换取复杂任务成功率,本质是对思考 token 数量这一计算资源的显式调度。
- 长上下文处理 :1M 窗口依托高效注意力实现,K3 所采用的 KDA 混合线性注意力与 Attention Residuals 路线(显式降低长序列注意力的计算开销)是 K2.8 的重要技术参照。
- 请求路由层 :产品侧由调度系统按模型可用性、思考开关状态将会话流量在 K3 与 K2.8 间无感切换,保证同一入口下的体验连续性。
如何使用K2.8 Preview
- 无需配置,开箱即用 :K2.8 Preview 已全量上线, kimi-for-coding 无感升级,现有客户端和第三方工具(Claude Code、OpenCode、Codex 等)无需修改任何配置。
- 订阅任意会员即可调用 :Adagio(免费档)到 Allegro 所有档位都能使用,且直接享有 1M 上下文。
- Kimi Code CLI :安装 CLI 后登录账号,正常发起会话即在用 K2.8,可输入 /model 查看或切换当前模型。
- 调节思考档位 :输入 /effort 在 low / high / max 三档间切换,简单任务用低档省 token,复杂任务用 max 换成功率。
- 第三方工具接入 :把工具里的模型 ID 配置为 kimi-for-coding 即可;追求速度且是 Allegretto 及以上会员,可换用 kimi-for-coding-highspeed 。
- Kimi Work 场景 :直接在 Kimi Work 中发起任务,平台会自动路由到 K2.8 Preview。
K2.8 Preview的核心优势
- 性能接近旗舰 :综合性能接近 K3,编码与 Agent 能力较 K2.7 Code 全面提升,思考效率显著改善。
- 零门槛使用 :全会员档位(含免费档 Adagio)均可调用,打破 K3 需 ¥99 起的限制。
- 响应更快 :用户实测反馈速度明显优于 K3,适合代码补全等高频交互场景。
- 行为更可控 :相比 K3 在模糊任务中过于主动、对历史 thinking 敏感的问题,K2.8 定位日常开发,行为边界更稳定。
- 无感迁移 :Model ID 保持 kimi-for-coding 不变,客户端与第三方工具零改动即可升级。
- 灵活思考档位 :low / high / max 三档自由切换,简单任务省 token、复杂任务保质量。
- 多模态能力 :支持图片和视频输入,1M 窗口可一次性吞下整个大型代码库。
K2.8 Preview的同类竞品对比
| 对比维度 | Kimi K2.8 Preview | Claude Sonnet 5 |
|---|---|---|
| 定位 | 低成本主力模型,接棒旗舰 K3 的日常流量 | 中端主力,Claude.ai 免费/Pro 默认模型 |
| 综合性能 | 官方称接近 K3(未公布 benchmark) | SWE-bench Pro 63.2%,OSWorld-Verified 81.2% |
| 上下文窗口 | 1M token,全会员开放 | 1M token |
| 多模态 | 图片 + 视频输入 | 文本 + 图片,无视频输入 |
| 思考档位 | low / high / max 三档,与 K3 对齐 | 自适应思考(adaptive thinking) |
| API 定价 | 随订阅会员(¥0–699/月),不按 token 计费 | $2 / $10 每百万 token(2026年8月31日后恢复 $3 / $15) |
| 开放权重 | 未公布(K 系列有开源传统,K3 已开源) | 闭源,仅 API 提供 |
K2.8 Preview的应用场景
- 大型代码库理解与重构 :1M 上下文可一次性吞下整个仓库,做跨文件依赖分析、批量重构和架构级修改建议。
- 日常代码补全与开发 :定位过日子模型,行为比 K3 更可控、响应更快,适合高频次的补全、debug、小功能迭代。
- 多模态开发辅助 :支持图片和视频输入,可直接截图报错界面、录屏演示 bug,或参考设计稿生成前端代码。
- Agent 自动化工作流 :编码与 Agent 能力较 K2.7 全面提升,可用于多步骤任务编排——跑测试、修失败用例、提 PR 的闭环流程。
- 长文档/长日志分析 :1M 窗口可容纳超长日志、技术文档或会议记录,做全文检索式问答和摘要提炼,会员内零额外成本。
相关工具
与本文相关的 AI 工具