首页/ 资讯/ K2.8 Preview 月之暗面 Kimi 推出的新一代主力模型

K2.8 Preview 月之暗面 Kimi 推出的新一代主力模型

灵犀编辑部 2026-09-13 2 阅读

K2.8 Preview是什么

Kimi K2.8 Preview 是月之暗面在 Kimi Code 和 Kimi Work 全量上线的主力模型,官方称综合性能接近旗舰 Kimi K3,编码与 Agent 能力提升,思考效率较 K2.7 显著改善。模型支持 low/high/max 三档思考和图片、视频输入,1M 超长上下文向全会员开放。

K2.8 Preview

K2.8 Preview的主要功能

  • 代码生成与补全 :定位日常开发主力,优化代码补全、修改等明确边界的任务。
  • Agent 能力 :编码与智能体能力较 K2.7 Code 全面提升,可自主推进多步工程任务。
  • 三档思考强度 :支持 low / high / max 三档 reasoning effort,与 K3 思考等级对齐,默认 max。
  • 多模态输入 :支持图片和视频输入,可处理视觉类开发素材。
  • 1M 超长上下文 :全部会员档位开放最高 100 万 token 上下文,可一次性处理大规模代码库。
  • 无感升级 :Model ID 仍为 kimi-for-coding ,客户端与第三方工具无需改配置。
  • 智能路由 :K3 系列关闭 thinking 后,请求自动转交 K2.8 无思考版本处理。

K2.8 Preview的技术原理

  • 分档推理控制 :通过 reasoning effort 机制在推理预算上做取舍——low 档牺牲思考深度换速度,max 档投入更多思考 token 换取复杂任务成功率,本质是对思考 token 数量这一计算资源的显式调度。
  • 长上下文处理 :1M 窗口依托高效注意力实现,K3 所采用的 KDA 混合线性注意力与 Attention Residuals 路线(显式降低长序列注意力的计算开销)是 K2.8 的重要技术参照。
  • 请求路由层 :产品侧由调度系统按模型可用性、思考开关状态将会话流量在 K3 与 K2.8 间无感切换,保证同一入口下的体验连续性。

如何使用K2.8 Preview

  • 无需配置,开箱即用 :K2.8 Preview 已全量上线, kimi-for-coding 无感升级,现有客户端和第三方工具(Claude Code、OpenCodeCodex 等)无需修改任何配置。
  • 订阅任意会员即可调用 :Adagio(免费档)到 Allegro 所有档位都能使用,且直接享有 1M 上下文。
  • Kimi Code CLI :安装 CLI 后登录账号,正常发起会话即在用 K2.8,可输入 /model 查看或切换当前模型。
  • 调节思考档位 :输入 /effort 在 low / high / max 三档间切换,简单任务用低档省 token,复杂任务用 max 换成功率。
  • 第三方工具接入 :把工具里的模型 ID 配置为 kimi-for-coding 即可;追求速度且是 Allegretto 及以上会员,可换用 kimi-for-coding-highspeed 。
  • Kimi Work 场景 :直接在 Kimi Work 中发起任务,平台会自动路由到 K2.8 Preview

K2.8 Preview的核心优势

  • 性能接近旗舰 :综合性能接近 K3,编码与 Agent 能力较 K2.7 Code 全面提升,思考效率显著改善。
  • 零门槛使用 :全会员档位(含免费档 Adagio)均可调用,打破 K3 需 ¥99 起的限制。
  • 响应更快 :用户实测反馈速度明显优于 K3,适合代码补全等高频交互场景。
  • 行为更可控 :相比 K3 在模糊任务中过于主动、对历史 thinking 敏感的问题,K2.8 定位日常开发,行为边界更稳定。
  • 无感迁移 :Model ID 保持 kimi-for-coding 不变,客户端与第三方工具零改动即可升级。
  • 灵活思考档位 :low / high / max 三档自由切换,简单任务省 token、复杂任务保质量。
  • 多模态能力 :支持图片和视频输入,1M 窗口可一次性吞下整个大型代码库。

K2.8 Preview的同类竞品对比

对比维度 | Kimi K2.8 Preview | Claude Sonnet 5

>
对比维度 Kimi K2.8 Preview Claude Sonnet 5
定位 低成本主力模型,接棒旗舰 K3 的日常流量 中端主力,Claude.ai 免费/Pro 默认模型
综合性能 官方称接近 K3(未公布 benchmark) SWE-bench Pro 63.2%,OSWorld-Verified 81.2%
上下文窗口 1M token,全会员开放 1M token
多模态 图片 + 视频输入 文本 + 图片,无视频输入
思考档位 low / high / max 三档,与 K3 对齐 自适应思考(adaptive thinking)
API 定价 随订阅会员(¥0–699/月),不按 token 计费 $2 / $10 每百万 token(2026年8月31日后恢复 $3 / $15)
开放权重 未公布(K 系列有开源传统,K3 已开源) 闭源,仅 API 提供

K2.8 Preview的应用场景

  • 大型代码库理解与重构 :1M 上下文可一次性吞下整个仓库,做跨文件依赖分析、批量重构和架构级修改建议。
  • 日常代码补全与开发 :定位过日子模型,行为比 K3 更可控、响应更快,适合高频次的补全、debug、小功能迭代。
  • 多模态开发辅助 :支持图片和视频输入,可直接截图报错界面、录屏演示 bug,或参考设计稿生成前端代码。
  • Agent 自动化工作流 :编码与 Agent 能力较 K2.7 全面提升,可用于多步骤任务编排——跑测试、修失败用例、提 PR 的闭环流程。
  • 长文档/长日志分析 :1M 窗口可容纳超长日志、技术文档或会议记录,做全文检索式问答和摘要提炼,会员内零额外成本。
相关工具
与本文相关的 AI 工具
AI 智能推荐 ×
输入关键词,AI 从 1000+ 工具中精准匹配推荐