AB
AiBoss
project

K2.8 Preview - 月之暗面 Kimi 推出的新一代主力模型

Kimi K2.8 Preview 是月之暗面在 Kimi Code 和 Kimi Work 全量上线的主力模型,官方称综合性能接近旗舰 Kimi K3,编码与 Agent 能力提升,思考效率较 K2.7 显...

K2.8 Preview是什么

Kimi K2.8 Preview 是月之暗面在 Kimi Code 和 Kimi Work 全量上线的主力模型,官方称综合性能接近旗舰 Kimi K3,编码与 Agent 能力提升,思考效率较 K2.7 显著改善。模型支持 low/high/max 三档思考和图片、视频输入,1M 超长上下文向全会员开放。

K2.8 Preview的主要功能

  • 代码生成与补全:定位日常开发主力,优化代码补全、修改等明确边界的任务。
  • Agent 能力:编码与智能体能力较 K2.7 Code 全面提升,可自主推进多步工程任务。
  • 三档思考强度:支持 low / high / max 三档 reasoning effort,与 K3 思考等级对齐,默认 max。
  • 多模态输入:支持图片和视频输入,可处理视觉类开发素材。
  • 1M 超长上下文:全部会员档位开放最高 100 万 token 上下文,可一次性处理大规模代码库。
  • 无感升级:Model ID 仍为 kimi-for-coding,客户端与第三方工具无需改配置。
  • 智能路由:K3 系列关闭 thinking 后,请求自动转交 K2.8 无思考版本处理。

K2.8 Preview的技术原理

  • 分档推理控制:通过 reasoning effort 机制在推理预算上做取舍——low 档牺牲思考深度换速度,max 档投入更多思考 token 换取复杂任务成功率,本质是对”思考 token 数量”这一计算资源的显式调度。
  • 长上下文处理:1M 窗口依托高效注意力实现,K3 所采用的 KDA 混合线性注意力与 Attention Residuals 路线(显式降低长序列注意力的计算开销)是 K2.8 的重要技术参照。
  • 请求路由层:产品侧由调度系统按模型可用性、思考开关状态将会话流量在 K3 与 K2.8 间无感切换,保证同一入口下的体验连续性。

如何使用K2.8 Preview

  • 无需配置,开箱即用:K2.8 Preview 已全量上线,kimi-for-coding 无感升级,现有客户端和第三方工具(Claude Code、OpenCode、Codex 等)无需修改任何配置。
  • 订阅任意会员即可调用:Adagio(免费档)到 Allegro 所有档位都能使用,且直接享有 1M 上下文。
  • Kimi Code CLI:安装 CLI 后登录账号,正常发起会话即在用 K2.8,可输入 /model 查看或切换当前模型。
  • 调节思考档位:输入 /effort 在 low / high / max 三档间切换,简单任务用低档省 token,复杂任务用 max 换成功率。
  • 第三方工具接入:把工具里的模型 ID 配置为 kimi-for-coding 即可;追求速度且是 Allegretto 及以上会员,可换用 kimi-for-coding-highspeed
  • Kimi Work 场景:直接在 Kimi Work 中发起任务,平台会自动路由到 K2.8 Preview。

K2.8 Preview的核心优势

  • 性能接近旗舰:综合性能接近 K3,编码与 Agent 能力较 K2.7 Code 全面提升,思考效率显著改善。
  • 零门槛使用:全会员档位(含免费档 Adagio)均可调用,打破 K3 需 ¥99 起的限制。
  • 响应更快:用户实测反馈速度明显优于 K3,适合代码补全等高频交互场景。
  • 行为更可控:相比 K3 在模糊任务中过于主动、对历史 thinking 敏感的问题,K2.8 定位日常开发,行为边界更稳定。
  • 无感迁移:Model ID 保持 kimi-for-coding 不变,客户端与第三方工具零改动即可升级。
  • 灵活思考档位:low / high / max 三档自由切换,简单任务省 token、复杂任务保质量。
  • 多模态能力:支持图片和视频输入,1M 窗口可一次性吞下整个大型代码库。

K2.8 Preview的同类竞品对比

对比维度 Kimi K2.8 Preview Claude Sonnet 5
定位 低成本主力模型,接棒旗舰 K3 的日常流量 中端主力,Claude.ai 免费/Pro 默认模型
综合性能 官方称接近 K3(未公布 benchmark) SWE-bench Pro 63.2%,OSWorld-Verified 81.2%
上下文窗口 1M token,全会员开放 1M token
多模态 图片 + 视频输入 文本 + 图片,无视频输入
思考档位 low / high / max 三档,与 K3 对齐 自适应思考(adaptive thinking)
API 定价 随订阅会员(¥0–699/月),不按 token 计费 $2 / $10 每百万 token(2026年8月31日后恢复 $3 / $15)
开放权重 未公布(K 系列有开源传统,K3 已开源) 闭源,仅 API 提供

K2.8 Preview的应用场景

  • 大型代码库理解与重构:1M 上下文可一次性吞下整个仓库,做跨文件依赖分析、批量重构和架构级修改建议。
  • 日常代码补全与开发:定位”过日子模型”,行为比 K3 更可控、响应更快,适合高频次的补全、debug、小功能迭代。
  • 多模态开发辅助:支持图片和视频输入,可直接截图报错界面、录屏演示 bug,或参考设计稿生成前端代码。
  • Agent 自动化工作流:编码与 Agent 能力较 K2.7 全面提升,可用于多步骤任务编排——跑测试、修失败用例、提 PR 的闭环流程。
  • 长文档/长日志分析:1M 窗口可容纳超长日志、技术文档或会议记录,做全文检索式问答和摘要提炼,会员内零额外成本。