据量子位报道,9月11日,月之暗面Kimi K2.8 Preview在Kimi Code和Kimi Work全量上线,官方称其综合性能接近旗舰K3,Coding和Agent能力进一步提升,并把1M上下文开放给所有会员档位。

K2.8 Preview支持low、high、max三档reasoning effort,与K3的思考等级对齐,同时支持图片和视频输入,上下文窗口为1M。官方称其思考效率较K2.7 Code显著改善,定位更偏向代码补全和常规开发任务。本次预览更新未公布benchmark数据,“综合性能接近K3”的具体程度尚不清楚。

权限变化最直接。Kimi Code会员目前分五档:Adagio免费、Andante每月49元、Moderato每月99元、Allegretto每月199元、Allegro每月699元。K3从每月99元档起可调用,1M上下文需每月199元及以上;K2.8 Preview所有会员可用,并直接提供1M上下文。

流量接管方式上,原有kimi-for-coding无感知升级为K2.8 Preview,Model ID保持不变;在Kimi Code中,K3系列关闭thinking后,请求会转给K2.8 Preview的无思考版本。Kimi Work也同步上线该模型。

K2.8被视为月之暗面商业化节奏中的低成本主力模型。据报道,月之暗面ARR今年3月约1亿美元,4月约2亿美元,6月超过3亿美元,8月突破10亿美元;彭博社消息称,公司内部希望年底达到20亿美元。K3是增长关键:7月发布后,以开源权重、超长上下文和旗舰级编程能力打开市场。K3为总参数量2.8万亿、激活约1040亿参数的MoE模型,定价为每百万token输入3美元、输出15美元,为对手的三分之一,并在编程基准上超过Claude Opus 4.8和GPT-5.5。在Arena.ai前端代码竞技场,K3以1679分登顶,超过Claude Fable 5和GPT-5.6 Sol;前代K2.6在同一榜单排第18位。K3系列目前每天生成约3000亿token。

但K3成本高、速度慢、吃资源。月之暗面在K3技术博客中提到,K3对历史thinking内容较敏感,如果Agent框架未完整传回此前思考记录,或会话中途从其他模型切换到K3,生成质量可能明显不稳定;在模糊任务中,K3也可能过于主动,作出超出用户预期的决定。对代码补全、修改和边界明确的日常开发,行为更可控、门槛更低的模型更合适。

据彭博社消息,本月初月之暗面以保密形式向港交所递交A1上市申请文件,启动港股IPO流程。估值方面,2025年底C轮投后估值43亿美元,2026年5月升至200亿,7月F轮后达350亿;7月底启动Pre-IPO轮融资,投前估值升至500亿美元。按500亿美元投前估值和3亿美元ARR计算,市销率约167倍。作为参照,Anthropic约为20倍,OpenAI约40倍,智谱万亿市值时约94倍。