Kimi模型生态持续优化,剪枝技术实现参数减少性能反升。月之暗面加强与开发者社区互动,预示可能有重要更新即将公布。

模型动态

Cerebras发布Kimi-Linear剪枝版本

将Kimi-Linear从48B剪枝到35B,性能反而提升 在LiveCodeBench、AIME25、HumanEval等基准测试中表现更好 输出速度可达2000 token/s,适合本地部署

月之暗面将在Reddit举办AMA

时间未定,关注r/LocalLllama社区 可能涉及Kimi3发布时间、Kimi-linear后续版本、K2工具调用技术等话题