Kimi团队坦诚分享技术路线,KDA架构和视觉版本值得期待;通义在图像生成领域推出实用工具,降低视频创作门槛。

模型动态

Kimi K2团队在Reddit AMA中透露多项技术进展

KDA混合架构比传统MLA+RoPE表现更好,将用于K3训练 正在开发K2视觉语言版本,承认当前纯文本是短期策略 K2-Thinking模型因推理更细致导致输出较慢,优化进行中 使用H800 GPU配合Infiniband,硬件资源不如美国但利用率高[1]

通义实验室推出"Next Scene" LoRA电影导演工具

基于Qwen-Image-Edit-2509开发,支持推拉镜头等运镜效果 用户只需输入"Next Scene"提示词即可生成电影级序列 V2版本已发布,效果进一步提升[2]