Kimi K2团队在Reddit AMA中透露多项技术进展
KDA混合架构比传统MLA+RoPE表现更好,将用于K3训练 正在开发K2视觉语言版本,承认当前纯文本是短期策略 K2-Thinking模型因推理更细致导致输出较慢,优化进行中 使用H800 GPU配合Infiniband,硬件资源不如美国但利用率高[1]
Kimi团队坦诚分享技术路线,KDA架构和视觉版本值得期待;通义在图像生成领域推出实用工具,降低视频创作门槛。