MiniMax M3 在 Fireworks 上提供推理,解码速度提升15.6倍
Fireworks AI宣布与MiniMax合作,为M3模型提供推理服务,采用MiniMax Sparse Attention (MSA)实现1M token【解码速度提升15.6倍】。已报道技术发布,此为具体性能数据和合作进展。[1]
本周AI领域动态密集:MiniMax M3解码速度提升15.6倍引发关注,a16z连投两家AI应用公司(Town 5500万美元、Lassie),Uber限制编码Agent月费1500美元反映成本管理挑战,Runway Aleph 2.0视频编辑模型在Replicate上线,LangChain推出Sandbox和Agent验证器研究,Weaviate发布专用记忆系统Engram。