图像生成领域出现重大突破,FLUX.2在速度上实现数量级提升,推动实时图像生成成为可能。同时,国产大模型GLM-Image在文本渲染和布局控制上展现出顶尖的工程化能力。

模型动态

Black Forest Labs 发布亚秒级图像生成模型 FLUX.2 [klein]。

核心特性:0.5秒内生成或编辑图像,整合文生图、图生图、多图融合功能。 性能:质量接近 Midjourney V6,在消费级显卡(13GB VRAM起)上可运行。 开源:4B模型采用Apache 2.0许可,可商用;9B模型为研究用途。[1][2]

智谱AI的GLM-Image模型实测结果公布。

测试结论:在80字以内文本渲染可做到0失误,达到当前SOTA水平。 布局控制:在5x5网格(25区域)内能精确控制元素位置,极限约64格。 可用性:模型已在BigModel平台上线。