GLM-5.3-Flash在Fireworks正式GA
Fireworks宣布GLM-5.3-Flash正式GA。官方强调相同权重在不同推理基础设施上的质量表现可能存在差异。详情:https://x.com/FireworksAI_HQ/status/2093592116555657277[1]
本期重点包括GLM-5.3-Flash正式GA及Terminal Bench 4.0新评测,显示模型部署与基准表现仍需结合基础设施观察。社区还分享了【本地推理提速】、非Transformer架构和自学习模型治理等实践。