GLM-5.3-Flash正式发布,320B模型采用MIT许可
Z.ai发布GLM-5.3-Flash,320B-A18B、原生多模态、支持100万Token上下文,并以MIT协议开放权重。此前该模型代号为Ox Alpha,可运行于中国AI芯片。博客:https://t.co/tzOmB7gdZP[1]
本期重点聚焦GLM-5.3-Flash与Qwen3.8-Flash两款高性价比开放模型:前者以低价和代码能力进入竞技场前列,后者则提前展示Qwen4架构方向。企业侧,Google Cloud补充了面向Agent的成本控制与容量管理能力。