智谱GLM-5.1 highspeed上线,输出速度达400 TPS
智谱发布glm-5.1-highspeed,实测输出速度300-400 tps,首token延迟稳定1s,是普通GLM-5.1接口的10倍。官方与TileRT团队合作,从底层优化推理链路,将GPU性能榨干。使用GLM-5.1编程的用户可直接切换新模型。[4]
本期动态包括:腾讯Hy-MT2翻译模型获用户实测好评,可本地部署;智谱GLM-5.1 highspeed输出速度飙至400 TPS,10倍提升;Gemini Omni正式上线展示多模态创作;AI应用翻车事件频发,毕业典礼念名出错、航班信息不准确引发信任讨论;AI编码工具Token成本暴涨,企业开始收紧预算。