Qwen / Vllm Qwen 3.6 27B在VLLM上发布性能基准测试 社区公布Qwen 3.6 27B在VLLM上的性能基准,对比【BF16、FP8、NVFP4】量化。NVFP4速度极快但存在循环问题,对模型部署选型有直接参考价值。[3]
Zhipu @向阳乔木 实测对比:GLM 5.2生成前端网页远超GPT 用户反馈GLM 5.2生成前端网页效果远好于GPT,即使用Codex中的Skill也难以改善。真实对比案例,体现国产模型在前端生成上的优势。[4]
Meta考虑推出算力服务,小扎称GPU业务优先于模型速度 Meta正考虑推出Meta Compute算力服务,扎克伯格表态GPU业务优先于模型速度。此举对AI从业者获取算力资源有重要影响,尚在规划阶段。[1]