本期关注【Meta考虑推出算力服务】和【Qwen 3.6 27B VLLM性能基准测试】,同时有新开源工具和用户真实反馈值得关注。

模型动态

Qwen 3.6 27B在VLLM上发布性能基准测试

社区公布Qwen 3.6 27B在VLLM上的性能基准,对比【BF16、FP8、NVFP4】量化。NVFP4速度极快但存在循环问题,对模型部署选型有直接参考价值。[3]

产品工具

@向阳乔木 实测对比:GLM 5.2生成前端网页远超GPT

用户反馈GLM 5.2生成前端网页效果远好于GPT,即使用Codex中的Skill也难以改善。真实对比案例,体现国产模型在前端生成上的优势。[4]

行业资讯

Meta考虑推出算力服务,小扎称GPU业务优先于模型速度

Meta正考虑推出Meta Compute算力服务,扎克伯格表态GPU业务优先于模型速度。此举对AI从业者获取算力资源有重要影响,尚在规划阶段。[1]

华为更新“韬定律”论文,详解放弃的技术路线

华为更新关于韬定律的论文,详细说明了放弃的技术路线。该理论对AI芯片与系统设计有参考价值,适合研究型从业者关注。[2]