GLM-5.3权重即将发布,Qwen3.8-Flash-Next获得多项首日生态支持。本地推理工作流与Isaac机器人训练方案也受到关注。

模型动态

GLM-5.3权重将于明日发布

Z.ai宣布GLM-5.3权重将于明日【正式发布】。详情:https://t.co/v1IbWMXxg4[1]

产品工具

Qwen3.8-Flash-Next获NeMo与TokenSpeed首日支持

NeMo AutoModel支持垂直微调,TokenSpeed覆盖GDN、QSA与FP8。https://t.co/H7aiTJcJ9j[2][2][3][3]

千问办公接入Qwen3.8-Flash并降低推理成本

千问办公接入新模型,宣称生成速度提升100%、Token消耗【减少75%】,并新增标准模式。[4]

技巧教程

社区分享Blackwell显卡的两套vLLM优化方案

方案结合MTPDFlash2与NVFP4 KV缓存,提升【上下文和并发】并减少显存浪费。[8]

本地Qwen模型可通过MCP接入Claude Code

用户用MCP将本地Qwen3.8-27B接入Claude Code,分担编码任务并节省【云端Token】。[9]

硬件动态

Isaac利用百万小时视频大幅降低机器人示教成本

Isaac先学习百万小时视频,再用28小时遥操作校正,较5900小时方案【提效210倍】,并【开放权重】。[10]

行业资讯

法律AI公司Legora ARR两年增长至1亿美元

Legora用户已覆盖全球超过3%的律师,ARR不到两年从100万美元增至1亿美元[5]

英伟达据称洽谈超130亿美元收购Hugging Face

消息称NVIDIA正深入洽谈收购Hugging Face,估值或超过130亿美元,目前尚待官方确认。[6][7]