本期亮点包括Qwen3.8-MaxAPI/Token Plan 上线、MiniMax H3 的文本渲染教学场景,以及 G9v3-39A5B、GLM 5.3 等多个开源模型动态;另有 Agent 测试报告 Skill 和 llama.cpp 启动技巧值得关注。

模型动态

MiniMax H3 视频模型被验证可精准渲染画面文字,简化教育内容制作

MiniMaxH3文本渲染上表现出色,可生成带文字的视觉化教学内容,让原本需要制作团队的教育视频制作门槛大幅降低。[2]

AI9Stars 发布开源模型 G9v3-39A5B

AI9Stars 发布G9v3-39A5B,采用【39B参数+5个激活专家】,Apache 2.0 许可支持个人和商用,主打更强推理能力。[3]

GLM 5.3 踪迹现身 GitHub,社区猜测智谱正在开发新版本

Reddit 用户发现 GitHub 代码提交中出现GLM 5.3,推测智谱新模型正在开发中,社区关注度明显升高。[4]

开发者实测推荐 KAT Coder 2.5 dev,称比 Qwen 3.6 35b 更省 token

Reddit 用户实测KAT Coder 2.5 dev,称其比Qwen 3.6 35b更省 token、更快更准确,且远胜 Gemma 4,但目前讨论热度不高。[5]

产品工具

Qwen3.8-Max 首发上线千问平台,API 与 Token Plan 同步开放

Qwen3.8-Max总参数2.4万亿,编码与协作能力大幅提升;API 已在千问平台首发开放,同步支持Token Plan,性能位居全球前列。[1]

技巧教程

这个 Skill 把 Agent 信任从读代码转向读测试报告

纯 Markdown 的Skill把 Agent 代码当黑盒:开工前交测试计划,完成后交带数字的【证据报告】,程序员只审核测试结果。链接:https://t.co/LqQ6tWIHuR[6]

llama.cpp Router Mode 快速启动技巧:用 Windows 搜索一键拉起

通过Win+Q 搜索启动 llama.cpp Router Mode,借助批处理脚本和 config.ini,简化本地模型默认加载流程。[8]

行业资讯

深度文章拆解 OPD 与 RL 算法在 Kimi、DeepSeek、Qwen、GLM 中的应用

文章深入讲解在线策略蒸馏(OPD)GRPO等 RL 算法在前沿模型中的实现,包含数学推导和代码讲解,对研究者有参考价值。[7]