Qwen3.8-27B本地部署持续升温,动态量化与编码代理实测受到关注;研究侧出现【千倍降算力复现RL收益】及单卡实时世界模型等进展。

模型动态

Qwen3.8-27B动态量化降低笔记本部署门槛

官方提供8-bit至1-bit动态GGUF,降低笔记本门槛。社区称搭配DeepSeek Harness编码体验突出。[1][1][2][3]

类Genie世界模型在单张RTX 5090上实时运行

社区展示类Genie世界模型,声称单张RTX 5090可达720p、16 FPS,仅占19GB显存。[10]

产品工具

浏览器端DWG/DXF查看方案支持测量与批注

DWG/DXF可在浏览器查看、批注,且数据不出站。https://juejin.cn/post/7674372498314936370[5]

DeepSeek Harness将获界面美化插件与客户端封装

开发者正迁移CodePilot资产,改善DeepSeek Harness交互与视觉,后续还将封装客户端。[6]

CodePilot接入三款新模型及Grok多模态额度

CodePilot新增Grok 4.6、DeepSeek V4 Pro和GLM 5.3,并支持调用【Grok图像视频】及Twitter检索。[7]

技巧教程

社区实测Qwen3.8不同推理强度的效果与延迟

用户用SVG任务比较【low、medium、xhigh】模式。xhigh思考更久,可用于权衡效果与延迟。[4]

行业资讯

研究称无需强化学习也能低成本复现推理增益

论文称RL仅改变约1%-3% Token,并以约【千分之一算力】复现收益,结论仍待独立核验。[8]

LittleLearner以小学课程语料研究模型知识获取

LittleLearner用仅覆盖美国小学课程的880亿Token训练模型,区分知识学习与能力诱导。[9]