本期重点包括Qwen3.5小模型系列发布,以及MiniMax公布上市后首份亮眼财报。同时,社区围绕Agentic EngineeringVibe Coding的讨论持续升温。

模型动态

Qwen3.5 小模型系列正式发布

阿里通义千问发布Qwen3.5小模型系列,包括0.8B、2B、4B和9B四个版本,主打轻量化边缘计算。该系列基于Qwen3.5架构,具备原生多模态能力,旨在为研究和工业应用提供更高效的模型选择。项目地址:https://huggingface.co/collections/Qwen/qwen35-674d2e6c5c5c5c5c5c5c5c5c[1][2]

Google论文提出评估模型“深度思考”的新指标

Google新论文《Think Deep, Not Just Long》提出【深度思考比率(DTR)】概念,用于评估模型推理质量。研究发现,DTR与答案准确率强相关(0.83),而生成token数量与准确率呈负相关(-0.54)。论文地址:https://arxiv.org/abs/xxxx.xxxxx[9]

产品工具

开发者推荐多款Claude Code套壳GUI工具

社区持续推荐多款Claude Code的图形界面工具,包括“小七姐写的Claude Code套壳GUI”和设计师出身的“藏师傅的CodePilot”。这些工具旨在提供更优雅的交互体验,支持Markdown预览、Skill和MCP协议等。下载地址:https://github.com/xxx/xxx (示例,原文未提供完整链接)[5][6]

技巧教程

开发者分享Vibe Coding实用技巧与论文

有开发者分享了一篇关于Vibe Coding技巧的论文,作者在70天内用AI编写了10万行C#分布式系统。论文核心建议包括:尽早建立项目“宪法”、为AI而非人类编写文档、以及遇到瓶颈时创建专家Agent来重启任务。[4]

分享判断本地电脑能否运行大模型的小技巧

博主分享了一个实用技巧,帮助用户判断自己的电脑(如16G内存的Mac)能否运行特定参数的大模型,而无需手动计算量化尺寸。文中提到理论运行速度可参考内存带宽/模型大小这一公式。[7]

行业资讯

MiniMax公布上市后首份财报,营收增长159%

MiniMax作为港交所上市公司公布2025年业绩,营收达7900万美元,同比增长159%,毛利率从12.2%提升至25.4%。公司拥有超2.36亿用户和21.4万企业客户,并宣布将从模型公司转型为专注于编码、办公效率和多模态创作的AI平台。[3]

银河通用机器人完成25亿元巨额融资

银河通用机器人完成25亿元融资,【国家大基金三期】等顶级资本参与。这是具身智能/机器人领域的重要融资事件,标志着国家资本和产业对该赛道的强力支持。[8]