本期焦点:开发者用Codex一键生成可玩游戏的惊人体验,以及Qwen-Scope工具集开放模型内部特征控制。同时,Tenstorrent新硬件和小模型运行Agent的实战经验也值得关注。

模型动态

通义千问开源 Qwen-Scope 工具集,可精细控制模型内部特征

Qwen团队正式发布Qwen-Scope,为Qwen 3.5系列模型提供稀疏自编码器。开发者可以像“拧开关”一样,找到并抑制“中文”或“拒绝回答”等具体特征ID,实现对模型的精准干预和调试。项目地址:https://huggingface.co/spaces/Qwen/QwenScope[5]

产品工具

开发者用 Codex 一键生成《杀戮尖塔》风格游戏

开发者歸藏实测,仅输入“做类似《杀戮尖塔》的中国风游戏”,Codex便独立完成了从代码到素材的全部开发,并生成了一个可玩的游戏。演示视频显示游戏完成度极高,几乎可玩。项目将【开源】并提供安装包。[1][2][3][4]

Browser Use 浏览器AI代理刷新SOTA最高分

AI Agent工具Browser Use将浏览器自动化SOTA性能提升至新高度,其最新版本的浏览器代理在所有公开排行榜上获得了【最高分】。这表明AI在自动执行网页任务上的能力再次取得突破。[10]

技巧教程

在小模型上运行编码Agent的实战避坑指南

开发者分享了用7B以下小模型运行编码Agent的失败经验:常见问题包括Markdown代码块、结构化输出不稳定以及“自信地”改错文件。建议通过后处理剥离格式、强制路径校验以及按文件隔离任务来解决。[6]

社区推荐将沉浸式翻译模型切换为 DeepSeek V4 Flash

用户分享称,可将【沉浸式翻译】的自定义模型换成DeepSeek V4 Flash,特点是“又快又便宜,跟不要钱一样”。这被视为不唯Benchmark论、注重实际性价比的典型案例。[9]

硬件动态

Tenstorrent 发布 TT-QuietBox 2 工作站规格

新硬件TT-QuietBox 2搭载两颗液冷Blackhole加速卡,提供总计128GB的DDR6显存和256GB系统内存,配备Ryzen 7 CPU。该工作站专为本地运行大模型设计,旨在成为NVIDIA RTX Pro 6000的强劲对手。[7]

行业资讯

百度智能云获IDC中国自动驾驶解决方案市场第一

根据IDC报告,2025年【百度智能云】在中国自动驾驶研发解决方案市场中以超三分之一份额【排名第一】。目前已服务国内销量前15的汽车品牌,助力自动驾驶从研发走向大规模量产。[8]