本期热点包括英伟达RTX Spark真机亮相可跑120B模型、DeepSeek自研AI芯片、llama.cpp性能修复、低成本部署方案及多个实用工具与技巧。

产品工具

llama.cpp b9966修复sm-tensor重复编译问题

llama.cpp版本b9966修复了sm-tensor模式下每次解码重复编译29次正则的问题,显著提升生产环境性能。来源:https://www.reddit.com/r/LocalLLaMA/comments/1utyzbl/llamacpp_b9966_for_smtensor/[3]

Tasket++开源Windows自动化工具发布

基于C++/Qt的【开源】Windows自动化工具Tasket++,支持排期模拟按键、光标移动、文本粘贴等操作序列,可开机自动运行。项目地址:https://t.co/UYG7cRkPSZ[5]

在线模型PK擂台工具,支持一键对比多模型输出

用GPT开发模型评测对比工具,支持相同提示词多模型输出,渲染Markdown/HTML/SVG。在线体验:https://t.co/q05HBYbJ49,GitHub开源:https://t.co/acckdsnWo1[7][8]

speak-human-tw:繁体中文去AI味改写skill

speak-human-tw专为繁体中文设计,能识别35种以上AI写作套路,自动转换中国用语和半形标点为台湾写法,适配Claude Code/Codex/Cursor。地址:https://t.co/PQZfigy9BO[9]

技巧教程

利用Codex整理对话快速生成文档和PPT

用户分享工作流:让Codex整理所有对话,提取项目经验后输出飞书文档和PPT大纲,再用内置功能生成PPT,提高分享效率。[6]

硬件动态

英伟达RTX Spark超级芯片真机亮相,笔记本运行120B大模型

英伟达RTX Spark真机现身Bilibili World,CPU与GPU高度集成,笔记本即可运行120B大模型,标志AI硬件新突破。来源:https://www.qbitai.com/2026/07/447981.html[1]

DeepSeek正自主研发AI芯片

消息称中国AI公司DeepSeek正在开发自有AI芯片,可能增强本土硬件竞争力,对行业格局有潜在影响。来源:https://www.reddit.com/r/LocalLLaMA/comments/1uu15mz/chinas_deepseek_developing_its_own_ai_chip/[2]

100美元实现20GB VRAM本地跑大模型方案

用户分享以100美元成本组合多张显卡,实现20GB VRAM和448GB/s带宽,为低预算本地部署提供实用方案。来源:https://www.reddit.com/r/LocalLLaMA/comments/1utwqf8/ultra_budget_20gb_vram_with_448gbs_for_100_bucks/[4]