本期热点包括:Qwen3.6-35B-A3B在RTX 5090上达到543 tok/s解码速度,Unsloth正式支持AMD GPU,腾讯实现94% AI代码生成率,Kimi K3修复15个安全漏洞,以及社区热议AI Slop与额度重置差异。

模型动态

NInfer引擎在RTX 5090上实现Qwen 543 tok/s解码

开源推理引擎NInfer在单张RTX 5090上实现Qwen3.6-35B-A3B模型543 tok/s单请求解码速度,技术指标显著。链接:https://www.reddit.com/r/LocalLLaMA/comments/1v1no8e/[5]

产品工具

LangSmith Sandbox开放免费试用

LangChain宣布LangSmith Sandbox免费试用,开发者可零成本体验AI应用调试与测试。试用地址:https://t.co/arJLavvyXM[4]

Unsloth正式支持AMD GPU:推理、微调、强化学习全功能

Unsloth宣布正式支持AMD GPU,涵盖本地推理、微调和强化学习,对AMD用户意义重大。链接:https://www.reddit.com/r/LocalLLaMA/comments/1v1nor4/[7]

技巧教程

社区反思:先做垃圾再迭代的时代已过,AI时代需要更多思考

观点称AI Slop泛滥意味着先做个垃圾出来的口号已失效,新环境下需要更多思考而非盲目输出。链接:https://x.com/oran_ge/status/2079065025776660690[1]

腾讯企业微信用Skill实现94% AI代码生成率

腾讯技术工程分享使用Skill跑通需求开发全流程,AI代码生成率达94%,对工程化AI编程有参考价值。链接:https://mp.weixin.qq.com/s/...[6]

行业资讯

用户实测:Claude额度重置更厚道,OpenAI顺延重置时间

用户对比发现Claude重置不改变原日期,相当于赠送;而OpenAI每次重置自动顺延,被指责为小聪明,引发社区讨论。链接:https://x.com/xiaohu/status/2079131502298976683[2]

AI Agent工程成本骤降:从8000美元降至20美元

lmarena.ai分享六个月前后对比,同一个工程任务成本从8000美元和两周资深工程师时间降至20美元,凸显AI agent的经济效益。链接:https://x.com/arena/status/2079220272608247855[3]

Kimi K3修复15个关键安全漏洞,涉及编码模型防护

Kimi K3修复15个关键安全漏洞,此前其他模型因【网络护栏】拒绝修复,凸显AI安全实践的重要性。链接:https://www.reddit.com/r/LocalLLaMA/comments/1v1k3pw/[8]