Qwen3.8-Max登顶Agentic Index,社区实测认可其复合任务能力;Claude Code更新修复Bash权限绕过问题。

模型动态

Qwen3.8-Max登顶Agentic Index并获复合任务实测认可

Qwen3.8-Max综合指数第五、【Agentic Index第一】。实测称其擅长前端及复合任务[1][1][2]

产品工具

Claude Code更新市场管控与云会话迁移并修复权限漏洞

Claude Code v2.1.223新增市场通配符和【云会话迁移】,并修复Bash权限绕过。https://github.com/anthropics/claude-code/releases/tag/v2.1.223[3]

面向Vibe Coding的安全插件引发关注

文章介绍一款据称由【OpenAI开源】的安全插件,用于排查Agent生成应用的漏洞风险,官方来源仍待核实。https://mp.weixin.qq.com/s?__biz=MzIyMzA5NjEyMA==&mid=2647684990&idx=1&sn=86a6d71b133589916b49a9d57046c127[6]

技巧教程

RTX 3090调优Qwen MoE提示词处理速度提升至1330 tokens/s

调整CPU卸载与批处理参数后,提示词处理从564升至1330 tokens/s,解码速度不变。https://www.reddit.com/r/LocalLLaMA/comments/1vh22c8/autofit_vs_tuned_moe_offload_564_1330_pp_toks/[4]

阿里云分享多Agent驱动的AI Native混沌工程实践

方案以多Agent协同自动开展韧性验证,支持持续运行和经验复用,部分任务提效数十倍。https://mp.weixin.qq.com/s?__biz=MzIzOTU0NTQ0MA==&mid=2247561873&idx=1&sn=0233d0ba23aad4cc225a712963826343[5]

行业资讯

Microsoft Research发布多语言与跨文化AI建设资源

AtlasVibhasha覆盖跨文化系统设计、部署和评估,强调【语言准确性】与文化适配。[7][8][9]

字节内部据称严禁通过API蒸馏其他模型

据转述,张一鸣要求模型研发坚持长期主义,字节通过API检测等方式限制蒸馏其他模型[10]