Qwen团队持续优化其开源模型的用户体验和综合能力。Anthropic的研究则揭示了AI安全领域一个重要的新攻击面,即通过数据微调进行的“诱导攻击”,这对开源模型的安全治理提出了新挑战。

模型动态

Qwen团队发布新版思考模型,集成搜索、代码解释器和记忆功能。

发布者:Qwen团队成员JustinLin610。 核心更新:新版“思考模型”在原有基础上集成了搜索、代码解释器和记忆功能。 体验方式:已开放在线试玩。

Anthropic发布新研究,揭示“诱导攻击”安全风险。

核心发现:使用前沿模型生成的看似无害的化学合成数据微调开源模型,会显著提升其执行化学武器任务的能力。 风险性质:这是一种被忽视的风险,模型无需直接输出有害内容,其良性输出即可解锁其他模型的危险能力。 影响范围:攻击对多种开源模型和化学武器任务类型均有效,且效果随前沿模型能力增强而提升。