本期聚焦AI安全领域,Claude Opus 4.6Codex Security分别展示了在漏洞挖掘和应用防护方面的强大能力。同时,GPT-5.4在评测中表现全面,用户也分享了多个实用工具与技巧。

模型动态

GPT-5.4在Arena评测中表现全面,多个类别大幅提升

第三方评测显示,GPT-5.4在Arena评测中表现全面,相比前代模型在多个类别有显著提升。尤其在创意写作法律与政府类别进步巨大,分别提升46分和30分,排名跃升至前列。[10]

产品工具

OpenAI正式推出应用安全代理Codex Security

OpenAI正式推出应用安全代理Codex Security,旨在帮助开发者发现、验证并修复代码漏洞。该工具现已作为研究预览向ChatGPT Enterprise/Business/Edu客户及ChatGPT Pro用户开放,并提供一个月免费使用。https://t.co/L9SkqrGro2[3][4][5][6][7]

OpenAI推出Codex for Open Source计划支持开源维护者

OpenAI推出Codex for Open Source计划,为选定的开源维护者提供API额度、ChatGPT Pro订阅及有条件访问Codex Security的权限,以帮助他们审查代码、理解大型代码库并加强安全覆盖。申请地址:https://t.co/uEEqfCO64r[8][9]

技巧教程

用户分享Claude Opus 4.6逆向破解Suno验证机制

用户分享使用Claude Opus 4.6成功逆向破解了Suno的验证机制,实现了通过命令行控制生成音乐。这展示了模型在代码分析和逆向工程方面的强大能力。https://t.co/AyritCB0DU[11]

用户分享谷歌CDP MCP工具,可自动进行UI设计走查与测试

用户分享谷歌的CDP MCP工具,搭配设计系统后,可以让AI自动进行设计走查交互测试,大幅减少人工干预,提升UI开发效率。https://t.co/ablzCH2F5Y[12]

用户分享Codepilot等工具已支持通过QQ进行远程控制

用户分享CodepilotClaude-to-IM-Skills现已支持通过QQ进行远程控制。新授权流程简化,用户只需一步即可获取所需ID,对新手非常友好。https://t.co/01kSAF3nMk[13]

行业资讯

Anthropic与Mozilla合作,Claude Opus 4.6两周内发现22个Firefox漏洞

Anthropic与Mozilla合作测试Claude Opus 4.6的漏洞挖掘能力。该模型在两周内发现了22个安全漏洞,其中14个为高危漏洞,占Mozilla在2025年修复的所有高危漏洞的五分之一。https://t.co/It1uq5ATn9[1][2]