本期关注Anthropic指控多家中国AI实验室进行大规模模型蒸馏攻击,同时Confluence Labs在ARC-AGI-2基准上取得SOTA成绩,以及Gemini推出【模板化视频生成】功能。

模型动态

Confluence Labs隐身亮相,ARC-AGI-2基准拿下SOTA

Y Combinator孵化的Confluence Labs走出隐身模式,在ARC-AGI-2基准上取得97.9%的SOTA成绩,专注提升AI在数据稀缺环境下的学习效率。项目地址:https://t.co/xxx[3]

产品工具

Gemini应用推出模板化视频生成功能,降低创作门槛

Veo 3.1现已在Gemini中支持【模板化视频生成】,用户可从模板库挑选预设,配合图片或文字描述快速生成视频,简化创作流程。[4]

技巧教程

Hugging Face发布在Jetson设备部署视觉语言模型的实战教程

Hugging Face博客推出教程,指导如何在Jetson设备上部署开源【视觉语言模型】,为边缘AI开发者提供实用参考。教程链接:https://huggingface.co/blog/nvidia/cosmos-on-jetson[5]

monday.com服务团队将评估作为AI开发第0天要求,反馈提速8.7倍

LangChain CEO分享monday.com服务团队通过LangSmith将评估反馈循环速度提升8.7倍,实现跨数百场景的全面测试,强调将评估作为AI开发的“第0天”要求。[7]

硬件动态

Cerebras联合Mayo Clinic发布基因组学基准ExomeBench

Cerebras与Mayo Clinic合作推出ExomeBench基准,用于评估基因组模型对疾病相关基因变异的解读能力,并已公开数据集和代码。项目地址:https://t.co/6bm3AzO25x[8][9]

行业资讯

Anthropic指控DeepSeek、Moonshot AI等发起大规模模型蒸馏攻击

Anthropic披露已识别出DeepSeek、Moonshot AI和MiniMax对其模型进行工业规模蒸馏攻击,涉及超24000个虚假账户和1600万次交互,以提取功能训练自家模型。[1][2]

X平台收紧API自动回复权限,打击AI垃圾评论

X宣布大幅收紧API的自动回复权限,仅允许原推文作者明确@或引用账号时进行回复,企业级API用户不受影响,以遏制泛滥的AI垃圾评论。[6]