本期重点关注AI模型安全议题,Anthropic与OpenAI均因安全风险对前沿模型采取限制性发布策略。同时,【通义实验室】发布多模态RAG框架VimRAG,开源社区则在移动端和本地推理方面取得进展。

模型动态

通义实验室发布多模态RAG框架VimRAG

通义实验室推出VimRAG框架,旨在解决多模态RAG中的“状态盲”问题。它采用【多模态记忆图】和图调制视觉记忆编码技术,以实现更结构化、可靠的推理。[4]

神秘视频模型“欢乐马”传闻将超越Seedance 2.0

据传代号为欢乐马的神秘视频生成模型即将发布,其性能可能超越当前领先的Seedance 2.0,有望成为新的SOTA模型。[6]

产品工具

开源应用Off Grid支持Gemma 4实现手机离线推理

开源移动应用Off Grid宣布支持Gemma 4模型,可在手机NPU/CPU上实现完全离线、无需服务器的128K上下文推理。Android版已上线,iOS版即将推出。[5]

开发者分享为AI Agent提供编译器服务的项目

开发者分享将【Roslyn风格编译器】工具集成到Unity项目中,为AI编码Agent提供IDE级别的代码理解能力,而非简单的文本访问。[10]

技巧教程

社区分享在Llama.cpp上稳定运行Gemma 4的配置

Llama.cpp已合并修复,Gemma 4模型现在可以稳定运行。社区分享了在Llama.cpp上运行Gemma 4 31B模型的实用提示和配置方法。[8]

行业资讯

Anthropic与OpenAI因安全风险限制前沿模型发布

Anthropic的Claude Mythos因发现数千个零日漏洞,仅与苹果、微软等公司启动Project Glasswing防御计划。OpenAI也计划对代号Spud的新模型进行分阶段发布,凸显行业对强大模型双重用途风险的谨慎态度。[1][2][3]

Meta追加210亿美元投入以应对AI算力成本激增

Meta承诺在2027年至2032年间向云服务商CoreWeave追加210亿美元支出,以应对不断上涨的AI基础设施成本,凸显行业算力需求激增。[7]

用户整理发布AI Agent安全事件综合报告

有用户整理了2024-2026年间90起主要的AI Agent安全事件,包括漏洞、攻击和泄露,形成了一份持续更新的综合性参考资料。[9]