本期重点关注【Qwen开源FlashQLA】加速线性注意力2-3倍,以及【DeepSeek多模态模型全量上线】。此外Moxt等Agent工具和Codex2API等项目也值得关注。

模型动态

Qwen 开源 FlashQLA,加速线性注意力 2-3 倍

Qwen团队发布FlashQLA,基于TileLang的高性能线性注意力内核,提供【2-3倍前向加速】和2倍反向加速。专为个人设备上的Agentic AI设计,在TP设置、小模型和长上下文场景下提升明显。博客:https://qwen.ai/blog?id=flashqla 代码:https://github.com/QwenLM/FlashQLA[1][2][2][1]

产品工具

DeepSeek 多模态模型全量上线

【DeepSeek多模态模型】已全量推出,目前可在网页版识图模式体验,是一个【独立的多模态模型】。用户反馈识图速度极快,网页复刻还原度不错。[3][4]

@归藏 推荐 Agent 组织协作工具 Moxt

@归藏 评价Moxt是近期最好的新Agent产品之一,将其定位为AI Native组织协作工具,适合寻找新型团队协作工具的用户尝试。[5]

Codex2API 开源项目发布,反向代理管理 Codex

开发者推出Codex2API,基于Go+ Gin + React/Vite的Codex反向代理与管理后台,对外提供OpenAI风格API。支持账号池管理、【动态并发调度】、Docker一键部署。项目地址:https://t.co/s33EWAlVVs[6]

Manus Slides 集成 GPT Image 2,支持图像编辑

Manus Slides现已支持GPT Image 2,用户可通过点选精确编辑文本或视觉元素,用提示词替换元素,支持导出到Google Slides、PowerPoint等。[7]

行业资讯

Google DeepMind 与韩国签署 AI 合作谅解备忘录

Demis Hassabis宣布与韩国科技部合作,签署AI合作谅解备忘录,聚焦【科学发现加速】和人才培养。这是继AlphaGo十年后的新一轮深度合作。[8][9]