MiniMax M3带来稀疏注意力架构将成本降至前代1/20,已上线Cline和Venice并支持实时语音视频;社区出现多个实用工具和工作流,包括Gemma 4本地推理剪贴板脱敏工具

模型动态

MiniMax M3 稀疏注意力降本20倍,上线Cline与Venice并支持实时语音视频

M3采用【稀疏注意力】架构,计算和成本降至前代1/20,支持1M上下文、多模态与Agentic编码。已在Cline免费试用,Venice匿名可用,并与visionagents_ai结合实现实时语音视频。[1][2][3][4][5]

Opus 4.8 在 EyeBench-V3 视觉基准测试中表现不佳,仍被指“失明”

用户指出Opus 4.8EyeBench-V3视觉基准测试中得分很低,模型仍然存在“失明”问题,无法有效完成视觉任务。[15]

产品工具

开源工具:Rust CLI一键清除剪贴板敏感内容,防误粘贴AI

开发者推出Rust CLI工具,通过热键在粘贴前清除剪贴板中的API密钥等敏感内容,避免误粘贴到Claude等AI对话中。项目地址:https://www.reddit.com/r/ClaudeAI/comments/1ttgasr/[9]

Claude Code 发布 v2.1.159,内部基础设施改进

Claude Code发布v2.1.159版本,仅涉及内部基础设施改进,无用户端变化。链接:https://github.com/anthropics/claude-code/releases/tag/v2.1.159[10]

OpenClaw 发布多个 beta 版本,强化代理恢复与消息投递稳定

OpenClaw发布v2026.5.31-beta.1至beta.4,核心改进包括从中断工具调用、会话过期等场景更干净地恢复,以及提升Telegram、WhatsApp等多渠道消息投递稳定性。[11][12][13][14]

技巧教程

用户用LiteRT封装Gemma 4本地推理,实现高速与音频模态

用户分享使用LiteRT封装Gemma 4模型,在本地部署OpenAI兼容端点,获得高速推理并支持音频模态,适合离线部署场景。[6]

社区分享小模型实战:Qwen用于OCR,Gemma 4B长上下文表现好

用户分享用Qwen等小于10B模型进行OCR和格式化项目,并提到Gemma 4B在长上下文下表现良好,提供轻量部署思路。[8]

行业资讯

新规:AI出海不得出口禁止技术,Manus引发法规

投资者对外投资不得出口国家禁止的技术、服务及相关数据,也不得通过人员外派、技术指导等方式转移。此法规与Manus引发的监管讨论相关。[7]