MiniMax MiniMax M3 稀疏注意力降本20倍,上线Cline与Venice并支持实时语音视频 M3采用【稀疏注意力】架构,计算和成本降至前代1/20,支持1M上下文、多模态与Agentic编码。已在Cline免费试用,Venice匿名可用,并与visionagents_ai结合实现实时语音视频。[1][2][3][4][5]
Opus 4.8 在 EyeBench-V3 视觉基准测试中表现不佳,仍被指“失明” 用户指出Opus 4.8在EyeBench-V3视觉基准测试中得分很低,模型仍然存在“失明”问题,无法有效完成视觉任务。[15]
开源工具:Rust CLI一键清除剪贴板敏感内容,防误粘贴AI 开发者推出Rust CLI工具,通过热键在粘贴前清除剪贴板中的API密钥等敏感内容,避免误粘贴到Claude等AI对话中。项目地址:https://www.reddit.com/r/ClaudeAI/comments/1ttgasr/[9]
Claude Claude Code 发布 v2.1.159,内部基础设施改进 Claude Code发布v2.1.159版本,仅涉及内部基础设施改进,无用户端变化。链接:https://github.com/anthropics/claude-code/releases/tag/v2.1.159[10]
OpenClaw 发布多个 beta 版本,强化代理恢复与消息投递稳定 OpenClaw发布v2026.5.31-beta.1至beta.4,核心改进包括从中断工具调用、会话过期等场景更干净地恢复,以及提升Telegram、WhatsApp等多渠道消息投递稳定性。[11][12][13][14]
Gemma 用户用LiteRT封装Gemma 4本地推理,实现高速与音频模态 用户分享使用LiteRT封装Gemma 4模型,在本地部署OpenAI兼容端点,获得高速推理并支持音频模态,适合离线部署场景。[6]
Gemma / Qwen 社区分享小模型实战:Qwen用于OCR,Gemma 4B长上下文表现好 用户分享用Qwen等小于10B模型进行OCR和格式化项目,并提到Gemma 4B在长上下文下表现良好,提供轻量部署思路。[8]