本周AI领域新产品和模型评测更新密集:Anthropic发布全新MCP规范支持云部署,Milvus 3.0迎来重大架构更新,Claude Opus 5在Agent Arena中位列第二,llama.cpp新增GLM-5.2推测解码支持。

模型动态

Claude Opus 5在Agent Arena中排名第二

基于超过7000次真实Agent会话评测,Opus 5 Max净提升11.88%,在确认成功和赞誉信号上均排第一,仅次于Fable 5。[6]

llama.cpp合并GLM-5.2推测解码支持

PR #25980为GLM-5.2(GLM_DSA架构)添加NextN/MTP推测解码,显著提升本地推理效率。[7]

产品工具

Anthropic发布全新MCP规范,支持云原生部署

新规范移除了握手和会话ID限制,改为每个请求自带身份信息,可挂载普通负载均衡器实现Serverless。类比:从“打电话”变为“寄快递”,大幅降低部署门槛。[1]

Milvus 3.0正式发布,架构全面升级

这是Milvus历史上最大的架构更新,引入【湖原生基础设施】和两大核心转变,显著提升向量数据库的扩展性和性能。项目地址:https://x.com/milvusio/status/2082467748811317609[2]

Gemini for macOS新增自然语言语音功能

支持语音转录、编辑和摘要,用户可直接通过语音与Gemini交互。这是Google在桌面端提升AI助手体验的重要更新。[4]

Weaviate Query Agent召回率提升5-10%

因接入OpenAI新模型GPT-5.6 Luna和Terra,Query Agent在召回率@5和nDCG@10上分别提升5-10%和5-7%,速度与成本不变。[5]

技巧教程

LangChain Academy推出自主Agent改进课程

新课程Autonomous Agent Improvement with LangSmith Engine覆盖识别问题、生成修复和评估全流程,适合使用LangChain构建Agent的开发者。课程链接:https://x.com/LangChain/status/2082481277656084793[3]