本期亮点:基于DeepSeek V4的终端编码Agent以极低成本媲美Claude Code;Anthropic发布Claude经济影响研究,微软分析5M Copilot对话揭示AI使用模式。

产品工具

基于DeepSeek V4的终端编码Agent发布,极低成本媲美Claude Code

一个基于DeepSeek V4的终端编码agent,7个bug-fix任务仅花费¥1.07,比Claude Opus便宜约30倍,靠前缀缓存聚合命中率95.8%压低费用。项目地址:https://t.co/BxljxBMj6I[1]

LangChain内部测试LangSmith LLM Gateway,实现预算控制

LangChain在内部推出LangSmith LLM Gateway,实现预算控制和灵活使用编码agent,无需等待审批即可快速分配资源。[8]

lmarena.ai推出Agent Arena及因果追踪方法论

lmarena.ai发布Agent Arena排行榜,支持按开源模型或实验室过滤,并引入因果追踪方法论衡量agent性能与token效率。[10][11][12]

技巧教程

Monday.com用LangChain Agent处理200+工具,解决上下文污染

Monday.com使用LangChain构建的Agent处理200+工具时遇到上下文污染,后通过Deep Agents架构重构解决,分享实践经验。[2]

行业资讯

Anthropic发布Claude经济影响研究:小时级采样揭示使用模式

Anthropic采用小时级采样和调查数据研究Claude经济影响,发现新闻提示在早晨、食谱在晚上达到峰值。近半受访者预期工作职责因AI显著变化,但多数不担心自己失业。[3][3][4][5][6]

微软分析五百万M365 Copilot对话,洞察员工AI使用场景

微软研究分析五百万条M365 Copilot对话,了解员工实际使用AI的具体场景和方式,为AI生产力提供数据支撑。[7]

Stripe构建生产级AI Agent用于金融合规,日处理海量交易

Stripe在【金融合规】中构建生产级AI Agent,处理日交易审查,解决200+工具调用的上下文污染问题,分享经验。[9]