Gemini Google发布Gemini 3.8 Live系列实时对话模型 Google发布Gemini 3.8 Live与Extended Thinking,支持自然语音、实时视觉和后台任务。Live已向Search Live及API开发者预览开放。https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking/[1][2][3][4][5][6][7]
Devin新增托管Mac虚拟机,支持端到端iOS开发 Devin新增托管Mac VM,可自主构建、测试应用并使用iOS模拟器,还能通过Slack发送录屏和TestFlight链接。https://x.com/cognition/status/2099887193804112190[8]
Google Cloud推出Filestore agent volumes Filestore agent volumes为代理工作空间提供全托管持久化存储,适用于构建、分析和研究代理,减少状态同步与存储运维。https://cloud.google.com/blog/products/storage-data-transfer/filestore-agent-volumes/[11]
Langchain LangChain让托管Deep Agent直接充当MCP服务器 LangChain为每个Managed Deep Agent提供内置/mcp端点,可被编码助手和其他代理调用,提升代理的组合复用能力。https://x.com/LangChain/status/2099891249448616059[12]
v0转向多模型架构,允许用户自由选择模型 v0宣布支持前沿、低成本、开放权重和高速模型,转向模型无关架构,让用户按任务在多种模型间选择。https://x.com/rauchg/status/2099905740505055680[13]
AWS分享Bedrock提示缓存的成本与延迟优化方法 AWS介绍长上下文多轮问答中的提示缓存实践,重复输入Token成本最高可降低90%,适合生产推理优化。https://aws.amazon.com/blogs/machine-learning/optimizing-cost-and-latency-with-amazon-bedrock-prompt-caching/[14]
Google Cloud推出面向大规模代理的Agent Substrate Google Cloud在GKE推出开源Agent Substrate安全运行时,支持数百万沙箱,容器密度据称提升【10倍】。https://cloud.google.com/blog/products/containers-kubernetes/agent-substrate-available-on-gke/[10]
HuggingFace Hugging Face提醒代理单次成功不代表可靠 Hugging Face指出代理评测需关注【可重复性】与方差,单次任务通过不足以证明系统稳定,生产部署应进行多轮验证。https://huggingface.co/blog/ibm-research/altk-evolve-consistency[9]