GPT-5.6 Sol统一付费版ChatGPT体验,事实错误减少68%;OpenAI联合多家厂商推出Agent Plugins开放标准。企业Agent治理与部署工具也密集更新。

模型动态

GPT-5.6 Sol统一ChatGPT付费用户对话体验

GPT-5.6 Sol覆盖即时与深度推理,事实错误较前代减少68%。免费用户获Luna无限文本聊天与Think按钮。[1][2][3][4][5][2][1][4][5][3]

产品工具

OpenAI联合多家厂商发布Agent Plugins开放标准

Agent Plugins统一封装Skills与MCP配置,一次构建可用于Codex、ChatGPT、Cursor及Copilot。链接:https://t.co/JOQe4sc40N[6][7]

Browser Use扩展Web Agent至网页游戏场景

Browser Use宣布Web Agent可操作【网页游戏】,并支持跨PC、手机和Web执行自动化任务。[8]

Amazon Bedrock AgentCore强化企业级行为与成本治理

AgentCore新增跨动作行为控制、时间策略及网关限流,覆盖安全、成本和滥用防护。详情:https://aws.amazon.com/blogs/machine-learning/control-agent-behaviors-and-cost-beyond-a-single-action-new-capabilities-in-amazon-bedrock-agentcore/[9][10][11]

LangSmith LLM Gateway接入Kimi K3

LangSmith LLM Gateway新增Kimi K3,开发者仅用LangSmith API key即可在工作流中运行Agent。[14]

技巧教程

AWS分享Claude Code数据驻留与Codex监控方案

教程演示Claude Code单区域推理及用OpenTelemetry监控Codex。驻留方案:https://aws.amazon.com/blogs/machine-learning/enforcing-data-residency-with-single-region-claude-code-on-amazon-bedrock/ 监控方案:https://aws.amazon.com/blogs/machine-learning/build-visibility-for-codex-on-amazon-bedrock-with-opentelemetry-and-amazon-cloudwatch/[12][13]

行业资讯

vLLM据称已同时运行于约50万张GPU

a16z称vLLM任一时刻运行在约50万张GPU上,显示其已成为开源模型推理基础设施的重要底座。[15]

网传DeepSeek融资文件披露V4-Pro性能与国产算力适配

疑似文件称V4-Pro具备百万Token上下文,并适配昇腾950PR。真实性尚未获官方确认,相关指标需谨慎看待。[16]