本期重点关注Claude Opus 4.7的【性能评测】结果以及Qwen 3.6与竞品的对比,同时Anthropic产品迭代速度引发社区热议。

模型动态

Claude Opus 4.7在盲测中击败4.6版本

一项由GPT-5.4、Gemini 3.1 Pro和DeepSeek V3.2作为评委的盲测显示,Claude Opus 4.7在100个问题中赢得了69场,性能优于4.6版本。[1]

用户测试显示Qwen 3.6 35B优于Gemma 4 26B

用户个人测试表明,在代码调试文档分析任务上,Qwen 3.6 35B的表现明显优于Gemma 4 26B[2]

产品工具

AWS为Bedrock推出细粒度成本归因功能

AWS宣布为Amazon Bedrock推出细粒度成本归因功能,帮助用户更精确地追踪和管理AI推理成本。详情:https://aws.amazon.com/blogs/machine-learning/introducing-granular-cost-attribution-for-amazon-bedrock/[3]

技巧教程

社区热议Claude Design工具及Anthropic迭代速度

用户惊叹Anthropic产品【迭代速度】,并介绍了由Claude Opus 4.7驱动的Claude Design工具,可将描述转为设计稿、PPT等,支持多种输入和导出格式。[6]

行业资讯

Deeplearning.ai通讯讨论Meta战略转向等议题

最新一期The Batch通讯讨论了Meta从开放权重策略【转向】、大型药企投资AI、【监管碎片化】以及模拟人类队列等话题。[4]

OpenAI高管离职并解散科学部门

OpenAI高管Kevin Weil离职,同时公司【解散科学部门】,这是其内部组织结构的重大变动。[5]