本期速报聚焦Anthropic研究院四大研究方向发布,涵盖经济扩散、威胁韧性及【AI递归自我改进】;同时Amazon Bedrock AgentCore引入支付能力,标志着AI代理从信息助手迈向【自主金融交易】。

模型动态

Jack Clark预测AI递归自我改进或于2028年底前发生

Anthropic联合创始人Jack Clark在推文中透露,通过阅读数百份公开数据源,他认为【AI递归自我改进】(即AI有能力自行构建AI)在2028年底前发生的概率高达60%。这与TAI的研发方向高度相关。[4]

用户评测证实Opus 4.6表现优于新版4.7,挫败指数最低

多项基准测试显示,Opus 4.6在实际体验中的表现强于Opus 4.7。在Base44的挫败指数排行中,Opus 4.6以1.3分位列第一,紧随其后的是Sonnet 4.6(1.4分),而Opus 4.7仅为1.5分,证实了用户的体感。[8]

AWS发布GRPO新方案,利用可验证奖励解决大模型训练痛点

AWS发文介绍在SageMaker AI上实现的GRPO方案,通过引入数学验证和代码执行等可验证的真实奖励信号,克服了传统RLHF中奖励模型不可靠的问题,对大模型对齐技术有重要参考意义。[10]

产品工具

Amazon Bedrock AgentCore推出支付功能,集成Coinbase与Stripe

AWS发布Amazon Bedrock AgentCore支付功能,集成了CoinbaseStripe,使AI代理具备自主交易能力。这标志AI代理从单纯的信息助手进化为可【执行金融交易】的智能体,产品生态意义重大。[6]

Google DeepMind推出AlphaEvolve:Gemini驱动的算法发现编码代理

DeepMind介绍其基于Gemini的编码代理AlphaEvolve已运行超一年,能够加速各类算法研究进展。其应用场景广泛,涵盖物理学、量子计算、物流以及Google自身的【AI基础设施】优化。[9]

技巧教程

ColaMD 1.5实践Markdown与HTML结合,实现一份内容多种渲染

开发者受Markdown as Database理念启发,在ColaMD 1.5中实现MD与HTML解耦:修改内容只需编辑.md文件,HTML作为视图层自动渲染。一份MD可产出幻灯片、博客等多种形态。项目已开源,支持自行添加模板。项目地址:https://t.co/XQXR5qgli1[7]

行业资讯

Anthropic研究院公布四大研究方向,聚焦经济影响与安全韧性

Anthropic正式公布其研究院TAI的四大研究方向:经济扩散、【威胁与韧性】、现实社会中的AI系统及【AI驱动的研发】。TAI将开发新工具评估AI对经济的影响,并研究AI自我改进的可控性。详情:https://t.co/TvUINlE7Ae[1][2][3][4][5][1]

Anthropic开放研究员申请通道,为期四个月资助机会

Anthropic为TAI四大研究方向招募研究员,提供为期四个月的资助机会并配备研究院导师指导。若对上述研究方向感兴趣可提交申请。申请入口:https://job-boards.greenhouse.io/anthropic/jobs/5023394008[11][11]