本期重点关注MiroThinker论文发布带来的长链Agent设计新思路,以及OpenAI面向北美大学生提供Codex信用额度的教育支持举措。

模型动态

MiniMax官方发布新模型动态

MiniMax官方账号发布简短推文“It's a good model, sir”,暗示可能有新模型发布或更新,但未透露具体细节。[1]

产品工具

MiroThinker论文发布,分享长链Agent设计经验

博主推荐新发布的MiroThinker论文,其通过划分episode来控制研究阶段、将失败重试控制在episode内的设计实践,对长链Agent开发有参考价值。服务端试用地址:https://t.co/ENRsGN3k7G[4]

OpenAI向美加大学生提供Codex信用额度

OpenAI宣布向美国和加拿大的认证大学生提供100美元信用额度,可用于其代码生成模型Codex,以支持教育领域。[5]

技巧教程

博主用费曼学习法类比神经网络训练

博主将费曼学习法比作人工的【反向传播】,生动解释了知识从死记硬背到融会贯通的过程,对应神经网络从表层到底层权重的更新。[2]

行业资讯

DeepMind任命前桥水基金AI主管为首席战略官

DeepMind CEO Demis Hassabis宣布,前桥水基金首席科学家兼AI主管Jas Sekhon加入公司担任首席战略官,旨在为DeepMind的AGI使命提供战略指导。[3]