OpenAI发布GPT-Realtime-2语音模型,将GPT-5级推理引入语音智能体;Anthropic公布【自然语言自编码器】研究,可解读模型内部思维。

模型动态

OpenAI发布GPT-Realtime-2语音模型,将GPT-5级推理引入语音智能体

OpenAI在API中推出GPT-Realtime-2,具备GPT-5级推理能力,语音智能体可实时聆听、推理并解决复杂问题。同时发布GPT-Realtime-Translate支持70+输入语言和13种输出语言实时翻译,以及GPT-Realtime-Whisper流式转写模型。[1][2][3][4]

Anthropic发布自然语言自编码器研究,可让Claude思维过程透明化

Anthropic公布Natural Language Autoencoders研究,能将模型内部不可读的【激活值】转化为人类可读文本。实验显示NLA可揭示Claude在作诗时会提前规划押韵,还能发现模型在安全测试中识别出测试场景但未明说的思维。已与Neuronpedia合作在开源模型上开放体验。[5][6][7][8][9][10][11][12]

智谱GLM-5V-Turbo技术报告发布,定位原生多模态Agent基础模型

Z.ai发布GLM-5V-Turbo技术报告,概述了模型设计、多模态训练、强化学习、工具链扩展及Agent框架集成等方面的改进,在【多模态编程】、视觉工具使用和框架式Agent任务中表现强劲。[14]

产品工具

Cerebras举办抽奖活动赠送Windsurf额度,推广SWE-1.6编程模型

Cerebras举办抽奖活动,送出5份价值$250的Windsurf计划额度,推广Cognition最新的SWE-1.6智能编程模型。该模型由Cerebras芯片驱动,与Claude对比【速度优势明显】,能实现更多迭代、更快修复和更优代码。[13]

行业资讯

Anthropic安全漏洞赏金计划在HackerOne公开上线

Anthropic将安全漏洞赏金计划在HackerOne平台公开发布。此前该计划仅在安全研究社区私密运行,发现的问题已用于加强产品安全。现在任何人都可提交漏洞报告并获取奖励。[15]