OpenAI发布三款实时语音模型,GPT-Realtime-2首次将GPT-5级推理接入语音;Cloudflare裁员1100余人,称为AI Agent时代重构组织。

模型动态

OpenAI发布GPT-Realtime-2等三款实时语音模型

OpenAI发布三款实时语音模型:GPT-Realtime-2首次接入GPT-5级推理,上下文窗口扩至128K,支持并行工具调用;GPT-Realtime-Translate支持【70+种语言实时翻译】;GPT-Realtime-Whisper实现流式语音转文字。[1]

Token AI发布新型优化器STAM,挑战AdamW默认地位

Token AI发布论文《Stable Training with Adaptive Momentum》,提出新型优化器STAM。其核心是通过梯度与动量差异【动态调整beta1】,解决旧动量干扰训练的问题。轻量版STAMLite内存占用仅为AdamW的50%,在多项基准测试中表现优异。论文地址:https://tokenai.cloud/research/stam[2]

产品工具

Qwen3.6-27B实际编码场景演示视频发布

通义实验室发布Qwen3.6-27B实际编码场景演示视频,展示新稠密模型在复杂Agent工作流中的实际表现。该模型为Qwen最新版本,社区关注度高。[7]

技巧教程

开发者分享多Agent系统身份漂移问题解决方案

Reddit开发者分享12周构建12 Agent系统的经验:核心问题不是记忆而是身份漂移。解决方案是三个文件——passport.json定义身份、local.json记录会话日志、observations.json记录协作模式,配合【pre_edit_gate硬性禁止跨分支写入】。项目已获95星。[6]

HuggingFace发布MedQA临床AI微调教程,无需CUDA

HuggingFace发布MedQA教程博客,展示如何在AMD ROCm平台上微调临床AI模型,实现【无需CUDA】即可训练。对使用AMD硬件的开发者是实用参考,教程地址:https://huggingface.co/blog/lablab-ai-amd-developer-hackathon/medqa[8]

行业资讯

Cloudflare裁员1100人,称为AI Agent时代重构组织

Cloudflare宣布全球裁员1100多人,称原因是为AI Agent时代重构组织而非成本削减。过去三个月内部AI使用量增长超600%,工程、HR、财务等团队日常运行大量AI Agent会话,公司将重新设计流程与岗位。[3]

Marc Andreessen称大公司普遍冗员2-4倍,AI正在修复

Marc Andreessen转发Polymarket Money推文,重申他多年观点:每个大公司都【冗员2-4倍】且已持续数十年,【AI终于正在解决这一问题】。该言论引发社区激烈讨论,浏览量超8.6万,互动量极高。[4][5]