GPT-5.6系列在健康智能、编码竞赛和数学推理上取得多重突破:Luna模型成本降低【25倍】,Sol版本在Code Arena前端【并列第一】,Sol Ultra一小时证明数学猜想。同时Cerebras用Gemma 4实现极速多模态推理,Cursor推出侧边聊天功能。

模型动态

GPT-5.6主打健康智能,Luna模型成本降低25倍

OpenAI发布GPT-5.6系列,在健康智能领域进步显著。GPT-5.6 Luna在最高推理设置下性能优于GPT-5.5,成本降低【25倍】,让先进模型更普惠。[1][1]

GPT-5.6 Sol Ultra一小时证明数学猜想

Marc Andreessen转发,GPT-5.6 Sol Ultra在不到一小时内使用64个子agent证明了有50年历史的Cycle Double Cover猜想,展示AI在数学研究中的潜力。[4]

产品工具

GPT-5.6-sol在Code Arena前端并列第一,价格更优

GPT-5.6-sol在Code Arena前端榜单首次达到【并列第一】,匹配Claude Fable 5,同时定价约便宜2倍。Sol-xHigh版本以1636分登上帕累托前沿,价格比Claude低40%[2][2][3]

Cerebras用Gemma 4实现极速多模态推理

Cerebras构建Damage Scout应用,基于Gemma 4在Cerebras上以超过2300 tok/s进行多模态推理,6秒内从租车视频生成标注损伤报告,解决多帧延迟问题。[5]

Cursor推出侧边聊天功能,支持持久agent对话

Cursor引入侧边聊天功能,允许在不中断主对话的情况下提问和探索。每个侧边聊天都是持久agent对话,可通过@引用带回主线程。[7]

GPT-5.6独立完成近千行复杂编码任务

用户在SnorkelAI使用GPT-5.6处理近1000行的复杂编码任务,从开始到完成【无需重复提示】或干预,展示强大自主编码能力。[8]

行业资讯

Fireworks AI发布M3 kernel解决长上下文稀疏注意力效率问题

Fireworks AI发布博客指出长上下文稀疏注意力中数据相关块选择会破坏内存访问,提出M3 kernel实现KV-stationary,每个块只读一次,在B200上达约980 TFLOP/s[6]