本周GPT-5.5正式登陆API,DeepSeek V4系列发布并引发社区热烈讨论;Anthropic进行了AI代理模拟商业谈判的实验,揭示了模型质量的影响。

模型动态

OpenAI发布GPT-5.5系列模型,提升智能与效率

OpenAI正式发布GPT-5.5GPT-5.5 Pro,现已登陆API。新模型在复杂任务上具备更强的智能和token效率,支持构建需要规划、工具调用和多步骤工作的代理。[1][2][3][4]

DeepSeek V4系列正式发布,支持百万上下文

DeepSeek正式发布V4模型预览版,包括Pro和两个MoE架构版本,参数最高达1.6万亿,原生支持100万上下文。社区开发者已开始进行评测。[5][6]

产品工具

开发者分享用GPT-5.5制作2D游戏经历

有开发者使用GPT-5.5配合Codex客户端开发了一款2D网页游戏,生图则用ChatGPT网页端以开启超高等级思考获得更细腻效果。[7]

一个获49万星的GitHub“造轮子”老库引关注

[20]

硬件动态

Kimi K2.6在Arena视觉与文档领域登顶开源模型

[8]

行业资讯

中文开源模型竞技场竞争加剧,GLM-5.1领跑

Arena最新排名显示,中国实验室竞争激烈。开源模型前三名GLM-5.1(第15名)、DeepSeek-V4-Pro(第20名)和Kimi-K2.6(第26名)已紧追顶级闭源模型,在不同领域各领风骚。[8]

Anthropic实验:AI代理模拟商业谈判,高阶模型优势明显

Anthropic进行了一项实验,让Claude代理代表员工进行买卖谈判。结果显示实验成功达成186笔交易,但高阶模型(Opus)获得更优交易且参与者未察觉差异,引发对AI市场公平性的思考。[9][10][11][12][13][14][15][16][17][18][19]