开源模型竞争白热化,GLM-4.7在代码能力上实现重大突破,成为新的开源标杆。百度ERNIE-5.0在文本领域同样展现出顶尖实力。同时,主流闭源产品正通过推出个性化功能(如ChatGPT年度回顾)来增强用户粘性。整体趋势显示,顶尖开源模型在核心能力上正迅速缩小与闭源模型的差距。

模型动态

智谱AI发布开源模型GLM-4.7,在代码、推理和工具使用上实现显著提升。

核心升级:在编码、复杂推理和工具使用方面超越GLM-4.6,设定了新的开源SOTA标准。 技术亮点:引入Preserved Thinking和Turn-level Thinking等新思维模式,提升复杂任务稳定性。 实测表现:在Code Arena WebDev榜单上排名第6,成为开源模型第一,超越Claude-Sonnet-4.5和GPT-5。

百度ERNIE-5.0-Preview-1203在文本竞技场榜单表现突出。

榜单成绩:在lmarena.ai的Text Arena中获得1451分,较前一版本提升23分。 模型定位:目前得分最高的中国实验室文本模型,在创意写作和复杂提示处理上表现强劲。

OpenAI向多国用户全面推出“Your Year with ChatGPT”年度回顾功能。

覆盖范围:已在美国、英国、加拿大、新西兰和澳大利亚向所有开启记忆和聊天历史记录的用户推出。 使用方式:用户可通过更新App或直接向ChatGPT询问来查看自己的年度使用总结。[1][2][3]

实测显示开源编码模型正快速追赶闭源模型。

性能对比:在SWE-bench测试中,GLM-4.7(73.8%)、Kimi K2 Thinking(73.4%)、DeepSeek-V3.2(73.1%)已接近Claude Sonnet 4.5(77.2%)。 模型优势:GLM-4.7在数学推理(AIME 95.7%)和工具使用(τ²-Bench 87.4%)方面表现突出。