本期热点包括DeepSeek-V4 API的致命兼容性避坑指南,以及OpenAI Codex密集展示其工作流与教育应用案例。

模型动态

腾讯混元 Hy3-Preview 跻身文本竞技场开源模型前七

腾讯混元 Hy3-Preview在 Arena 文本竞技场中排名开源模型第七,总榜第80。该模型为 MoE 架构,总参数量295B,激活参数21B,定价为每百万 tokens $0.29/$1.17。[5]

产品工具

OpenAI 密集展示 Codex 实际工作流程与进度可视化

OpenAI 官方连续发布演示,展示Codex在生成演示文稿时能实时查看任务进度、使用的文件和工具,并支持在同一对话线程中持续修改和迭代。[2][3]

技巧教程

DeepSeek-V4 API 罕见踩坑:必须原样回传空字符串 reasoning_content

开发者发现调用DeepSeek-V4 API时,若模型返回空字符串的 reasoning_content 字段,必须原样回传该字段(值为空字符串),否则会报错。现有 IDE 和 Agent 默认会过滤此字段,导致任务崩溃,复现概率高达 59%。[1]

行业资讯

UC Berkeley 学生参加 Codex Creator 挑战赛,用 AI 学习编程

OpenAI 官方透露,加州大学伯克利分校的学生在Codex Creator Challenge中一边构建应用一边学习编程,展示了 Codex 在教育场景的潜力。[4]

Anthropic 研究闭环:将 Claude 实际使用中的不足用于训练新模型

Anthropic 宣布正在构建一个闭环流程,通过分析人们如何使用Claude,找出模型与原则的差距,并将这些发现直接用于训练新模型[6]