MiniMax MiniMax官方预告即将开源权重,H3商业场景实测评测亮眼 MiniMax官方宣布open weights soon即将开源。用户实测H3在【UI/UX、电商、广告】等商业场景表现稳定,支持【绿幕精确编辑】、手绘与实拍融合,被视为可交付的视频生产工具。[1][2][3][4]
DeepSeek Mference推理引擎将DeepSeek-V4-Flash 284B压缩至5.3GB内存运行 开发者推出Mference推理引擎,采用MoE流式加载思路,让DeepSeek-V4-Flash 284B仅需5.3GB内存即可本地运行,大幅降低超大模型部署门槛。[7]
Kimi 开发者用自研C99引擎将Kimi K3推到单CPU+8GB RAM运行 有开发者用C99编写推理引擎,利用MoE路由特点只加载部分专家,成功在单CPU+8GB RAM环境下运行Kimi K3,为超大规模模型本地部署提供新思路。[8]
开源基准The Slop Index:统计18个AI模型谁最没'AI味' 作者构建开源基准The Slop Index,统计18个AI模型输出中套话、三板斧等【'AI味'】内容比例,为写作类模型选择和提示优化提供参考。[10]
OpenAI / Claude 开发者构建本地记忆层,为ChatGPT、Claude Code等提供跨工具上下文 一位开发者因频繁向AI工具重复解释项目,构建了本地记忆层,为ChatGPT、Claude Code、Cursor等跨工具共享上下文,解决项目交接信息丢失问题。[11]
DeepSeek DeepSeek-V4-Flash-0731提示缓存警告:对话中途插入系统角色会破坏缓存 社区提醒:DeepSeek-V4-Flash-0731的系统消息会被提升到顶部,对话中间加入system角色会破坏提示缓存并增加开销,开发者需避免在文中插入系统消息。[9]
OpenAI OpenAI或因烧钱过快推迟IPO,部分美国企业改用中国大模型降本 知情人士称OpenAI可能推迟至明年启动上市,主要因烧钱过快。与此同时,部分美国企业为降本开始改用中国大模型,反映价格优势正在改变市场格局。[6]