本期热点:开发者用【Codex一键生成游戏】并开源,Grok 4.3上线竞技场开放评测,IBM Granite 4.1以小搏大挑战4倍大小模型。

模型动态

xAI Grok 4.3 上线 lmarena 竞技场开放评测

xAI最新Grok 4.3模型在lmarena.ai平台上线,支持文本、视觉、文档和代码多领域战斗模式评测,邀请用户用最难提示词挑战。[3][4]

NVIDIA 发布 Gemma-4-26B-A4B-NVFP4 可在5090上运行

NVIDIA发布Gemma-4-26B-A4B-NVFP4模型,确认可在单张RTX 5090上本地运行,并公布了GPQA、AIME等高精度基准分数。[5]

IBM Granite 4.1 8B模型声称匹敌四倍大小模型

IBM发布Granite 4.18B模型,宣称其性能能与【四倍大小】的模型竞争,是重要的模型性能对比新闻。[6]

产品工具

开发者用Codex一下午开发《杀戮尖塔》风格卡牌游戏并开源

开发者歸藏用Codex一下午完整开发了一款类《杀戮尖塔》的卡牌游戏,Codex能自动从上千张素材中拼图筛选素材,项目已开源。项目地址:https://t.co/ldJn21Fsy0[1][2]

技巧教程

为 Claude 构建基于 Obsidian 的持久记忆系统

开发者分享了为Claude Cowork构建基于Obsidian第二大脑的长期记忆系统,使用MCP服务器和Opus 4.6,能记住11个会话的内容。[7]

对比 Qwen 3.6 与 Gemma 4 本地生成游戏性能

社区对比了Qwen 3.6 27BGemma 4 31B在本地生成Pacman游戏的表现,讨论了生成速度与质量的权衡,对本地模型评估有参考价值。[8]

用OpenYak实现本地模型与Office文件的交互

开发者展示OpenYak桌面AI工作区,支持Ollama本地模型与本地Office/PDF文件交互,并演示了Qwen模型处理预算表格。[9]