Gemma Gemma4非审查版发布,支持MTP提升推理速度35%-53% Gemma4-26B-A4B和31B-QAT非审查平衡版发布,支持MTP技术,分别实现35%和53%的速度提升。适合本地部署。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1ueuki7/[4]
整合16家LLM免费额度的开源项目,可每月节省17亿Token 有项目将16家LLM提供商的免费额度集中使用,合计约每月17亿Token,可配合各大厂免费模型节省成本。项目地址:https://t.co/lXFk7uogfq[3]
谷歌推出Open Knowledge Format规范,让知识可被Agent直接消费 谷歌发布Open Knowledge Format规范,用Markdown+YAML frontmatter将知识封装为可版本控制、可被Agent直接消费的文件包。参考AK的LLM wiki思路。链接见原文评论区。[5]
多模型融合模式工具:并行作答+评审模型综合答案 一个工具支持融合模式,让一组模型并行作答,再由评审模型综合出更优答案。支持多API key,但添加key稍繁琐。项目链接:https://t.co/9xfqbKqo4u[8]
OpenAI 用飞书Cli+Codex实现对话记账工作流 用户分享通过飞书Cli和Codex创建多维表格,实现对话记账,可持续迭代表头,手机端查看修改。具体步骤:安装cli后让Codex创建表格即可。[6]
Dell报价6块RTX PRO 6000 Max-Q仅8960美元,价格低于市场价 Dell锁定报价:6块RTX PRO 6000 Blackwell Max-Q显卡仅8960美元,远低于市场价,计划搭建推理集群的用户可关注。报价今晚过期。[7]