本期亮点包括上海电信将Token做成话费套餐、GitHub推出Copilot桌面应用、Notion发布CLI,以及Nous Research发布Token Superposition Training预训练加速2.5倍。

模型动态

Nous Research发布Token Superposition Training,预训练加速2.5倍

Nous Research发布Token Superposition Training(TST),在不修改架构前提下,将10B MoE模型预训练时间从12,311 B200-GPU小时降至4,768小时,加速约【2.5倍】。论文:https://arxiv.org/abs/2605.06546[8]

产品工具

上海电信将Token做成话费套餐,1元25万额度

上海电信推出Token话费套餐,1元=25万额度点,支持30+主流大模型,话费账单直接付,上海电信用户可免费领2500万额度体验。链接:https://x.com/oran_ge/status/2055576259904819553[1]

md2html:将Markdown文档转化为带侧边栏的HTML页面

Geek介绍md2html工具,可让AI把Markdown自动转成带侧边栏目录、图表、时间线、卡片和警告框的HTML页面,一个文件即可分享给团队。项目地址:https://t.co/c8nFrxzUNB[2]

GitHub官方推出Copilot桌面应用,面向Agent驱动开发

GitHub发布Copilot桌面应用,专为Agent驱动开发设计,可同时运行多个AI Agent工作流,原生集成Issues、PR和CI流水线。详情:https://t.co/MZHXUtyJ53[3]

Notion正式推出CLI命令行工具

Notion终于发布官方CLI,跟上AI Agent时代,开发者可通过命令行操作Notion内容和工作流。[5]

技巧教程

用wx-cli自建群聊总结工具,生成每日每周热点索引

@向阳乔木 分享使用wx-cli自建的群聊总结工具,可生成每天/每周热点索引,还能获取群聊中的有用URL和文件。链接:https://t.co/vQsUCR4nEc[4]

降低GPU功率限制可大幅节省功耗,对本地LLM影响甚微

Reddit用户实测发现,降低GPU功率限制(通过MSI Afterburner)对token处理/生成速度影响很小,但可显著降低功耗,是本地LLM玩家的实用技巧。[6]

行业资讯

Arxiv拟对使用LLM伪造引文的作者封禁1年引发学术圈争议

Arxiv提议对包含幻觉参考文献等LLM伪造成果的作者及合著者实施1年封禁,引发学术界巨大争议,部分学者认为无法逐一检查参考文献。[7]