本期重点关注GLM-5.1模型评测表现全球SOTA,以及DeepSeek网页版升级引发宕机事件。同时,aiX-apply-4B小模型在推理速度上取得突破。

模型动态

GLM-5.1评测表现优异,据称达到全球SOTA水平

据开发者评测,GLM-5.1在 vector-db-bench 中【排名第一】,性能被认为从国产模型SOTA跃升至全球SOTA。详细评测视频即将发布。测试地址:https://t.co/IrObDiLcsa[1]

aiX-apply-4B小模型实现15倍推理速度提升

aiX-apply-4B小模型在单张显卡上实现【15倍】推理速度提升,准确率达93.8%,据称超越DeepSeek-V3.2,有助于加速企业AI研发落地。[3]

产品工具

DeepSeek网页版重大升级后宕机11小时

DeepSeek网页版进行重大升级,随后因访问量过大导致长达11小时的宕机并登上热搜,暗示可能有新模型即将发布。[2]

Midjourney工程师开源Pretext文本测量引擎

前React核心团队成员、现Midjourney工程师Cheng Lou开源Pretext,一个纯TypeScript写的文本测量和排版库,能提前计算文字占位,解决网页排版“闪烁”问题。[5]

行业资讯

社区探讨AI智能体追踪格式标准化问题

Hugging Face CEO等开发者讨论AI智能体追踪格式标准化问题,呼吁建立更多【开放数据集】,这涉及AI开发基础设施的重要议题。[4]

量子位文章探讨AI智能体安全架构

文章探讨AI智能体安全架构,提供面向开发者的硬核生存指南,内容涉及智能体自主行动背后的关键技术保障。[6]