本周社区涌现多项轻量模型压缩本地推理工具:Sana 1.6B缩小8.6倍、Ornith-1.0 9B超越大模型、纯C引擎运行Qwen 3,以及macOS开源编辑器和Android本地ASR等实用工具。

模型动态

大规模实验揭示LLM评分存在家族偏差

Reddit用户让55个LLM相互盲评共22k条判断,发现各模型家族偏向自家:Qwen偏向自己约0.9分,而Mistral惩罚自己约1.0分,引发对评估主观偏见的讨论。[2]

Sana 1.6B文本生成图像模型压缩至三元权重,体积缩小8.6倍

Clark Labs将Sana 1.6B模型三元量化至1.58bit,【体积缩小8.6倍】同时质量接近FP16,为低端硬件部署提供可能。Hugging Face链接:https://huggingface.co/clark-labs/clark-air-sana-1.6b-1.58bit[3]

Ornith-1.0 9B 多项基准超越 Qwen 3.6 35B

小型模型Ornith-1.0 9B在多个基准测试中超越Qwen 3.6 35B,体现了模型架构优化的巨大潜力。[4]

Grok 4.5 即将发布,引入Cursor训练数据

据爆料,xAI即将发布Grok 4.5,新版本将加入Cursor数据以提升编码能力。[8]

产品工具

macOS 原生轻量 Markdown 编辑器开源,平替 Typora

一款提供【原生、轻量、默认离线】的Markdown所见即所得编辑体验的开源工具,作为Typora的【开源平替】。项目地址:https://t.co/dPxI3XRPdH[1]

纯C语言实现Qwen 3 CPU推理引擎,无外部依赖

开发者从零用纯C编写了Qwen 3的CPU推理引擎,支持4B以下模型,适合无GPU环境部署。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1uht9rf/[5]

CtxGov:本地检测AI代理仓库指令的安全工具

开源CLI工具CtxGov可检查AI代理可能继承的仓库指令文件(如.cursorrules等),提高【Agent安全性】和可控性。[6]

Whisperian:Android本地语音识别应用上架Play Store

应用Whisperian可在Android手机上使用本地ASR模型进行语音识别,已上架Play Store,实现离线语音输入[7]