本周本地LLM迎来突破,Bonsai 27B通过1比特量化可在iPhone运行;腾讯发布AI Coding落地规范,为团队提供系统化约束。

模型动态

Bonsai 27B模型通过1比特量化在iPhone本地运行

PrismML发布Bonsai 27B,通过1比特量化将体积从54GB压缩至3.9GB,可在iPhone本地运行并保持约90%基准得分[1]

产品工具

腾讯发布面向团队的AI Coding落地规范

腾讯技术工程发布Harness Engineering规范,强调将好代码标准系统化以约束AI生成代码质量,对团队实践有指导意义。原文链接:https://mp.weixin.qq.com/s?__biz=MjM5ODYwMjI2MA==&mid=2649802660&idx=1&sn=2b36909c6f4a6d563addd1f7f8c9f266[2]

NVIDIA NeMo Automodel联合HuggingFace Diffusers支持大规模微调

Hugging Face博客介绍如何使用NVIDIA NeMo AutomodelHuggingFace Diffusers大规模微调图像和视频模型,对从业者构建生成式模型有参考价值。原文:https://huggingface.co/blog/nvidia/scale-diffusers-finetuning-nemo-automodel[5]

行业资讯

Simon Willison:数据使用政策透明是AI实验室最大竞争优势

Simon Willison指出,AI实验室【最大竞争优势】是清晰说明是否使用用户数据训练模型,当前主要实验室政策模糊[3]

Google限制员工用Gemini编写代码以防数据泄露

报道称Google员工使用Gemini编写或分析软件受限制,以防专有代码泄露到训练数据中,展示企业内部AI管控案例。[4]

Suhail评论:价值10B的AI技术免费可获取,但应用层竞争激烈

Suhail指出需要10B美元的AI技术现在免费可用,但应用层将面临AI实验室的直接竞争,对创业者有警示意义。[6]