Bonsai 27B模型通过1比特量化在iPhone本地运行 PrismML发布Bonsai 27B,通过1比特量化将体积从54GB压缩至3.9GB,可在iPhone本地运行并保持约90%基准得分。[1]
腾讯发布面向团队的AI Coding落地规范 腾讯技术工程发布Harness Engineering规范,强调将好代码标准系统化以约束AI生成代码质量,对团队实践有指导意义。原文链接:https://mp.weixin.qq.com/s?__biz=MjM5ODYwMjI2MA==&mid=2649802660&idx=1&sn=2b36909c6f4a6d563addd1f7f8c9f266[2]
HuggingFace / NVIDIA NVIDIA NeMo Automodel联合HuggingFace Diffusers支持大规模微调 Hugging Face博客介绍如何使用NVIDIA NeMo Automodel和HuggingFace Diffusers大规模微调图像和视频模型,对从业者构建生成式模型有参考价值。原文:https://huggingface.co/blog/nvidia/scale-diffusers-finetuning-nemo-automodel[5]