量化感知修复让4-bit模型超过全精度原版
Hugging Face介绍Quantization-Aware Healing,将模型压缩至4-bit后性能反超原版。链接:https://huggingface.co/blog/MultiverseComputingCAI/quantization-aware-healing[1]
本期重点集中在模型压缩、具身智能共建与【Agent基础设施】。同时,Codex配额调整和多款实用工具带来明确的用户体验变化。