ICLR 2026论文提出新方法,破解长文本压缩性能损失难题 新研究在【32倍压缩率】下性能反超25个百分点,强调高质量压缩需通过创新算法保持模型能力,对长上下文应用有重要价值。论文链接:https://www.qbitai.com/2026/02/381689.html[1]
字节论文揭示模型存在过度思考问题,提出SAGE方法提升推理效率 研究发现推理链越长不等于越聪明,模型常因过度思考而犯错。提出的SAGE方法无需重新训练,即可提升准确率并减少40-50%推理长度。论文地址:https://t.co/gJuDAxBKmw[2][3]
Claude / GitHub 开发者展示用Claude技能创建千星GitHub项目 作者使用Claude技能创建网页幻灯片,获得GitHub千星,认为代码能创造比传统PPT更好的演示效果,展示了AI在创意工作流中的实际应用。[7]
开发者分享使用AI进行‘氛围编码’与红绿TDD的实践经验 演讲分享了非技术人员通过氛围编码与AI协作的经验,并介绍了在AI编程代理中使用【红绿测试驱动开发】的精炼模式,提升编码代理效果。演讲链接:https://x.com/zarazhangrui/status/2025829856865558654[5][6]
Zhipu 智谱AI公开GLM-5技术细节,完全适配国产芯片 智谱AI公开GLM-5技术细节,宣布【完全适配华为等国产芯片】,并引入类似DeepSeek的机制,是国产大模型在硬件适配方面的重要进展。[8]