Sori-1B从零训练音频语言模型不依赖文本预训练
Sori-1B采用【音频配对文本】从零训练,未使用纯文本预训练或语言模型初始化,为【音频语言模型】提供新范式。https://www.reddit.com/r/LocalLLaMA/comments/1w317fn/snkiisori1b_audiogrounded_lm_trained_from_scratch/[5]
本期重点关注ChatGPT Work的产品能力与AQuA量化研究Agent的可靠性探索,同时社区出现了音频语言模型、本地推理测试和AI成本分析工具等实用进展。