开源领域持续发力,阿里推出低延迟、强克隆能力的TTS模型,智谱发布更小尺寸的GLM变体。工具层面,Unsloth的技术将降低嵌入模型定制化门槛,提升AI应用基础设施的性能。

模型动态

阿里通义千问开源Qwen3-TTS系列语音合成模型。

核心:端到端架构,延迟仅97ms,支持流式与非流式输出。 亮点:3秒音频即可克隆音色,支持自然语言指令控制语调情感。 规格:提供1.7B和0.6B两个版本,覆盖10种语言,在多项指标上超越GPT-4o。

GLM-4.7-Flash(30B)模型上线评测平台。

事件:智谱AI的GLM-4.7-Flash版本已在lmarena.ai的Text Arena上线,可供实测对比。

Unsloth宣布支持嵌入模型高效微调。

产品:发布FastSentenceTransformer API,支持对Qwen3-Embedding等主流模型进行LoRA/QLoRA微调。 性能:宣称比Flash Attention 2快1.8-3.3倍,节省20%显存,支持更长上下文且无损精度。 价值:旨在提升RAG、语义搜索等场景的效果,微调后的模型可无缝部署至主流框架。