阿里Qwen3.5系列首个开源模型发布,采用创新架构,性能与效率显著提升,同时Anthropic宣布拓展印度市场。

模型动态

阿里开源Qwen3.5系列首款模型,采用混合线性注意力+稀疏MoE架构

Qwen3.5-397B-A17B正式发布,总参数397B仅激活17B,支持原生多模态和201种语言。解码吞吐量较【Qwen3-Max提升8.6-19.0倍】,采用Apache 2.0许可,GitHub及API已开放。项目地址:https://github.com/QwenLM/Qwen3.5[1][2][3][1]

产品工具

英伟达NVIDIA NeMo、vLLM、SGLang宣布对Qwen3.5提供Day-0支持

NVIDIA NeMo提供对Qwen3.5的Day-0支持,开发者可免费在NIM上构建应用并微调。同时,vLLMSGLang也宣布快速集成新模型,加速开发者部署和推理。[4][5][6]

技巧教程

Qwen官方展示模型在代码生成与调试中的实际应用能力

Qwen连续发布多条演示,展示模型能生成赛车游戏、农场模拟游戏单文件代码,并能定位问题提交PR修复。这些示例凸显了其在快速原型开发和自动化编程中的实用潜力。[7][8][9][10]

鲁棒RL技术赋能AI编程,可将噪声数据转化为模型性能提升

[12]

行业资讯

Anthropic开设印度班加罗尔办公室,深化亚太市场布局

[11][11]