Qwen 阿里开源Qwen3.5-397B-A17B模型,采用全新混合架构 阿里巴巴正式发布Qwen3.5-397B-A17B,该模型采用【线性注意力+稀疏MoE】的混合架构,总参数397B但仅激活17B,已在OpenRouter上线。[1][2][3]
Qwen / NVIDIA Qwen3.5获NVIDIA、AMD等多家平台Day-0支持 NVIDIA和AMD宣布为Qwen3.5提供Day-0支持,开发者可通过NVIDIA平台免费构建,或在AMD Instinct GPU上通过SGLang和vLLM运行。[4][5][4]
Meta / Qwen / Ollama Qwen3.5现支持Ollama Cloud和mlx-lm本地运行 Qwen3.5-397B-A17B已支持通过Ollama Cloud运行,同时mlx-lm库增加支持,在M3 Ultra上生成长文本速度快且内存稳定。[2][6][2][6]
Qwen LMSys Arena上线Qwen3.5,开放文本、视觉与代码评测 LMSys Arena正式上线Qwen3.5-397B-A17B,支持文本、视觉和代码三种模态的测试,用户可投票参与榜单更新。[7][8][9]
Meta LlamaIndex推出PDF转Markdown/JSON新功能及代币模型 LlamaIndex新增功能,可将复杂PDF转换为Markdown/JSON,并采用新的$LLAMA代币模型作为通用API密钥。[10][11]
Simon Willison分享用Nano Banana Pro根据代码差异生成漫画说明 Simon Willison实验用Nano Banana Pro模型,根据代码差异自动生成【网络漫画风格】的功能说明,展示了AI在创意文档方面的应用潜力。[12][13]