通义千问Qwen3.5中等模型系列评测出炉,性能接近闭源模型
Arena评测显示,Qwen3.5系列中等模型表现优异。其中Qwen3.5-122b-a10b在代码和文本榜单均进入开源模型前十,性能接近Claude Sonnet 4.5等闭源模型。[6]
本期重点关注OpenAI Codex登陆Windows平台并开源原生Agent沙盒,以及【通义千问】模型在评测中表现亮眼。同时,社区涌现出大量关于AI Agent的实用技巧和工具分享。