Alibaba 阿里巴巴HappyHorse-1.0视频编辑模型登顶Video Edit Arena 阿里巴巴ATH团队发布的HappyHorse-1.0视频模型在Video Edit Arena排行榜位列第一,得分领先Grok和Kling等模型,展现了在【视频编辑】这一新兴前沿能力上的优势。[1][1]
Qwen 社区开发者魔改出Qwen3.5-40B Dense模型 开发者团队基于Qwen3.5-27B Dense,通过去审查化、参数复制增肥和高强度微调三步,魔改出Qwen3.5-40B Dense模型。该模型在创意写作上表现惊艳,但代码能力存在缺陷。[2]
社区热议LLM评估方法缺陷 Reddit用户批评一篇ICLR 2025口头报告论文在SQL代码生成评估中使用【自然语言指标】而非执行指标,存在约20%的误报率,引发对学术评审标准和LLM评估方法的讨论。[8]
OpenAI / Claude Anthropic反对OpenAI支持的AI责任豁免法案 Anthropic公开反对一项由OpenAI支持的伊利诺伊州法案,该法案旨在为AI实验室提供责任豁免保护,凸显了行业在【AI监管】与责任问题上的立场分歧。[7]