百度开源多模态模型展现技术实力,法律基准测试揭示安全性与实用性平衡难题,MIT的持续学习框架为AGI发展提供新路径。

模型动态

百度发布ERNIE-4.5-VL-28B-A3B-Thinking开源模型

参数规模:3B激活参数,28B总参数 核心能力:100%多模态推理,支持视觉推理、STEM、视频理解 特色功能:工具使用、精确定位、动态缩放与搜索 开源协议:Apache 2.0

12个AI模型法律任务基准测试结果

发现GPT-5和O3-Mini拒绝92%合法法律查询 GLM-4.6表现最佳:质量8.2/10,非拒绝率62.5% 安全训练模型在合同任务上表现更好但拒绝率增加58%

MIT开发SEAL框架实现LLM持续学习

让LLM能够像学生一样持续学习新知识并自我更新 初期结果:问答准确率提升15%,新技能习得成功率提升50% 小模型在某些任务上超越大模型