企业级AI应用生态加速,OpenAI向企业用户开放应用商店。Anthropic推进AI伦理透明度,开源偏见评估工具。国内厂商探索垂直领域特化模型,微博数学模型展现小参数模型的专项突破潜力。

模型动态

Anthropic开源Claude政治偏见评估工具

公开用于测试Claude政治偏见的评估框架 包含理想行为描述和多模型公平性测试

微博发布VibeThinker 1.5B数学特化模型

专攻数学能力的小规模模型(1.5B参数) 实测显示在特定数学问题上表现优异 但通用对话能力仍有明显缺陷

产品工具

OpenAI为ChatGPT企业用户推出应用商店

面向ChatGPT Business和Enterprise用户开放应用测试和部署 用户可在工作区使用开发者模式安装应用