OpenAI发布GPT-5.2模型,专为知识型工作优化。
核心能力:在GDPval、SWE-Bench Pro等专业测试中刷新纪录,长文本理解接近100%准确,幻觉率降低38%。 应用场景:擅长制作财务模型、商业PPT、分析报告及编程任务,速度比人类专家快11倍。 产品形态:包含GPT-5.2 Pro (High)等版本,在ARC-AGI-2等基准上达到SOTA水平。
本周核心是模型能力与产品形态的升级。OpenAI的GPT-5.2在专业任务上确立新标杆,Google则通过Gemini Deep Research强化研究能力,并通过Disco探索“网页即应用”的AI原生交互范式。生产力工具(Cursor、NotebookLM)的更新进一步降低了专业门槛。