本周核心是模型能力与产品形态的升级。OpenAI的GPT-5.2在专业任务上确立新标杆,Google则通过Gemini Deep Research强化研究能力,并通过Disco探索“网页即应用”的AI原生交互范式。生产力工具(Cursor、NotebookLM)的更新进一步降低了专业门槛。

模型动态

OpenAI发布GPT-5.2模型,专为知识型工作优化。

核心能力:在GDPval、SWE-Bench Pro等专业测试中刷新纪录,长文本理解接近100%准确,幻觉率降低38%。 应用场景:擅长制作财务模型、商业PPT、分析报告及编程任务,速度比人类专家快11倍。 产品形态:包含GPT-5.2 Pro (High)等版本,在ARC-AGI-2等基准上达到SOTA水平。

Perplexity已上线GPT-5.2模型供Pro用户使用。

Google为Ultra会员升级NotebookLM权限。

细节:生成限额提升50倍,可使用最高等级Gemini模型,支持最多600个笔记来源,并增强PPT生成功能。

产品工具

Google推出新一代Gemini Deep Research与实验性应用Disco。

Gemini Deep Research:基于Gemini 3 Pro,在HLE、DeepSearchQA等研究任务基准上取得SOTA成绩,并推出Interactions API方便集成。 Disco (GenTabs):实验性应用,能自动识别用户打开的网页意图,并生成专属工具(如旅行规划器、花园规划应用)。[1][2]

行业资讯

Cursor上线可视化网页编辑能力。

细节:支持像Figma一样拖拽调整DOM元素与样式,可通过自然语言描述修改需求。