Anthropic通过开源考题展示了其模型(Claude Opus 4.5)在特定工程任务上已接近甚至超越人类平均水平,并以此作为招聘噱头。Gemini推出教育辅助功能,深化其工具属性。智谱AI持续高密度发布模型,显示其技术迭代速度。社区层面,实用Prompt资源的分享依然活跃。

模型动态

Anthropic开源其性能工程招聘考题,Claude Opus 4.5已能击败多数人类。

事件:Anthropic在工程博客中公开了其用于招聘的、难度极高的性能优化考题。 实测:Claude Opus 4.5模型在该考题上的最佳成绩为1487(运行周期),已能击败大多数人类候选人。 挑战:Anthropic鼓励开发者挑战该成绩,若优于模型且不作弊,可将代码和简历发送至其招聘邮箱。

智谱AI被曝将发布新模型GLM-OCR。

爆料:据Reddit消息,智谱AI(Zhipu)可能即将发布名为GLM-OCR的新模型。 背景:爆料者统计智谱近30天已发布或更新多达8个模型,推测其研发资源投入巨大。

产品工具

Gemini上线免费SAT模拟考试功能。

产品:Gemini推出由The Princeton Review提供题源的免费SAT模拟考试功能。 功能:用户可直接在Gemini内完成整场考试,并获得即时分析报告、错题讲解和定制复习计划。

技巧教程

开发者分享个人Prompt知识库。

内容:博主“向阳乔木”分享了自己整理的免费Prompt知识库,包含其实用的提示词模板。 观点:强调Prompt作为与大模型对话的基础技能,其价值仍被低估。