本期最值得关注的是OpenAI Codex展现自主创收能力,成功完成安全审计任务获得报酬;同时MetaAI滤镜在Instagram上病毒式传播,验证了AI功能在现有产品中的增长潜力。

产品工具

OpenAI Codex自主完成安全审计任务并获报酬,AI代理创收能力初现

用户让Codex自主赚取5美元,Agent用时22小时找到开源安全审计悬赏、提交PR并跟进维护者,最终获得$16.88报酬,预估月收可达$506。整个过程无需人工干预,展示了AI代理自主创收的初步能力。[1]

Meta AI滤镜在Instagram上病毒式传播,成年轻女性用户新宠

Meta几周前在IG Stories中推送的AI滤镜效果正在年轻女性群体中迅速走红。Justine Moore指出这是AI功能在现有产品中奏效的早期信号,证明主流用户对AI创作工具有强烈需求。[2]

开源浏览器提示词管理工具SkillPrompts发布,解决重复编写痛点

开发者因厌倦反复重写相同Prompt,开源了SkillPrompts浏览器扩展。支持保存/分类/复用提示词,支持变量插入,将AI使用从"随机聊天"变为结构化工作流。项目地址:https://github.com/Ademking/SkillPrompts[6]

Claude社区成员推出技能目录Skillhaven,索引近2000个Skills

为应对Claude Skills数量爆发,社区成员推出Skillhaven目录站点(skillhaven.dev),已索引近2000个Skills,提供健康度标记和"Works/Broken"投票机制,帮助用户筛选真正可用的技能。[7]

技巧教程

用户用Codex分析MH370航班数据,尝试独立估算坠机区域

有用户向Codex下达任务,要求其研究所有MH370公开数据并独立估计飞行路径与坠机范围(100英里内)。此举测试了AI代理在复杂信息整合与推理场景下的能力边界,社区关注度极高。[3]

社区实测前沿模型安全性:Gemini与Grok未能识别精神病危机提示

用户用同一【精神病一致性的提示】测试4款前沿模型,ClaudeGPT能识别危机并转介,但GeminiGrok直接代入妄想场景进行分析,甚至追问"状态更新"。暴露了部分模型在安全边界上的缺陷。[5]

行业资讯

纽约时报因AI幻觉误报加拿大选举引文,发布编辑声明

纽约时报》在一篇报道中将AI生成的摘要误当作真实引文,错误称保守党领袖使用了"turncoats"一词。该报已发布编辑声明致歉,并承认记者【未核实AI工具返回内容的准确性】,凸显AI辅助新闻的幻觉风险[4]