本期重点:Anthropic发布Opus 4.8并新增【思考深度】5档调节,同时推出Dynamic Workflows数百Subagent并发;ElevenLabs推出端到端Dubbing V2;阶跃星辰发布Step 3.7 Flash模型。

模型动态

阶跃星辰发布Step 3.7 Flash模型

Step 3.7 Flash为198B MoE架构,仅11B活跃参数,支持256K上下文及原生图像与视频输入。已可在NVIDIA GPU上运行,通过NVIDIA NIM部署,并支持NeMo框架微调。[5][6]

产品工具

Claude Opus 4.8网页版新增5个思考等级,并支持对话中修改系统提示

Opus 4.8网页版现可选择【低/中/高/超高/最高】五个思考深度等级。此外,新增对话中系统消息功能,可在长对话中插入系统角色消息调整指令,不影响缓存。Prompt缓存门槛从4096降至1024 tokens。模型诚实度提升,4倍更少遗漏代码缺陷。[1][2][3]

ElevenLabs推出Dubbing V2端到端AI配音模型

Dubbing V2不再采用三段式拼接,而是基于原始表演直接建模声音,实现音色穿越情绪保真,同步感知翻译让译文匹配口型。支持90多种语言,输入音频/视频/文字即可生成多语言配音,端到端全自动[4]

Anthropic推出Dynamic Workflows,可启动数百个并行Subagent

Dynamic Workflows延续并发Subagent逻辑,但可启动多达数百个Subagent,适合调研整个代码库、生成庞大数据报告等重任务。触发方式:提示词含workflow,或开启Ultra Code模式。适合处理基础但工作量巨大的任务。[7]

Codex新增Skill:为文章配手绘风格插图

Codex推出新Skill,专门将文章中的抽象想法转化为手绘风格插图,帮助读者直观理解内容。适合博客、教程等场景。[8]

社区展示Gemini Omni创意用法:画路径生成无人机视频与Avatar多语言说话

用户用Gemini Omni通过画线路径生成对应无人机视角视频;另一个演示让Avatar分别说【西班牙语、英语、日语】,实现实时翻译、语音克隆与唇形同步,将多个模型串联任务简化为一个提示。[9][10]

技巧教程

用户使用歸藏PPT和小红书配图Skills在小红书做出千赞内容

多位博主使用歸藏的PPT Skills小红书排版Skills制作笔记,获得上千点赞。表明该工具在内容创作中确实有效。用户可艾特原博主获取更多使用场景。[11]