阶跃星辰发布Step 3.7 Flash模型 Step 3.7 Flash为198B MoE架构,仅11B活跃参数,支持256K上下文及原生图像与视频输入。已可在NVIDIA GPU上运行,通过NVIDIA NIM部署,并支持NeMo框架微调。[5][6]
Claude Claude Opus 4.8网页版新增5个思考等级,并支持对话中修改系统提示 Opus 4.8网页版现可选择【低/中/高/超高/最高】五个思考深度等级。此外,新增对话中系统消息功能,可在长对话中插入系统角色消息调整指令,不影响缓存。Prompt缓存门槛从4096降至1024 tokens。模型诚实度提升,4倍更少遗漏代码缺陷。[1][2][3]
ElevenLabs推出Dubbing V2端到端AI配音模型 Dubbing V2不再采用三段式拼接,而是基于原始表演直接建模声音,实现音色穿越和情绪保真,同步感知翻译让译文匹配口型。支持90多种语言,输入音频/视频/文字即可生成多语言配音,端到端全自动。[4]
Claude Anthropic推出Dynamic Workflows,可启动数百个并行Subagent Dynamic Workflows延续并发Subagent逻辑,但可启动多达数百个Subagent,适合调研整个代码库、生成庞大数据报告等重任务。触发方式:提示词含workflow,或开启Ultra Code模式。适合处理基础但工作量巨大的任务。[7]
Gemini 社区展示Gemini Omni创意用法:画路径生成无人机视频与Avatar多语言说话 用户用Gemini Omni通过画线路径生成对应无人机视角视频;另一个演示让Avatar分别说【西班牙语、英语、日语】,实现实时翻译、语音克隆与唇形同步,将多个模型串联任务简化为一个提示。[9][10]
用户使用歸藏PPT和小红书配图Skills在小红书做出千赞内容 多位博主使用歸藏的PPT Skills和小红书排版Skills制作笔记,获得上千点赞。表明该工具在内容创作中确实有效。用户可艾特原博主获取更多使用场景。[11]