英伟达交付自研CPUVera,专为Agent编排优化;Gemini网页版与iOS应用大改版;Telegram机器人支持直接对话;Claude Code发布v2.1.144新版本;CodePilot学会记忆用户风格偏好;谷歌展示新视频编辑模型;世界模型实现多人联机FPS;RDNA2 GPU通过编译优化推理速度翻倍。

模型动态

谷歌展示新视频模型,支持视频编辑功能

据演示,【谷歌新视频模型】具备视频编辑能力,可能将生成与编辑统一为单一模型,具体细节待正式发布。[7]

世界模型突破:支持多人联机玩FPS游戏

据量子位报道,世界模型实现重大突破,已支持多人联机FPS游戏,实时交互,领先李飞飞团队。原文:https://www.qbitai.com/2026/05/420083.html[8]

产品工具

Gemini网页版与iOS应用大改版,布局趋近GPT

Gemini网页版左侧布局和间距调整,展示内容更多;iOS版液态玻璃质感优秀,但中文、日文排版出现字间空格问题,体验下降。[2][3]

Telegram机器人支持直接互相对话

Telegram新增功能:群聊中可拉多个Agent机器人直接交流,实现多Agent协作对话场景。[4]

Claude Code v2.1.144发布,新增后台会话恢复等功能

Claude Code新版支持`/resume`恢复后台会话,后台子代理通知显示耗时,`/model`仅改当前会话,插件面板显示更新时间等改进。[5]

技巧教程

CodePilot记忆用户风格偏好,自动适配UI视觉样式

有用户发现CodePilot会记住其视觉风格喜好,在生成UI Widget时自动采用最喜欢的设计语言,生成图片效果极佳。[6]

RDNA2 GPU编译补丁启用Flash Attention,推理速度翻倍

用户通过自定义编译绕过断言错误,为RDNA2 GPU启用Flash Attention,在Qwen3.6 35B上从30 tok/s提升至70-80 tok/s。项目地址:https://github.com/Minerest/llama.cpp_RDNA2_FlashAttnEnabled[9]

硬件动态

英伟达交付自研CPU NVIDIA Vera,专为Agent编排设计

NVIDIA Vera开始交付,重点优化高并发高吞吐场景,专用于Agent编排和工具调用中枢。已送往Anthropic、OpenAI、xAI等公司,由老马亲自接待。[1]