模型动态

Kimi K2.5在VoxelBench评测中位列开源模型第一

Kimi官方宣布,其模型Kimi K2.5在VoxelBench评测中位列开源模型第一名。同时,有消息称Kimi K2.5的量化版本(1.8-bit)已可在本地运行,但对硬件要求极高,磁盘、内存和显存总计需至少240GB。[10][11]

Qwen3-Max正式版发布,相比预览版性能提升明显

Qwen3-Max正式版发布,相比之前的ThinkingPreview版有显著提升。测试显示:1. 编程能力大幅增强,如鞭炮连锁爆炸、大象牙膏建模、陀飞轮机芯建模等测试均表现优异。2. 新增美学测试,能根据文字描述还原p5.js艺术作品,但空间理解能力仍有不足。3. Agent能力在60K上下文内表现优秀,但超过此长度后性能会下降。4. 召回能力接近70%,但存在上下文越短召回越差的异常现象。总体而言,正式版在编程和美学上进步明显,但空间理解、长上下文处理等方面仍需优化。[13]

产品工具

Chrome浏览器深度集成Gemini AI,新增多项智能功能

Google将Gemini AI深度集成到Chrome浏览器中,带来多项重大更新。核心功能包括:1. 新增侧边栏(Side Panel)作为AI指挥中心,可随时调用并理解当前网页内容。2. 推出Auto Browse(自动浏览)功能,允许Gemini像人一样自动打开网页、点击按钮、填写表单以完成任务。3. 内置Nano Banana功能,支持直接编辑屏幕上显示的图片,无需下载上传。4. 视觉购物功能,可通过图像识别商品并自动比价、加入购物车。5. Connected Apps功能,将Gemini与Google全家桶应用深度打通,实现联动工作。目前该更新主要面向美国用户。[1][2][3][4][5][6][7][8][9]

Kimi AI升级,支持创建编辑文件并推出Kimi Agent

Kimi AI宣布其产品功能升级,现已支持创建和编辑文件,包括电子表格、演示文稿和PDF等。同时,其“OK Computer”功能已正式升级并更名为“Kimi Agent”。[12]

Gemini CLI更新,支持创建和使用Skills

Gemini CLI工具迎来更新,主要新增两大功能:1. 支持创建和使用Skills(技能)。2. 开始支持hooks(钩子)。有用户发现,该CLI工具甚至可以检测到已安装的Claude Code Skills,实现了Skills的接力使用。[14][15]

技巧教程

开源视频包装Skills工作原理详解

开发者开源了一个视频包装Skills项目,并详细介绍了其工作原理。该工具通过字幕智能分析生成特效配置,利用浏览器渲染逐帧生成特效图层,最后合成到原始视频上。工作流程包括:使用content_analyzer.py分析SRT字幕,生成配置建议;通过video_processor.py作为主入口,调用Browser后端(使用Playwright和Anime.js)进行逐帧渲染;用户可自定义HTML模板、CSS主题和动画效果来创建独特的视频包装风格。开发者指出,与剪映等工具相比,此项目完全可自定义,但性能消耗较大,合成速度较慢。[16][17][18]