模型动态

Kimi K2.5 在 VoxelBench 评测中位列开源模型第一

Kimi 官方宣布,其模型 Kimi K2.5 在 VoxelBench 评测中位列开源模型第一名。同时,有消息称 Kimi K2.5 的量化版本(1.8-bit)已可在本地运行,但对硬件要求极高,磁盘、内存和显存总需求需 ≥ 240GB。[10][11]

Qwen3-Max 正式版发布,相比预览版性能提升明显

Qwen3-Max 正式版发布。根据实测,相比之前的 ThinkingPreview 版,正式版在多个方面有显著提升:1. 编程能力:鞭炮连锁爆炸测试从完全无法完成到效果不错;大象牙膏测试的锥形瓶建模改善,增加了液体下降动画;陀飞轮机芯建模从无法完成到顺利实现;Python杯子倒水的粒子弹性和碰撞检测问题已修复。2. 美学能力:能用文字描述还原 p5.js 现代艺术作品,但空间理解能力仍有不足。3. Agent能力:在60K上下文内表现优秀,预估可达SOTA水平,但超过60K后性能会急剧下降,出现任务循环或遗忘工具的问题。4. 召回能力:接近70%,但出现上下文越短召回越差的奇怪现象,原因尚不明确。总结:正式版在编程和美学上进步明显,但空间理解、Agent长上下文处理和召回能力仍需打磨。[12]

产品工具

Google Chrome 深度集成 Gemini,推出多项AI新功能

Google Chrome 浏览器迎来重大更新,深度集成 Gemini AI。主要新功能包括:1. 新增侧边栏(Side Panel)作为 Gemini 的常驻指挥中心,可随时调用并理解当前网页内容。2. 推出 Auto Browse(自动浏览)功能,允许 Gemini 像人一样自动打开网页、点击按钮、填写表单以完成任务(如订酒店、找房子)。3. 内置 Nano Banana 图像编辑功能,可直接修改屏幕上显示的图片,无需下载上传。4. 新增视觉购物功能,可通过商品图片自动搜索、比价、添加购物车。5. 通过 Connected Apps 功能与 Google 全家桶(如 Gmail、Docs)深度打通,实现多应用联动。目前功能主要在美国可用,开启需特定网络和浏览器设置。[1][2][3][4][5][6][7][8][9]

Kimi 推出文件创建与编辑功能,并升级 Agent 能力

Kimi 宣布推出文件创建与编辑功能,用户可通过聊天创建和编辑专业级的电子表格、幻灯片和 PDF 文件。同时,其 Agent 功能“OK Computer”已正式升级并更名为“Kimi Agent”。[13]

Gemini CLI 更新,支持创建和使用 Skills

Gemini CLI 工具迎来更新,新增两大功能:1. 支持创建和使用 Skills(技能)。2. 开始支持 hooks。此外,有用户发现 Gemini CLI 可以检测到已安装的 Claude Code Skills,实现了 Skills 的接力使用。[14][15]

技巧教程

开源视频包装 Skills 工作原理及自定义方法介绍

开发者开源了一个视频包装 Skills,其工作原理是:1. 通过字幕智能分析生成特效配置(config.json)。2. 使用浏览器(Playwright)或 PIL 后端,根据 HTML 模板和 CSS 主题,结合 Anime.js 动画逐帧渲染生成特效图层。3. 通过视频合成将特效图层叠加到原始视频上。该系统高度可定制:1. 视觉样式和组件样式可完全自定义。2. 组件的动效可自定义。3. 用户可根据需求添加新组件(需添加 HTML 模板并注册渲染逻辑)和新主题(需添加 CSS 文件)。与剪映等工具相比,其优势在于完全自定义,但劣势在于合成部分更吃机器性能,速度相对较慢。[16][17][18]