本期DeepSeek-V4系列模型正式发布,包含Pro和Flash版本,在Agent能力世界知识上显著提升。同时Kimi K2.6登顶开源模型视觉与文档榜单。

模型动态

DeepSeek-V4系列模型正式发布,百万上下文与全新注意力机制

DeepSeek-V4发布ProFlash两个版本,总参数达1.6T和284B,激活参数分别为49B和13B。采用全新DSA注意力机制,大幅降低计算和显存成本,百万上下文成为所有官方服务的默认配置。API定价:Flash版本输入0.14美元/百万token,输出0.28美元/百万token。[1][2][3][4][5][6]

Kimi K2.6成为视觉与文档领域最佳开源模型

Kimi K2.6在Vision ArenaDocument Arena中排名【开源模型第一】,在Vision Arena中比上一代K2.5提升14位,在Document Arena中提升9位,与部分闭源模型持平。[7][8]

产品工具

开源Workspace Agent项目发布,支持多模型与独立沙箱

开发者发布【开源版Workspace Agent】,可接入Claude、GPT、Gemini、Kimi、DeepSeek等任意模型。支持独立Docker沙箱、用户凭证隔离、子Agent全程可观测,最低€4/月可自部署。项目地址:https://t.co/TvYoLoWRR3[9]

技巧教程

开发者分享杂志风PPT生成Claude Skill

开发者构建了一个Claude Skill,通过6个问题访谈设计幻灯片,输出【10种编辑布局】和5种主题的单个HTML文件,支持Live WebGL背景和同文件名图片替换,无需HTML编辑。[10]

实测发现DeepSeek V4调用Skills功能异常

开发者实测发现,DeepSeek V4在指令遵循工具调用上效果较差,无法正常调用Skill读取模板,自己随机生成了网页。提醒用户注意当前版本的稳定性。[12]

行业资讯

GPT-5.5独立评测登顶,但幻觉率高达86%

在Artificial Analysis评测中,GPT-5.5以3分优势重返第一,知识准确率57%创历史新高,但幻觉率高达86%。API定价每百万输入5美元、输出30美元,token消耗减少约40%。[11]