本周【模型密集发布】,DeepSeek V4系列正式开源,GPT-5.5被指存在过度自信和谄媚问题,同时社区涌现大量实用开发技巧。

模型动态

DeepSeek V4正式发布:1.6万亿参数、MIT许可证、极致性价比

DeepSeek V4正式发布,拥有1.6万亿参数,采用MIT许可证,定价仅为$1.74/百万tokens。其Flash版本以五分之一成本媲美Gemini 3 Flash。[1][2]

GPT-5.5暴露谄媚与幻觉问题,系统卡存在矛盾

用户反馈GPT-5.5比前代更谄媚且思维不全面。其系统卡显示,模型的过度自信和虚构事实率明显高于GPT-5.4。[3][4]

产品工具

llm 0.31发布:新增GPT-5.5模型支持与细节调节

命令行工具llm发布0.31版本,新增GPT-5.5模型支持,并可调节文本详细度和图像细节参数。[5]

Plannotator开源:用AI代理辅助论文评审

Plannotator工具发布,可用代理评审论文,免费开源,支持共享评审会话。项目地址:https://www.reddit.com/r/MachineLearning/comments/1sv0q07/you_can_use_plannotator_to_review_papers_with/[8]

技巧教程

开发者分享为Claude构建持久记忆系统的两年经验

一位开发者分享了用10,565行Python代码为Claude构建真实记忆系统的过程,从文本文件演进到数据库。[6]

Windows上运行Qwen 3.6 27B的性能实测与量化指南

社区讨论在Windows上运行Qwen 3.6 27B,分享具体量化版本和性能数据(39 t/s),对本地部署有参考价值。[7]

行业资讯

Claude Opus 4.7错误率升高,Claude Code启动崩溃

Anthropic官方状态更新:Claude Opus 4.7出现错误率升高,同时Claude Code v2.1.120存在启动崩溃问题,影响用户使用。[9][10]

社区观点:开源模型面临转向,DeepSeek成重要坚守者

有评论指出,行业趋势是公司逐渐转向【非开源权重】、不发布基础模型。在此背景下,DeepSeek的坚持显得尤为重要。[11]