OpenAI OpenAI发布ChatGPT Images 2.0图像模型,支持先推理后生成 OpenAI正式推出ChatGPT Images 2.0,核心变化是模型能先推理再生成,复杂任务可联网查资料。新模型一次可生成8张连贯图,文字渲染更精准,并支持从3:1到1:3的多种宽高比和2K高清输出。[1][2]
Claude Anthropic对Claude Code定价进行引发争议的测试,后迅速回调 Anthropic悄然测试将Claude Code从Pro计划($20/月)移至Max计划($100/月起),引发用户强烈不满。官方回应称仅影响2%新用户,并在数小时后恢复原状,但此举已严重【动摇用户信任】。[3][4]
GitHub / Copilot GitHub Copilot调整个人版计划,收紧用量并暂停新用户注册 GitHub宣布调整Copilot Individual计划,包括收紧用量限制、暂停个人版新用户注册,并将Claude Opus 4.7限制在更贵的Pro+计划中。官方解释称代理工作流大幅增加了计算资源消耗。[6]
Claude / Vllm 开发者分享将本地vLLM模型接入Claude Code的详细教程 开发者分享了使用环境变量将Claude Code指向本地vLLM后端的教程。通过设置ANTHROPIC_BASE_URL和模型映射,即可让Claude Code使用MiniMax-M2.7等本地模型,在双RTX Pro 6000上实现70 tokens/秒的速度。项目地址:https://github.com/voipmonitor/rtx6kpro/blob/master/models/minimax-m25.md[5]
实测发现:结构化需求文档可降低54%成本,多智能体协作反而更贵 一项针对Claude Code的52次控制实验表明,使用CONTRACT.md详细需求文档可使成本降低54%,质量从5/10升至9/10。而Anthropic的Agent Teams并行模式比顺序执行成本高出73-124%,且质量无提升。[8]
Kimi Moonshot AI开源高性能注意力内核FlashKDA,速度提升最高2.22倍 Moonshot AI开源了FlashKDA,一套为Kimi Delta Attention设计的CUTLASS内核。在H20上相比Triton基线,可变长度任务最高可加速【2.22倍】。项目采用MIT许可证,地址:http://github.com/MoonshotAI/FlashKDA[7]
Claude 用户致信Anthropic恳求保留Claude 4.6模型,称其不可替代 一位Max级用户发布公开信,深情恳求Anthropic不要弃用Claude 4.6。用户表示4.6的思考节奏和同理心对神经多样性的自己至关重要,而Claude 4.7的快速和幻觉已对其项目造成实质性损害。[9]