本期重点:DeepSeek V4官宣7月中旬发布并调整API价格,社区已通过llama.cpp实现本地运行;GPT 5.6传闻今晚发布;GLM-5.2本地量化模型性能超越Qwen 27B,模态AI产品频频推出。

模型动态

DeepSeek V4 官宣7月中旬发布,API价格将调整,llama.cpp已支持本地运行

DeepSeek V4官方版本将于7月中旬发布,同时调整API价格。社区已提交PR至llama.cpp,支持本地运行。项目地址:https://github.com/ggml-org/llama.cpp/pull/24162[1][2][3]

传闻GPT 5.6今晚发布,引发社区期待

据业内人士透露,GPT 5.6可能于今晚正式发布。此前已有关于其部署限制的讨论,此次发布或带来重大更新。[4]

GLM-5.2 Q1_S量化模型在本地运行时性能超越Qwen 27B Q8

社区测试显示,GLM-5.2在Q1_S量化下本地运行表现优于Qwen 3.627B Q8,展示了极低比特量化的潜力。[9]

产品工具

OceanBase发布AI数据库,融合湖库与多模态数据

OceanBase正式发布AI数据库,以一套引擎融合湖库与多模态数据,助力企业AI应用。该产品旨在简化AI数据管理流程。[6]

技巧教程

分享2个Vibe Coding必备超实用Prompt

分享两个Vibe Coding Prompt技巧,帮助非程序员高效编码。详细教程见原文链接。链接:https://mp.weixin.qq.com/s?__biz=MzIyMzA5NjAyMA==&mid=2647683924&idx=1&sn=76d9327a863ff3da67e736da1b97e8c6[8]

新方法可在加载时跳过Transformer块,对硬件有限场景实用

研究发现可在加载时跳过整个Transformer块,对性能影响很小。此方法对硬件资源有限的场景特别有用。[10]

行业资讯

DeepSeek因Claude Mythos决定融资,储备弹药应对竞争

DeepSeekClaude Mythos的影响决定启动融资,强调储备弹药应对行业竞争。此举被视为为即将到来的V4及后续迭代做准备。[5]

智平方获国家队和头部财投重仓,估值200亿成具身智能独角兽

智平方成为大湾区首个【200亿估值】的具身智能独角兽,获国家队和头部财投集体入局,标志具身智能领域进一步升温。[7]