本期重点关注LTX-2.5上线、Daybreak开放企业客户,以及本地模型在老旧GPU上的高性能推理实践。另有推理轨迹泄露研究和多项AI开发工作流更新值得留意。

产品工具

LTX-2.5上线Replicate并支持4K HDR视频生成

LTX-2.5已上线Replicate,新增Diffusion Fidelity Rendering,支持原生4K HDR、运动与音频生成。[1]

AWS向合格客户开放OpenAI网络攻防模型

Daybreak Red/Blue现已面向合格Amazon Bedrock客户开放,用于【网络攻防】与代码漏洞分析。详情:https://aws.amazon.com/blogs/machine-learning/accelerate-cyber-defense-with-openai-and-aws-daybreak-red-daybreak-blue-now-available-to-eligible-customers-on-bedrock/[2]

Cline免费提供Nemotron 3.5 Lightning

Cline宣布免费提供NVIDIA Nemotron 3.5 Lightning,这是30B开源模型,面向编码Agent,输出速度据称较同类模型最高快【4倍】。[9]

技巧教程

OpenAI分享自动同步与现有工作流接入Codex方法

OpenAI Developers发布自动同步设置方法,并补充将现有工作流接入Codex的教程,适合需要持续同步项目上下文的开发者。详情:https://t.co/HtsEsMLJrT[6][7]

开发者持续迭代面向GEO的专业Skill

团队将两年GEO研究与实战整理为专业Skill,强调行业知识与判断力,并计划持续迭代,服务内容优化与搜索增长场景。[8]

硬件动态

DeepSeek V4 0731量化版本在8张RTX 5090上完成对比

LocalLLaMA社区在8×RTX 5090上测试DeepSeek V4 0731量化版本,并发现可能导致权重NaN或静默损坏的配置问题。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vlurlv/we_quantized_deepseek_v4_0731_and_benchmarked_it/[4]

Qwen3.6-27B在V100上实现366 tokens/s推理

开发者通过内核优化与推测解码,让Qwen3.6-27B NVFP4在V100上达到约366 tokens/s,展示老GPU的低比特推理潜力。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vlt0lj/366_ts_qwen36_27b_nvfp4_on_v100s/[5]

行业资讯

研究探讨从专有API窃取推理轨迹

新研究讨论从Anthropic、OpenAI和Google API重建推理轨迹,涉及加密思维链、跨会话复用与信息泄露风险。详情:https://simonwillison.net/2026/Aug/11/stealing-reasoning-traces/#atom-everything[3]