Replicate LTX-2.5上线Replicate并支持4K HDR视频生成 LTX-2.5已上线Replicate,新增Diffusion Fidelity Rendering,支持原生4K HDR、运动与音频生成。[1]
OpenAI AWS向合格客户开放OpenAI网络攻防模型 Daybreak Red/Blue现已面向合格Amazon Bedrock客户开放,用于【网络攻防】与代码漏洞分析。详情:https://aws.amazon.com/blogs/machine-learning/accelerate-cyber-defense-with-openai-and-aws-daybreak-red-daybreak-blue-now-available-to-eligible-customers-on-bedrock/[2]
Cline免费提供Nemotron 3.5 Lightning Cline宣布免费提供NVIDIA Nemotron 3.5 Lightning,这是30B开源模型,面向编码Agent,输出速度据称较同类模型最高快【4倍】。[9]
OpenAI OpenAI分享自动同步与现有工作流接入Codex方法 OpenAI Developers发布自动同步设置方法,并补充将现有工作流接入Codex的教程,适合需要持续同步项目上下文的开发者。详情:https://t.co/HtsEsMLJrT[6][7]
DeepSeek DeepSeek V4 0731量化版本在8张RTX 5090上完成对比 LocalLLaMA社区在8×RTX 5090上测试DeepSeek V4 0731量化版本,并发现可能导致权重NaN或静默损坏的配置问题。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vlurlv/we_quantized_deepseek_v4_0731_and_benchmarked_it/[4]
Qwen Qwen3.6-27B在V100上实现366 tokens/s推理 开发者通过内核优化与推测解码,让Qwen3.6-27B NVFP4在V100上达到约366 tokens/s,展示老GPU的低比特推理潜力。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vlt0lj/366_ts_qwen36_27b_nvfp4_on_v100s/[5]
研究探讨从专有API窃取推理轨迹 新研究讨论从Anthropic、OpenAI和Google API重建推理轨迹,涉及加密思维链、跨会话复用与信息泄露风险。详情:https://simonwillison.net/2026/Aug/11/stealing-reasoning-traces/#atom-everything[3]