本期速报聚焦DeepSeek V4 Pro以低成本对标GPT-5.2,Peanut文生图模型即将开源挑战SOTA。同时,微软VibeVoice被移植为纯C++本地推理,GUARD法案提出AI聊天机器人年龄验证新规。

模型动态

DeepSeek V4 Pro 性价比突破,成本仅为GPT-5.2的1/17

新模型DeepSeek V4 Pro在FoodTruck Bench代理基准上性能匹配GPT-5.2,同时推理成本低约17倍,成为首个进入前沿层的中国模型。[1]

产品工具

Peanut 文生图模型即将开源,竞技场排名第八

匿名模型Peanut在人工分析竞技场中排名第8,官方宣布即将【开源权重】,有望成为最佳开源文生图模型之一。[2]

微软 VibeVoice 被移植为纯 C++ 本地推理实现

vibevoice.cpp项目将微软VibeVoice(TTS+长语音ASR)移植为ggml/C++实现,支持CPU/CUDA/Metal/Vulkan,无需Python即可本地推理。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1t48fkt/vibevoicecpp_microsoft_vibevoice_tts_longform_asr/[3]

Sherlock 开源:为 Claude Code 提供本地 Apple 开发者文档 MCP

开源项目Sherlock构建了Apple开发者文档的本地Claude Code MCP插件,索引7万符号以解决API幻觉问题。项目地址:https://www.reddit.com/r/ClaudeAI/comments/1t45bzg/sherlock_apple_developer_docs_as_a_local_claude/[6]

技巧教程

一个定界符加严格提示让Gemma 4防注入率从21%飙升至100%

最新提示注入基准测试显示,使用定界符+严格提示可使Gemma 4防御率从21%提升至100%。该测试覆盖15个模型,共6100余次测试。[4]

硬件动态

老将 GTX 1080 Ti 仍可流畅运行 7B-8B 级别模型

用户实测GTX 1080 Ti(11GB显存)运行Qwen 2.5 7B和Llama 3.2 8B,速度可达8-9 tokens/s,11GB显存仍是本地LLM入门底线。[7]

行业资讯

美国 GUARD 法案拟强制 AI 聊天机器人进行年龄验证

美国GUARD法案已通过委员会进入参议院,要求AI聊天机器人实施年龄验证。该法案将对AI合规与未成年人保护产生重大影响。[5]