DeepSeek DeepSeek-V4-Flash-0731 本地部署引热议:智能分逼近前沿但问题频出 社区称本地可跑的 DS4 Flash 0731智能指数约50,接近3月顶级模型51;用户也反馈量化版运行失败、token 效率不佳。链接:https://www.reddit.com/r/LocalLLaMA/comments/1vchoua/deepseekv4flash0731_models_you_can_run_locally/[3][4][5][6]
开发者自制多标签 Markdown 桌面应用,支持 Mermaid 与多格式导出 用 Electron+React+TS 构建的Markdown桌面应用,多标签工作区,支持 KaTeX、Mermaid 图表渲染与缩放导出,可导出 HTML/PDF/PNG。链接:https://t.co/3s18YG5FA1[2]
Kimi MoE 流式卸载新探索:29GB 内存可运行 Kimi K3,但速度仅 0.50 tok/s 开发者提出Weight-Aware Streaming Tensor Engine,用29GB内存运行 Kimi K3,速度仅0.50 tok/s;另有新方法探索大型 MoE 流式卸载到边缘设备。链接:https://www.reddit.com/r/LocalLLaMA/comments/1vche00/weightaware_streaming_tensor_engine_run_kimi_k3/[7][8]
Qwen 3x RTX 2080 Ti 跑 Qwen 3.6 27B Q5 达 55tps,用户分享配置求优化 用户分享在3张2080Ti上运行 Qwen 3.6 27B Q5 的 llama.cpp 配置,达到55 tokens/s,并求进一步优化建议。链接:https://www.reddit.com/r/LocalLLaMA/comments/1vch2vl/qwen_36_27b_q5_on_3x2080ti_55tps_with_llamacpp/[9]
用 Seedance 2.5 重制 iPod 剪影广告,全靠模型推理能力 用户让Seedance 2.5将经典 iPod 剪影广告重制成视频,素材抽象、参考极少,完全依赖模型推理生成动态效果。链接:https://t.co/otrvAYxxGg[10]
“天线宝宝”机器人上门保洁实为远程人工操控,定价200元/小时 具身智能机器人上门保洁标价200元/小时,实为“纯·人工·智能”——远程人工操控,反映具身智能在服务场景的落地现状与局限。链接:https://www.qbitai.com/2026/08/464781.html[1]