本期重点集中在【代码模型竞技加速】与【多代理开发工具】落地,同时社区继续提供多卡本地推理的新实测数据,并出现一则关于Kimi的官方辟谣

模型动态

Code Arena显示Web开发模型一年提升340分

Code Arena数据显示,WebDev榜首一年提升340分,竞争实验室由6家增至10家;GPT-6 Astra目前以1796分领先。[1][1][2]

产品工具

fx.sh支持不同模型协同编排子代理

fx.sh新增多代理编排,可让规划、执行等子代理采用不同模型与推理强度,适合构建复杂开发工作流。[3]

社区免费提供DeepSeek V4.1 Flash测试入口

社区用户开放DeepSeek V4.1 Flash免费体验,并宣称支持零数据保留;但服务并非官方渠道,隐私承诺尚待验证。地址:https://www.reddit.com/r/LocalLLaMA/comments/1welcjg/if_anyone_wants_to_try_the_deepseek_v41_flash/[5]

硬件动态

DeepSeek V4.1 Flash在8张A40上达到40 tok/s

社区实测DeepSeek V4.1 Flash在8×A40上运行GGUF,Q2_K约40、Q4_K_M约32 tokens/s。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1wejdbe/deepseek_v41_flash_on_8_a40_40_toks_q2_k_and_32/[4]

双RTX 3090可运行Qwen3.8-Flash-Next

用户称双RTX 3090加EPYC服务器运行量化版Qwen3.8-Flash-Next,速度约38 tokens/s。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wehnsd/2rtx_3090_epyc_box_running_qwen38flashnext_at_38/[6]

行业资讯

网传Kimi创始人与员工被带走,官方紧急辟谣

社交平台流传Kimi创始人及16名员工被带走,随后出现官方辟谣。目前原始消息与回应细节仍需持续核验。[7]

Vercel称编码代理正在改变编程语言选择逻辑

Vercel团队称,Zig、Go、Rust项目的迭代速度已接近TS与Python;编码代理成为新“编译器”后,语言选择或更看重机器效率[8]