Code Arena显示Web开发模型一年提升340分 Code Arena数据显示,WebDev榜首一年提升340分,竞争实验室由6家增至10家;GPT-6 Astra目前以1796分领先。[1][1][2]
DeepSeek 社区免费提供DeepSeek V4.1 Flash测试入口 社区用户开放DeepSeek V4.1 Flash免费体验,并宣称支持零数据保留;但服务并非官方渠道,隐私承诺尚待验证。地址:https://www.reddit.com/r/LocalLLaMA/comments/1welcjg/if_anyone_wants_to_try_the_deepseek_v41_flash/[5]
DeepSeek DeepSeek V4.1 Flash在8张A40上达到40 tok/s 社区实测DeepSeek V4.1 Flash在8×A40上运行GGUF,Q2_K约40、Q4_K_M约32 tokens/s。项目地址:https://www.reddit.com/r/LocalLLaMA/comments/1wejdbe/deepseek_v41_flash_on_8_a40_40_toks_q2_k_and_32/[4]
Qwen 双RTX 3090可运行Qwen3.8-Flash-Next 用户称双RTX 3090加EPYC服务器运行量化版Qwen3.8-Flash-Next,速度约38 tokens/s。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wehnsd/2rtx_3090_epyc_box_running_qwen38flashnext_at_38/[6]