Qwen 阿里开源高效稀疏MoE模型Qwen3.6-35B-A3B 阿里开源Qwen3.6-35B-A3B模型,仅激活3B参数即可超越Gemma4-31B,显著提升了开源模型的效率上限。社区测试也证实其性能提升显著。[1][2]
Cloudflare开源无损LLM压缩工具Unweight Cloudflare开源无损压缩工具Unweight,可将模型大小减少15-22%且不损失精度,为模型部署节省显存。项目地址:https://github.com/cloudflare/unweight[4]
开发者分享前缀缓存技术大幅降低大模型首次响应延迟 用户分享在Mac Studio上运行Qwen3.5-397B时,通过【前缀缓存】技术将首次令牌延迟从22秒降至2秒的优化经验,为本地部署大模型提供了实用技巧。[3]
Claude 用户将Linear任务队列与Claude Code集成实现自动化 用户构建了一个自动化系统,将Linear任务队列与Claude Code集成,实现任务自动分配与执行,展示了AI代理在实际工作流中的实用应用。[5]
开发者改造墨水屏硬件实时监控AI代理状态 开发者基于Claude实体项目,将代码改造后在M5 Paper墨水屏上运行,实现了在家任何地方都能【实时监控】和审批Claude Code等AI代理状态。[6]
DeepSeek DeepSeek寻求首次外部融资并计划发布V4模型 报道称DeepSeek正寻求首次外部融资,目标估值100亿美元。同时其V4模型将使用万亿参数和华为昇腾芯片,旨在摆脱对英伟达的依赖。[7]