本期重点集中在主动式智能体交互本地大模型部署两条线上:Browser Use探索任务审批卡片,社区则持续挖掘24GB显卡和低成本服务器的推理潜力。

模型动态

Aurora 1.0-150M开源发布

Aurora 1.0-150M正式发布,约含1.5亿参数,使用70亿Token训练并公布基准成绩,适合参考小模型训练实践。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wfg0sb/aurora10150m_releases/[6]

产品工具

Browser Use探索任务卡片式主动智能体

Browser Use提出让智能体主动生成任务卡片,用户可允许或跳过执行,探索从被动提示词转向主动式个人智能体。详情:https://x.com/browser_use/status/2099158244329726219[1]

FlyOCR用果蝇神经连接组读取PDF

FlyOCR将果蝇神经连接组与简化神经动力学用于PDF字符识别,是偏【生物启发式AI】的实验性演示。详情:https://x.com/jerryjliu0/status/2099168936059437206[7]

技巧教程

Browser Use科普无头浏览器及其自动化原理

Browser Use发布无头浏览器入门介绍,解释其与普通浏览器的区别及工作方式,适合构建【网页自动化】和浏览器智能体。详情:https://x.com/browser_use/status/2099188991518191638[2]

vLLM AOT帮助24GB显卡运行27B模型

社区测试显示,借助vLLM AOT,RTX 3090可运行Qwen3.8 27B INT4,并配置144K FP8 KV Cache。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wfdtm7/dear_24g_owners_try_vllm_you_might_be_able_to_run/[3]

开发者讨论从Claude Code迁移到私有本地Harness

社区用户交流从Claude Code迁移至私有本地Harness时的配置、能力和工作流问题,反映开发者对本地代码智能体的实际需求。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wfcewd/migration_from_claude_code_to_a_private_local/[5]

硬件动态

用户分享3000美元搭建128GB显存本地推理服务器

用户以约3000美元搭建128GB显存、256GB内存服务器,并分享硬件选型与踩坑经验,为低成本本地大模型部署提供参考。详情:https://www.reddit.com/r/LocalLLaMA/comments/1wfe9zt/3k_128gb_vram_256gb_ram_ddr4_server/[4]