本期重点关注【AI基础设施成本上涨】与本地大模型部署优化;机器人也在高速运动和家庭消费场景出现新进展。

产品工具

上纬新材开启个人与家庭机器人预订

上纬新材开启家庭机器人预订,推动机器人从工业和展示场景进入消费市场;具体能力与交付规模仍待验证。详情:https://www.qbitai.com/2026/08/478017.html[3]

gork bot开放免费体验

gork bot现已开放免费体验,具体功能和使用限制暂未披露。体验地址:https://x.com/op7418/status/2091343192318939149[5]

技巧教程

M2 Ultra无损重打包DeepSeek V4 Flash并实现25.8 tok/s

社区通过定制llama.cpp分支将DeepSeek V4 Flash无损重打包至141GiB,M2 Ultra实测25.8 tok/s。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vw4qzf/deepseek_v4_flash_on_an_m2_ultra_repacked_to_141/[6]

llama.cpp AMD-Ecosystem分支可提升提示词处理速度

AMD用户可尝试llama.cpp AMD-Ecosystem分支,在Strix Halo与ROCm/HIP环境下提示词处理速度最高提升【2倍】。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vw16z9/amd_users_have_you_tried_the_llammacpp/[7]

硬件动态

内存涨价或推高英伟达AI服务器与数据中心成本

内存成本上涨或使英伟达AI服务器涨价15%,1GW数据中心成本增加约50亿美元,并波及训练、推理和云服务定价。详情:https://www.qbitai.com/2026/08/478164.html[1]

AstraTennis机器人首次与人类网球运动员实战对抗

AstraTennis展示【高速视觉感知】、运动规划、极限救球及跌倒后快速恢复,体现具身智能在动态交互任务上的进展。详情:https://www.qbitai.com/2026/08/478093.html[2]

用户用8张B300部署2.8万亿参数Kimi K3

社区实测8张NVIDIA B300部署2.8万亿参数Kimi K3,吞吐92 tok/s、首Token约1秒,成本约190美元/百万输出Token。详情:https://www.reddit.com/r/LocalLLaMA/comments/1vw1j2p/i_hosted_kimi_k3_28t_parameters_using_8/[8]

行业资讯

AliExpress被指通过音频指纹追踪设备

AliExpress疑似利用【音频指纹】识别设备,绕过Cookie追踪用户;无声音频还可能占用音频通道,干扰蓝牙耳机切换。详情:https://x.com/xiaohu/status/2091465417571352605[4]