GPT-6 Astra评测暴露专有Harness与隐性推理问题
新评论称Astra具备较高Token效率和Computer Use能力,但专有Harness可能放大成绩;关闭思维链后自主运行时间显著增加,带来安全风险。https://x.com/vista8/status/2095798300385636810[1]
本期重点关注GPT-6 Astra的新评测争议与安全风险,以及Atlas空间智能模型发布。与此同时,Agent产品设计、开放权重模型采用和安全编码实践也出现了值得关注的新进展。