本期重点关注Claude Opus 4.7的详细评测与系统提示词分析,以及LiteParse、Browser Harness等开源工具的动态。
模型动态
Claude
Claude Opus 4.7文档理解能力评测出炉
LlamaIndex团队在ParseBench上评测了Claude Opus 4.7的文档理解能力。结果显示其在图表识别上有显著提升,表格处理略逊于Gemini 3 Flash,但内容忠实度最高。不过,用作OCR方案成本较高,约7美分/页。评测地址:https://parsebench.ai/[1][2]
由于Anthropic公开系统提示词,开发者Simon Willison对Claude Opus 4.7和4.6的提示词进行了详细对比,并分享了分析笔记。这有助于理解模型迭代的具体改进方向。分析文章:https://simonwillison.net/2026/Apr/18/opus-system-prompt/[3]