Kimi Kimi K2 Thinking模型实测结果存在差异,官方发布标准测试指南 第三方API端点可能导致准确率下降20个百分点以上 建议使用官方API端点并设置stream=True、temperature=1.0 提供不同任务类型的max_token建议:推理128k、编程256k[1][2]