发生了什么
AI Labs推出PACT谈判基准测试,GPT-5.5在20轮买卖博弈中表现最优,Opus 4.7、DeepSeek V4 Pro等模型位列前五。
为什么值得关注
AI谈判能力评测结果,反映模型在协商、承诺等场景的技术突破,对AI应用发展有参考价值。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
AI Labs推出PACT谈判基准测试
AI Labs推出PACT谈判基准测试,GPT-5.5在20轮买卖博弈中表现最优,Opus 4.7、DeepSeek V4 Pro等模型位列前五。
打开原始来源 ↗