01
Artificial Analysis 报告 Grok 4.5 在 AutomationBench 中超越 GPT-5.6、Claude 和 Gemini 的 AI 基准测试结果
Artificial Analysis 在 AutomationBench 演练测试中相比较多个 AI 模型的表现,结果显示 Grok 4.5 榜首(51.4%),GPT-5.6 第二(51.2%),Claude Haiku 4.5 和 Opus 4.6 排名第三和第四(各约 48.5%),Muse Spark 1.1 表现为第五(42....
值得跟进