发生了什么
Artificial Analysis 公布 前沿模型评测 (8天内4款模型发布,6家实验室得分超50)
为什么值得关注
提供了各模型具体得分、价格和性能对比,以及前沿格局从2家扩展到6家的关键变化,值得阅读原文获取详细数据。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
8天内四款前沿模型发布评测
Artificial Analysis 发布评测,8天内 SpaceXAI 的 Grok 4.5(54分)、OpenAI 的 GPT-5.6 Sol/Terra/Luna(最高59/55/51)、Meta 的 Muse Spark 1.1(51分)和 Moonshot AI 的 Kimi K3(57分)相继发布,前沿模型实验室从6月初的2家增至6家。Kimi K3 以57分位列第三,在知识工作基准上仅次于 Claude Fable 5,且成本仅为后者一半。前沿智能价格在8天内下降2-3倍。
打开原始来源 ↗