发生了什么
Sakana AI 测试 Fugu Ultra 古典散写阅读顺序(准确率0.80)
为什么值得关注
该测试展示了 Fugu Ultra 在非标准空间推理上的独特能力,值得关注其泛化性以用于类似复杂布局任务。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
Sakana AI Fugu Ultra 古典散写阅读测试
Sakana AI 测试其 Fugu Ultra 模型解读1610年日本古典信件散写阅读顺序,Fugu Ultra 准确率0.80,对比模型 A 和 B 得0.24,模型 C 失败。
打开原始来源 ↗