发生了什么
论文 分析 LLMs在文档问答中的幻觉率(172-Billion-Token研究)
为什么值得关注
点读原文获取具体数据趋势,尤其注意长上下文下的幻觉恶化情况。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
How Much Do LLMs Hallucinate in Document Q
该研究测试了LLM在文档问答中编造答案的比例,最佳模型在32K上下文下编造率1.19%,强模型通常5-7%,中等模型约25%,在200K上下文下所有模型至少10%编造,表明幻觉随上下文增长恶化。
打开原始来源 ↗02
LLM在文档问答中的幻觉率研究
一项使用172B token的研究测试了LLM在文档问答场景中的幻觉率,最佳模型在32K上下文时幻觉1.19%,强模型通常为5-7%,中等模型约25%,200K上下文时所有模型至少10%。
打开原始来源 ↗