← 返回精选动态
精选动态

How Much Do LLMs Hallucinate in Document Q

论文 分析 LLMs在文档问答中的幻觉率(172-Billion-Token研究)

更新于 2026年06月26日 04:33 2 条公开来源

发生了什么

论文 分析 LLMs在文档问答中的幻觉率(172-Billion-Token研究)

为什么值得关注

点读原文获取具体数据趋势,尤其注意长上下文下的幻觉恶化情况。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

How Much Do LLMs Hallucinate in Document Q

twitter关注列表 2026年06月26日 01:13

该研究测试了LLM在文档问答中编造答案的比例,最佳模型在32K上下文下编造率1.19%,强模型通常5-7%,中等模型约25%,在200K上下文下所有模型至少10%编造,表明幻觉随上下文增长恶化。

打开原始来源 ↗
02

LLM在文档问答中的幻觉率研究

twitter关注列表 2026年06月26日 03:32

一项使用172B token的研究测试了LLM在文档问答场景中的幻觉率,最佳模型在32K上下文时幻觉1.19%,强模型通常为5-7%,中等模型约25%,200K上下文时所有模型至少10%。

打开原始来源 ↗
← 返回精选动态