当审核员捏造时:LLM 检测植入文档污染时的批次大小退化和可信幻觉
HuggingFace Daily Papers · · 发布于 2026-09-11 · 1 分钟阅读
arXiv:2609.09696v1 公告类型:新 摘要:大型语言模型越来越多地被提议作为文档质量的自动审核员,但它们作为植入错误检测器的可靠性却很少被描述。我们构建了一个包含 150 篇学术论文的污染语料库
要点 1
arXiv:2609.09696v1 公告类型:新 摘要:大型语言模型越来越多地被提议作为文档质量的自动审核员,但它们作为植入错误检测器的可靠性却很少被描述。
要点 2
我们构建了一个包含 150 篇学术论文的污染语料库
SOURCES
共 1 个来源