对语言模型中无需训练的自我报告信心的分析
HuggingFace Daily Papers · · 发布于 2026-09-19 · 1 分钟阅读
大型语言模型可以报告数值置信度与生成内容,但尚不清楚该报告是否仅仅是校准的修辞。我们分析了三种无训练信号:含答案的口头置信度、事后置信度$P(\mathrm{True})$和 agreeme
要点 1
大型语言模型可以报告数值置信度与生成内容,但尚不清楚该报告是否仅仅是校准的修辞。
要点 2
我们分析了三种无训练信号:含答案的口头置信度、事后置信度$P(\mathrm{True})$和 agreeme
SOURCES
共 1 个来源