大型语言模型的上下文理解评估
HuggingFace Daily Papers · · 发布于 2026-09-11 · 1 分钟阅读
arXiv:2609.09004v1 公告类型:交叉 摘要:大型语言模型(LLMs)在各种自然语言处理任务中表现出令人印象深刻的性能,但它们展现真正上下文理解能力的能力仍不确定。传统的评估指标如困惑度、双语
要点 1
arXiv:2609.09004v1 公告类型:交叉 摘要:大型语言模型(LLMs)在各种自然语言处理任务中表现出令人印象深刻的性能,但它们展现真正上下文理解能力的能力仍不确定。
SOURCES
共 1 个来源