NewsFi.AI
返回今日
已核验来源

MetroLLM-Bench:评估作为公交信息亭运行时的语言模型

HuggingFace Daily Papers · · 发布于 2026-09-11 · 1 分钟阅读

NewsFi 导读1 分钟速览

arXiv:2609.10016v1 公告类型:cross 摘要:我们引入了 MetroLLM-Bench,这是一个包含 955 个案例的基准测试,用于测试作为交通信息亭策略层的语言模型。它涵盖了六个真实的地铁系统,从 37 个车站到 414 个车站,以及十一个类别,包括路线、f

1

要点 1

arXiv:2609.10016v1 公告类型:cross 摘要:我们引入了 MetroLLM-Bench,这是一个包含 955 个案例的基准测试,用于测试作为交通信息亭策略层的语言模型。

2

要点 2

它涵盖了六个真实的地铁系统,从 37 个车站到 414 个车站,以及十一个类别,包括路线、f

当前为原文抽取式整理,不包含站外事实推断。
SOURCES

来源与引用

共 1 个来源
官方原文HuggingFace Daily Papers 原始发布2026-09-11 · 一手信息