克罗内克分解提高了稀疏自编码器的效率和可解释性
HuggingFace Daily Papers · · 发布于 2026-09-11 · 1 分钟阅读
arXiv:2505.22255v5 公告类型:替换 摘要:稀疏自编码器(SAEs)将语言模型的激活分解为稀疏且可解释的特征,但标准编码器通常将潜在字典视为一组独立坐标的平坦集合,忽略了层次结构和特征
要点 1
arXiv:2505.22255v5 公告类型:替换 摘要:稀疏自编码器(SAEs)将语言模型的激活分解为稀疏且可解释的特征,但标准编码器通常将潜在字典视为一组独立坐标的平坦集合,忽略了层次结构和特征
SOURCES
共 1 个来源