标签: 可解释性
所有使用该标签的文章 "可解释性".
-
CS 221M: Mechanistic Interpretability
理解模型如何处理信息以及为什么产生特定输出的 ML 子领域。涵盖探针(probing)、引导(steering)、因果抽象和稀疏自编码器。包含来自学术界和工业界领先可解释性实验室的客座讲座。
所有使用该标签的文章 "可解释性".
理解模型如何处理信息以及为什么产生特定输出的 ML 子领域。涵盖探针(probing)、引导(steering)、因果抽象和稀疏自编码器。包含来自学术界和工业界领先可解释性实验室的客座讲座。