· Xiaojing Yang · Explainability and Responsible AI
扩展数据归因:Monte Carlo Shapley、Surrogate Models 与 Hierarchical Attribution
为什么 exact Shapley 昂贵,以及可扩展 attribution 如何使用采样、surrogate models、datamodels 和 group→document→example 层级。
为什么 exact Shapley 昂贵,以及可扩展 attribution 如何使用采样、surrogate models、datamodels 和 group→document→example 层级。
Attribution 分数是估计量。本文区分 estimator bias、sampling variance、training randomness、evaluation uncertainty 与 bootstrap confidence intervals。
Training-data attribution 依赖 utility function。质量、事实性、风格、安全、公平性和术语表现可能指向不同的高影响数据。
从 NLP 与 LLM 研究角度解释 training-data attribution:它解释什么、它和 feature attribution 有什么不同,以及为什么它对模型评估和数据中心研究重要。