标签
本文是 arXiv 论文,提出了一套协议,用于衡量科学解释为实验预测所贡献的预测信用(predictive credit)。研究在 Tox21 和 OpenML 基准上发现,匹配的科学解释并未显著提升预测准确率,但在某些模型复现(model replay)设置下仍观察到了一定的性能增益。