01causal-eval-lab
可信的因果模型评估
评估处理效应的排序与估计质量;把数据切分、重叠性诊断和指标定义作为实验的一部分。
causal-eval-lab
可信的因果模型评估
查看拟议范围
首版:独立评估器、指标测试、合成真值与固定数据划分。多目标模型、通用 DGP 和局部残差校正先作为实验模块;没有可复现证据时,不声明优于基线。
研究笔记选题 · 拟写
当 AUUC 指标彼此矛盾时,我们究竟在比较什么?
拟写内容:区分目标人群、估计量、随机基线和归一化口径;以可计算的小例子说明不应直接横比不同评估协议。此处为选题摘要,尚非已发表文章。