机器学习何时超越价值排序?基于三个数据集的风险暴露加权发货优先级诊断
摘要
本文通过三个数据集研究机器学习何时在风险暴露加权发货优先级排序中优于传统价值排序。
arXiv:2607.18573v1 公告类型:新
摘要:延迟风险模型通常以预测准确性来衡量。但在实践中,更关键的问题是:由于只有能力审查少数几批货物,经理应该优先检查哪些?我们评估了机器学习是否能够超越一个苛刻的无模型基线:首先检查价值最高的货物。在三个真实的供应链背景下:SCMS采购、DataCo物流和Olist电子商务,我们采用了泄漏控制的滚动起点评估和1000样本配对自助法置信区间。按预测的延迟严重程度乘以已知价值进行排序(M1)在所有三个数据集中都优于仅按严重程度排序,但通常并未超越价值排序。在10%的审查预算下,M1减去VALUE_ONLY的差异:SCMS为-5.5个百分点,DataCo为+10.1个百分点,Olist为-4.9个百分点。这种差异与严重程度的可学习性一致:DataCo的R²=0.27,校准偏差为+0.01天,而SCMS和Olist的R²约为-0.02,校准偏差为负。嵌套交叉验证的成本敏感重新训练并未带来比M1稳定的改进。本文并非提出新的学习算法,而是提出了一个部署诊断和评估协议。价值排序应作为一个永久基准,只有在检验了严重程度的可学习性和校准性,并且模型在泄漏控制的滚动起点评估下通过该门槛后,才能部署机器学习。
查看缓存全文
缓存时间: 2026/07/22 08:22
# 机器学习何时优于价值排序?基于三个数据集的暴露加权运输优先级诊断 来源:https://arxiv.org/abs/2607.18573 文献工具 ## 文献与引用工具 文献浏览器 切换 代码、数据与媒体 ## 本文相关的代码、数据与媒体 演示 ## 演示 相关论文 ## 推荐与搜索工具 关于 arXivLabs ## arXivLabs:与社区贡献者共同进行的实验性项目 arXivLabs 是一个框架,允许贡献者直接在我们的网站上开发和共享新的 arXiv 功能。 与 arXivLabs 合作的个人和组织都已接受并认同我们的开放、社区、卓越和用户数据隐私价值观。arXiv 致力于这些价值观,仅与遵守这些价值观的合作伙伴合作。 有一个能为 arXiv 社区增添价值的项目想法吗?**了解更多关于 arXivLabs** (https://info.arxiv.org/labs/index.html)。
相似文章
生物医学二分类中不平衡处理方法的系统评估
本文系统评估了五种不平衡处理方法(RUS、ROS、SMOTE、重加权、直接F1优化)在三个生物医学数据集(表格、文本、图像)上使用不同复杂度模型的效果。结果表明,收益取决于模型复杂度和数据模态,其中ROS、重加权和直接F1优化对非结构化数据上的复杂模型有效。
类别不平衡约束下少数类财务困境预测的机器学习方法比较评估
本文对在严重类别不平衡条件下预测财务困境的经典方法、集成方法和神经网络方法进行了比较评估,使用SMOTE进行过采样,SHAP进行可解释性分析。
机器学习用于2型糖尿病风险预测的综合评估:大规模外部验证与公平性分析
本文构建了一个多维框架,用于评估基于机器学习的2型糖尿病风险预测模型的区分度、校准度、可解释性和算法公平性,揭示了在现实世界分布偏移下性能显著下降以及按年龄和肥胖程度存在的偏差。
将数据驱动预测与分配对齐:一种以决策为中心的生存分析方法
本文介绍了一种面向决策的生存分析学习方法,该方法通过NDCG优化将预测模型与后续分配决策对齐。应用于美国心脏移植数据后,排名性能提升了50-100%,每年可能带来数千额外生命年。
贝叶斯上下文赌博机在实时仓库分拣优化中的比较研究
本文对贝叶斯上下文赌博机(BCB)、XGBoost和线性回归在电商仓库实时分拣转向优化中进行了比较研究,结果显示BCB实现了2.03%的奖励提升,并具有优越的在线学习和推理延迟性能。