标签
本文提出了一种决策支持框架,用于优化权益证明区块链中的验证者选择,通过多目标优化和交互式偏好学习,平衡投资组合的质量与分散化。
本文提出了一种适用于非契约服务环境的滚动窗口客户流失预测框架,利用30天的行为窗口实现持续风险评估。基于真实数据的评估显示,基于特征的模型达到了87.6%的准确率和0.94的ROC-AUC,而基于序列的模型召回率高达96.1%。
本文提出了VDSS,一种用于呼吸机决策支持的人机协同多智能体框架,它利用上下文Bandit偏好学习来适应特定临床医生的调校风格。回顾性ICU轨迹重放表明,推荐的可接受性提高,交互轮次减少。
RealICU是一个事后标注的基准测试,用于评估ICU场景中的大型语言模型(LLM),涵盖四个由医生驱动的任务。实验表明,现有LLM在回忆-安全权衡和锚定偏差方面存在困难,而一种新的结构化记忆代理改善了推理能力,但未能完全消除安全故障。
Cryzo 是一款 AI CEO Agent,旨在通过单一聊天界面管理业务运营。它连接 CRM、广告平台和办公工具,提供可操作的洞察并自动执行任务。
本文介绍了 DiagnosticIQ,一个用于评估大语言模型将工业符号维护规则转化为可执行步骤能力的基准测试。研究指出,虽然前沿模型在标准任务上表现良好,但在结构扰动下会表现出脆弱性和模式匹配行为。
介绍 ChatGPT Work 如何将内外部财务信号整合成 CFO 指挥中心,自动生成决策备忘录和 Excel 模型,帮助 CFO 主动塑造业务成果。
Council of High Intelligence 是一个开源工具,它编排来自多个 LLM 提供商的 18 个 AI 角色,对艰难决策进行审议,通过单一命令提供结构化的分歧和多视角分析。