最新

全部文章,按抓取时间从新到旧排列。

Cards List

机器学习技术用于自闭症诊断与治疗的系统性综述:挑战与机遇

arXiv cs.LG · 9小时前 缓存

本文系统回顾了55项关于机器学习在自闭症谱系障碍中的应用研究,聚焦于诊断与治疗的挑战和机遇。

0 人收藏 0 人点赞

人工智能能从医学中学到什么?生成性类比与可靠的机器学习系统

arXiv cs.LG · 9小时前 缓存

本文在医学临床转化与构建可靠的机器学习系统之间发展了一种生成性类比,提出了一种基于可靠主义认识论保证的新型机器学习可靠主义。

0 人收藏 0 人点赞

H$^2$EDL: 用于层次分类的超证据深度学习

arXiv cs.LG · 9小时前 缓存

本文提出H2EDL,一种用于层次分类的超证据深度学习模型,它能捕捉标签层次结构中多层次的不确定性,减少校准误差,并在细粒度识别任务中提高粗粒度类别的保留率。

0 人收藏 0 人点赞

加速视觉策略内蒸馏:基于批处理推测性雅可比展开

arXiv cs.LG · 9小时前 缓存

本文提出HB-SJD,一种用于视觉策略内蒸馏的批处理推测性雅可比解码方法。该方法通过并行处理多个词元来加速展开生成,在保持生成质量的同时缩短训练时间。

0 人收藏 0 人点赞

迈向可逆遗忘:在持续企业AI智能体中管理过时知识

arXiv cs.LG · 9小时前 缓存

本文提出一种针对企业AI智能体的可逆遗忘方法来管理过时知识,引入一个框架,该框架包含记忆状态和控制器,根据相关性抑制和重新激活知识。

0 人收藏 0 人点赞

熵约束自适应随机量化

arXiv cs.LG · 9小时前 缓存

引入熵约束自适应随机量化(ECASQ),一种方法,联合优化量化值以在熵预算和无偏约束下最小化均方误差,用于机器学习工作负载中的高效压缩。

0 人收藏 0 人点赞

语义链接不确定性下的省略三段论补全两两逻辑选择

arXiv cs.AI · 9小时前 缓存

本文提出了一种用于省略三段论补全两两逻辑选择的神经符号管道,引入了PWAL方法,该方法使用逻辑阻力分数来提高准确性并在各种推理任务中减少平局。

0 人收藏 0 人点赞

自我生成的评估指标:从盲点中进化出的评估器

arXiv cs.AI · 9小时前 缓存

本文提出了EvalCEGAR方法,该方法利用一组Python运算符池自动进化评估指标,能标记AI输出中的特定缺陷,相比手写运算符和LLM评判者提高了准确性。

0 人收藏 0 人点赞

用于自动化企业分析和洞察生成的多代理平台

arXiv cs.AI · 9小时前 缓存

本文提出了一种基于CrewAI构建的多代理框架,用于自动化对话式商业智能。该框架使用五个专门的AI代理来处理查询、检索数据并生成洞察。评估显示,在准确性和质量上较基线有显著提升。

0 人收藏 0 人点赞

能力,而非准确性:技能优化中无参考评判门的诊断

arXiv cs.AI · 9小时前 缓存

本文提出一个诊断框架,用于评估LLM-judge能否在无参考验证器的情况下有效评估优化任务中的候选技能,重点在于能力和可区分性指标。

0 人收藏 0 人点赞

RTPO:用于稳定智能体强化学习训练的反序回合策略优化

arXiv cs.AI · 9小时前 缓存

论文提出了反序回合策略优化(RTPO)来稳定多轮智能体强化学习训练,通过将展开组织为反序树并按反序执行回合级更新,展示了相较于基线的改进。

0 人收藏 0 人点赞

Sanyu Studio: 一个用于艺术史叙事构建的多智能体系统

arXiv cs.AI · 9小时前 缓存

本文介绍了Sanyu Studio,一个多智能体对话系统,使用LLM为Sanyu油画构建艺术史叙事,展示了AI如何通过用户交互支持多样化的解释。

0 人收藏 0 人点赞

用于透明传感器诊断管道搜索的候选命运核算

arXiv cs.AI · 9小时前 缓存

本文提出候选命运核算,作为一种框架,用于审计传感器诊断中的自动化机器学习管道搜索,通过跟踪所有候选及其结果来提升透明度。

0 人收藏 0 人点赞

预算优先资费推荐 (BFTR):一个完整的电信套餐推荐算法框架,避免超额收费

arXiv cs.CL · 9小时前 缓存

本文介绍了BFTR,一个电信资费推荐算法框架,优先考虑客户预算并防止超额收费。在受尼日利亚MTN市场启发的实验数据集上进行的实验证明了该框架的有效性,实现零附加费和高实用度。

0 人收藏 0 人点赞

大型语言模型中不确定条件下的偏好推理

arXiv cs.AI · 9小时前 缓存

本文形式化了大型语言模型中不确定条件下的偏好推理,并评估了最先进的模型,揭示了在区分确定与不确定实例时存在的系统性失败。

0 人收藏 0 人点赞

MemFuse:基于碎片化观察的多源记忆融合

arXiv cs.CL · 9小时前 缓存

MemFuse推出了MemFuseBench,一个用于评估AI智能体中多源记忆融合的基准测试,并提出了MemFuse——一种结构化的记忆系统,可在整合碎片化观察的同时保持来源的可追溯性。

0 人收藏 0 人点赞

CTIFoundry: 一个代理原生的网络威胁情报语料框架

arXiv cs.AI · 9小时前 缓存

CTIFoundry引入了一个代理原生的网络威胁情报语料框架,通过结构化本体图和程序性技能提升LLM代理的性能,在调查中实现更高的准确性和效率。

0 人收藏 0 人点赞

NADI 2026 上的 Aslema:通过少样本增强实现口语语言理解

arXiv cs.CL · 9小时前 缓存

本文介绍了 Aslema,这是一个针对 NADI 2026 共享任务(口语语言理解)的系统,通过微调音频大语言模型和合成数据增强来提升突尼斯阿拉伯语方言的意图识别和槽位填充性能。

0 人收藏 0 人点赞

学习失败模式:用于对抗性数据策展的上下文强盗方法

arXiv cs.CL · 9小时前 缓存

本文介绍了一种故障感知的对抗检索增强框架,利用上下文强盗来提升自然语言理解的鲁棒性,并在SNLI、ANLI和MultiNLI等基准测试中取得了显著改进。

0 人收藏 0 人点赞

轻量级多模态模型能否估计LLM推理性能?一项面向计算最优文档推理的研究

arXiv cs.AI · 9小时前 缓存

本研究介绍了BudgetDoc,第一个用于评估文档任务中模型-预算-性能权衡的多模态基准,并开发了DRB,一种轻量级估计器,用于预测推理性能以优化计算分配并降低LLMs成本。

0 人收藏 0 人点赞
← 上一页
下一页 →
← 返回首页

提交意见反馈