来自 arXiv 的文章
ROOSTER是一个共享模块,它学习条件序列与目标序列之间的对齐,适用于时间序列预测和PPG到生命体征重建,在多个基准测试中表现出色。
本文提出QRLQ,一种量子强化学习框架,该框架将参数化量子电路与dueling double deep Q-networks集成,以优化量子云编排中的成本与延迟权衡,实现在成本和延迟上优于启发式基线,同时参数量少于经典DRL。
本文提出Task-Conditioned Latent Alignment (TCLA),通过学习共享潜在空间来稳定脑机接口中的跨会话神经解码。在非人灵长类动物数据上评估,与现有方法相比,TCLA显示出改进的鲁棒性。
本文提出CC-OPD,一种用于多约束指令跟随的新颖在线策略蒸馏方法,该方法使用反事实消融来增强训练信号,实现更优性能,其中1.5B模型在基准测试中超越其7B教师模型。
DualRes是一种紧凑的振荡状态空间模型,用于从振动数据诊断机器故障,在标签有限的情况下实现了最先进的性能,并降低了计算需求,适用于边缘部署。
FWBench 引入了一个基准,用于评估语言模型如何选择和使用时间序列预测来做出成本约束决策,并在电力和共享单车租赁数据集上比较托管与本地配置,同时由 GPT-6 Astra 实现高效的预算使用。
本文提出一种利用变分自回归网络参数化归一化概率分布的离散扩散模型,并将其应用于Ising模型,以实现精确的热力学计算和增强的Monte Carlo采样。
本文介绍KITE,一种KV不变Transformer扩展方法,通过降低推理成本在保持性能的同时高效扩展LLM。它提出了SST模型,与基线相比,实现了更低的训练损失和减少的推理成本。
论文介绍了Neurogenesis Network (NGN),这是一种可微分参数化方法,用于在训练过程中学习神经网络的最优规模,适用于包括MLPs、CNNs和Transformers在内的多种架构。
SR-Fraud 是一种针对非平稳支付欺诈检测的结果监督反思型LLM智能体框架,在生产基准测试上相比传统方法提高了检测指标。
本文挑战了对Platonic Representation Hypothesis的解释,通过区分关系结构和度量几何,表明关系收敛是稳健的,而度量几何收敛在各种模型校准后较弱。
论文提出LLMAE方法,利用潜在瓶颈将预训练的仅解码器LLMs重新定位为连续文本自编码器,实现高保真重建,并支持图像描述等下游任务。
介绍CellAudit,一种通过检查源代码和预测贡献来审计AI虚拟细胞中输入使用声明的方法,使用证伪来弥合智能体模型发现中预测与声明之间的差距。