arxiv

标签

Cards List
#arxiv

物理学家终于发现胶球了吗?新证据指向肯定。

Ars Technica · 16小时前 缓存

北京谱仪III(BES III)实验的物理学家发现了令人信服的新证据,证明胶球——完全由胶子组成的奇异粒子——的存在,支持粒子物理标准模型的预言。

0 人收藏 0 人点赞
#arxiv

Can Released LLM Vocabularies Support Token-Level Estimation of Hidden Corpora?

arXiv cs.CL · 昨天 缓存

This paper investigates whether released LLM tokenizer vocabularies can support fine-grained token-level estimation of hidden pretraining corpora, proposing a Quantile-Guided Density Estimation (QGDE) method that achieves low error rates in controlled and realistic settings.

0 人收藏 0 人点赞
#arxiv

面向LLM数据污染检测的后训练特征偏移校准

arXiv cs.CL · 昨天 缓存

本文提出CalibDCD,一种用于基于特征的LLM数据污染检测的校准框架,可缓解后训练引起的特征偏移,检测性能最高提升7.0% AUC和15.0% TPR@5%FPR。

0 人收藏 0 人点赞
#arxiv

MD-ProTector:为LLM生成文本检测定位多个数据驱动原型

arXiv cs.CL · 昨天 缓存

MD-ProTector是一篇研究论文,提出了一种基于原型的LLM生成文本检测方法,每个类别使用多个可训练参考向量来捕获类内差异,并提高跨领域、生成器、语言和对抗性编辑的鲁棒性。

0 人收藏 0 人点赞
#arxiv

Off-Axis, On Purpose: Where a Transformer Computes Concepts and Why it Does So

arXiv cs.CL · 昨天 缓存

This paper investigates why transformer intermediate representations are off-axis relative to the readout direction, showing that this off-axis subspace functionally insulates composition from the vocabulary and proposing methods to impose this geometry via rotation.

0 人收藏 0 人点赞
#arxiv

PERCEPT:用于波斯语-英语代码混合的词性标注与分析语料库

arXiv cs.CL · 昨天 缓存

本文介绍了PERCEPT,这是首个从X、Instagram和Digikala收集的大规模波斯语-英语代码混合语料库,标注了Universal Dependencies词性标签。文章提出了一种LLM辅助的标注框架,并分析了不同平台上的代码混合模式。

0 人收藏 0 人点赞
#arxiv

具有重尾奖励和信息不对称的鲁棒多智能体多臂老虎机

arXiv cs.LG · 昨天 缓存

本文研究了三种信息不对称机制下具有重尾奖励的多智能体多臂老虎机问题,提出了鲁棒的分布式算法,其遗憾保证几乎匹配集中式算法的速率,并在帕累托分布奖励环境中进行了验证。

0 人收藏 0 人点赞
#arxiv

Coordinating the Unknown Lipschitz Constant in Multiplayer Bandits

arXiv cs.LG · 昨天 缓存

This paper studies cooperative multi-player bandits in continuous Lipschitz action spaces when the Lipschitz constant is unknown, proposing a meta-algorithm (mECAB) that estimates the constant and coordinates discretization across players under different information structures, with regret guarantees.

0 人收藏 0 人点赞
#arxiv

时间序列预测器是否使用了正确的历史:时间延迟的可恢复性、恢复与功能使用

arXiv cs.LG · 昨天 缓存

本文研究时间序列预测器是否使用了正确的历史输入,区分了延迟的可恢复性、模型报告和功能使用。文章证明,即使预测准确且延迟报告正确,仍可能隐藏使用了错误滞后的情况,并在N-HiTS和TCN模型中实证展示了这一问题。

0 人收藏 0 人点赞
#arxiv

Invertible Logits Transformation for Accuracy-Preserving Post-Hoc Uncertainty Calibration

arXiv cs.LG · 昨天 缓存

The paper proposes Invertible Logits Transformation (InvLT), a post-hoc calibration method that applies a learnable scalar MLP element-wise to logits, preserving accuracy while correcting nonlinear miscalibration more flexibly than temperature scaling.

0 人收藏 0 人点赞
#arxiv

CRHT:一种基于在线聚类采样的连续回归混合Transformer船舶轨迹预测方法

arXiv cs.LG · 昨天 缓存

本文提出了CRHT,一种利用AIS数据进行船舶轨迹预测的连续回归混合Transformer,采用在线K-means聚类采样策略和CNN-Transformer混合架构,以解决地理偏差问题并提高短期预测精度。

0 人收藏 0 人点赞
#arxiv

内在结构:机制可解释性的谱可识别性

arXiv cs.LG · 昨天 缓存

本文引入了一个基于Koopman算子理论的理论框架,用于识别机制可解释性中的模型内在结构,证明了针对机制可解释性原语的第一个可识别性定理,并在GPT-2、Gemma-2-2B和Qwen3-8B-Base上进行了实证验证。

0 人收藏 0 人点赞
#arxiv

REATS:基于LLM推理的自适应时间序列预测集成学习

arXiv cs.LG · 昨天 缓存

REATS是一种新方法,利用LLM推理进行可解释的、样本自适应的集成学习以用于时间序列预测。它将文本和数值特征与思维链推理及两阶段微调框架相结合,在八个基准测试上优于竞争性基线。

0 人收藏 0 人点赞
#arxiv

评估协议决定结果:在TwoRoom上对LeWorldModel的独立复现

arXiv cs.LG · 昨天 缓存

这项复现研究在TwoRoom环境中独立重新实现了LeWorldModel,达到了94%的目标达成率,而非报告的87%,并表明四个未记录的评估约定决定了结果。它还发现,单步预测误差不能可靠预测长时域规划的成功,且批归一化可能虚增验证损失。

0 人收藏 0 人点赞
#arxiv

ChronoSSM:在自回归状态空间模型中训练时间感知表示

arXiv cs.LG · 昨天 缓存

ChronoSSM 提出了一种自回归状态空间模型,该模型联合建模事件和时间戳,表明联合训练能够提高时间可恢复性,同时不降低内容生成质量。

0 人收藏 0 人点赞
#arxiv

DOCSCHISEL:面向LLM智能体的自适应工具文档优化框架

arXiv cs.LG · 昨天 缓存

本文研究了工具文档中的信息如何在不同设置下影响LLM智能体的性能,并提出了DocsChisel——一个自适应框架,通过迭代优化工具文档来提高任务成功率。

0 人收藏 0 人点赞
#arxiv

DashArena:对LLM在交互式分析仪表板生成上的基准测试

arXiv cs.AI · 昨天 缓存

介绍了DashArena,这是首个针对LLM开放式、任务驱动的交互式分析仪表板生成的基准测试。它使用浏览器执行器重放交互轨迹,并使用VLM评判器评估结果,人工研究证实了其有效性。

0 人收藏 0 人点赞
#arxiv

基于强化学习的激光切割机参数优化

arXiv cs.AI · 昨天 缓存

本文提出了RL2C,一种基于Q-learning的算法,用于优化光学薄膜的激光切割参数(焦距、激光功率),以减少锥度尺寸和材料浪费。实验表明,与现有强化学习方法相比,其优化步骤最多减少12.5%,处理时间最多减少81.8%。

0 人收藏 0 人点赞
#arxiv

SKILLER: Language-Level Reinforcement Learning for Reusable Skill Extraction in Small Language Models

arXiv cs.AI · 昨天 缓存

SKILLER is a natural-language-driven reinforcement learning framework that automatically generates executor-specific agent skills for small language models, matching closed-source performance at lower cost.

0 人收藏 0 人点赞
#arxiv

从错误记忆到纠正行动:面向记忆增强智能体的依赖引导回滚修复

arXiv cs.AI · 昨天 缓存

本文介绍了面向记忆增强智能体的依赖引导回滚修复方法,该方法利用运行时来源信息构建类型化的记忆到行动图,在保留良性状态的同时选择性地撤销错误记忆的影响,并在基准测试中取得了强劲的恢复效果。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈