ai-research

标签

Cards List
#ai-research

@shinjiw_at_cmu: Interspeech 2026 将于本周日,9月27日在悉尼开幕!我们将展示2场教程和19篇论文。周日教程包括:- 关于语音语言模型的全貌(上午)…

X AI KOLs Following ↗ · 7小时前 缓存

该推文宣布 Interspeech 2026 在悉尼开幕,重点介绍了将展示2场关于语音语言模型与对话语音识别的教程和19篇论文。

0 人收藏 0 人点赞
#ai-research

C5R建立了一个完全由GPT-6 Astra运营的研究设施——该模型端到端地设计、执行和观察生物学、化学及材料科学的实验,并控制周围的人员和仪器

Reddit r/singularity ↗ · 8小时前

C5R建立了一个完全由AI模型GPT-6 Astra运营的研究设施,实现了跨多个科学学科的实验的自主设计、执行和观察。

0 人收藏 0 人点赞
#ai-research

@akshay_pachaar: NVIDIA 和斯坦福刚刚向 Jev 发起了挑战。(他们的新 System 1 架构运行速度最高可达 9 倍。)它被称为 Contras…

X AI KOLs Timeline ↗ · 9小时前 缓存

NVIDIA 和斯坦福开发了一个对比语言模型 (CLM),将人工智能中的决策制定视为一个检索问题,通过缓存动作嵌入,与现有系统如 Jev 相比,实现了最高 9 倍的延迟降低。

0 人收藏 0 人点赞
#ai-research

FB-GDM: 基于无监督变分推断的高维线性逆问题全贝叶斯引导扩散模型

arXiv cs.LG ↗ · 19小时前 缓存

FB-GDM 引入了一种用于高维线性逆问题的全贝叶斯引导扩散方法,消除了针对每个任务的超参数调优,并展示了相对于现有技术的稳健性能提升。

0 人收藏 0 人点赞
#ai-research

从文本决策到像素:Jev-Style视觉选择模型研究

arXiv cs.AI ↗ · 19小时前 缓存

PixelJev被介绍为一种原生图像决策接口,使用小型开放多模态模型将图像、指令和候选集映射到结构化选择。该研究表明,在Pets等基准测试中,自适应提高了准确性,并突出了校准和泛化方面的挑战。

0 人收藏 0 人点赞
#ai-research

面向自主智能系统的基于LLM的BT和FSM统一转换框架

arXiv cs.AI ↗ · 19小时前 缓存

本文提出一种基于LLM的统一转换框架,该框架能够实现自主智能系统中行为树与有限状态机之间自动且语义一致的转换,提升可扩展性与可维护性。

0 人收藏 0 人点赞
#ai-research

弯路不毁旅程:偏差引导的LLM智能体技能自我进化

arXiv cs.AI ↗ · 19小时前 缓存

本文介绍SkillPivot,一个偏差引导的框架,用于LLM智能体的技能自我进化,通过对比从共同前缀出发的失败和成功轨迹来改进技能。

0 人收藏 0 人点赞
#ai-research

强化学习中的策略复杂性、响应时间与有限理性

arXiv cs.LG ↗ · 19小时前 缓存

本文介绍了MI-SARSA,这是一种强化学习算法,通过引入互信息正则化在认知约束下平衡策略复杂性和响应时间,从而建模有限理性。

0 人收藏 0 人点赞
#ai-research

SGA:时间序列基础模型中多步预测的不确定性量化

arXiv cs.LG ↗ · 19小时前 缓存

本文提出了Slicing-Graphing-Alignment (SGA) 方法,用于量化时间序列基础模型中多步预测的不确定性,展示了优越的性能并揭示了一个经验缩放规律。

0 人收藏 0 人点赞
#ai-research

能理解数据修订的时间序列基础模型

arXiv cs.LG ↗ · 19小时前 缓存

本文提出了VINTAGE-TS,这是一种考虑修订的时间序列基础模型适配方案,它能区分观测时间与信息可用时间,并提供了一个用于评估数据修订下预测表现的框架。

0 人收藏 0 人点赞
#ai-research

DEEPO: 针对多模态大语言模型幻觉的双熵增强策略优化

arXiv cs.AI ↗ · 19小时前 缓存

本文提出DEEPO,一种双阶段强化学习优化方法,通过解决从奖励到参数更新的纠正链中的弱点,以减少多模态大语言模型中的幻觉。

0 人收藏 0 人点赞
#ai-research

CARE:面向扩散模型的条件感知表示正则化

arXiv cs.LG ↗ · 19小时前 缓存

该论文介绍了CARE,这是一个针对扩散模型的条件感知表示正则化框架,通过基于条件相似性动态调节特征分布来提高样本质量和训练效率。在经验上,它在类别到图像和文本到图像任务中显著降低了FID并加快了收敛速度。

0 人收藏 0 人点赞
#ai-research

TW3Cast:一个基于轻度微调基础模型的冻结路由器,用于GIFT-Eval上的时间序列预测,完全基于训练集划分选择

arXiv cs.AI ↗ · 19小时前 缓存

本文介绍了TW3Cast,一个时间序列预测系统,它使用基于轻度微调基础模型的冻结路由器,在GIFT-Eval基准上取得顶尖性能,且无需代理或语言模型

0 人收藏 0 人点赞
#ai-research

ModularSQL:Text-to-SQL系统多重性盲点的运行时防护措施

arXiv cs.CL ↗ · 19小时前 缓存

ModularSQL引入运行时防护措施,以解决Text-to-SQL系统中的多重性盲点,通过低开销检测和纠正多重性错误,提高生产环境中的执行安全性。

0 人收藏 0 人点赞
#ai-research

通过生成顺序干预评估解释驱动的视觉-语言推理

arXiv cs.CL ↗ · 19小时前 缓存

本文通过生成顺序干预评估了视觉-语言推理中解释与模型预测之间的因果联系,发现需要更大的模型进行理由优先推理,而答案优先生成能减少格式相关的错误。

0 人收藏 0 人点赞
#ai-research

在流式全双工模型中控制反馈通道

arXiv cs.CL ↗ · 19小时前 缓存

本文介绍了一种用于全双工语音对话模型的轻量级反馈通道头部,以预测和控制反馈时机,改善自然对话动态。

0 人收藏 0 人点赞
#ai-research

后训练在不相关决策上留下行为痕迹

arXiv cs.CL ↗ · 19小时前 缓存

本文提出了主动无任务蒸馏(ATD),这是一种仅通过单一词汇回复对与任务无关的提示进行提示,从而将能力从教师模型转移到学生模型的方法,旨在探究后训练的行为痕迹。

0 人收藏 0 人点赞
#ai-research

AAAI的审稿人和组织者怎么了?[D]

Reddit r/MachineLearning ↗ · 23小时前

一位研究人员抱怨AAAI同行评审的问题,包括未匿名的论文、类似AI的评审,以及组织者沟通不畅。

0 人收藏 0 人点赞
#ai-research

@MajorTimbWlf21: neurips宝宝来啦,敬请期待!预印本即将发布!

X AI KOLs Timeline ↗ · 昨天 缓存

一位用户兴奋地宣布,与NeurIPS会议相关的预印本即将发布。

0 人收藏 0 人点赞
#ai-research

@tommiekerssies: 我已加入 @amilabs 在巴黎担任技术员!AI尚未真正理解现实世界。我坚信…

X AI KOLs Following ↗ · 昨天 缓存

一个人宣布加入 @amilabs 在巴黎担任技术员,并表示相信这个团队将帮助AI更好地理解现实世界。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈