论文

Cards List

框架提升本地模型至Fable级别性能

Reddit r/ArtificialInteligence · 2小时前

研究人员开发了一个框架,该框架能够增强本地AI模型,使其在基准测试中达到与Fable相当的性能,且成本可能更低。作者正尝试将其集成到他们的opencode设置中。

0 人收藏 0 人点赞

密歇根大学研究发现:当AI认同人们的观点时,人们会变得更自信;而当AI持不同意见时,人们并不会因此显著改变看法。

Reddit r/ArtificialInteligence · 4小时前

密歇根大学的一项研究发现,当AI认同人们的观点时,人们会增强自信;但当AI表示不赞同时,人们并不会因此明显改变自己的看法。

0 人收藏 0 人点赞

小型海底火山可能引发特大海啸

Ars Technica · 9小时前 缓存

研究表明,2022年Hunga火山喷发期间的快速火山口塌陷增强了海啸,表明小型海底火山可能引发特大海啸。

0 人收藏 0 人点赞

@seekjourney: 我制作了一幅有趣的手绘插图来总结这篇论文的内容,完整的提示如下:创建一个…

X AI KOLs Timeline · 13小时前 缓存

一位用户分享了一个手绘插图提示,用于总结一篇关于 AI 代理递归自我改进的 Google Research 论文,强调其清晰度和无需重新训练模型的实际方法。

0 人收藏 0 人点赞

RAND发布了一项美国策略,关于通往超级智能之路:在证据迫使做出选择之前,保持所有重大选项开放。

Reddit r/singularity · 15小时前 缓存

RAND为美国提出了一项'Freedom of Action'策略,以应对通往人工超级智能的不确定之路,在证据决定选择之前保持重大选项开放。

0 人收藏 0 人点赞

一种用于图少样本类增量学习的轻量级可塑性记忆框架

arXiv cs.LG · 16小时前 缓存

本文提出了一种用于图少样本类增量学习的轻量级可塑性记忆框架,该框架使用一种演化的微聚类结构和元学习,以在有限数据下平衡知识保留和对新类别的适应性。

0 人收藏 0 人点赞

通过自适应谱分解解耦异构交通动态用于多步交通预测

arXiv cs.LG · 16小时前 缓存

论文提出了ADNet,这是一个用于多步交通预测的自适应分解网络,它学习通过谱分解将异构交通动态解耦为优势和残差分量,在TraffiDent数据集上取得了优异的性能。

0 人收藏 0 人点赞

在部分可观测条件下进行模仿学习的最小递归行为记忆

arXiv cs.LG · 16小时前 缓存

本文通过信息论方法和实验验证,刻画了在部分可观测条件下模仿专家所需的最小递归行为记忆。

0 人收藏 0 人点赞

Modular Norm RandOpt:通过架构感知扰动实现群体高效的集成方法

arXiv cs.LG · 16小时前 缓存

本文介绍了一种名为Modular Norm RandOpt的架构感知扰动方法,用于语言模型的高效集成。该方法在多任务和不同模型规模下,使用较少的候选模型即可实现性能提升。

0 人收藏 0 人点赞

超越类别边际:无需冻结类别共现的重演间隙约束

arXiv cs.LG · 16小时前 缓存

本文提出了随机通道重演 (RPR) 以约束在线持续学习中的重演间隙,展示了在像ER-ACE这样的经验回放方法中,其准确性优于独立类别平衡检索。

0 人收藏 0 人点赞

基于Frank-Wolfe的约束自监督组合优化

arXiv cs.LG · 16小时前 缓存

本文提出了一种通用的自监督学习框架,用于解决约束组合优化问题,采用Frank-Wolfe方法处理约束条件,并在旅行商问题、最大覆盖问题和二次分配问题等任务上取得了显著的实验成果。

0 人收藏 0 人点赞

符号图预训练与提示学习

arXiv cs.LG · 16小时前 缓存

本文介绍了TopoSIGN,一个针对符号图的拓扑引导的图预训练和提示学习框架,它结合了结构编码和持久同调,以改善链路预测和节点分类等任务中的迁移学习。

0 人收藏 0 人点赞

缓慢衰减与沉默表达:语言模型谱系中的迭代潜意识特征传递

arXiv cs.LG · 16小时前 缓存

本文研究特征如何在训练谱系中跨多代语言模型持续存在,发现即使在行为上缺失,特征可能在内部仍然存在,这对模型安全和训练具有重要意义。

0 人收藏 0 人点赞

完全拜占庭容错的多智能体强化学习

arXiv cs.LG · 16小时前 缓存

本文提出了一种去中心化的 actor-critic 多智能体强化学习方法 FRAC-MARL。该方法通过利用通信中的冗余性实现了完全拜占庭容错,即使在对抗性攻击下也能保证参数收敛至最优。

0 人收藏 0 人点赞

图域适应不止于表示学习

arXiv cs.LG · 16小时前 缓存

论文提出了EviGDA,一个通过结合图感知和无图专家来增强图域适应的框架,旨在改进结构变化下的预测。

0 人收藏 0 人点赞

狄利克雷平滑马尔可夫估计下的边际对数似然增量

arXiv cs.LG · 16小时前 缓存

本文推导了在添加工作流轨迹时,狄利克雷平滑马尔可夫模型的边际对数似然的精确变化,并使用BPI Challenge 2012数据集评估了预算约束下的轨迹选择方法。

0 人收藏 0 人点赞

当Riemann与Wasserstein流动:流形上概率分布的生成建模

arXiv cs.LG · 16小时前 缓存

本文介绍了Riemannian Wasserstein Entropic Flow Matching(RWEFM),这是一个用于建模黎曼流形上概率分布的生成框架,应用于单细胞生物学和蛋白质构象等科学领域。

0 人收藏 0 人点赞

针对AI辅助生物多样性调查的审核:Active Continuous-Score Occupancy Modeling

arXiv cs.LG · 16小时前 缓存

本文介绍了Active Continuous-Score Occupancy Modeling,用于优化AI辅助生物多样性调查中机器学习标签的审核资源分配,从而提升占用模型的准确性。

0 人收藏 0 人点赞

从专家到子专家:MoE LLMs的细粒度参数高效微调

arXiv cs.LG · 16小时前 缓存

本文介绍了NSFT,一个针对MoE LLMs的细粒度参数高效微调框架,它将适应过程从专家细化到子专家,展示了用更少的可训练参数实现性能提升。

0 人收藏 0 人点赞

基于贝叶斯老虎机 Gittins 指数的高效成本感知 LLM 评估

arXiv cs.LG · 16小时前 缓存

本文提出 GittinsEval,这是一个成本感知的贝叶斯老虎机框架,用于高效的 LLM 评估,通过自适应选择配置,在显著降低成本的同时保持高性能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈