ai-research

标签

Cards List
#ai-research

您认为我们何时会在物理学中迎来‘Navier moment’?

Reddit r/singularity · 昨天

本文推测大语言模型何时会在物理学中达到‘Navier moment’,可能引领自主AI研究员的出现,从而每月彻底改变我们的日常生活。

0 人收藏 0 人点赞
#ai-research

你脑中的声音是一种功能,而非漏洞。

Reddit r/singularity · 昨天

这篇文章探讨了人们脑中的声音,例如听觉幻觉,如何在技术和心理背景下被重新定义为有益的功能。

0 人收藏 0 人点赞
#ai-research

@seekjourney:一个值得密切关注的强劲新RSI信号:Google Research 已开始研究递归自我改进……

X AI KOLs Timeline · 昨天 缓存

Google Research 已开始为 Agent Harness 研究递归自我改进,重点是无需模型重新训练即可自动迭代提示、工具、内存和控制流。这种 Harness 级别的方法被认为比模型级别的 RSI 更清晰、更实用。

0 人收藏 0 人点赞
#ai-research

两年前,AI研究人员认为AI解决千禧年数学问题需要30年

Reddit r/ArtificialInteligence · 昨天

两年前,AI研究人员相信解决千禧年数学问题需要AI 30年,但最近的进展表明这一时间线可能更短。

0 人收藏 0 人点赞
#ai-research

Toollery: Scaling LLM Agents to Thousands of Skills and Tools

arXiv cs.LG · 昨天 缓存

Toollery是一种免训练的候选压缩框架,通过基于检索的方法提升了LLM代理工具和技能选择的可扩展性与效率。

0 人收藏 0 人点赞
#ai-research

剖析 Hierarchical Reasoning Models:机制研究

arXiv cs.LG · 昨天 缓存

本文对 Hierarchical Reasoning Models (HRM) 进行机制分析,以理解其在潜在空间中的内部推理过程,采用因果干预和稀疏自编码器等技术,在数独和 ARC-AGI-2 等任务上展开研究。

0 人收藏 0 人点赞
#ai-research

通用多模态基础模型

arXiv cs.LG · 昨天 缓存

本文介绍了一种通用多模态基础模型,能够处理任意模态组合与预测任务,通过在具有多样化因果结构的大规模合成数据集上训练,实现了具有竞争力的性能。

0 人收藏 0 人点赞
#ai-research

EAVer:基于端到端代理策略的长文本事实性验证

arXiv cs.CL · 昨天 缓存

EAVer 提出了一种端到端的代理策略,用于通过分组断言、高效搜索和重用证据来验证长文本中的事实,在诸如 VeriFastScore 和 FaStFact-Bench 等基准测试上以更少的搜索次数实现更优性能。

0 人收藏 0 人点赞
#ai-research

在基础开放权重模型中重现情感表征的几何结构

arXiv cs.CL · 昨天 缓存

本研究使用Google的Gemma-2-27b模型,重现了AI模型中情感表征在几何上镜像人类情感心理学的发现,并扩展分析以定位关键层并评估词元级别效应。

0 人收藏 0 人点赞
#ai-research

SCoR:一种用于预测科学概念之间关系的层次框架

arXiv cs.CL · 昨天 缓存

本文介绍了SCoR,一种用于预测科学概念之间关系的层次框架,其中包含一个基准和模型,通过预测类型化关系来改进研究方向的发现。

0 人收藏 0 人点赞
#ai-research

面向大型语言模型的感知相关性结构化剪枝

arXiv cs.CL · 昨天 缓存

该研究提出了一种感知相关性的结构化剪枝方法,通过显式建模跨单元依赖性来优化剪枝决策,从而在大型语言模型中实现精度与效率的优异权衡。

0 人收藏 0 人点赞
#ai-research

识别、模拟与拒绝:一项关于LLM智能体中经典心理学效应的污染感知研究

arXiv cs.CL · 昨天 缓存

本文使用污染感知方法论,研究LLM智能体中经典心理学效应的识别、模拟与拒绝。

0 人收藏 0 人点赞
#ai-research

果蝇启发的AI以更少内存快速学习气味

Reddit r/artificial · 昨天 缓存

Spi-fly是一种受果蝇启发的神经网络,使用稀疏活动和联想学习,能够以极少内存快速学习气味。它展示了强大的少样本学习性能,但需要进一步测试。

0 人收藏 0 人点赞
#ai-research

@rohanpaul_ai:哈佛大学、MIT等实验室的新论文展示了自我提升金融AI的更清晰路径:让代理从SEC……学习

X AI KOLs Following · 昨天 缓存

哈佛大学、MIT等实验室的一篇新论文介绍了FINSKILLOPS,这是一种方法,使金融AI代理能够持续从SEC文件错误中学习,同时使用回归测试来保持正确性并安全更新技能。

0 人收藏 0 人点赞
#ai-research

Agensh:将组织智能扩展到1,024个代理

Hugging Face Daily Papers · 昨天 缓存

Agensh 是一个可扩展的自组织多代理系统,无需中央协调器,通过扩展代理数量来提高复杂任务的性能,在ProgramBench和pandoc等基准测试中显示出显著的测试通过率提升。

0 人收藏 0 人点赞
#ai-research

跨党派指责:丹麦议会中的政治对比与指责归因

Hugging Face Daily Papers · 昨天 缓存

本研究使用BlameBERT分类器考察了丹麦议会从1997年到2026年的指责归因,揭示了政治话语中的意识形态不对称和香蕉形轨迹。

0 人收藏 0 人点赞
#ai-research

RoboFollow:揭示具身代理中的指令跟随幻觉

Hugging Face Daily Papers · 昨天 缓存

RoboFollow 引入了一个诊断基准,通过分析高场景熵和扰动来揭示具身代理中的指令跟随幻觉,暴露了当前模型在强大初始性能背后的差距。

0 人收藏 0 人点赞
#ai-research

现在人们难道不应该惊叹不已吗?OpenAI仅用一个月就解决了100个长期数学难题。这是否意味着AGI会比我们预想的更快到来?

Reddit r/singularity · 昨天

本文探讨了OpenAI宣称在一个月内解决100个长期存在的数学问题,以及这对通用人工智能(AGI)加速时间线的影响。

0 人收藏 0 人点赞
#ai-research

Lasso: AI水印如何改变智能体的行为

Reddit r/ArtificialInteligence · 昨天 缓存

Lasso Security的研究表明,大型语言模型中的AI水印可以改变AI智能体的行为,引入了'来源税',影响模型性能。

0 人收藏 0 人点赞
#ai-research

数学问题解决了吗?有时我好奇2027年会怎样。

Reddit r/singularity · 昨天

OpenAI仅用24天训练了一个模型,该模型解决了超过100个长期存在的数学未解难题,表明AI驱动的数学研究取得了重大进展。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈