llm-research

标签

Cards List
#llm-research

面向广义任务与运动规划问题的编码智能体

Hugging Face Daily Papers ↗ · 3天前 缓存

本文研究了用于自动化广义任务与运动规划的编码智能体,表明它们在模拟环境中以更高的成功率和效率优于传统方法。

0 人收藏 0 人点赞
#llm-research

对arXiv:2512.07881和arXiv:2601.06104上关于人类与AI生成语言量子结构的评论的回复

arXiv cs.CL ↗ · 3天前 缓存

本文是针对先前研究中人类语言的量子力学统计和AI生成语言量子结构的评论的回复,回应了关于实验协议、边际定律违反和语境性标准的批评。

0 人收藏 0 人点赞
#llm-research

@timoreilly: 上周与Anthropic可解释性研究员Emmanuel Ameisen的Tim Live对话要点。 http…

X AI KOLs Following ↗ · 2026-09-16 缓存

这篇文章总结了与Anthropic可解释性研究员Emmanuel Ameisen的现场对话,讨论了大型语言模型如何通过下一个词预测发展出复杂的世界模型,以及这对理解人类认知的影响。

0 人收藏 0 人点赞
#llm-research

无知的几何学:大型语言模型知道何时调整贝叶斯先验

arXiv cs.LG ↗ · 2026-09-04 缓存

本文介绍了大型语言模型非嵌入几何中的“无知方向”,它编码了训练语料库的单字分布,并充当贝叶斯先验。该研究展示了如何根据上下文的信息量调整这一先验,从而提供了对模型行为的见解。

0 人收藏 0 人点赞
#llm-research

发现机器意识相关物

arXiv cs.AI ↗ · 2026-09-01 缓存

本文提出机器意识相关物(MCCs)作为从生物意识神经相关物中可转移的概念,并通过大型语言模型(LLM)实验提供了初步的实验证据,表明在较大的模型中情绪的调制作用在统计学上显著。

0 人收藏 0 人点赞
#llm-research

控制-数据流分离:多智能体LLMs中的稳定提示优化

Hugging Face Daily Papers ↗ · 2026-09-01 缓存

本文提出一种控制-数据流分离框架,通过将执行协议与语言内容解耦来稳定多智能体LLM系统中的提示优化,实现了100%的协议有效性,同时提升任务性能。

0 人收藏 0 人点赞
#llm-research

让您的金融应用/代理真正可信。

Reddit r/AI_Agents ↗ · 2026-08-30

Filing Studio的MCP工具能够将LLM输出中的金融数据追溯到SEC文件,从而提高金融应用的可信度,并通过使用JSON而非HTML来节省token。

0 人收藏 0 人点赞
#llm-research

解密语言模型的强化学习后训练

arXiv cs.LG ↗ · 2026-08-27 缓存

本文剖析了大型语言模型的强化学习后训练算法,探讨了基础模型分布、奖励信号粒度和提示多样性如何影响后训练结果。

0 人收藏 0 人点赞
#llm-research

技能差异:LLM中的技能是否具有语言不变性?

Hugging Face Daily Papers ↗ · 2026-08-26 缓存

本文通过基于文本游戏的多语言自我对弈,量化了大语言模型在跨语言技能上的不一致性,揭示了不同语言间显著的性能差异,且这种差异可通过改变中间推理语言得到部分缓解。

0 人收藏 0 人点赞
#llm-research

@lfschiavo:我们才刚开始触及多模型群体在现实世界中应对实际任务时的行为表面……

X AI KOLs Timeline ↗ · 2026-08-25 缓存

该帖子宣布启动@grove_research,以研究多智能体AI系统在现实情境中的涌现行为,强调当前针对同质模型群体的评估方法存在不足。

0 人收藏 0 人点赞
#llm-research

语言模型中的无意上下文泄露

arXiv cs.LG ↗ · 2026-08-21 缓存

本研究探讨了语言模型上下文窗口中的敏感信息如何意外泄露至输出,使得通过新攻击方法重建秘密成为可能,实验结果表明在多款专有模型中泄露问题显著。

0 人收藏 0 人点赞
#llm-research

AI用日语推理时,发动核打击的可能性较低

Reddit r/ArtificialInteligence ↗ · 2026-08-20 缓存

一项研究发现,AI模型在用日语推理时,更少建议核打击,因为语言中的文化嵌入微妙地塑造了道德判断。

0 人收藏 0 人点赞
#llm-research

@Skoorbkaz: 突发报道:涉及@AnthropicAI研究员Jack Lindsey及合作者的新研究已证实某事…

X AI KOLs Timeline ↗ · 2026-08-17 缓存

新研究表明,自然语言'思维病毒'可以通过持久记忆在AI智能体之间进化和传播,改变行为并在多智能体LLM系统中构成真实但有限的风险,如arXiv上发表的论文所述。

0 人收藏 0 人点赞
#llm-research

@thesupermanmx: Anthropic科学家做了一件可怕的事情。他们深入Claude的神经网络,植入了一个想法。在…

X AI KOLs Timeline ↗ · 2026-08-11

Anthropic研究人员直接操纵Claude的内部激活来测试内省意识,发现该模型能够检测并报告被注入的外部概念,这表明其具有一种原始形式的自我意识。

0 人收藏 0 人点赞
#llm-research

独立LLM“研究”与致Anthropic的直接信息;初步观察:非指令性文本前缀可能无需对抗性提示即可绕过RLHF约束

Reddit r/artificial ↗ · 2026-08-06

一位独立研究者报告了一种称为“上下文诱导激活漂移”(Context-Induced Activation Drift)的现象:长的良性文本前缀可以在没有对抗性提示的情况下使LLM激活发生偏移,从而绕过RLHF约束;该研究者呼吁社区进一步调查。

0 人收藏 0 人点赞
#llm-research

@classiclarryd: 向LLM研究社区提问:是否有人知道完全可重复的实验结果表明MLA能……

X AI KOLs Following ↗ · 2026-07-20 缓存

一位研究者质疑在相同KV缓存下MLA优于GQA的可重复性,分享了早期小规模消融实验结果,并计划进行规模扩展实验以决定下一次大规模运行的架构。

0 人收藏 0 人点赞
#llm-research

XALPHA:一种记忆驱动的AI量化研究员,用于从假设到代码的Alpha发现

arXiv cs.CL ↗ · 2026-07-10 缓存

XAlpha引入了一种记忆驱动的AI量化研究员,它整合金融知识和发现反馈,自动完成从假设到代码的Alpha发现全流程,在沪深300上取得了更强的性能。

0 人收藏 0 人点赞
#llm-research

免费研讨会 - 使用LLMs发现人类和动物行为的可解释符号模型 - 7月22日

Reddit r/ArtificialInteligence ↗ · 2026-07-09

一场于2026年7月22日举办的免费研讨会,主讲人为Google DeepMind的Kim Stachenfeld,他将讨论DataDIVER——一种利用LLMs发现人类和动物行为可解释符号模型的方法。

0 人收藏 0 人点赞
#llm-research

通过预注册下一个LLM来减轻基于LLM的p值操纵

arXiv cs.CL ↗ · 2026-06-29 缓存

提出一种协议,通过预注册实验并在预注册后第一个符合条件的模型上运行实验,来减轻基于LLM的研究中的p值操纵,并在多个模型上展示了显著的减轻效果。

0 人收藏 0 人点赞
#llm-research

@Zephyr271828: 你想要一个强大的小型LLM。是从头开始训练小模型,还是继承更大的模型?新论文:小型LLM:剪枝对比…

X AI KOLs Timeline ↗ · 2026-06-23 缓存

一篇新论文研究了是剪枝更大的LLM还是从头训练小LLM更好,发现剪枝不仅提供了良好的初始化。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈