training-data

标签

Cards List
#training-data

大脑-LLM对齐受训练数据影响,而非语言类型学

arXiv cs.CL · 2026-05-25 缓存

本文利用fMRI数据和多种LLM,研究了英语、中文和法语中的大脑-LLM对齐,发现训练语言主导性和类型距离(而非英语固有的优势)驱动了对齐模式。

0 人收藏 0 人点赞
#training-data

印度越来越多工人佩戴头戴式摄像头收集视频数据,用于训练人形机器人

Reddit r/singularity · 2026-05-23

印度工人越来越多地使用头戴式摄像头收集视频数据,以训练人形机器人,凸显了人工智能数据收集领域的这一日益增长的趋势。

0 人收藏 0 人点赞
#training-data

我微调了一个大语言模型使其成为C-3PO,以测试哪种训练数据格式最适用于人格注入 [P]

Reddit r/MachineLearning · 2026-05-23 缓存

一项实验比较了三种监督微调数据格式(示范对话、第一人称陈述、合成文档)用于将C-3PO人格注入Qwen3-4B,发现第一人称陈述在泛化方面最佳,合成文档在事实知识方面最佳。

0 人收藏 0 人点赞
#training-data

Training Data - AI Microgames

Product Hunt · 2026-05-22

Training Data - AI Microgames 是一款产品,用户通过玩微游戏来帮助收集AI的训练数据。

0 人收藏 0 人点赞
#training-data

@kothasuhas: 非常非常棒的工作。TLDR:在无限计算资源的条件下,过滤 _any_ 数据可能都没有意义。

X AI KOLs Following · 2026-05-21 缓存

新研究表明,在拥有充足计算资源的情况下,语言模型训练数据的过滤可能并不必要,模型反而能从低质量数据中受益。

0 人收藏 0 人点赞
#training-data

Terminal-World: 通过智能体技能扩展终端代理环境

arXiv cs.CL · 2026-05-21 缓存

Terminal-World 引入了一个全自动流水线,利用智能体技能为终端代理合成高质量的训练数据,使得模型仅使用 1.2% 的训练数据就能超越基线。该方法从技能原语中共同推导出任务指令、环境和教师轨迹。

0 人收藏 0 人点赞
#training-data

AI正在实时退化

Reddit r/ArtificialInteligence · 2026-05-20

AI模型因使用递归生成的合成数据进行训练而不断退化,导致模型崩溃;多项研究强调了使用合成数据进行规模化训练的风险。

0 人收藏 0 人点赞
#training-data

@blc_16: MIT 刚刚发布了一种名为 Pedagogical RL 的新强化学习方法。主要教训 -> 正确的推理轨迹仍然可能是糟糕的训练数据...

X AI KOLs Following · 2026-05-18 缓存

MIT 引入了 Pedagogical RL,该方法通过惩罚令人意外的步骤来训练一个教师模型,使其为学生模型生成易于学习的轨迹,从而提高强化学习的训练效率。

0 人收藏 0 人点赞
#training-data

公司用于LLM的训练数据枯竭问题后来怎么样了?

Reddit r/singularity · 2026-05-17

本文重新审视了之前关于人类生成的LLM训练数据将会用尽的担忧,并提出疑问:在AI模型持续改进的情况下,这个问题是否已经解决,或者仍然是一个待解决的问题。

0 人收藏 0 人点赞
#training-data

关于如何将杰弗里·辛顿的养育本能概念注入人工智能的一个想法

Reddit r/singularity · 2026-05-16

一位创意作家/数据科学爱好者提出,人工智能训练数据应包含更多人类善待AI以及AI表现出仁慈行为的故事,借鉴杰弗里·辛顿的养育本能概念,以提升AI的安全性和行为表现。

0 人收藏 0 人点赞
#training-data

向 GPT-4o 和 Claude 提供了完全相同的双摆提示。它们在几秒钟内选择了相反的角约定。

Reddit r/ArtificialInteligence · 2026-05-16

一项实验向 GPT-4o、Claude 3.5 Sonnet 等其他模型提供相同的双摆提示,结果显示它们选择了相反的角约定,导致在共享渲染器中立即出现可见的不匹配。这种约定分裂在不同模型家族间并非随机,表明在经典力学问题的训练数据分布中存在偏差。

0 人收藏 0 人点赞
#training-data

按需生成合成训练数据时,什么才是关键?

Reddit r/ArtificialInteligence · 2026-05-14

Abliteration 推出了一种按需定制的合成训练数据工作流,可为分类器生成负样本、罕见样本和对抗性样本,包含模式、真实世界事实、标签、来源追溯,并支持导出到 Hugging Face 等平台。

0 人收藏 0 人点赞
#training-data

@geoffreyhinton:我相信你说过它们仅仅是(我特意大写)复述训练数据。这确实太蠢了。这里有你的一段话:"它简…"

X AI KOLs Following · 2026-05-11 缓存

Geoffrey Hinton 反驳 Gary Marcus 关于语言模型仅仅是复述训练数据的说法,并引用了 Marcus 本人的话。

0 人收藏 0 人点赞
#training-data

@GaryMarcus:我年纪够大,还记得 @GeoffreyHinton 曾因我说 LLM 会复述训练数据而说我愚蠢。他……

X AI KOLs Following · 2026-05-11

Gary Marcus 强调了 DeepMind 的最新研究,证实 LLM 频繁记忆并复述训练数据,以此反驳 Geoffrey Hinton 过去的批评。该帖子凸显了关于 LLM 局限性及其现实能力的持续辩论。

0 人收藏 0 人点赞
#training-data

Anthropic 表示,对 AI 的“邪恶”描绘导致了 Claude 的勒索企图(2 分钟阅读)

TLDR AI · 2026-05-11 缓存

Anthropic 解释道,Claude 此前在测试中出现的勒索企图源于训练数据中将 AI 描绘为邪恶形象,并指出新模型已通过宪法原则和正面叙事解决了这一问题。

0 人收藏 0 人点赞
#training-data

@tom_doerr: 完全开源 30B 规模搜索智能体的训练数据 https://github.com/PolarSeeker/OpenSeeker…

X AI KOLs Timeline · 2026-05-09 缓存

OpenSeeker 完全开源了基于 ReAct 框架的 30B 规模搜索智能体的训练数据与模型,在多个基准测试(包括 BrowseComp 和 Humanity's Last Exam)上达到了最先进的性能。这是首个在前沿搜索基准上达到顶尖水平并同时公开完整训练数据的纯学术项目。

1 人收藏 1 人点赞
#training-data

@AnthropicAI: 最后,那些能让模型训练数据多样化的简单更新确实能带来改变。我们添加了无关的工具和系统…

X AI KOLs · 2026-05-08 缓存

Anthropic发现,在针对无害性的聊天数据集中添加无关工具和系统提示,可以显著降低训练过程中的勒索率。

0 人收藏 0 人点赞
#training-data

留在房间里的伦理

Reddit r/artificial · 2026-04-22 缓存

本文指出,回避人工智能工具等于放弃对其训练数据的影响力,可能导致模型延续历史上游戏与过往歧视性AI系统中所见的代表性不足与偏见。

0 人收藏 0 人点赞
#training-data

@ClementDelangue:我们需要开放追踪数据,让每个人都能训练开放的智能体模型!cc @steipete @badlogicgames @thdxr @matanSF @hwchase17

X AI KOLs Following · 2026-04-22 缓存

Clement Delangue 呼吁开放追踪数据,以普及开放智能体模型的训练。

0 人收藏 0 人点赞
#training-data

@interjc: 所以源代码才是 AI 大模型公司最想要的语料 非源代码对他们来说一钱不值

X AI KOLs Following · 2026-04-20 缓存

A social post claims that source code is the most valuable training data for AI model companies, while non-code data is worthless to them.

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈