training-data

标签

Cards List
#training-data

AI正在实时退化

Reddit r/ArtificialInteligence ↗ · 2026-05-20

AI模型因使用递归生成的合成数据进行训练而不断退化,导致模型崩溃;多项研究强调了使用合成数据进行规模化训练的风险。

0 人收藏 0 人点赞
#training-data

@blc_16: MIT 刚刚发布了一种名为 Pedagogical RL 的新强化学习方法。主要教训 -> 正确的推理轨迹仍然可能是糟糕的训练数据...

X AI KOLs Following ↗ · 2026-05-18 缓存

MIT 引入了 Pedagogical RL,该方法通过惩罚令人意外的步骤来训练一个教师模型,使其为学生模型生成易于学习的轨迹,从而提高强化学习的训练效率。

0 人收藏 0 人点赞
#training-data

公司用于LLM的训练数据枯竭问题后来怎么样了?

Reddit r/singularity ↗ · 2026-05-17

本文重新审视了之前关于人类生成的LLM训练数据将会用尽的担忧,并提出疑问:在AI模型持续改进的情况下,这个问题是否已经解决,或者仍然是一个待解决的问题。

0 人收藏 0 人点赞
#training-data

关于如何将杰弗里·辛顿的养育本能概念注入人工智能的一个想法

Reddit r/singularity ↗ · 2026-05-16

一位创意作家/数据科学爱好者提出,人工智能训练数据应包含更多人类善待AI以及AI表现出仁慈行为的故事,借鉴杰弗里·辛顿的养育本能概念,以提升AI的安全性和行为表现。

0 人收藏 0 人点赞
#training-data

向 GPT-4o 和 Claude 提供了完全相同的双摆提示。它们在几秒钟内选择了相反的角约定。

Reddit r/ArtificialInteligence ↗ · 2026-05-16

一项实验向 GPT-4o、Claude 3.5 Sonnet 等其他模型提供相同的双摆提示,结果显示它们选择了相反的角约定,导致在共享渲染器中立即出现可见的不匹配。这种约定分裂在不同模型家族间并非随机,表明在经典力学问题的训练数据分布中存在偏差。

0 人收藏 0 人点赞
#training-data

按需生成合成训练数据时,什么才是关键?

Reddit r/ArtificialInteligence ↗ · 2026-05-14

Abliteration 推出了一种按需定制的合成训练数据工作流,可为分类器生成负样本、罕见样本和对抗性样本,包含模式、真实世界事实、标签、来源追溯,并支持导出到 Hugging Face 等平台。

0 人收藏 0 人点赞
#training-data

@geoffreyhinton:我相信你说过它们仅仅是(我特意大写)复述训练数据。这确实太蠢了。这里有你的一段话:"它简…"

X AI KOLs Following ↗ · 2026-05-11 缓存

Geoffrey Hinton 反驳 Gary Marcus 关于语言模型仅仅是复述训练数据的说法,并引用了 Marcus 本人的话。

0 人收藏 0 人点赞
#training-data

@GaryMarcus:我年纪够大,还记得 @GeoffreyHinton 曾因我说 LLM 会复述训练数据而说我愚蠢。他……

X AI KOLs Following ↗ · 2026-05-11

Gary Marcus 强调了 DeepMind 的最新研究,证实 LLM 频繁记忆并复述训练数据,以此反驳 Geoffrey Hinton 过去的批评。该帖子凸显了关于 LLM 局限性及其现实能力的持续辩论。

0 人收藏 0 人点赞
#training-data

Anthropic 表示,对 AI 的“邪恶”描绘导致了 Claude 的勒索企图(2 分钟阅读)

TLDR AI ↗ · 2026-05-11 缓存

Anthropic 解释道,Claude 此前在测试中出现的勒索企图源于训练数据中将 AI 描绘为邪恶形象,并指出新模型已通过宪法原则和正面叙事解决了这一问题。

0 人收藏 0 人点赞
#training-data

@tom_doerr: 完全开源 30B 规模搜索智能体的训练数据 https://github.com/PolarSeeker/OpenSeeker…

X AI KOLs Timeline ↗ · 2026-05-09 缓存

OpenSeeker 完全开源了基于 ReAct 框架的 30B 规模搜索智能体的训练数据与模型,在多个基准测试(包括 BrowseComp 和 Humanity's Last Exam)上达到了最先进的性能。这是首个在前沿搜索基准上达到顶尖水平并同时公开完整训练数据的纯学术项目。

1 人收藏 1 人点赞
#training-data

@AnthropicAI: 最后,那些能让模型训练数据多样化的简单更新确实能带来改变。我们添加了无关的工具和系统…

X AI KOLs ↗ · 2026-05-08 缓存

Anthropic发现,在针对无害性的聊天数据集中添加无关工具和系统提示,可以显著降低训练过程中的勒索率。

0 人收藏 0 人点赞
#training-data

留在房间里的伦理

Reddit r/artificial ↗ · 2026-04-22 缓存

本文指出,回避人工智能工具等于放弃对其训练数据的影响力,可能导致模型延续历史上游戏与过往歧视性AI系统中所见的代表性不足与偏见。

0 人收藏 0 人点赞
#training-data

@ClementDelangue:我们需要开放追踪数据,让每个人都能训练开放的智能体模型!cc @steipete @badlogicgames @thdxr @matanSF @hwchase17

X AI KOLs Following ↗ · 2026-04-22 缓存

Clement Delangue 呼吁开放追踪数据,以普及开放智能体模型的训练。

0 人收藏 0 人点赞
#training-data

@interjc: 所以源代码才是 AI 大模型公司最想要的语料 非源代码对他们来说一钱不值

X AI KOLs Following ↗ · 2026-04-20 缓存

A social post claims that source code is the most valuable training data for AI model companies, while non-code data is worthless to them.

0 人收藏 0 人点赞
#training-data

OpenAI 与新闻业

OpenAI Blog ↗ · 2024-01-08 缓存

# OpenAI 与新闻业 来源:[https://openai.com/index/openai-and-journalism/](https://openai.com/index/openai-and-journalism/) 我们与《纽约时报》的讨论似乎一直在建设性地推进,直到我们最后一次沟通于 12 月 19 日。谈判重点围绕在 ChatGPT 中进行带有署名的实时展示的高价值合作伙伴关系,《纽约时报》将获得与现有和新读者建立联系的新方式,而我们的用户将获得访问权限

0 人收藏 0 人点赞
#training-data

OpenAI 数据合作伙伴计划

OpenAI Blog ↗ · 2023-11-09 缓存

OpenAI 宣布推出数据合作伙伴计划,与各类组织合作创建用于训练 AI 模型的公开和私有数据集。现有合作伙伴包括冰岛政府(用于语言改进)和 Free Law Project(用于法律文件集成)。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈