training

标签

Cards List
#training

FBI建造了一个模拟网络攻击的小镇

The Verge ↗ · 2026-06-14 缓存

FBI在阿拉巴马州亨茨维尔建造了一个22000平方英尺的模拟小镇,名为Kinetic Cyber Range,用于模拟网络攻击以进行培训和研究,系统隔离以防止恶意软件逃逸。

0 人收藏 0 人点赞
#training

想要构建自定义模型

Reddit r/LocalLLaMA ↗ · 2026-06-14

一位用户讨论将小型自动补全模型(2500万参数)作为学习项目来构建,提到硬件限制(32GB VRAM)、数据要求(约1亿个token),并寻求关于数据集和自动补全式训练的数据格式的建议。

0 人收藏 0 人点赞
#training

@leerob: https://x.com/leerob/status/2065469795529588940

X AI KOLs Following ↗ · 2026-06-12 缓存

Cursor AI 描述了其用于扩展 Composer 模型训练的递归代理系统,该系统使用一组自我管理的代理,在出现问题时向人类发出警报。该系统支持并行实验并加速研究,将研究人员的时间视为最稀缺的资源。

0 人收藏 0 人点赞
#training

首个用于机器人的游戏引擎

Hacker News Top ↗ · 2026-06-12 缓存

Lucky Robots 宣布推出 Lucky Engine,这是首个专为机器人设计的游戏引擎,通过逼真的模拟和部署,为机器人 AI 训练生成无限数据。

0 人收藏 0 人点赞
#training

@GitHub_Daily: 想深入研究模型,不能只停留在应用层,需要弄懂底层系统是如何训练和优化的。 偶然发现 LLMSys-PaperList,这份精心整理了大模型系统相关的论文合集。 从 2022 年一直更新到 2026 年最新的顶会论文,并按训练、推理、多模态…

X AI KOLs Timeline ↗ · 2026-06-12 缓存

一个精心整理的大模型系统相关论文合集,涵盖训练、推理、多模态等方向,持续更新并收录了技术报告、框架和课程,适合研究人员和开发者参考。

0 人收藏 0 人点赞
#training

@MaxForAI: 田渊栋 @tydsh 的创业团队Recursive @Recursive_SI 发布了一个阶段性的成果:自动化AI研究系统 这个系统里AI能自己完成「提出想法→实现→跑实验→验证→根据结果选下一个实验」这一整套研究循环。 结果表明在目标清…

X AI KOLs Timeline ↗ · 2026-06-11 缓存

Recursive团队发布自动化AI研究系统,能自主完成研究循环,在多个基准上超越人类社区已有方案,如在NanoGPT Speedrun中将训练时间从79.7秒压缩至77.5秒,在SOL-ExecBench上将得分提升至0.754。

0 人收藏 0 人点赞
#training

Boxwood Chess

Product Hunt ↗ · 2026-06-11

Boxwood Chess 是一款国际象棋模式训练工具,没有计时器、连续记录或评分。

0 人收藏 0 人点赞
#training

@neural_avb: 正在研究推理训练文档。准备编写验证器环境,然后用 Unsloth/TRL 搞起来!如果一切顺利,很快就会出视频。

X AI KOLs Timeline ↗ · 2026-06-11 缓存

用户正在使用 Unsloth 和 TRL 实现带验证器的推理训练,报告了使用小型 SLM 和微型 RM 本地生成类似 GRPO 的样本的进展,并承诺很快发布视频。

0 人收藏 0 人点赞
#training

从零构建一个复古风格的LLM

Hacker News Top ↗ · 2026-06-11 缓存

作者记录了从零构建一个340M参数LLM的过程,该模型仅使用1900年以前的文本进行训练,包括自定义数据集、训练脚本,并开源了模型和代码。

0 人收藏 0 人点赞
#training

@ClementDelangue: 我们是否应该尝试训练一个开源AI构建模型?我们显然有有趣的数据集,如HF、MLintern、tran…

X AI KOLs Following ↗ · 2026-06-10

Clement Delangue 询问是否应该训练一个开源AI构建模型,并指出有可用的数据集和工具,如HF、MLintern、transformers和trl。

0 人收藏 0 人点赞
#training

@natashajaques:非常喜欢阅读微软MAI-Thinking-1的《Building a Hill Climbing Machine》论文。令人惊讶的是他们公开了……

X AI KOLs Following ↗ · 2026-06-10 缓存

Natasha Jaques赞扬微软MAI-Thinking-1论文完全公开了前沿模型的训练方法,重点指出预训练、中期训练和RL后训练阶段的token分布,并提到Yann LeCun的蛋糕比喻很有先见之明。

0 人收藏 0 人点赞
#training

反馈对齐在自蒸馏中的作用

Hugging Face Daily Papers ↗ · 2026-06-09 缓存

本文研究了语言模型中自蒸馏的上下文设计,发现逐步对齐的批评反馈显著优于二元奖励或参考解条件,因为它只针对错误词元,同时保留正确行为。

0 人收藏 0 人点赞
#training

@qjoyliu: 训练的未来是开源的。非常激动地宣布,我们已与HuggingFace、Nvidia、Met…

X AI KOLs Following ↗ · 2026-06-08 缓存

OpenEnv,一个训练环境,正在向社区开放,得到了HuggingFace、Nvidia、Meta等领先公司的支持。

0 人收藏 0 人点赞
#training

@SergioPaniego: OpenEnv 有了新家:http://github.com/huggingface/OpenEnv… 从今天起,由一个委员会协调,其中包括…

X AI KOLs Following ↗ · 2026-06-08 缓存

OpenEnv,一个用于创建和部署隔离执行环境以进行智能体强化学习训练的框架,已迁移到 Hugging Face,现在由一个包括 Meta-PyTorch、NVIDIA 等的委员会管理。

1 人收藏 1 人点赞
#training

@charles_irl: 在忙碌中竟然错过了这个。很酷的演示!

X AI KOLs Following ↗ · 2026-06-07 缓存

一位开发者使用自建ML框架,基于Rust后端和CUDA内核,包含Flash Attention和AdamW,从零训练了一个1200万参数的LLM。

0 人收藏 0 人点赞
#training

@eliebakouch:我最喜欢的项目之一是斯坦福团队的Marin,他们采用科学的方法进行训练,并且愿意……

X AI KOLs Following ↗ · 2026-06-07 缓存

Marin是斯坦福大学开发的开源框架,用于可复现的基础模型研究,涵盖数据整理、分词、训练和评估;它被用于训练一个80亿参数的模型,其性能超过了Llama 3.1 8B。

0 人收藏 0 人点赞
#training

@ChenHenryWu: 自我提升取决于模型能否判断自身工作。我们通常训练模型生成更好的内容——为什么不也训练它们进行同等水平的验证?

X AI KOLs Timeline ↗ · 2026-06-05 缓存

这条推文线程介绍了一项研究:训练模型验证自身工作,可使模型在复杂数学问题上的准确率几乎翻倍,并将科学推理能力提升14倍。

0 人收藏 0 人点赞
#training

@tut_ml: 最佳大型语言模型课程 - https://mltut.com/best-large-language-models-courses/…

X AI KOLs Timeline ↗ · 2026-06-05 缓存

一篇博客文章列出了10个最佳大型语言模型(LLM)课程和培训资源,包括来自Coursera、DataCamp、Udacity以及Vanderbilt等大学的课程。

0 人收藏 0 人点赞
#training

状态承诺学习:训练语言模型区分计算与记忆

arXiv cs.LG ↗ · 2026-06-05 缓存

本文介绍了状态承诺学习,这是一种训练目标,旨在教会语言模型区分临时计算令牌与持久状态令牌。作者提出了反事实擦除强化学习(CERL)和擦除依赖协议,在数学、逻辑、科学问答以及工具使用任务中展示了改进,且未牺牲准确性。

0 人收藏 0 人点赞
#training

CollabBench:通过主动参与与多样玩家基准测试并释放LLM协作能力

arXiv cs.CL ↗ · 2026-06-05 缓存

CollabBench是一个新的基准测试,用于评估和训练LLM智能体在合作游戏中的表现,具有多样玩家模拟和协作训练范式。实验表明,与基础模型相比,效率提高19.5%,情感性能提升24.4%。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈