training

标签

Cards List
#training

@KaitoEtLIA:- 我每天都用Claude - 我觉得自己挺擅长的 - 我看了两位Anthropic工程师整整2小时的视频 - Claude的引擎…

X AI KOLs Timeline ↗ · 2026-05-16 缓存

一条Twitter帖子对Anthropic关于构建Claude代理的2小时培训视频做出反应,强调“Skills”功能可以持久化工作流程和专业知识,并对之前手动重复的工作表示遗憾。

0 人收藏 0 人点赞
#training

@Jouhatsu_ai: Anthropic发布了关于构建Claude代理的完整2小时培训。由构建Claude Code的工程师主持。

X AI KOLs Timeline ↗ · 2026-05-16 缓存

Anthropic发布了关于构建Claude代理的全面2小时培训,由Claude Code背后的工程师主持,涵盖代理结构设计、终端访问、内存管理和幻觉预防。

0 人收藏 0 人点赞
#training

@DailyDoseOfDS_: 将任意自回归LLM转换为扩散LM。dLLM是一个Python库,统一了扩散语言模型的训练与评估…

X AI KOLs Timeline ↗ · 2026-05-16 缓存

dLLM是一个开源Python库,能以极少的计算资源将任意自回归语言模型转换为扩散语言模型,统一训练和评估。

0 人收藏 0 人点赞
#training

DynMuon:一种动态频谱塑形视角下的Muon优化器

Hugging Face Daily Papers ↗ · 2026-05-16 缓存

本文介绍了DynMuon,一种动态频谱塑形优化器,它在训练过程中将更新参数p从正值调度为轻微负值,从而持续获得更低的验证损失,并且达到相同目标损失所需的步数比标准Muon优化器减少10.6%–26.5%。

0 人收藏 0 人点赞
#training

AstraFlow:面向数据流的智能体大语言模型强化学习系统

Hugging Face Daily Papers ↗ · 2026-05-15 缓存

AstraFlow是一个面向数据流的强化学习系统,支持智能体大语言模型的高效多策略协同训练与弹性扩展,训练速度相比现有系统提升2.7倍。

0 人收藏 0 人点赞
#training

@SOURADIPCHAKR18: 两个因素使其有效。1. Spike-aware 教学奖励:仅当模型正确且合理时才给予奖励。惩…

X AI KOLs Following ↗ · 2026-05-14 缓存

描述了一种训练技术,涉及 Spike-aware 教学奖励(惩罚不合理跳跃)和 Surprisal-gated 模仿(学生快速学习简单标记,缓慢学习困难标记)。

0 人收藏 0 人点赞
#training

@stanfordnlp:学习成功训练最先进语言模型的细节(即“技巧”或“秘诀”)有两条路径……

X AI KOLs Following ↗ · 2026-05-13 缓存

斯坦福NLP将CS336课程推广为学习成功训练最先进语言模型技巧的途径。

0 人收藏 0 人点赞
#training

MinT:用于训练和服务数百万LLM的托管基础设施

Hugging Face Daily Papers ↗ · 2026-05-13 缓存

MinT 是一种托管基础设施系统,通过保持基础模型常驻并移动轻量级 LoRA 适配器,实现数百万个 LLM 的高效训练和服务,可跨模型架构、存储和策略管理进行扩展。

0 人收藏 0 人点赞
#training

@eglyman:我们训练了一个0.35B参数的模型,在电子表格导航方面比opus 4.6更优秀。普通企业信用卡公司的常规操作。

X AI KOLs Following ↗ · 2026-05-07 缓存

一位开发者训练了一个350M参数的模型,其处理电子表格的能力优于Anthropic的Opus 4.6。

0 人收藏 0 人点赞
#training

2026年中ROCm状态 [D]

Reddit r/MachineLearning ↗ · 2026-05-07

作者询问2026年中AMD的ROCm生态系统在AI训练领域的当前可行性,将其与NVIDIA的CUDA进行比较,并询问它是否已达到PyTorch的“开箱即用”阶段。

0 人收藏 0 人点赞
#training

ChatGPT如何在保护隐私的同时了解世界

OpenAI Blog ↗ · 2026-05-06 缓存

OpenAI解释了ChatGPT如何从公共数据和用户互动中学习,同时通过过滤和用户控制来保护隐私。

0 人收藏 0 人点赞
#training

Transition

Product Hunt ↗ · 2026-05-05

Transition 是一个由人工智能驱动的教练平台,旨在优化跑步者的运动训练计划并提升比赛表现。

0 人收藏 0 人点赞
#training

第八代TPU:面向智能体时代的双芯片设计

Hacker News Top ↗ · 2026-04-22 缓存

Google发布第八代TPU:TPU 8t用于训练,TPU 8i用于推理,专为大规模、高能效AI智能体工作负载打造,将于今年晚些时候推出。

0 人收藏 0 人点赞
#training

如何获得一个好的目标检测模型?[P]

Reddit r/MachineLearning ↗ · 2026-04-20

一位用户希望获得关于改进其YOLO11n目标检测模型的建议,计划将其部署在Raspberry Pi 5上,但困扰于理论mAP50指标与实际检测性能之间的差距。

0 人收藏 0 人点赞
#training

kaizen

Product Hunt ↗ · 2026-04-16

Kaizen 是一款训练平台,能够根据用户的运动表现与活动数据动态调整跑步训练计划。

0 人收藏 0 人点赞
#training

DataFlex:面向大语言模型数据驱动动态训练的统一框架

Papers with Code Trending ↗ · 2026-03-27 缓存

DataFlex是一个面向大语言模型数据驱动动态训练的统一框架,集成了样本选择、领域混合调整和样本重加权,兼容标准工作流程并支持高效大规模部署,相比静态训练实现了一致的性能提升。

0 人收藏 0 人点赞
#training

Ulysses 序列并行:百万Token上下文训练

Hugging Face Blog ↗ · 2026-03-09 缓存

Ulysses 序列并行是一种用于训练具有百万Token上下文的大语言模型的技术,通过将序列块分布在多个GPU上来降低内存需求,实现高效的长上下文训练。它与HuggingFace Accelerate、Transformers Trainer和TRL集成,支持Flash Attention和DeepSpeed ZeRO。

0 人收藏 0 人点赞
#training

OpenAI 为新闻机构推出学院

OpenAI Blog ↗ · 2025-12-17 缓存

# 为新闻机构推出 OpenAI 学院 来源:[https://openai.com/index/openai-academy-for-news-organizations/](https://openai.com/index/openai-academy-for-news-organizations/) OpenAI 与美国新闻项目(American Journalism Project)和伦费斯特研究所(The Lenfest Institute)合作,为使用 AI 的记者和出版商推出一个新的学习中心。在 OpenAI,我们认为新闻业对于健康的民主至关重要。人们依靠可靠的地方和国家报道来了解他们的社区和

0 人收藏 0 人点赞
#training

maderix/ANE

GitHub Trending (daily) ↗ · 2026-07-29 缓存

一种逆向工程实现,通过私有API在Apple Neural Engine上进行神经网络训练,展示了超出推理能力的硬件潜力。

0 人收藏 0 人点赞
#training

Training Agents: Live tutorial on how to fine-tune a coding agent for continual learning

YouTube AI Channels ↗ · 2026-06-28 缓存

本直播教程展示了如何使用监督微调(SFT)在代理跟踪记录数据集上训练一个小型代码代理(Gemma 4 2B),并利用HF Jobs和Track IO自动化参数扫描与评估,体现“用代理训练代理”的理念。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈