training

标签

Cards List
#training

@fuzzsociety_org: Linux Kernel Exploitation 即将发布,别忘了以折扣价预订席位

X AI KOLs Timeline ↗ · 2026-09-17 缓存

Linux Kernel Exploitation 即将发布的公告,提供折扣预订席位。

0 人收藏 0 人点赞
#training

更新:小模型 + Engram

Reddit r/LocalLLaMA ↗ · 2026-09-17

作者提供了关于构建一个小型20亿参数AI模型的更新,该模型具有Engram组件,在1500万维基百科tokens上训练,达到了惊人的连贯性,并计划进行Apache 2.0开源发布。

0 人收藏 0 人点赞
#training

@Kay2289123: 关于AI发展放缓的那个鬼故事——读一读,笑一笑,然后继续前行;别连自己都骗了。Grok4.…

X AI KOLs Timeline ↗ · 2026-09-16 缓存

这篇文章反驳了AI发展正在放缓的观点,强调了Grok4.8,一个拥有2.5T参数的模型,已经完成训练,以及主要科技公司仍在积极训练AI模型。

0 人收藏 0 人点赞
#training

航天飞机着陆——飞行器与毕生难忘的激动时刻

Hacker News Top ↗ · 2026-09-16 缓存

一名宇航员回忆了着陆Space Shuttle Atlantis的刺激瞬间,详述了从Mach 1到着陆的无动力滑翔下降所需的严苛训练和精确度。

0 人收藏 0 人点赞
#training

@HuggingPapers: ZGCM-1: 7B模型,前沿数学与搜索能力 一个完全开放的7B LLM,现已登陆Hugging Face。从头训练,采用FP…

X AI KOLs Timeline ↗ · 2026-09-15 缓存

ZGCM-1是一个完全开源的7B大语言模型,从头训练,采用FP8、MDP中期训练和AI4AI,在数学和智能搜索任务上达到了与Qwen3-235B相当的性能。

0 人收藏 0 人点赞
#training

@kentcdodds: 这家伙总是在我们还没拥有下一个东西之前就谈论下下个东西。

X AI KOLs Timeline ↗ · 2026-09-14 缓存

Elon Musk宣布,Grok 4.8——一个采用新C++软件栈训练的2.5万亿参数AI模型——将于本周结束训练并启动强化学习。与此同时,@kentcdodds就Elon Musk提前讨论未来发展的习惯发表了评论。

0 人收藏 0 人点赞
#training

通过方向分解解析Transformer中的表示演化

Hugging Face Daily Papers ↗ · 2026-09-14 缓存

本文将Transformer表示更新分解为平行和垂直分量,以研究演化几何,并将其与编辑鲁棒性、压缩诊断和训练改进联系起来。

0 人收藏 0 人点赞
#training

踏准前沿 – Tahuna: AI训练基础设施,现已开源 [P]

Reddit r/MachineLearning ↗ · 2026-09-13

Tahuna是一个开源的AI训练基础设施,专为小团队设计,用于训练模型、运行推理、编排GPU并进行自主研究实验,具有可重现的运行和如Hillclimb这样的工具。

0 人收藏 0 人点赞
#training

对于一个密集的9b模型,是否仍有浓厚兴趣?

Reddit r/LocalLLaMA ↗ · 2026-09-13

一位开发者创建了一个密集的9.4B参数AI模型,具有Engram表和AttnRes建模等技术增强,旨在开源发布,并寻求社区兴趣以进行进一步训练和部署。

0 人收藏 0 人点赞
#training

平滑长上下文混合专家训练中的所有内存峰值

Hugging Face Daily Papers ↗ · 2026-09-13 缓存

本文介绍了管理长上下文长度下训练大型混合专家模型内存峰值的技术,包括Pipelined LLEP、Ring-DTP、SCO和OffloadStreamAdamW,这些技术实现了固定的GPU工作集,并将吞吐量提高了多达10.4倍。

0 人收藏 0 人点赞
#training

OpenAI 可以使用所有付费用户的交互,即使他们选择了退出训练

Reddit r/LocalLLaMA ↗ · 2026-09-11

文章揭示,由于推理令牌未被归类为用户拥有的输出这一漏洞,OpenAI 的条款允许其使用付费用户的交互进行训练,尽管存在退出选项。

0 人收藏 0 人点赞
#training

利用搜索为下一场重要比赛做准备的3种方法

Google AI Blog ↗ · 2026-09-10 缓存

Google Search的AI功能可以通过提供个性化训练计划、定制播放列表和装备建议来帮助跑者准备比赛。

0 人收藏 0 人点赞
#training

DF/IR 中的知识保留与共享

Lobsters Hottest ↗ · 2026-09-10 缓存

本文回顾了数字取证和事件响应(DF/IR)中历史性的知识共享与培训不足,通过个人经历强调利用自动化和文档化改进流程的努力。

0 人收藏 0 人点赞
#training

在8GB GPU上实验用于PyTorch的自适应内存管理器——非常期待反馈

Reddit r/LocalLLaMA ↗ · 2026-09-09

作者正在实验用于PyTorch的自适应内存管理器,以防止8GB GPU上的CUDA内存溢出错误,分享代码并寻求社区反馈。

0 人收藏 0 人点赞
#training

@LearnOpenCV: 1/20 我使用GPT-6 Astra Ultra作为编排器训练了两个分割模型,未提供人工标签。我的提…

X AI KOLs Timeline ↗ · 2026-09-08 缓存

一个实验,其中两个分割模型使用GPT-6 Astra Ultra作为编排器进行训练,未使用人工标签,由于时间限制提示较为随意,并展示了在保留视频上的预测结果。

0 人收藏 0 人点赞
#training

@AlexGDimakis: 4000块GB200刚刚抵达Texas,用于Horizon TACC集群。我获悉这是最大的学术超级计算机…

X AI KOLs Timeline ↗ · 2026-09-02 缓存

4000块NVIDIA GB200 GPU已抵达Texas,用于Horizon TACC集群,形成了最大的学术超级计算机,并计划训练开源AI模型。

0 人收藏 0 人点赞
#training

@leeoxiang: 确实非常轻量的 TTS 实现,尝试用 2000 个小时数据复现了一下 Audio8的从头训练,在 H200上训了不到 10 个小时 SIM 指标就已经达到 0.72了。

X AI KOLs Timeline ↗ · 2026-08-29 缓存

一个轻量级的TTS实现,通过2000小时数据复现Audio8的训练,在H200上不到10小时训练就达到了0.72的SIM指标。

0 人收藏 0 人点赞
#training

@StasBekman: 我向您呈现一本2026年8月大幅修订的机器学习工程开放书籍 https://github.com/stas00/ml-engi…

X AI KOLs Following ↗ · 2026-08-26 缓存

这是一本大幅修订的机器学习工程开放书籍,已更新至最新的硬件规格和示例,为训练和微调大语言模型及多模态模型提供实用指南。

0 人收藏 0 人点赞
#training

使用 Sentence Transformers 训练和微调多向量嵌入模型

Hugging Face Blog ↗ · 2026-08-26 缓存

本文介绍了如何使用 Sentence Transformers 库训练和微调多向量嵌入模型,展示了其 v6.0 更新中的新 MultiVectorEncoder 类型,并在医疗检索任务中演示了其卓越的性能。

0 人收藏 0 人点赞
#training

训练、学习和推断:神经系统的统一动力学

arXiv cs.LG ↗ · 2026-08-24 缓存

本文提出了一种统一的动力学框架,用于神经系统的训练、学习和推断。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈