@DanKornas: 每个层都有自己的笔记本,从零开始构建LLM就更容易了。EveryonesLLM是一个基于Google Colab的教程…
摘要
EveryonesLLM是一个开源的基于Google Colab的教程仓库,用于从零开始构建nanoGPT风格的LLM,包含逐步章节,涵盖数据加载、嵌入、注意力机制、训练和指令调优。
查看缓存全文
缓存时间: 2026/06/18 00:04
当每一层都有自己的笔记本时,从头构建一个LLM会更容易。
EveryonesLLM 是一个基于 Google Colab 的教程仓库,用于从头构建一个 nanoGPT 风格的 LLM。
它通过将路径拆分为编号章节,帮助你逐步学习整个技术栈,从数据加载和嵌入到注意力机制、训练、扩展、指令微调,以及一个 beta 版本的视觉 LLM 分支。
关键特性:
• Colab 优先的课程 – 每章链接到一个“在 Colab 中打开”的笔记本,并附有预估时间 • 逐层路径 – 涵盖数据加载器、词元/位置嵌入、层归一化、注意力机制、Transformer 块、logits 以及 nanoGPT • 训练进程 – 包括 CPU/GPU 速度检查、更大的模型/数据集、学习率调度、检查点、预训练和指令微调 • 练习 + 答案笔记本 – 独立的待办和答案笔记本使练习后对比更加容易 • 额外学习辅助 – README 中链接了张量图、演示/Web 应用,以及 beta 版本的视觉预训练/指令微调章节
它是开源的(MIT 许可证)。
链接在回复中。
相似文章
@Modular: MAX-LLM 书籍让从零开始构建 LLM 变得更加简单。新的笔记本格式让你可以运行 GPT-2 …
MAX-LLM 书籍现在提供交互式 Jupyter 笔记本,逐步指导用户使用 MAX 框架从零开始构建完整的 GPT-2 实现,使用户能够探索张量形状、运行组件并生成文本。
@DanKornas:不要通过零散的教程学习 LLM。LLM from Scratch 是一个面向开发者的实践性 PyTorch 课程,适合那些想要……
一个实践性 PyTorch 课程,教授从 Transformer 基础到微调和对齐的 LLM 训练,包括 RLHF 和 GRPO。
@oliviscusAI:OpenAI 联合创始人刚刚发布了他的个人指南,教你从头训练大语言模型。它叫 llm.c。无需繁琐设置。只…
OpenAI 联合创始人 Andrej Karpathy 发布了 llm.c,这是一份开源指南,教你如何从头训练大语言模型。代码简洁,可在任何硬件上运行,包括 CPU 和 MacBook,并且比标准方法快 7%。
@DanKornas:通过结构化的斯坦福课程学习LLMs和生成式AI。你将学到:- 理解transformer和LLM概念…
一门结构化的斯坦福课程被分享,涵盖transformer和LLM概念,不将其视为黑箱。
@techNmak: 从零构建LLMs 发现来自Vizuara的宝藏,一个43讲的系列课程,真正兑现了承诺:构建…
Vizuara的43讲系列课程教你如何从零构建LLMs,涵盖Transformer架构、GPT内部原理、分词(BPE)和注意力机制,并提供完整的Python实现。