@vintcessun: 3 天更新了 3 课:Day00 学习地图、Day01 Transformer 全景、Day02 输入层。每天上午一课,配图、表格、公式、检查表都有。这个路径最大的价值是让新手从输入层开始搭认知,而不是直接啃论文。学到的是——理解 tok…
摘要
发布了一个面向初学者的 LLM 学习路径 GitHub 仓库,包含从 Transformer 基础到 LLM 技术的课程内容,每天更新一课。
查看缓存全文
缓存时间: 2026/07/04 14:47
3 天更新了 3 课:Day00 学习地图、Day01 Transformer 全景、Day02 输入层。每天上午一课,配图、表格、公式、检查表都有。这个路径最大的价值是让新手从输入层开始搭认知,而不是直接啃论文。学到的是——理解 token、embedding、位置编码这三步转换,就能看懂后续所有 LLM 结构。
仓库在这 👇
terrense/LLM_path_for_begginers
Source: https://github.com/terrense/LLM_path_for_begginers
LLM Path for Beginners
一个面向初学者的大模型技术学习路径。内容从 Transformer 基础开始,逐步进入 LLM、VLM、RAG、SFT、RLHF、量化、Ollama、vLLM、SGLang 和本地部署实验。
课程目录
| 编号 | 主题 | 链接 |
|---|---|---|
| Day 00 | 大模型学习路线:从看见森林到搭起实验台 | posts/day-00-learning-map |
| Day 01 | Transformer 全景:为什么它改变了 NLP | posts/day-01-transformer-big-picture |
| Day 02 | Token、Embedding 与位置编码:LLM 输入层的三步转换 | posts/day-02-tokens-embeddings-position |
更新节奏
计划每天上午 7 点更新一课。每篇文章包含正文、配图、表格、流程图、数学公式、实践检查表和小测。图片优先采用报告式技术图、架构图、流程图和对比图,强调可读性与学习价值。
相似文章
@kuririrn: Studying to grasp the recent trends in scratch development of LLMs Stanford CS336 Lang. Modeling from Scratch | Spring …
本课程笔记总结了从原始Transformer到现代LLM的架构演变,重点介绍了预归一化、RMS归一化、RoPE等趋同演化,并提供了超参数选择建议。
@techNmak: 这是学习LLM工作原理的最佳方式。交互式3D,逐步讲解。涵盖:→ 嵌入 → 层归一化 → 自注意力…
一个交互式3D逐步指南,通过可视化方式学习LLM工作原理,涵盖嵌入、自注意力、softmax等关键Transformer概念。推荐使用视觉化方法,而非阅读论文。
@QingQ77: 《动手学深度学习》是很好的入门书,但更新速度已经有些跟不上这个领域的发展。Transformer 之后,CLIP、Diffusion、vLLM 等等内容越来越多,网上资料虽然丰富,却很零散,今天看 Attention,明天学 LoRA,后…
该项目是一个系统化的深度学习笔记仓库,涵盖 PyTorch、Transformer、生成模型等内容,旨在解决学习资料碎片化问题,并提供代码实现与实践指南。
@GitHub_Daily: 想搞懂大语言模型底层原理,大部分资料只介绍理论知识,或者只给源码,看完还是一头雾水。 偶然看到 EveryonesLLM 这个开源教程,手把手带我们在 Google Colab 上从零搭建一个完整的大语言模型,全程动手写代码。 整套教程分…
EveryonesLLM 是一个开源教程,提供29个章节的Colab笔记本,手把手教用户从零在Google Colab上搭建完整的大语言模型,包括预训练和指令微调,并支持中文。
@FinanceYF5: 抛开朋友靠这个拿到75万年薪的故事包装,这条视频本身的干货是实打实的——一段3小时的从零构建LLM实录。 内容走了LLM入门、transformer架构、训练过程、模型现代化改造、扩展五个阶段,代码全程可见,边讲边敲。 想搞懂ChatGP…
一段3小时的从零构建LLM实录视频,涵盖LLM入门、transformer架构、训练、模型现代化改造和扩展五个阶段,代码全程可见。