@TheAhmadOsman:目前正在撰写4篇不同的文章,将发布在X上并添加到下面列出的6篇文章中。它们将涵盖——LLM…
摘要
Ahmad Osman宣布了四篇即将发布的文章,涵盖LLM解码/预填充、LLM核以及硬件比较(CPU、GPU、Tenstorrent、Apple Silicon),这些文章是基于他现有的“Local LLMs From Zero to Hero”系列。
目前正在撰写4篇不同的文章,将发布在X上并添加到下面列出的6篇文章中
它们将涵盖
- LLM解码与预填充
- LLM核
- CPU vs GPU vs Tenstorrent vs Apple Silicon
- “核”的区别
期待它们本周发布
查看缓存全文
缓存时间: 2026/06/08 03:16
目前正在撰写4篇不同的文章,将在X上发布,并添加到下面列出的6篇文章中。
它们将涵盖:
- LLMs解码与预填充
- LLMs内核
- CPU、GPU、Tenstorrent与Apple Silicon的对比
- “内核”之间的差异
期待本周发布。
@tenstorrent
相似文章
@TheAhmadOsman: LLM解码简化 来自X上即将发布的文章
Ahmad Osman预告了X上即将发布的一篇文章,该文章简化了LLM解码。
LLMs 101:实用指南(2026年版)
一份关于LLMs的全面实用指南,涵盖推理机制、令牌、Transformer、KV缓存、本地部署硬件和量化,截至2026年5月。
逐步 LLM 工程项目 (2026 版)
一个基于项目的路线图,通过构建从分词器到服务栈的关键组件来学习 LLM 工程,包括硬件基础和后训练技术。
我写了一个免费的15部分系列文章,讲解LLM内部原理——真实的数学、真实的张量形状、真实的硬件限制。全部基于Gemma 4 12B的实际配置。
一个涵盖LLM内部原理的全面15部分系列,从分词到服务部署,基于Gemma 4 12B的实际配置。
@TheAhmadOsman:不知道从哪里开始本地AI?阅读我的Local LLMs From Zero to Hero系列 它涵盖:- 硬件 - 软件 -…
推广一个适合初学者的系列,教你如何在本地运行LLM,涵盖硬件、软件和模型原理。