GPT-2 在纯 CMake 中的实现
摘要
这个 GitHub 仓库提供了用于执行 GPT-2 的 CMake 脚本,使用 Q16.16 整数算术,包括运行完整模型和玩具模型的说明。
查看缓存全文
缓存时间: 2026/08/24 01:43
AlpinDale/gpt2.cmake
来源: https://github.com/AlpinDale/gpt2.cmake
gpt2.cmake
使用 Q16.16 整数运算实现的纯 CMake 版 GPT-2。
完整模型
sh mkdir -p checkpoint curl -L -o checkpoint/model.safetensors https://huggingface.co/openai-community/gpt2/resolve/main/model.safetensors curl -L -o checkpoint/vocab.json https://huggingface.co/openai-community/gpt2/resolve/main/vocab.json curl -L -o checkpoint/merges.txt https://huggingface.co/openai-community/gpt2/resolve/main/merges.txt python3 tools/gen_full.py cmake -P gpt2_full.cmake -DPROMPT="Hello" -DN=2
迷你模型
sh python3 tools/gen_tables.py python3 tools/gen_model.py cmake -P gpt2.cmake
许可证
BSD 3-Clause。详见 LICENSE。
相似文章
Show HN: NanoEuler – 从头开始用纯C/CUDA实现的GPT-2规模模型
NanoEuler 是一个完全用纯 C/CUDA 从头构建的 GPT-2 规模语言模型,不依赖任何机器学习库,包括手写的前向/反向传播、字节级 BPE 分词器和训练流水线。该项目是一个教育示范,展示了 Transformer 训练背后的工程原理,可在单个 RTX 4070 上运行。
逆向工程RK3588 NPU:构建开放编译器以36 tok/s运行GPT-2
逆向工程了RK3588 NPU并构建了一个开放编译器和运行时,以从PyTorch、ONNX和JAX运行GPT-2和SigLIP,无需供应商SDK。
GPT2-BASIC: 基于BASIC的便携式机器智能
GPT2-BASIC 在 FreeBASIC 中为 DOS 系统实现了 GPT 风格的 Transformer 推理引擎,使用定点算术和本地模型工件,在老旧硬件上运行 AI 辅助任务。
MiniGPT: 从第一性原理重建GPT
本文介绍了MiniGPT,这是一个基于PyTorch从头实现的紧凑型GPT风格自回归语言模型,其构建参考了nanoGPT的研究。该模型在Tiny Shakespeare数据集上使用字符级分词进行评估,在10.77M参数配置下达到了1.4780的验证损失。
迷你可修改的CUDA语言模型实现
一个最小化的、可修改的CUDA实现,类似于GPT的变压器语言模型,处理字节序列,附带示例输出和构建说明。