llama.cpp 里程碑
摘要
llama.cpp 发布里程碑版本,该开源库可在消费级硬件上本地运行大型语言模型,本次更新提升了性能或增加了新功能。
暂无内容
相似文章
llama.cpp 就是 LLM 界的 Linux
文章把 llama.cpp 比作 Linux,认为这款开源库已成为运行大语言模型的基础底座。
@ggerganov:llama.cpp 的第10000次发布
庆祝 llama.cpp 的第10000次发布,这是一个用于本地运行大型语言模型的工具。
llama : 网站 + 统一的 `llama` 二进制文件 · ggml-org/llama.cpp · 讨论 #23875
Llama.cpp 宣布推出新网站和统一的 'llama' 二进制文件,以简化 LLM 推理,同时还包括 Hugging Face 缓存迁移和多模态支持等更新。
ggml-org/llama.cpp
llama.cpp 是一个开源 C/C++ 库,用于在本地硬件上高效运行 LLM 推理,支持多种量化方法和多后端(CPU、GPU 等)。
llama.cpp 更新 - granite-speech-4.1-2b, LFM2.5-ColBERT/Embedding-350M, Vulkan 后端相关变更及其他事项
llama.cpp 新增对 granite-speech-4.1-2b 和 LFM 嵌入模型的支持,引入了多项 Vulkan 后端增强功能(例如 CONV_3D、规范常量、溢出修复),并包含 UI/UX 改进和其他修复。