pull-request

标签

Cards List
#pull-request

CUDA: 添加快速 Walsh-Hadamard 变换(作者 am17an)· Pull Request #23615 · ggml-org/llama.cpp

Reddit r/LocalLLaMA · 2026-05-25 缓存

此拉取请求为 llama.cpp(一个流行的开源 LLM 推理引擎)添加了 CUDA 上的快速 Walsh-Hadamard 变换实现。该优化提升了在 NVIDIA GPU 上某些计算操作的性能。

0 人收藏 0 人点赞
#pull-request

给所有使用 OpenCode / Pi 的用户——这是你的 prompt processing 修复方案!

Reddit r/LocalLLaMA · 2026-05-21

一个针对 llama.cpp 的拉取请求修复了使用 OpenCode 或 Pi 时出现的持续 prompt processing 问题。

0 人收藏 0 人点赞
#pull-request

llama: 在 MTP 中避免在提示解码期间复制 logits · 由 am17an 提交 · PR #23198 · ggml-org/llama.cpp

Reddit r/LocalLLaMA · 2026-05-17 缓存

此拉取请求通过避免在多令牌预测的提示解码过程中不必要地复制 logits,优化了 llama.cpp,从而提升推理性能。

0 人收藏 0 人点赞
#pull-request

MTP 支持已合并至 llama.cpp

Reddit r/LocalLLaMA · 2026-05-16

为 llama.cpp 添加 MTP(多令牌预测)支持的拉取请求已合并至 master 分支。

0 人收藏 0 人点赞
#pull-request

MTP PR 已合并!!!

Reddit r/LocalLLaMA · 2026-05-16

与 LLaMA 模型相关的 MTP(可能指模型训练管道或类似内容)拉取请求已合并,标志着一个里程碑。

0 人收藏 0 人点赞
#pull-request

llama + spec: 由 am17an 提交的 MTP 支持 · Pull Request #22673 · ggml-org/llama.cpp

Reddit r/LocalLLaMA · 2026-05-16 缓存

拉取请求为 llama.cpp 添加多令牌预测(MTP)支持,启用推测解码以加速推理。

0 人收藏 0 人点赞
#pull-request

@LangChain: 这个AI监控自己的代码库,标记缺失的监测器,并自动创建PR修复发现的漏洞。@Shevchenkoaalex 在 @TryR…

X AI KOLs Following · 2026-05-11 缓存

一个基于LangChain构建的AI代理持续监控自己的代码库,标记缺失的监测器,并自动创建PR修复发现的漏洞,如Ramp公司的Alex Shevchenko所述。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈