llama-swap

标签

Cards List
#llama-swap

RetroCraft - Qwen 3.8 27B Q8,双路3090显卡单次运行提供精确性能数据。

Reddit r/LocalLLaMA · 5天前

以下是在双块英伟达3090显卡上运行Qwen 3.8 27B Q8模型的性能演示:通过单次指令生成名为RetroCraft的《我的世界》仿制游戏,包含详细的Token处理与生成速度分析。

0 人收藏 0 人点赞
#llama-swap

@iluciddreaming: 玩了两个月本地 LLM。 用 Windows 11 + llama.cpp + llama-swap 狂测各种开源模型,这是我的最终成绩单: 硬件:i7-13700 + 64GB RAM + RTX 4070 目前最能打的组合是 gemm…

X AI KOLs Timeline · 2026-06-15 缓存

经过两个月本地 LLM 测试,作者认为 gemma-4-12B-it-QAT 和 MTP 辅助组合在速度和可用性上表现最佳,硬件为 i7-13700 + 64GB RAM + RTX 4070。

0 人收藏 0 人点赞
#llama-swap

@leopardracer: https://x.com/leopardracer/status/2055341758523883631

X AI KOLs Timeline · 2026-05-15 缓存

一位用户分享了他们搭建双GPU本地AI实验室的经验,使用了RTX 4080 Super和5060 Ti,通过llama.cpp和llama-swap运行Qwen 3.6模型,以降低API成本并实现无限制的实验。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈