exllama

Tag

Cards List
#exllama

ExLlamav3 Recent Updates : CPU offload, GLM-5.3-FLASH, Qwen3.8-Flash, SC Quants ++

Reddit r/LocalLLaMA · 4d ago

ExLlamav3 has released major updates including CPU offload for MoE experts, support for new AI models like GLM-5.3-Flash and Qwen-3.8-Flash, and various performance optimizations.

0 favorites 0 likes
#exllama

ExLlamaV3 v1.0.0 - Major Performance Upgrades

Reddit r/LocalLLaMA · 2026-07-15

ExLlamaV3 v1.0.0 brings major performance upgrades for running large language models locally.

0 favorites 0 likes
← Back to home

Submit Feedback