llada2

Tag

Cards List
#llada2

GitHub - coder543/minnow: Fast LLaDA2.2 inference server

Reddit r/LocalLLaMA · 14h ago Cached

Minnow is a high-performance Rust inference server for LLaDA2.2 models, offering optimized inference with quantization, GPU acceleration, and significant speed improvements over standard Transformers implementations.

0 favorites 0 likes
← Back to home

Submit Feedback