cost-efficient-training

Tag

Cards List
#cost-efficient-training

Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090

Hugging Face Daily Papers · 2026-08-27 Cached

This paper presents an open-source pretraining recipe that trains 2B-parameter language models on consumer-grade RTX 5090 GPUs for under $7K, achieving performance near larger baselines and deriving cost scaling laws for model training.

0 favorites 0 likes
← Back to home

Submit Feedback