attention-sparsification

Tag

Cards List
#attention-sparsification

SAS: Simple Attention Sparsification via End-to-End Optimization of Context Ranking

Hugging Face Daily Papers ↗ · 2026-09-11 Cached

SAS introduces a gated sparse attention mechanism that optimizes context ranking end-to-end with language modeling loss, improving performance in reasoning and long-context tasks under tight attention budgets.

0 favorites 0 likes
#attention-sparsification

Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification

Hugging Face Daily Papers ↗ · 2026-07-27 Cached

Sol-Attn introduces a training-free method to sparsify attention for video generation inference, achieving over 2x speedup by dynamically selecting key-value blocks during online softmax with minimal quality loss.

0 favorites 0 likes
← Back to home

Submit Feedback