query-guided

Tag

Cards List
#query-guided

OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models

arXiv cs.LG · 2026-07-07 Cached

OmniFocus is a training-free, query-guided token compression method for omni-modal LLMs that independently estimates importance for video and audio to preserve modality-specific evidence while maintaining alignment, achieving significant inference speedups with minimal accuracy loss at low token retention ratios.

0 favorites 0 likes
← Back to home

Submit Feedback