efficient-transformers

Tag

Cards List
#efficient-transformers

Ghost in the Kernel: In-Context Learning with Efficient Transformers via Domain Generalization

arXiv cs.LG · 2026-07-02 Cached

This paper theoretically analyzes linear transformers for in-context learning under domain generalization, establishing dimension-independent convergence rates and proposing novel activation and loss designs for linearizing pretrained softmax LLMs.

0 favorites 0 likes
← Back to home

Submit Feedback