multilingual-dataset

Tag

Cards List
#multilingual-dataset

Improving Cross-Lingual Transfer for Sequential Sentence Classification in Research Papers via Structural Similarity

arXiv cs.CL ↗ · 2026-09-18 Cached

This paper explores improving cross-lingual transfer for sequential sentence classification in research papers by leveraging structural similarity, proposing methods that enhance performance in multilingual settings based on experiments with encoder-based and generative models.

0 favorites 0 likes
#multilingual-dataset

IKS-Instruct: A 24,000-Example Multilingual Dataset for Teaching Language Models Indian Knowledge Systems

arXiv cs.CL ↗ · 2026-07-28 Cached

IKS-Instruct is a multilingual dataset of 24,795 instruction-response pairs for teaching language models Indian Knowledge Systems, spanning seven Indian languages and covering 41 pedagogical techniques. Evaluation shows a fine-tuned 7B model performs competitively with larger general-purpose models on IKS-specific tasks.

0 favorites 0 likes
← Back to home

Submit Feedback