multi-lingual

Tag

Cards List
#multi-lingual

Q2D-Web: Evaluating First-Stage Retrievers at Scale (11 minute read)

TLDR AI · 2d ago

Q2D-Web is a large-scale benchmark and leaderboard for evaluating retrieval models on web search, featuring 190 million documents and queries in ten languages with methods to minimize bias and reduce evaluation costs.

0 favorites 0 likes
#multi-lingual

ALEE: Any-Language Evaluation of Embeddings via English-Centric Minimal Pairs

arXiv cs.CL · 2026-07-02 Cached

Introduces ALEE, a framework that uses Abstract Meaning Representations to generate English minimal pairs with controlled semantic shifts and translates them for evaluating text embeddings across 275+ languages, revealing persistent gaps in cross-lingual semantic representation.

0 favorites 0 likes
#multi-lingual

@HEI: Evaluating Commercial AI Chatbots as News Intermediaries Mirac Suzgun, Emily Shen, Federico Bianchi, Alexander Spangher…

X AI KOLs Timeline · 2026-05-28 Cached

A study evaluating six commercial AI chatbots on factual questions derived from BBC News across six languages, finding high multiple-choice accuracy but significant drops in free-response, with retrieval errors driving over 70% of failures and revealing regional biases.

0 favorites 0 likes
← Back to home

Submit Feedback