← People

Xinyu Crystina Zhang

  • Language models
  • Information retrieval
  • Evaluation

Selected work

5
  1. MIRACL: A Multilingual Retrieval Dataset Covering 18 Diverse LanguagesContributor · 2023
  2. MMTEB: Massive Multilingual Text Embedding BenchmarkAuthor · 2025
  3. Mr. TyDi: A Multi-lingual Benchmark for Dense RetrievalContributor · 2021
  4. Rank-without-GPT: Building GPT-Independent Listwise Rerankers on Open-Source Large Language ModelsFirst author · 2025
  5. Tomato, Tomahto, Tomate: Do Multilingual Language Models Understand Based on Subword-Level Semantic Concepts?First author · 2025