Xinyu Crystina Zhang
- Language models
- Information retrieval
- Evaluation
Selected work
5- MIRACL: A Multilingual Retrieval Dataset Covering 18 Diverse LanguagesContributor · 2023
- MMTEB: Massive Multilingual Text Embedding BenchmarkAuthor · 2025
- Mr. TyDi: A Multi-lingual Benchmark for Dense RetrievalContributor · 2021
- Rank-without-GPT: Building GPT-Independent Listwise Rerankers on Open-Source Large Language ModelsFirst author · 2025
- Tomato, Tomahto, Tomate: Do Multilingual Language Models Understand Based on Subword-Level Semantic Concepts?First author · 2025