← People

Raphaël Avalos Martinez de Escobar

Source-listed: Member of Technical Staff · Cohere

  • Language models
  • Reinforcement learning

Selected work

5
  1. Command A: An Enterprise-Ready Large Language ModelAuthor · 2025
  2. ShiQ: Bringing back Bellman to LLMsContributor · 2025
  3. The Wasserstein Believer: Learning Belief Updates for Partially Observable Environments through Reliable Latent Space ModelsContributor · 2024
  4. Online Planning in POMDPs with State-RequestsContributor · 2024
  5. Local Advantage Networks for Multi-Agent Reinforcement Learning in Dec-POMDPsContributor · 2023