Raphaël Avalos Martinez de Escobar
Source-listed: Member of Technical Staff · Cohere
- Language models
- Reinforcement learning
Selected work
5- Command A: An Enterprise-Ready Large Language ModelAuthor · 2025
- ShiQ: Bringing back Bellman to LLMsContributor · 2025
- The Wasserstein Believer: Learning Belief Updates for Partially Observable Environments through Reliable Latent Space ModelsContributor · 2024
- Online Planning in POMDPs with State-RequestsContributor · 2024
- Local Advantage Networks for Multi-Agent Reinforcement Learning in Dec-POMDPsContributor · 2023