Max Bartolo
Source-listed: AI Research Scientist · Google DeepMind
- Language models
- Reinforcement learning
Selected work
5- Command A: An Enterprise-Ready Large Language ModelAuthor · 2025
- Reverse Engineering Human Preferences with Reinforcement LearningContributor · 2025
- Procedural Knowledge in Pretraining Drives Reasoning in Large Language ModelsContributor · 2025
- Fishing for Magikarp: Automatically Detecting Under-trained Tokens in Large Language ModelsContributor · 2024
- Human Feedback is not Gold StandardContributor · 2024