Yang Yue
Source-listed: Ph.D. student (direct-entry doctoral student) · Tsinghua University
- Multimodal AI
- Language models
- Robotics
Selected work
5- Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?First author · 2025
- The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language ModelsContributor · 2026
- DeeR-VLA: Dynamic Inference of Multimodal Large Language Models for Efficient Robot Manipulator ControlFirst author · 2024
- Understanding, Predicting and Better Resolving Q-Value Divergence in Offline-RLFirst author · 2023
- Decoupled Prioritized Resampling for Offline RLContributor · 2023