← People

Yang Yue

Source-listed: Ph.D. student (direct-entry doctoral student) · Tsinghua University

  • Multimodal AI
  • Language models
  • Robotics

Selected work

5
  1. Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?First author · 2025
  2. The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language ModelsContributor · 2026
  3. DeeR-VLA: Dynamic Inference of Multimodal Large Language Models for Efficient Robot Manipulator ControlFirst author · 2024
  4. Understanding, Predicting and Better Resolving Q-Value Divergence in Offline-RLFirst author · 2023
  5. Decoupled Prioritized Resampling for Offline RLContributor · 2023