← People

Jie Huang

Source-listed: 2024 master's candidate · Institute of Computing Technology, Chinese Academy of Sciences

  • Multimodal AI
  • Language models

Selected work

5
  1. Revisiting Multimodal Positional Encoding in Vision–Language ModelsFirst author · 2025
  2. RefHCM: A Unified Model for Referring Perceptions in Human-Centric ScenariosFirst author · 2024
  3. Multimodal-RoPEsMaintainer · 2025
  4. RefHCM official implementationFirst author · 2024
  5. Qwen3-VL Technical ReportContributor · 2025