Jie Huang
Source-listed: 2024 master's candidate · Institute of Computing Technology, Chinese Academy of Sciences
- Multimodal AI
- Language models
Selected work
5- Revisiting Multimodal Positional Encoding in Vision–Language ModelsFirst author · 2025
- RefHCM: A Unified Model for Referring Perceptions in Human-Centric ScenariosFirst author · 2024
- Multimodal-RoPEsMaintainer · 2025
- RefHCM official implementationFirst author · 2024
- Qwen3-VL Technical ReportContributor · 2025