Nabeel Shan
- Language models
- Reinforcement learning
Selected work
5- Advanced LLM Adaptation: From Supervised Fine-Tuning to Reinforcement Learning for Dialogue SummarizationMaintainer
- End-to-End Reinforcement Learning from Human Feedback (RLHF)Creator
- The Transformer Adaptation PlaybookCreator
- GPT-Forge: A From-Scratch Transformer for Text GenerationCreator
- Math VLM Pipeline: Handwritten Math to LaTeXCreator