Find the people behind AI papers and projects.
/
Search public work, explore its connections, and check the sources. How coverage works
4,006 saved profiles
Matching saved profiles. Coverage and source-listed affiliations may be incomplete or historical.
Search results
1–80 of 1,778
- Jianwei YangAffiliation: xAIWork: Magma: A Foundation Model for Multimodal AI Agents
- Prajjwal BhargavaAffiliation: MetaWork: The Llama 4 herd: The beginning of a new era of natively multimodal AI innovation
- Xiaocheng TangAffiliation: Not recordedWork: The Llama 4 herd: The beginning of a new era of natively multimodal AI innovation
- Gayatri KrishnakumarAffiliation: Not recordedWork: SandboxSocial: A Sandbox for Social Media Using Multimodal AI Agents
- Lars LidenAffiliation: Microsoft Research (Microsoft)Work: Magma: A Foundation Model for Multimodal AI Agents
- Robert KaczmarczykAffiliation: LAION e.V.; Technical University of MunichWork: Evaluating multimodal AI in medical diagnostics
- Swadheen ShuklaAffiliation: Microsoft Research (Microsoft)Work: Magma: A foundation model for multimodal AI agents across digital and physical worlds
- Wenwen JiangAffiliation: Not recordedWork: Model-in-the-Loop (MILO): Accelerating Multimodal AI Data Annotation with LLMs
- Aakanksha ChowdheryAffiliation: Stanford UniversityWork: Gemini: A Family of Highly Capable Multimodal Models
- Aakash KakuAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Aaron Daniel CohenAffiliation: Not recordedWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Aaron ParisiAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Aarush KattaAffiliation: LAIONWork: LAION-5B: An open large-scale dataset for training next generation image-text models
- Aarush SelvanAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhanshu SharmaAffiliation: GoogleWork: ScreenAI: A Vision-Language Model for UI and Infographics Understanding
- Abhi RaoAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhijit KarmarkarAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhimanyu DubeyAffiliation: MetaWork: Defense Against Adversarial Images Using Web-Scale Nearest-Neighbor Search
- Abhimanyu GoyalAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhipso GhoshAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhishek ChakladarAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhishek GoswamiAffiliation: Microsoft ResearchWork: Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs
- Abhishek JindalAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Abhishek KadianAffiliation: MetaWork: Scaling Llama 3 Training with Efficient Parallelism Strategies
- Abhishek SharmaAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Abraham IttycheriahAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Achintya SinghalAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Ada MaAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Adam BloniarzAffiliation: GoogleWork: Gemini: A Family of Highly Capable Multimodal Models
- Adam GrycnerAffiliation: Google DeepMindWork: LoRA-Squeeze: Simple and Effective Post-Tuning and In-Tuning Compression of LoRA Modules
- Adam KurzrokAffiliation: PathwayWork: Gemini: A Family of Highly Capable Multimodal Models
- Adam PaszkeAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Adam SadovskyAffiliation: Microsoft AIWork: Gemini: A Family of Highly Capable Multimodal Models
- Adams Wei YuAffiliation: Google DeepMindWork: SimVLM: Simple Visual Language Model Pretraining with Weak Supervision
- Adi Mayrav GiladyAffiliation: Google ResearchWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities.
- Adithya S KolaviAffiliation: Not recordedWork: Nayana: A Foundation for Document-Centric Vision-Language Models via Multi-Task, Multimodal, and Multilingual Data Synthesis
- Aditya BaruaAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Aditya RameshAffiliation: OpenAIWork: Learning Transferable Visual Models From Natural Language Supervision
- Aditya SiddhantAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Adnan El AssadiAffiliation: Not recordedWork: MTEB: Massive Text Embedding Benchmark / MTEB multimodal toolbox
- Adrià Puigdomènech BadiaAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Adrià Recasens ContinenteAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Adrian GoedeckemeyerAffiliation: GoogleWork: Gemini: A Family of Highly Capable Multimodal Models
- Adrian HutterAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Aedan PopeAffiliation: Not recordedWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Afroz MohiuddinAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Ágoston WeiszAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Aida AminiAffiliation: Google ResearchWork: Gemini: A Family of Highly Capable Multimodal Models
- Aida NematzadehAffiliation: Google DeepMindWork: Decoupling the Role of Data, Attention, and Losses in Multimodal Transformers
- Aidan GomezAffiliation: CohereWork: Aya Vision: Advancing the Frontier of Multilingual Multimodality
- Aishwarya KamathAffiliation: Google DeepMindWork: Gemma 4 Technical Report
- Aixin LiuAffiliation: Not recordedWork: DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
- AJ PiergiovanniAffiliation: Not recordedWork: MaMMUT: A Simple Architecture for Joint Learning for MultiModal Tasks
- Ajay KannanAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Akanksha MauryaAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Akhil UdathuAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Akshay GuptaAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alan AraziAffiliation: Prior LabsWork: MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image
- Alan PapirAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Alanna WaltonAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alban RrustemiAffiliation: Not recordedWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Albert CuiAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Albert WebsonAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alberto MagniAffiliation: Google DeepMindWork: Gemini: A Family of Highly Capable Multimodal Models
- Albin CassirerAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Ale Jakse HartmanAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alec RadfordAffiliation: METRWork: Improving Language Understanding by Generative Pre-Training
- Alek DimitrievAffiliation: AnthropicWork: Constitutional Classifiers++: Efficient Production-Grade Defenses against Universal Jailbreaks
- Aleksandr ChuklinAffiliation: Google DeepMindWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Alena RepinaAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex BaileyAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex Castro-RosAffiliation: Google DeepMindWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Alex ChinienAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex DyckAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex FabrikantAffiliation: Google ResearchWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex FengAffiliation: Not recordedWork: Gemma 3 Technical Report
- Alex GoldinAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex KaskasoliAffiliation: Not recordedWork: Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Alex KorchemniyAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Alex MorrisAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models