Find the people behind AI papers and projects.
/
Search public work, explore its connections, and check the sources. How coverage works
4,006 saved profiles
Matching saved profiles. Coverage and source-listed affiliations may be incomplete or historical.
Search results
1–80 of 207
- Hila NogaAffiliation: Not recordedWork: Multilingual Sequence-to-Sequence Models for Hebrew NLP
- Mohammad SalehAffiliation: Not recordedWork: PEGASUS: Pretraining with Extracted Gap-sentences for Abstractive Summarization by Sequence-to-sequence Models
- Abha JainAffiliation: Not recordedWork: The Llama 3 Herd of Models
- AlexAffiliation: Not recordedWork: rwkv.cpp
- Cahya WirawanAffiliation: Preparatory Commission for the Comprehensive Nuclear-Test-Ban Treaty Organization (CTBTO)Work: Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence
- Christian Zhou-ZhengAffiliation: Stanford UniversityWork: RWKV-7 "Goose" with Expressive Dynamic State Evolution
- CyberhanAffiliation: Not recordedWork: Slab
- Daniel WuttkeAffiliation: DANWUCON.AIWork: RWKV-7 "Goose" with Expressive Dynamic State Evolution
- Georgi GerganovAffiliation: Hugging FaceWork: llama.cpp
- Jianhao ZhangAffiliation: Skywork AIWork: ONNX Simplifier
- Jianxin MaAffiliation: Not recordedWork: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
- Llion JonesAffiliation: Sakana AI K.K. (Sakana AI)Work: Lingvo: a Modular and Scalable Framework for Sequence-to-Sequence Modeling
- Logan DarklockAffiliation: Not recordedWork: rwkv.cpp
- Luo QiqiAffiliation: RWKV-Vibe / RWKV communityWork: RWKV centralised community documentation (RWKV Wiki)
- Min SiAffiliation: Meta Platforms, Inc. (Meta; legacy Facebook AI branding)Work: FreeScale: Distributed Training for Sequence Recommendation Models with Minimal Scaling Cost
- Molly SophiaAffiliation: TencentWork: rwkv-mobile
- Nathan WilceAffiliation: Not recordedWork: RWKV-7 "Goose" with Expressive Dynamic State Evolution
- Olatunji RuwaseAffiliation: SnowflakeWork: ZeRO: Memory Optimizations Toward Training Trillion Parameter Models
- Ronald McClelland Jr.Affiliation: Not recordedWork: Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence
- Sergey EdunovAffiliation: Genesis Molecular AIWork: Llama 2: Open Foundation and Fine-Tuned Chat Models
- Teddy FerdinanAffiliation: Wrocław University of Science and TechnologyWork: Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence
- Tianyi WuAffiliation: Beijing Normal UniversityWork: Blind identification of collective motion criticality using sequence model predictive entropy variance
- Xiaodong WangAffiliation: Meta Platforms, Inc. (Meta)Work: The Llama 3 Herd of Models
- yuunnn_wAffiliation: Not recordedWork: RWKV_Pytorch
- Ye ZhangAffiliation: Not recordedWork: Effective Sequence-to-Sequence Dialogue State Tracking
- Bo PengAffiliation: Not recordedWork: RWKV: Reinventing RNNs for the Transformer Era
- Ye JiaAffiliation: Not recordedWork: The Llama 3 Herd of Models
- Noam GatAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Raz AlonAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Peng ZhouAffiliation: Not recordedWork: Gated Slot Attention for Efficient Linear-Time Sequence Modeling
- Rom GiladAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Ben AviramAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Chen LiangAffiliation: Not recordedWork: SlimMoE: Structured Compression of Large MoE Models via Expert Slimming and Distillation
- Elad DolevAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Hayden LauAffiliation: Not recordedWork: RWKV: Reinventing RNNs for the Transformer Era
- Hofit BataAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Huanqi CaoAffiliation: Not recordedWork: mHC: Manifold-Constrained Hyper-Connections
- Nir RatnerAffiliation: Not recordedWork: Parallel Context Windows for Large Language Models
- Oded FriedAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Shahar LevAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Dor ZimbergAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Inbal MagarAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Kaifeng TanAffiliation: Not recordedWork: RWKV-7 "Goose" with Expressive Dynamic State Evolution
- Matan DanosAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Milad GholamiAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Ohad LeshnoAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Ro'i BelsonAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Tal DelbariAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Tom Ben GalAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Yikang ShenAffiliation: Not recordedWork: SALMON: Self-Alignment with Instructable Reward Models
- Amir BergmanAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Guangyu SongAffiliation: Not recordedWork: RWKV: Reinventing RNNs for the Transformer Era
- Mahdis MahdiehAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Maria RozmanAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Opher LieberAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Qinghua ZhouAffiliation: Not recordedWork: RWKV: Reinventing RNNs for the Transformer Era
- Michael ChungAffiliation: Not recordedWork: RWKV: Reinventing RNNs for the Transformer Era
- Roman GlozmanAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Siddharth GoyalAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Bhavishya MittalAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Haim RozenblumAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Jhonathan OsinAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Alexei BaevskiAffiliation: Not recordedWork: fairseq: A Fast, Extensible Toolkit for Sequence Modeling
- Christopher HideyAffiliation: Not recordedWork: Gemini: A Family of Highly Capable Multimodal Models
- Michael GokhmanAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Uriya PumerantzAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Jack William RaeAffiliation: Not recordedWork: Scaling Language Models: Methods, Analysis & Insights from Training Gopher
- Mor ZusmanAffiliation: CormaWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Yuval Peleg LevyAffiliation: Not recordedWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- Tal NessAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Tomasz GrzegorzekAffiliation: Not recordedWork: Llama-Nemotron: Efficient Reasoning Models
- Yian ZhangAffiliation: NVIDIAWork: Holistic Evaluation of Language Models
- Christian CosgroveAffiliation: Not recordedWork: Holistic Evaluation of Language Models
- Erez SafahiAffiliation: TenzaiWork: Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
- David W. Sculley IIAffiliation: Not recordedWork: Gemma 2: Improving Open Language Models at a Practical Size
- Robert Xiangru TangAffiliation: Not recordedWork: BioCoder: A Benchmark for Bioinformatics Code Generation with Large Language Models
- Noam RozenAffiliation: AI21 LabsWork: MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning
- Brandon NorickAffiliation: NVIDIAWork: An Empirical Study of Mamba-based Language Models
- Daniel Jannai-EpsteinAffiliation: Not recordedWork: Jamba: Hybrid Transformer-Mamba Language Models
- Omer AntvergAffiliation: IrregularWork: A Content-Based Framework for Cybersecurity Refusal Decisions in Large Language Models