Ax Hanxian Huang, Igor Fedorov, Andrey Gromov, Bernard Beckerman, Naveen Suda, David Eriksson, Maximilian Balandat, Rylan Conway, Patrick Huber, Chinnadhurai Sankar, Ayushi Dalmia, Zechun Liu, Lemeng Wu, Tarek Elgamal, Adithya Sagar, Vikas Chandra, Raghuraman Krishnamoorthi 4/29/2026

MobileLLM-Flash: Latency-Guided On-Device LLM Design for Industry Scale Deployment

MobileLLM-Flash: Hardware-in-the-loop architecture search for designing efficient on-device LLMs with real-time latency constraints for mobile deployment.

Ax Huaiyang Wang, Xiaojie Li, Deqing Wang, Haoyi Zhou, Zixuan Huang, Yaodong Yang, Jianxin Li, Yikun Ban 4/29/2026

Policy Improvement Reinforcement Learning

Policy Improvement Reinforcement Learning method verifying actual performance gains in LLM post-training, replacing open-loop optimization with closed-loop verification.

Ax Alexandra Dragomir, Ioana Pintilie, Antonio Barbalau, Marius Dragoi, Florin Brad, Cristian Daniel Paduraru, Alexandru Tifrea, Elena Burceanu, Radu Tudor Ionescu 4/29/2026

JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models

JumpLoRA framework for efficient continual learning in LLMs using sparse low-rank adapters with adaptive interference mitigation to prevent catastrophic forgetting.

Ax Brooks Kinch, Xiaozhe Hu, Yilong Huang, Martine Dyring Hansen, Sunniva Meltzer, Nathaniel Donald Hamlin, David Sirajuddin, Eric C. Cyr, Nathaniel Trask 4/29/2026

A Hybridizable Neural Time Integrator for Stable Autoregressive Forecasting

Hybrid technique embedding autoregressive transformers in finite element schemes for stable long-horizon forecasting of chaotic dynamical systems.

Ax Zhicheng Ma, Xiang Liu, Zhaoxiang Liu, Ning Wang, Yi Shen, Kai Wang, Shuming Shi, Shiguo Lian 4/29/2026

Mixture of Heterogeneous Grouped Experts for Language Modeling

Mixture-of-Experts architecture with heterogeneous expert sizes that adapts computational costs to varying token-level complexity in LLMs.