Ax Kun Zhang, Jiaqi Sun, Yiqing Li, Ignavier Ng, Namrata Deka, Shaoan Xie 5/15/2026

SEDGE: Structural Extrapolated Data Generation

SEDGE framework for generating structured data beyond training distribution with conditions for reliable extrapolation.

Ax Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei 5/15/2026

LLMs Should Express Uncertainty Explicitly

Research on training LLMs to explicitly express uncertainty signals within responses during reasoning or at answer time.

Ax Yixian Xu, Yusong Wang, Shengjie Luo, Kaiyuan Gao, Tianyu He, Di He, Chang Liu 5/15/2026

Quotient-Space Diffusion Models

Quotient-Space Diffusion Models leverage symmetry in generative tasks for faster 3D molecule structure generation.

Ax Mohamed Ali Souibgui, Jan Fostier, Rodrigo Abad\'ia-Heredia, Bohdan Denysenko, Christian Marschke, Igor Peric 5/15/2026

LayerBoost: Layer-Aware Attention Reduction for Efficient LLMs

LayerBoost proposes layer-aware attention reduction to improve efficient LLM inference by replacing softmax attention selectively across layers.

Ax Jiazheng Zhang, Ziche Fu, Junrui Shen, Yunbin Zhao, Yunke Zhang, Zhiheng Xi, Long Ma, Chenxin An, Zhihao Zhang, Shichun Liu, Dingwei Zhu, Shihan Dou, Shaofan Liu, Han Li, Wiggin Zhou, Aiden Adams, Tao Gui, Fei Huang, Qi Zhang, Xuanjing Huang 5/15/2026

Entropy Polarity in Reinforcement Fine-Tuning: Direction, Asymmetry, and Control

Theoretical framework of entropy mechanics in LLM reinforcement learning with verifiable rewards analyzing token-level policy updates.

Ax Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal, Joseph E. Gonzalez, Matei Zaharia, Kurt Keutzer, Inderjit S Dhillon, Rishabh Agarwal, Devvrit Khatri 5/15/2026

Learning, Fast and Slow: Towards LLMs That Adapt Continually

Continual learning method combining parameter updates and in-context learning for LLMs to adapt without catastrophic forgetting.

Ax Mingyu Zhang, Lifeng Zhuo, Tianxi Tan, Guocan Xie, Xian Nie, Yan Li, Renjie Zhao, Zizhu He, Ziyu Wang, Jiting Cai, Yong-Lu Li 5/15/2026

IPR-1: Interactive Physical Reasoner

Interactive physical reasoning agent learning human-like causal understanding from game interaction with visual domain gaps.

Ax Xi Wang, Anushri Suresh, Alvin Zhang, Rishi More, William Jurayj, Benjamin Van Durme, Mehrdad Farajtabar, Daniel Khashabi, Eric Nalisnick 5/15/2026

Conformal Thinking: Risk Control for Reasoning on a Compute Budget

Conformal prediction framework for adaptive reasoning in LLMs, controlling risk-accuracy tradeoff when allocating compute budget for inference.

Ax Lin Zheng, Xinyu Li, Qian Liu, Xiachong Feng, Lingpeng Kong 5/15/2026

Proxy Compression for Language Modeling

Proxy compression training scheme for language models preserving efficiency of tokenization while enabling raw-byte inference interface.

Ax Tom Kempton, Julia Rozanova, Parameswaran Kamalaruban, Maeve Madigan, Karolina Wresilo, Yoann L. Launay, David Sutton, Stuart Burrell 5/15/2026

DMAP: A Distribution Map for Text

Framework extracting distribution maps from LLM next-token probabilities for better statistical text analysis beyond perplexity metrics.

Ax Anthony Liang, Yigit Korkmaz, Jiahui Zhang, Minyoung Hwang, Abrar Anwar, Sidhant Kaushik, Aditya Shah, Alex S. Huang, Luke Zettlemoyer, Dieter Fox, Yu Xiang, Anqi Li, Andreea Bobu, Abhishek Gupta, Stephen Tu, Erdem Biyik, Jesse Zhang 5/15/2026

Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons

Scalable reward modeling framework for robotics using trajectory comparisons to handle failed and suboptimal trajectories.

Ax Fei Bai, Huatong Song, Shuang Sun, Daixuan Cheng, Yike Yang, Chuan Hao, Renyuan Li, Feng Chang, Yuan Wei, Ran Tao, Bryan Dai, Jian Yang, Wayne Xin Zhao, Ji-Rong Wen 5/15/2026

ClawGym: A Scalable Framework for Building Effective Claw Agents

Scalable framework for training and evaluating agents in claw-style environments with file systems, tools, and persistent workspace.