Ax Perry Dong, Qiyang Li, Dorsa Sadigh, Chelsea Finn 5/1/2026

EXPO: Stable Reinforcement Learning with Expressive Policies

Training expressive RL policies like diffusion and flow-matching models using online RL with offline data, addressing gradient stability challenges in complex policy parameterizations.

Ax Elena Celledoni, Brynjulf Owren, Lars Ruthotto, Tianjiao Nicole Yang 5/1/2026

Mixed Precision Training of Neural ODEs

Mixed precision training schemes for neural ODEs balancing low-precision efficiency with stability and accuracy.

Ax Jiangnan Zhu, Yukai Xu, Li Xiong, Yixuan Liu, Junxu Liu, Hong kyu Lee, Yujie Gu 5/1/2026

BicKD: Bilateral Contrastive Knowledge Distillation

BicKD bilateral contrastive knowledge distillation framework combining sample-wise and class-wise probability alignment.