Ax Ping Guo, Tiantian Zhang, Xi Lin, Xiang Li, Zhi-Ri Tang, Qingfu Zhang 3/13/2026

Few-for-Many Personalized Federated Learning

arXiv paper on personalized federated learning (PFL) using multi-objective optimization to train customized models across clients with heterogeneous data.

Ax Yixin Liu, Yue Yu, DiJia Su, Sid Wang, Xuewei Wang, Song Jiang, Bo Liu, Arman Cohan, Yuandong Tian, Zhengxing Chen 3/13/2026

Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training

Study examining reasoning LLMs used as judges for evaluating non-verifiable domains in post-training, testing inference-time scaling benefits for policy training.

Ax Cornelius V. Braun, Robert T. Lange, Marc Toussaint 3/13/2026

Stein Variational Evolution Strategies

Gradient-free variant of Stein Variational Gradient Descent combining evolution strategies for sampling from unnormalized distributions.

Ax Jun Liu, Zhenglun Kong, Peiyan Dong, Changdi Yang, Tianqi Li, Hao Tang, Geng Yuan, Wei Niu, Wenbin Zhang, Pu Zhao, Xue Lin, Dong Huang, Yanzhi Wang 3/13/2026

Structured Agent Distillation for Large Language Model

Framework for compressing large LLM-based ReAct agents into smaller student models while preserving reasoning and action consistency.

Ax Ozgur Guldogan, Neeraj Sarna, Yuanyuan Li, Michael Berger 3/13/2026

Counterfactually Fair Conformal Prediction

Development of conformal prediction method that ensures counterfactual fairness in prediction sets for fair decision-making under uncertainty.

Ax Jose Javier Gonzalez Ortiz, Abhay Gupta, Christopher Rinard, Davis Blalock 3/13/2026

FlashOptim: Optimizers for Memory-Efficient Training

Introduces FlashOptim, memory-efficient optimizers for mixed-precision neural network training reducing per-parameter memory requirements.

Ax Isotta Magistrali, Fr\'ed\'eric Berdoz, Sam Dauncey, Roger Wattenhofer 3/13/2026

Subliminal Signals in Preference Labels

Shows preference labels in LLM-as-judge training can function as covert communication channels, challenging assumptions about semantic supervision.

Ax Hadi Sotoudeh, Payel Mukhopadhyay, Ruben Ohana, Michael McCabe, Neil D. Lawrence, Shirley Ho, Miles Cranmer 3/13/2026

On the Value of Tokeniser Pretraining in Physics Foundation Models

Investigates tokenizer pretraining impact on physics foundation models for emulating complex multiphysics phenomena in data-limited settings.

Ax Benjamin A. T. Grahama, Lauren Brown, Georgios Chochlakis, Morteza Dehghani, Raquel Delerme, Brittany Friedman, Ellie Graeden, Preni Golazizian, Rajat Hebbar, Parsa Hejabi, Aditya Kommineni, Mayag\"uez Salinas, Michael Sierra-Ar\'evalo, Jackson Trager, Nicholas Weller, Shrikanth Narayanan 3/13/2026

Community-Informed AI Models for Police Accountability

AI system analyzing police bodycam footage at scale to assess officer-public interactions and improve government accountability.

Ax Nadav Kunievsky, James A. Evans 3/13/2026

Measuring Intent Comprehension in LLMs

Research paper on measuring whether LLMs comprehend user intent beyond surface-level text patterns, addressing training-inference gaps in language models.

Ax Sayan Nag, K J Joseph, Koustava Goswami, Vlad I Morariu, Balaji Vasan Srinivasan 3/13/2026

Agentic Design Review System

Agentic Design Review System orchestrates multiple AI agents to collaboratively analyze graphic designs with meta-agent coordination.