Ax Or Ordentlich, Yury Polyanskiy 5/14/2026

High-Rate Quantized Matrix Multiplication II

Quantized matrix multiplication technique for weight-only post-training quantization of LLMs using available covariance information.

Ax Mind Lab, :, Song Cao, Vic Cao, Andrew Chen, Kaijie Chen, Cleon Cheng, Steven Chiang, Kaixuan Fan, Hera Feng, Huan Feng, Arthur Fu, Jun Gao, Hongquan Gu, Aaron Guan, Nolan Ho, Mutian Hong, Hailee Hou, Peixuan Hua, Charles Huang, Miles Jiang, Nora Jiang, Yuyi Jiang, Qiuyu Jin, Fancy Kong, Andrew Lei, Kyrie Lei, Alexy Li, Lucian Li, Ray Li, Theo Li, Zhihui Li, Jiayi Lin, Kairus Liu, Kieran Liu, Logan Liu, Xiang Liu, Irvine Lu, Maeve Luo, Runze Lv, Pony Ma, Verity Niu, Anson Qiu, Vincent Wang, Rio Yang, Maxwell Yao, Carrie Ye, Regis Ye, Wenlin Ye, Josh Ying, Danney Zeng, Yuhan Zhan, Anya Zhang, Di Zhang, Ruijia Zhang, Sueky Zhang, Ya Zhang, Wei Zhao, Ada Zhou, Changhai Zhou, Yuhua Zhou, Xinyue Zhu, Murphy Zhuang 5/14/2026

MinT: Managed Infrastructure for Training and Serving Millions of LLMs

Managed infrastructure system for LoRA post-training and serving of millions of LLM variants using shared base model deployments.

Ax Ying Feng, Piotr Indyk, Michael Kapralov, Dmitry Krachun, Boris Prokhorov 5/14/2026

Provable Quantization with Randomized Hadamard Transform

Theoretical analysis of vector quantization using randomized Hadamard transform for similarity search, federated learning, and KV cache compression.

Ax Luca Maria Del Bono, Giulio Biroli, Patrick Charbonneau, Marylou Gabri\'e 5/14/2026

The critical slowing down in diffusion models

Theoretical analysis of computational complexity in diffusion models using statistical field theory.

Ax Ahmed Heakl, Youssef Mohamed, Abdullah Sohail, Rania Elbadry, Ahmed Nassar, Peter W. J. Staar, Fahad Shahbaz Khan, Imran Razzak, Salman Khan 5/14/2026

DocAtlas: Multilingual Document Understanding Across 80+ Languages

DocAtlas: Multilingual OCR and document understanding benchmark covering 82 languages and 9 evaluation tasks.

Ax Tommaso Giovannelli, Griffin D. Kent 5/14/2026

CHAL: Council of Hierarchical Agentic Language

CHAL proposes hierarchical multi-agent debate framework for LLM reasoning, addressing limitations of majority voting and confidence escalation.

Ax Zhongkai Yu, Yichen Lin, Chenyang Zhou, Yuwei Zhang, Kun Zhou, Junxia Cui, Haotian Ye, Zhengding Hu, Zaifeng Pan, Ruiyi Wang, Yujie Zhao, Hejia Zhang, Jingbo Shang, Jishen Zhao, Yufei Ding 5/14/2026

ChipMATE: Multi-Agent Training via Reinforcement Learning for Enhanced RTL Generation

ChipMATE uses multi-agent reinforcement learning for RTL code generation with self-trained models compatible with vendor security requirements.

Ax Siyuan Zhu, Chao Yu, Rongxin Yang, Zongkai Liu, Jinjun Hu, Qiwen Chen, Yibo Zhang 5/14/2026

GAGPO: Generalized Advantage Grouped Policy Optimization

Generalized Advantage Grouped Policy Optimization for reinforcement learning on LLM agents, improving credit assignment in multi-turn sparse reward settings.

Ax Zetai Cen, Chenfei Gu, Jin Zhu, Ting Li, Yunxiao Chen, Chengchun Shi 5/14/2026

Learning Perturbations to Extrapolate Your LLM

Framework for enhancing LLM extrapolation performance through learnable continuous perturbations in embedding space rather than discrete fixed designs.