Ax Yifei Zhang, Xu Yang, Xiao Yang, Bowen Xian, Qizheng Li, Shikai Fang, Jingyuan Li, Jian Wang, Mingrui Xu, Weiqing Liu, Jiang Bian 3/11/2026

Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search

LLM-based agent (GOME) for machine learning engineering using gradient-based reasoning instead of tree search for efficient optimization.

Ax Martino Ciaperoni, Collin Leiber, Aristides Gionis, Heikki Mannila 3/11/2026

Khatri-Rao Clustering for Data Summarization

Clustering algorithm for data summarization using Khatri-Rao product to reduce redundancies in centroid-based cluster prototypes.

Ax Shaobo Wang, Youxin Jiang, Tianle Niu, Yantai Yang, Ruiji Zhang, Shuhao Hu, Shuaiyu Zhang, Chenghao Sun, Weiya Li, Conghui He, Xuming Hu, Linfeng Zhang 3/11/2026

DRUPI: Dataset Reduction Using Privileged Information

DRUPI: dataset reduction method using privileged information beyond input-label pairs for dataset condensation tasks.

Ax Tobias J\"ulg, Pierre Krack, Seongjin Bien, Yannik Blei, Khaled Gamal, Ken Nakahara, Johannes Hechtl, Roberto Calandra, Wolfram Burgard, Florian Walter 3/11/2026

Robot Control Stack: A Lean Ecosystem for Robot Learning at Scale

Robot Control Stack ecosystem for scalable vision-language-action model training and deployment, replacing traditional robotics frameworks.

Ax Yen-Ju Lu, Yashesh Gaur, Wei Zhou, Benjamin Muller, Jesus Villalba, Najim Dehak, Luke Zettlemoyer, Gargi Ghosh, Mike Lewis, Srinivasan Iyer, Duc Le 3/11/2026

Latent Speech-Text Transformer

Latent Speech-Text Transformer improving compute efficiency of speech-text models by reducing token sequence length through latent representations.

Ax Zhanke Zhou, Chentao Cao, Xiao Feng, Xuan Li, Zongze Li, Xiangyu Lu, Jiangchao Yao, Weikai Huang, Tian Cheng, Jianghangfan Zhang, Tangyu Jiang, Linrui Xu, Yiming Zheng, Brando Miranda, Tongliang Liu, Sanmi Koyejo, Masashi Sugiyama, Bo Han 3/11/2026

AlphaApollo: A System for Deep Agentic Reasoning

AlphaApollo agentic reasoning system addressing reasoning capacity and verification bottlenecks through multi-turn reasoning and trustworthy tool integration.

Ax Siddharth Boppana, Annabel Ma, Max Loeffler, Raphael Sarfati, Eric Bigelow, Atticus Geiger, Owen Lewis, Jack Merullo 3/11/2026

Reasoning Theater: Disentangling Model Beliefs from Chain-of-Thought

Analysis of performative chain-of-thought in reasoning models, showing models generate tokens without revealing internal beliefs via activation probing.

Ax Zijie Yan (NVIDIA), Hongxiao Bai (NVIDIA), Xin Yao (NVIDIA), Dennis Liu (NVIDIA), Tong Liu (NVIDIA), Hongbin Liu (NVIDIA), Pingtian Li (NVIDIA), Evan Wu (NVIDIA), Shiqing Fan (NVIDIA), Li Tao (NVIDIA), Robin Zhang (NVIDIA), Yuzhong Wang (NVIDIA), Shifang Xu (NVIDIA), Jack Chang (NVIDIA), Xuwen Chen (NVIDIA), Kunlun Li (NVIDIA), Yan Bai (NVIDIA), Gao Deng (NVIDIA), Nan Zheng (NVIDIA), Vijay Anand Korthikanti (NVIDIA), Abhinav Khattar (NVIDIA), Ethan He (NVIDIA), Soham Govande (NVIDIA), Sangkug Lym (NVIDIA), Zhongbo Zhu (NVIDIA), Qi Zhang (NVIDIA), Haochen Yuan (NVIDIA), Xiaowei Ren (NVIDIA), Deyu Fu (NVIDIA), Tailai Ma (NVIDIA), Shunkang Zhang (NVIDIA), Jiang Shao (NVIDIA), Ray Wang (NVIDIA), Vasudevan Rengasamy (NVIDIA), Rachit Garg (NVIDIA), Santosh Bhavani (NVIDIA), Xipeng Li (NVIDIA), Chandler Zhou (NVIDIA), David Wu (NVIDIA), Yingcan Wei (NVIDIA), Ashwath Aithal (NVIDIA), Michael Andersch (NVIDIA), Mohammad Shoeybi (NVIDIA), Jiajie Yao (NVIDIA), June Yang (NVIDIA) 3/11/2026

Scalable Training of Mixture-of-Experts Models with Megatron Core

Megatron Core system optimizations for scaling Mixture-of-Experts model training across memory, communication, and computation constraints.

Ax Peter Brodeur, Jacob M. Koshy, Anil Palepu, Khaled Saab, Ava Homiar, Roma Ruparel, Charles Wu, Ryutaro Tanno, Joseph Xu, Amy Wang, David Stutz, Hannah M. Ferrera, David Barrett, Lindsey Crowley, Jihyeon Lee, Spencer E. Rittner, Ellery Wulczyn, Selena K. Zhang, Elahe Vedadi, Christine G. Kohn, Kavita Kulkarni, Vinay Kadiyala, Sara Mahdavi, Wendy Du, Jessica Williams, David Feinbloom, Renee Wong, Tao Tu, Petar Sirkovic, Alessio Orlandi, Christopher Semturs, Yun Liu, Juraj Gottweis, Dale R. Webster, Jo\"elle Barral, Katherine Chou, Pushmeet Kohli, Avinatan Hassidim, Yossi Matias, James Manyika, Rob Fields, Jonathan X. Li, Marc L. Cohen, Vivek Natarajan, Mike Schaekermann, Alan Karthikesalingam, Adam Rodman 3/11/2026

A prospective clinical feasibility study of a conversational diagnostic AI in an ambulatory primary care clinic

Clinical feasibility study of AMIE, an LLM-based conversational AI for patient diagnostic history in real-world primary care workflows.

Ax Ben Rank, Hardik Bhatnagar, Ameya Prabhu, Shira Eisenberg, Karina Nguyen, Matthias Bethge, Maksym Andriushchenko 3/11/2026

PostTrainBench: Can LLM Agents Automate LLM Post-Training?

PostTrainBench benchmarks LLM agents' ability to automate post-training of language models, extending AI agents to AI research automation.