Ax Sadra Sabouri, Zeinabsadat Saghi, Run Huang, Sujay Maladi, Esmeralda Eufracio, Sumit Gulwani, Souti Chattopadhyay 4/23/2026

Auditing and Controlling AI Agent Actions in Spreadsheets

System for auditing and controlling AI agent actions in spreadsheets during execution with user oversight.

Ax Zehong Ke, Yanbo Jiang, Jinhao Li, Zhiyuan Liu, Yiqian Tu, Qingwen Meng, Heye Huang, Jianqiang Wang 4/23/2026

From Scene to Object: Text-Guided Dual-Gaze Prediction

Text-guided dual-gaze prediction model for interpretable driver attention using Vision-Language Models with scene-to-object semantic reasoning.

Ax Wenhong Zhu, Ruobing Xie, Rui Wang, Pengfei Liu 4/23/2026

Hybrid Policy Distillation for LLMs

Hybrid Policy Distillation framework unifying knowledge distillation methods for LLM compression, reformulating KD as reweighted token-level log-likelihood objective.

Ax Adriana Aida, Walida Amer, Katarina Bankovic, Dhruv Behl, Fabian Busch, Annie Bhalla, Minh Duong, Florian Gienger, Rohan Godse, Denis Grachev, Ralf Gulde, Elisa Hagensieker, Junpeng Hu, Shivam Joshi, Tobias Knoblauch, Likith Kumar, Damien LaRocque, Keerthana Lokesh, Omar Moured, Khiem Nguyen, Christian Preyss, Ranjith Sriganesan, Vikram Singh, Carsten Sponner, Anh Tong, Dominik Tuscher, Marc Tuscher, Pavan Upputuri 4/23/2026

Cortex 2.0: Grounding World Models in Real-World Industrial Deployment

Cortex 2.0 robotic system shifting from reactive Vision-Language-Action models to proactive world models for long-horizon manipulation tasks across embodiments.

Ax Ryo Tamura, Haruhiko Morito, Yuna Oikawa, Guillaume Deffrennes, Shoichi Matsuda, Naruki Yoshikawa, Tomoaki Takayama, Taichi Abe, Koji Tsuda, Kei Terayama 4/23/2026

LLM-guided phase diagram construction through high-throughput experimentation

LLM used as experimental planner in closed-loop system for phase diagram construction of multicomponent alloys via high-throughput synthesis and X-ray diffraction.

Ax Valentin Gabeur, Shangbang Long, Songyou Peng, Paul Voigtlaender, Shuyang Sun, Yanan Bao, Karen Truong, Zhicheng Wang, Wenlei Zhou, Jonathan T. Barron, Kyle Genova, Nithish Kannen, Sherry Ben, Yandong Li, Mandy Guo, Suhas Yogin, Yiming Gu, Huizhong Chen, Oliver Wang, Saining Xie, Howard Zhou, Kaiming He, Thomas Funkhouser, Jean-Baptiste Alayrac, Radu Soricut 4/23/2026

Image Generators are Generalist Vision Learners

Demonstrates that image generators develop strong zero-shot visual understanding capabilities through generative pretraining, similar to emergent LLM abilities.

Ax Changho Han (Medical Big Data Research Center, Seoul National University Medical Research Center, Seoul National University College of Medicine, Seoul, Republic of Korea), Songsoo Kim (Department of Biomedical Systems Informatics, Yonsei University College of Medicine, Seoul, Republic of Korea), Dong Won Kim (Department of Biomedical Systems Informatics, Yonsei University College of Medicine, Seoul, Republic of Korea), Leo Anthony Celi (Laboratory for Computational Physiology, Massachusetts Institute of Technology, Cambridge, MA, USA, Department of Biostatistics, Harvard T.H. Chan School of Public Health, Boston, MA, USA), Jaewoong Kim (Department of Biomedical Systems Informatics, Yonsei University College of Medicine, Seoul, Republic of Korea), SungA Bae (Department of Cardiology, Yongin Severance Hospital, Yonsei University College of Medicine, Yongin, Republic of Korea, Center for Digital Health, Yongin Severance Hospital, Yonsei University Health System, Yongin, Republic of Korea), Dukyong Yoon (Department of Biomedical Systems Informatics, Yonsei University College of Medicine, Seoul, Republic of Korea, Institute for Innovation in Digital Healthcare, Severance Hospital, Seoul, Republic of Korea) 4/23/2026

Surrogate modeling for interpreting black-box LLMs in medical predictions

Surrogate modeling framework to interpret and explain knowledge encoded in black-box LLMs for medical prediction tasks.

Ax Alessio Palma, Indro Spinelli, Vignesh Prasad, Luca Scofano, Yufeng Jin, Georgia Chalvatzaki, Fabio Galasso 4/23/2026

Bimanual Robot Manipulation via Multi-Agent In-Context Learning

Using in-context learning with LLMs to enable bimanual robot manipulation without task-specific training, addressing coordination constraints in high-dimensional action spaces.

Ax Deevashwer Rathee, Jean-Luc Watson, Zirui Neil Zhao, G. Edward Suh, Raluca Ada Popa 4/23/2026

Onyx: Cost-Efficient Disk-Oblivious ANN Search

Research paper on Onyx, a cost-efficient disk-based approximate nearest neighbor search for sensitive data using oblivious RAM techniques.

Ax Leonardo Kuffo, Ioanna Tsakalidou, Roberta De Viti, Albert Angel, Ji\v{r}\'i I\v{s}a, Rastislav Lenhardt 4/23/2026

Semantic Recall for Vector Search

Paper introduces Semantic Recall metric for evaluating approximate nearest neighbor search by filtering semantically irrelevant objects.