Ax Zhiyuan Zhai, Xiaojun Yuan, Wei Ni, Xin Wang, Rui Zhang, Geoffrey Ye Li 2/24/2026

Event-Triggered Gossip for Distributed Learning

Event-triggered gossip framework for distributed learning that reduces inter-node communication overhead.

Ax Shirui Chen, Cole Harrison, Ying-Chun Lee, Angela Jin Yang, Zhongzheng Ren, Lillian J. Ratliff, Jiafei Duan, Dieter Fox, Ranjay Krishna 2/24/2026

TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics

TOPReward uses token probabilities from Vision-Language-Action models as zero-shot reward signals for robotics reinforcement learning without task-specific training.

Ax Yirou Ge, Yixi Li, Alec Chiu, Shivani Shekhar, Zijie Pan, Avinash Thangali, Yun-Shiuan Chuang, Chaitanya Kulkarni, Uma Kona, Linsey Pang, Prakhar Mehrotra 2/24/2026

Ada-RS: Adaptive Rejection Sampling for Selective Thinking

Adaptive Rejection Sampling framework for selective reasoning in LLMs, reducing token waste on simple requests while maintaining chain-of-thought benefits.

Ax Arundhati Banerjee, Jeff Schneider 2/24/2026

Cost-Aware Diffusion Active Search

Cost-aware active search algorithm for autonomous agents to balance exploration and exploitation with unknown target recovery.

Ax Jeffrey Li, Josh Gardner, Doug Kang, Fangping Shi, Karanjeet Singh, Chun-Liang Li, Herumb Shandilya, David Hall, Oncel Tuzel, Percy Liang, Ludwig Schmidt, Hadi Pour Ansari, Fartash Faghri 2/24/2026

Beyond a Single Extractor: Re-thinking HTML-to-Text Extraction for LLM Pretraining

Investigates HTML-to-text extraction methods for LLM pretraining datasets, showing single extractors lead to suboptimal web data coverage.

Ax Jiayu Wang, Yifei Ming, Zixuan Ke, Shafiq Joty, Aws Albarghouthi, Frederic Sala 2/24/2026

SkillOrchestra: Learning to Route Agents via Skill Transfer

SkillOrchestra system for routing across multiple AI agents via learned skill transfer, reducing routing collapse in multi-turn conversations.

Ax Maijunxian Wang, Ruisi Wang, Juyi Lin, Ran Ji, Thadd\"aus Wiedemer, Qingying Gao, Dezhi Luo, Yaoyao Qian, Lianyu Huang, Zelong Hong, Jiahui Ge, Qianli Ma, Hang He, Yifan Zhou, Lingzi Guo, Lantao Mei, Jiachen Li, Hanwen Xing, Tianqi Zhao, Fengyuan Yu, Weihang Xiao, Yizheng Jiao, Jianheng Hou, Danyang Zhang, Pengcheng Xu, Boyang Zhong, Zehong Zhao, Gaoyun Fang, John Kitaoka, Yile Xu, Hua Xu, Kenton Blacutt, Tin Nguyen, Siyuan Song, Haoran Sun, Shaoyue Wen, Linyang He, Runming Wang, Yanzhi Wang, Mengyue Yang, Ziqiao Ma, Rapha\"el Milli\`ere, Freda Shi, Nuno Vasconcelos, Daniel Khashabi, Alan Yuille, Yilun Du, Ziming Liu, Bo Li, Dahua Lin, Ziwei Liu, Vikash Kumar, Yijiang Li, Lei Yang, Zhongang Cai, Hokin Deng 2/24/2026

A Very Big Video Reasoning Suite

Benchmark suite for evaluating video reasoning capabilities of models, focusing on spatiotemporal consistency and reasoning beyond visual quality.