Ax Mahir Demir, Atahan Cilan, Seyyid Osman Sevgili, \"Ozg\"un Can Y\"ur\"utken, \"Umit Can Bekar 4/28/2026

An Aircraft Upset Recovery System with Reinforcement Learning

Pilot-Activated Recovery System using soft-actor critic reinforcement learning with hyperparameter optimization for aircraft upset recovery.

Ax Michal Valko, Alexandra Carpentier, R\'emi Munos 4/28/2026

Stochastic simultaneous optimistic optimization

Global optimization algorithm for noisy function evaluation requiring only weak local smoothness assumptions without prior knowledge.

Ax Jiachen Liu, Jiaxin Pei, Jintao Huang, Chenglei Si, Ao Qu, Xiangru Tang, Runyu Lu, Lichang Chen, Xiaoyan Bai, Haizhong Zheng, Carl Chen, Zhiyang Chen, Haojie Ye, Yujuan Fu, Zexue He, Zijian Jin, Zhenyu Zhang, Shangquan Sun, Maestro Harmon, John Dianzhuo Wang, Jianqiao Zeng, Jiachen Sun, Mingyuan Wu, Baoyu Zhou, Yuchen You, Shijian Lu, Yiming Qiu, Fan Lai, Yuan Yuan, Yao Li, Junyuan Hong, Ruihao Zhu, Beidi Chen, Alex Pentland, Ang Chen, Mosharaf Chowdhury, Zechen Zhang 4/28/2026

The Last Human-Written Paper: Agent-Native Research Artifacts

Proposes agent-native research artifacts to address limitations of traditional scientific papers, enabling AI agents to access experimental branching and engineering details.

Ax Nirmit Joshi, Roey Magen, Nathan Srebro, Nikolaos Tsilivis, Gal Vardi 4/28/2026

Learning to Think from Multiple Thinkers

Research on learning from Chain-of-Thought supervision across multiple different solution approaches to improve model generalization on tasks like math problems.

Ax Rahul Jain, Pierre Trepagnier, Rick Gentile, Joey Botero, Alexia Schulz 4/28/2026

Applied AI-Enhanced RF Interference Rejection

arXiv paper on deep learning for RF interference rejection in signal detection and demodulation across varying SINR levels.