Ax Yunke Ao, Le Chen, Bruce D. Lee, Assefa S. Wahd, Aline Czarnobai, Philipp F\"urnstahl, Bernhard Sch\"olkopf, Andreas Krause 5/1/2026

Bounded Ratio Reinforcement Learning

Bounded Ratio Reinforcement Learning framework bridging trust region theory and PPO's clipped objective.

Ax Jiachen Liu, Jiaxin Pei, Jintao Huang, Chenglei Si, Ao Qu, Xiangru Tang, Runyu Lu, Lichang Chen, Xiaoyan Bai, Haizhong Zheng, Carl Chen, Zhiyang Chen, Haojie Ye, Yujuan Fu, Zexue He, Zijian Jin, Zhenyu Zhang, Shangquan Sun, Maestro Harmon, John Dianzhuo Wang, Jianqiao Zeng, Jiachen Sun, Mingyuan Wu, Baoyu Zhou, Chenyu You, Shijian Lu, Yiming Qiu, Fan Lai, Yuan Yuan, Yao Li, Junyuan Hong, Ruihao Zhu, Beidi Chen, Alex Pentland, Ang Chen, Mosharaf Chowdhury, Zechen Zhang 5/1/2026

The Last Human-Written Paper: Agent-Native Research Artifacts

Research on AI agents as native artifacts that replace traditional linear scientific papers with branching exploration records.

Ax Zhuohan Xie, Daniil Orel, Rushil Thareja, Dhruv Sahnan, Hachem Madmoun, Fan Zhang, Debopriyo Banerjee, Georgi Georgiev, Xueqing Peng, Lingfei Qian, Jimin Huang, Jinyan Su, Aaryamonvikram Singh, Rui Xing, Rania Elbadry, Chen Xu, Haonan Li, Fajri Koto, Ivan Koychev, Tanmoy Chakraborty, Yuxia Wang, Salem Lahlou, Veselin Stoyanov, Sophia Ananiadou, Preslav Nakov 5/1/2026

FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning

FinChain benchmark evaluates chain-of-thought reasoning in financial analysis, emphasizing verifiable intermediate steps beyond final numerical answers.

Ax Santosh Vasa, Aditi Ramadwar, Jnana Rama Krishna Darabattula, Md Zafar Anwar, Stanislaw Antol, Andrei Vatavu, Thomas Monninger, Sihao Ding 5/1/2026

AutoVDC: Automated Vision Data Cleaning Using Vision-Language Models

AutoVDC framework uses vision-language models to automatically identify and clean annotation errors in autonomous driving datasets.

Ax Savini Kashmira, Jayanaka Dantanarayana, Thamirawaran Sathiyalogeswaran, Krisztian Flautner, Lingjia Tang, Jason Mars 5/1/2026

GraphMend: Code Transformations for Fixing Graph Breaks in PyTorch 2

GraphMend compiler technique eliminates FX graph breaks in PyTorch 2, reducing fallbacks to eager mode and improving compilation performance.

Ax Leo Fillioux, Enzo Ferrante, Paul-Henry Courn\`ede, Maria Vakalopoulou, Stergios Christodoulidis 5/1/2026

PVeRA: Probabilistic Vector-Based Random Matrix Adaptation

PVeRA proposes probabilistic vector-based random matrix adaptation for efficient finetuning of large foundation models on small datasets and limited compute.

Ax Yonggan Fu, Lexington Whalen, Zhifan Ye, Xin Dong, Shizhe Diao, Jingyu Liu, Chengyue Wu, Hao Zhang, Enze Xie, Song Han, Maksim Khadkevich, Jan Kautz, Yingyan Celine Lin, Pavlo Molchanov 5/1/2026

Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed

Method to convert pretrained autoregressive language models into efficient diffusion language models for faster parallel generation while maintaining task accuracy.

HN softservo 5/1/2026

Text-to-CAD

Open source harness for generating 3D CAD models using coding agents like Claude and Codex with bundled skills.

LB kmjn.org by mjn 5/1/2026

Porting microgpt to Futhark, Part I

Porting microgpt (GPT-2 implementation) from Python to Futhark, a data-parallel language, to improve scalability and performance.