Ax Mario Iacobelli, Adrian Robert Minut, Tommaso Mencattini, Donato Crisostomi, Andrea Santilli, Iacopo Masi, Emanuele Rodol\`a 4/9/2026

Multi-objective Evolutionary Merging Enables Efficient Reasoning Models

Multi-objective evolutionary merging approach to reduce computational overhead of reasoning models while maintaining accuracy with fewer tokens.

Ax Maojiang Su, Po-Chung Hsieh, Weimin Wu, Mingcheng Lu, Jiunhau Chen, Jerry Yao-Chieh Hu, Han Liu 4/9/2026

Discrete Flow Matching Policy Optimization

DoMinO framework unifies reinforcement learning fine-tuning of Discrete Flow Matching models by reformulating sampling as a multi-step MDP.

Ax Basil Kyriacou, Mo Kordzanganeh, Maniraman Periyasamy, Alexey Melnikov 4/9/2026

Soft-Quantum Algorithms

Soft-Quantum Algorithms explores classical simulation of variational quantum circuits for few-qubit problems with large datasets.

Ax Audrey Cheng, Harald Ng, Aaron Kabcenell, Peter Bailis, Matei Zaharia, Lin Ma, Xiao Shi, Ion Stoica 4/9/2026

AI-Driven Research for Databases

AI-Driven Research for Systems uses LLMs to automate database performance optimization through automated code generation instead of manual design.

Ax Evgeny Skvortsov, Yilin Xia, Ojaswa Garg, Shawn Bowers, Bertram Lud\"ascher 4/9/2026

Logical Robots: Declarative Multi-Agent Programming in Logica

Logical Robots: declarative multi-agent programming platform using logic programming language Logica for robot behavior specification combining reactive control and planning.

Ax Yiquan Wu, Yuhang Liu, Yifei Liu, Ang Li, Siying Zhou, Kun Kuang 4/9/2026

Luwen Technical Report

Open-source Chinese legal language model built on Baichuan foundation using continued pretraining and instruction tuning.

Ax Yunhao Feng, Yifan Ding, Yingshui Tan, Boren Zheng, Yanming Guo, Xiaolong Li, Kun Zhai, Yishan Li, Wenke Huang 4/9/2026

SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems

SkillTrojan: backdoor attack framework targeting skill-based agent systems through malicious skill implementations.

Ax Jiang Zhou, Yunhao Wang, Xing Wu, Tinghao Yu, Feng Zhang 4/9/2026

WRAP++: Web discoveRy Amplified Pretraining

WRAP++ improves LLM pretraining through synthetic data rephrasing that captures cross-document relationships and associative context.

Ax Bing Wang, Rui Miao, Chen Shen, Shaotian Yan, Kaiyuan Liu, Ximing Li, Xiaosong Yuan, Sinan Fan, Jun Zhang, Jieping Ye 4/9/2026

On the Step Length Confounding in LLM Reasoning Data Selection

Analysis of step length confounding bias in LLM reasoning dataset selection pipelines used for fine-tuning complex reasoning models on chain-of-thought tasks.