Ax Venus Team, Changlong Gao, Zhangxuan Gu, Yulin Liu, Xinyu Qiu, Shuheng Shen, Yue Wen, Tianyu Xia, Zhenyu Xu, Zhengwen Zeng, Beitong Zhou, Xingran Zhou, Weizhi Chen, Sunhao Dai, Jingya Dou, Yichen Gong, Yuan Guo, Zhenlin Guo, Feng Li, Qian Li, Jinzhen Lin, Yuqi Zhou, Linchao Zhu, Liang Chen, Zhenyu Guo, Changhua Meng, Weiqiang Wang 2/25/2026

UI-Venus-1.5 Technical Report

UI-Venus-1.5: GUI agent with 2B, 8B, and 30B-A3B variants for automating digital environment interactions with broad generality and strong task performance.

Ax Matthew Adiletta, Gu-Yeon Wei, David Brooks 2/25/2026

RPU -- A Reasoning Processing Unit

Proposes Reasoning Processing Unit (RPU) architecture to address memory bandwidth bottlenecks in LLM inference, particularly for reasoning applications with long outputs.

Ax Maijunxian Wang, Ruisi Wang, Juyi Lin, Ran Ji, Thadd\"aus Wiedemer, Qingying Gao, Dezhi Luo, Yaoyao Qian, Lianyu Huang, Zelong Hong, Jiahui Ge, Qianli Ma, Hang He, Yifan Zhou, Lingzi Guo, Lantao Mei, Jiachen Li, Hanwen Xing, Tianqi Zhao, Fengyuan Yu, Weihang Xiao, Yizheng Jiao, Jianheng Hou, Danyang Zhang, Pengcheng Xu, Boyang Zhong, Zehong Zhao, Gaoyun Fang, John Kitaoka, Yile Xu, Hua Xu, Kenton Blacutt, Tin Nguyen, Siyuan Song, Haoran Sun, Shaoyue Wen, Linyang He, Runming Wang, Yanzhi Wang, Mengyue Yang, Ziqiao Ma, Rapha\"el Milli\`ere, Freda Shi, Nuno Vasconcelos, Daniel Khashabi, Alan Yuille, Yilun Du, Ziming Liu, Bo Li, Dahua Lin, Ziwei Liu, Vikash Kumar, Yijiang Li, Lei Yang, Zhongang Cai, Hokin Deng 2/25/2026

A Very Big Video Reasoning Suite

Benchmark suite for evaluating video reasoning capabilities in modern video models including spatiotemporal reasoning and scaling behavior.

Ax Dongwei Wang, Jinhee Kim, Seokho Han, Denis Gudovskiy, Yohei Nakata, Tomoyuki Okuno, KhayTze Peong, Kang Eun Jeon, Jong Hwan Ko, Yiran Chen, Huanrui Yang 2/25/2026

MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Elastic LLMs

MoBiQuant enables elastic LLM deployment with token-adaptive mixture-of-bits quantization supporting dynamic precision switching at runtime.

Ax Longhua Li, Lei Qi, Qi Tian, Xin Geng 2/25/2026

Model Merging in the Essential Subspace

ESM framework for merging multiple task-specific fine-tuned models using principal component analysis to reduce task interference.

Ax Zhuofan Josh Ying, Shauli Ravfogel, Nikolaus Kriegeskorte, Peter Hase 2/25/2026

The Truthfulness Spectrum Hypothesis

Study of LLM truthfulness representations across domain-general and domain-specific directions using probe generalization across five truth types.

Ax Wanru Zhao, Lucas Caccia, Zhengyan Shi, Minseon Kim, Weijia Xu, Alessandro Sordoni 2/25/2026

Learning to Solve Complex Problems via Dataset Decomposition

Curriculum learning approach that recursively decomposes complex datasets into simpler components using teacher-student framework with step-by-step reasoning.

Ax Chen Zhang, Jianghui Wang, Bingyang Cheng, Zhongtao Chen, Wendong XU, Cong Wang, Marco Canini, Francesco Orabona, Yik Chung WU, Ngai Wong 2/25/2026

Nonparametric Teaching of Attention Learners

Attention Neural Teaching paradigm to reduce training costs for transformer-based attention learners.

Ax Shubhanshu Shekhar, Mohammad Javad Khojasteh, Ananya Acharya, Tony Tohme, Kamal Youcef-Toumi 2/25/2026

VINA: Variational Invertible Neural Architectures

Research on normalizing flows and invertible neural networks for generative modeling and inverse problems.