Ax Yuanda Xu, Hejian Sang, Zhengze Zhou, Ran He, Zhipeng Wang, Alborz Geramifard 4/21/2026

TIP: Token Importance in On-Policy Distillation

Token Importance analysis in on-policy knowledge distillation identifying which token positions provide most useful learning signals for student LLMs.

Ax Yuxi Li, Yi Liu, Yuekang Li, Ling Shi, Gelei Deng, Shengquan Chen, Kailong Wang 4/21/2026

Uncovering Logit Suppression Vulnerabilities in LLM Safety Alignment

Research on logit suppression vulnerabilities in LLM safety alignment, introducing SSAG method to systematically identify and manipulate safety mechanisms in large language models.

Ax Minghao Liu, Zonglin Di, Jiaheng Wei, Zhongruo Wang, Hengxiang Zhang, Ruixuan Xiao, Haoyu Wang, Jinlong Pang, Hao Chen, Ankit Shah, Hongxin Wei, Xinlei He, Zhaowei Zhao, Haobo Wang, Lei Feng, Jindong Wang, James Davis, Yang Liu 4/21/2026

Automatic Dataset Construction (ADC): Sample Collection, Data Curation, and Beyond

Automatic Dataset Construction methodology for large-scale data collection and curation with minimal human annotation.

Ax Timo Klein, Christoph Luther, Manus McAuliffe, Lukas Miklautz, Claudia Plant, Sebastian Tschiatschek 4/21/2026

Plasticity Loss in Deep Reinforcement Learning: A Survey

Survey of plasticity loss in deep reinforcement learning, examining causes and solutions for adaptation failures.

Ax Chien Van Nguyen, Huy Nguyen, Ruiyi Zhang, Hanieh Deilamsalehy, Puneet Mathur, Viet Dac Lai, Haoliang Wang, Jayakumar Subramanian, Ryan A. Rossi, Trung Bui, Nikos Vlassis, Franck Dernoncourt, Thien Huu Nguyen 4/21/2026

Lizard: An Efficient Linearization Framework for Large Language Models

Lizard linearization framework transforms Transformers into subquadratic architectures for efficient long-sequence LLM inference.

Ax Atharva Naik, Lawanya Baghel, Dhakshin Govindarajan, Darsh Agrawal, Yiqing Xie, Daniel Fried, Carolyn Rose 4/21/2026

MetaLint: Easy-to-Hard Generalization for Code Linting

MetaLint: meta-learning framework for code linting that generalizes to unseen best practices using instruction-following LLMs.

Ax Runyang You, Yongqi Li, Meng Liu, Wenjie Wang, Liqiang Nie, Wenjie Li 4/21/2026

Parallel Test-Time Scaling for Latent Reasoning Models

Parallel test-time scaling for latent reasoning LLMs, comparing efficiency of continuous vector space reasoning versus explicit chain-of-thought.

Ax Maria Gonzalez-Calabuig, Kai-Hendrik Cohrs, Vishal Nedungadi, Zuzanna Osika, Ruben Cartuyvels, Steffen Knoblauch, Joppe Massant, Shruti Nath, Patrick Ebel, Vasileios Sitokonstantinou 4/21/2026

SHRUG-FM: Reliability-Aware Foundation Models for Earth Observation

SHRUG-FM: Reliability-aware geospatial foundation models detecting out-of-distribution failures in Earth observation.

Ax Yifan Jiang, Yueying Wang, Rui Zhao, Toufiq Parag, Zhimin Chen, Zhenyu Liao, Jayakrishnan Unnikrishnan 4/21/2026

VIDEOP2R: Video Understanding from Perception to Reasoning

VideoP2R: Process-aware reinforcement fine-tuning framework separating perception and reasoning for video language models.

Ax Mario Markov (INSAIT, Sofia University "St. Kliment Ohridski"), Stefan Maria Ailuro (INSAIT, Sofia University "St. Kliment Ohridski"), Luc Van Gool (INSAIT, Sofia University "St. Kliment Ohridski"), Konrad Schindler (ETH Zurich), Danda Pani Paudel (INSAIT, Sofia University "St. Kliment Ohridski") 4/21/2026

FireScope: Wildfire Risk Prediction with a Chain-of-Thought Oracle

FireScope: Large-scale dataset and chain-of-thought oracle for multimodal wildfire risk prediction from satellite imagery.

Ax Dong Wang, Yang Li, Ansong Ni, Ching-Feng Yeh, Youssef Emad, Xinjie Lei, Liam Robbins, Karthik Padthe, Hu Xu, Xian Li, Asli Celikyilmaz, Ramya Raghavendra, Lifei Huang, Carole-Jean Wu, Shang-Wen Li 4/21/2026

Matrix: Peer-to-Peer Multi-Agent Synthetic Data Generation Framework

Matrix: Peer-to-peer multi-agent framework for coordinated synthetic data generation without centralized orchestrator.