Ax Maksym Del, Markus K\"angsepp, Marharyta Domnich, Ardi Tampuu, Lisa Yankovskaya, Meelis Kull, Mark Fishel 3/20/2026

How Uncertainty Estimation Scales with Sampling in Reasoning Models

Studies how uncertainty estimation scales with parallel sampling in reasoning models using self-consistency and verbalized confidence across mathematics and STEM tasks.

Ax Qiang Li, XiangRui Zhang, Haining Wang 3/20/2026

Implicit Patterns in LLM-Based Binary Analysis

Large-scale trace-level study showing multi-pass LLM reasoning in binary vulnerability analysis exhibits structured, token-level exploration patterns across hundreds of steps.

Ax Zehao Li, Zhenyu Wu, Yibo Zhao, Bowen Yang, Jingjing Xie, Zhaoyang Liu, Zhoumianze Liu, Kaiming Jin, Jianze Liang, Zonglin Li, Feng Wu, Bowen Zhou, Zun Wang, Zichen Ding 3/20/2026

OS-Themis: A Scalable Critic Framework for Generalist GUI Rewards

OS-Themis: scalable multi-agent critic framework using decomposed trajectory milestones for training robust GUI agents with reinforcement learning.

Ax Zhenwei Tang, Arun Verma, Zijian Zhou, Zhaoxuan Wu, Alok Prakash, Daniela Rus, Bryan Kian Hsiang Low 3/20/2026

MineDraft: A Framework for Batch Parallel Speculative Decoding

MineDraft framework for batch parallel speculative decoding to accelerate LLM inference by parallelizing draft and verification stages.

Ax Thomas Duboudin, Xavier Fontaine, Etienne Andrier, Lionel Guillou, Alexandre Filiot, Thalyssa Baiocco-Rodrigues, Antoine Olivier, Alberto Romagnoni, John Klein, Jean-Baptiste Schiratti 3/20/2026

CytoSyn: a Foundation Diffusion Model for Histopathology -- Tech Report

CytoSyn: Foundation diffusion model for computational histopathology enabling cell segmentation and tumor analysis from digitized slides.

Ax Jing Wang, Jie Shen, Amar Sra, Qiaomin Xie, Jeremy C Weiss 3/20/2026

LLM-Augmented Computational Phenotyping of Long Covid

Grace Cycle: LLM-augmented computational phenotyping framework for discovering clinical subtypes in Long COVID through iterative hypothesis generation and evidence extraction.

Ax Marwa Abdulhai, Isadora White, Yanming Wan, Ibrahim Qureshi, Joel Leibo, Max Kleiman-Weiner, Natasha Jaques 3/20/2026

How LLMs Distort Our Written Language

User study demonstrating that extensive LLM use for writing assistance alters voice, tone, and meaning of human text with 70% increase in essay length.

Ax Xavier Cadet, Aditya Vikram Singh, Harsh Mamania, Edward Koh, Alex Fitts, Dirk Van Bruggen, Simona Boboila, Peter Chin, Alina Oprea 3/20/2026

Retrieval-Augmented LLMs for Security Incident Analysis

RAG-based system using LLMs for automated cybersecurity incident analysis through targeted log filtering across multiple data sources.