Ax Nicolas Menet, Aleksandar Terzi\'c, Michael Hersche, Andreas Krause, Abbas Rahimi 3/2/2026

Thompson Sampling via Fine-Tuning of LLMs

ToSFiT: Thompson sampling via LLM fine-tuning for Bayesian optimization in large discrete spaces without acquisition function maximization.

Ax Vaibhav Singh, Oleksiy Ostapenko, Pierre-Andr\'e No\"el, Eugene Belilovsky, Torsten Scholak 3/2/2026

DiffuMamba: High-Throughput Diffusion LMs with Mamba Backbone

DiffuMamba: diffusion language model with Mamba backbone for efficient masked sequence modeling, achieving linear-time complexity vs Transformer quadratic overhead.

Ax Timoth\'ee Chauvin, Erwan Le Merrer, Fran\c{c}ois Ta\"iani, Gilles Tredan 3/2/2026

Log Probability Tracking of LLM APIs

Method for monitoring LLM API consistency over time by tracking log probability changes to detect undisclosed model updates.

Ax Sajad Ashkezari 3/2/2026

Robust Online Learning

Online learning framework for training robust classifiers under adversarially chosen clean data and labels.

Ax Daniel Romero-Alvarado, Fernando Mart\'inez-Plumed, Lorenzo Pacchiardi, Hugo Save, Siddhesh Milind Pawar, Behzad Mehrbakhsh, Pablo Antonio Moreno Casares, Ben Slater, Paolo Bova, Peter Romero, Zachary R. Tyler, Jonathan Prunty, Luning Sun, Jose Hernandez-Orallo 3/2/2026

Capabilities Ain't All You Need: Measuring Propensities in AI

Framework for measuring propensities (behavioral tendencies) in AI models beyond capability assessment using Item Response Theory.

Ax Paul Richmond, Prarit Agarwal, Borun Chowdhury, Vasilis Niarchos, Constantinos Papageorgakis 3/2/2026

FeynTune: Large Language Models for High-Energy Theory

20 fine-tuned Llama-3.1 8B variants specialized for High-Energy Physics, trained on arXiv abstracts with comparative domain analysis.

Ax Shuofei Qiao, Yanqiu Zhao, Zhisong Qiu, Xiaobin Wang, Jintian Zhang, Zhao Bin, Ningyu Zhang, Yong Jiang, Pengjun Xie, Fei Huang, Huajun Chen 3/2/2026

Scaling Generalist Data-Analytic Agents

DataMind framework trains scalable generalist data-analytic agents on diverse data formats for multi-step reasoning in scientific discovery.

Ax Constanza Fierro, Fabien Roger 3/2/2026

Steering Language Models with Weight Arithmetic

Contrastive weight steering method edits LLM parameters via weight arithmetic for post-training behavior modification without expensive retraining.