Ax Fengqing Jiang, Fengbo Ma, Zhangchen Xu, Yuetai Li, Zixin Rao, Bhaskar Ramasubramanian, Luyao Niu, Bo Li, Xianyan Chen, Zhen Xiang, Radha Poovendran 4/7/2026

SoSBench: Benchmarking Safety Alignment on Six Scientific Domains

SoSBench benchmarks safety alignment of LLMs across six scientific domains with sophisticated risks beyond basic misuse scenarios.

Ax Patrick Vossler, Fan Xia, Yifan Mai, Adarsh Subbaswamy, Jean Feng 4/7/2026

LLMs Judging LLMs: A Simplex Perspective

Studies the problem of using LLMs as judges for evaluating LLM outputs, addressing epistemic uncertainty in judge quality beyond sampling variability.

Ax Vincent Grari, Tim Arni, Thibault Laugel, Sylvain Lamprier, James Zou, Marcin Detyniecki 4/7/2026

ACT: Agentic Classification Tree

Agentic Classification Tree (ACT) combining LLMs with decision trees for transparent, interpretable decisions on unstructured data.

Ax Stefano Goria, Levent A. Meng\"ut\"urk, Murat C. Meng\"ut\"urk, Berkan Sesen 4/7/2026

Random-Bridges as Stochastic Transports for Generative Models

Random-bridges framework for generative models using stochastic processes conditioned on target distributions for flexible transport between distributions.