Ax Masahiro Kato 3/2/2026

General Bayesian Policy Learning

General Bayes framework for policy learning where decision rules are the target rather than outcome prediction.

Ax Nathanael Jo, Nikhil Garg, Manish Raghavan 3/2/2026

The Subjectivity of Monoculture

Analysis of monoculture in LLMs showing agreement metrics depend on subjective baseline assumptions for independence.

Ax Shengqu Cai, Weili Nie, Chao Liu, Julius Berner, Lvmin Zhang, Nanye Ma, Hansheng Chen, Maneesh Agrawala, Leonidas Guibas, Gordon Wetzstein, Arash Vahdat 3/2/2026

Mode Seeking meets Mean Seeking for Fast Long Video Generation

Proposes training paradigm decoupling local fidelity from long-term coherence for scaling video generation from seconds to minutes.

Ax Zhuoran Li, Xun Wang, Hai Zhong, Qingxin Xia, Lihua Zhang, Longbo Huang 3/2/2026

OM2P: Offline Multi-Agent Mean-Flow Policy

Offline multi-agent reinforcement learning using efficient flow-based policies for time-sensitive deployment.

Ax Haining Pan, James V. Roggeveen, Erez Berg, Juan Carrasquilla, Debanjan Chowdhury, Surya Ganguli, Federico Ghimenti, Juraj Hasik, Henry Hunt, Hong-Chen Jiang, Mason Kamb, Ying-Jer Kao, Ehsan Khatami, Michael J. Lawler, Di Luo, Titus Neupert, Xiaoliang Qi, Michael P. Brenner, Eun-Ah Kim 3/2/2026

CMT-Benchmark: A Benchmark for Condensed Matter Theory Built by Expert Researchers

Benchmark dataset of 50 condensed matter theory problems for evaluating LLMs on advanced research-level physics problem-solving.