Ax Jasmine Brazilek, Miles Tidmarsh 5/6/2026

Alignment midtraining for animals

Study on LLM value alignment via midtraining using synthetic documents; releases ANIMA evaluation dataset for animal compassion reasoning.

Ax Alexis Kafantaris 5/6/2026

Attractor FCM

Attractor FCM: gradient descent-based fuzzy cognitive map using residual memory and backpropagation through time.

Ax Rohan Surana, Gagan Mundada, Xunyi Jiang, Chuhan Wang, Zhenwei Tang, Difan Jiao, Zihan Huang, Yuxin Xiong, Junda Wu, Sheldon Yu, Xintong Li, Raghav Jain, Nikki Kuang, Sizhe Zhou, Bowen Jin, Zhendong Chu, Tong Yu, Ryan Rossi, Kuan-Hao Huang, Jingbo Shang, Jiawei Han, Julian McAuley 5/6/2026

Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning

Comprehensive survey of rollout strategies in LLM reinforcement learning for reasoning and tool use.

Ax Fang Wu, Weihao Xuan, Heli Qi, Hanqun Cao, Heng-Jui Chang, Zeqi Zhou, Haokai Zhao, Ma Jian, Carl Ma, Yu-Chi Cheng, Kuan Pang, Xiangru Tang, Zehong Wang, Guanlue Li, Hanchen Wang, Kejun Ying, Pan Lu, Chiho Im, Seungju Han, Peng Xia, Tinson Xu, Yinxi Li, Deyao Zhu, Pheng-Ann Heng, Naoto Yokoya, Masashi Sugiyama, Li Erran Li, Jure Leskovec, Yejin Choi 5/6/2026

Proteo-R1: Reasoning Foundation Models for De Novo Protein Design

Reasoning foundation models for de novo protein design with explicit biochemical reasoning.

Ax Zhaoyuan Su, Olatunji Ruwase, Karthik Ganesan, Aurick Qiao, Samyam Rajbhandari, Juncheng Yang, Yue Cheng, Yuxiong He 5/6/2026

ZeRO-Prefill: Zero Redundancy Overheads in MoE Prefill Serving

ZeRO-Prefill optimization reducing distributed execution overhead in mixture-of-experts model serving for prefill-only discriminative tasks.

Ax Ruiyang Qin, Qingzhuo Wang, Dongrui Liu, Qiang Li, Zhihua Wei, Wen Shen 5/6/2026

Multilingual Safety Alignment via Self-Distillation

Cross-lingual safeguard transfer framework improving multilingual safety alignment in LLMs through self-distillation from high-resource languages.