Ax Michael S. Lee, Yash Maurya, Drew Rein, Bert Herring, Jonathan Nguyen, Kyungho Song, Udari Madhushani Sehwag, Jiyeon Cho, Kaustubh Deshpande, Yeongkyun Jang, Jiyeon Joo, Minn Seok Choi, Evi Fuelle, Christina Q Knight, Joseph Brandifino, Max Fenkell 5/15/2026

ROK-FORTRESS: Measuring the Effect of Geopolitical Transcreation for National Security and Public Safety

Benchmark dataset for evaluating multilingual LLM safety in national security and public safety contexts across diverse language-geopolitical pairs.

Ax Kai Guo, Xinnan Dai, Zhibo Zhang, Nuohan Lin, Shenglai Zeng, Jie Ren, Haoyu Han, Jiliang Tang 5/15/2026

Why Retrieval-Augmented Generation Fails: A Graph Perspective

Research study examining failure modes of RAG systems through a graph-based lens, analyzing how retrieved evidence influences LLM answer generation.

Ax Andrew Lanpouthakoun, Aryaman Arora, Zhengxuan Wu, Dhruv Pai, Ben Keigwin, Dan Jurafsky, Christopher Potts 5/15/2026

PreFT: Prefill-only finetuning for efficient inference

Prefill-only finetuning method enabling efficient personalized LLM serving without throughput degradation from user-specific adapters.

Ax Jerem\'ias Figueiredo Paschmann, Juan Kaplan, Francisco Nattero Santiago Mauricio Barron Bucolo, Juan Wisznia, Luciano del Corro 5/15/2026

Active Learners as Efficient PRP Rerankers

Active learning approach to improve pairwise ranking prompting from LLMs by reframing as efficient reranking problem.

Ax Julien Piet, Annabella Chow, Yiwei Hou, Muxi Lyu, Sylvie Venuto, Jinhao Zhu, Raluca Ada Popa, David Wagner 5/15/2026

Web Agents Should Adopt the Plan-Then-Execute Paradigm

Web agents should use plan-then-execute paradigm instead of ReAct, committing to task-specific programs before observing web content to avoid injection attacks.

Ax Fangyuan Yu, Xin Su, Amir Abdullah 5/15/2026

Dynamic Latent Routing

Dynamic Latent Routing: Language model post-training method using General Dijkstra Search for temporal composition of sub-policies in MDPs.

Ax Xiang Shen, Yuhang Zhou, Yifan Wu, Zhuokai Zhao, Siyu Lin, Lei Huang, Qianqian Zhong, Lizhu Zhang, Benyu Zhang, Xiangjun Fan, Hong Yan 5/15/2026

Agentic Recommender System with Hierarchical Belief-State Memory

MARS framework for memory-augmented LLM agents in recommendation systems using structured belief-state memory with lifecycle management.

Ax Letian Yang (Shanghai Jiao Tong University, Shanghai, China), Xu Liu (Shanghai Jiao Tong University, Shanghai, China), Yiqiang Lu (Ant Group, Shanghai, China), Jian Liu (Ant Group, Shanghai, China), Weiqiang Wang (Ant Group, Shanghai, China), Shuai Li (Shanghai Jiao Tong University, Shanghai, China) 5/15/2026

ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization

Offline-to-online reinforcement learning approach using bi-level optimization for adaptive data mixing across training stages.