Ax Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev, Vyacheslav Zhdanovskiy, Yegor Yershov 5/11/2026

KV Cache Offloading for Context-Intensive Tasks

Technique for offloading KV cache to reduce memory and latency bottlenecks in long-context LLM inference while maintaining accuracy.

Ax Sichun Luo, Yi Huang, Haochen Luo, Fengyuan Liu, Guanzhi Deng, Lei Li, Qinghua Yao, Zefa Hu, Junlan Feng, Qi Liu 5/11/2026

SeaEvo: Advancing Algorithm Discovery with Strategy Space Evolution

SeaEvo uses LLM-guided evolutionary search for algorithm discovery with persistent population-level state management and structured reasoning.

Ax Daniel Song, Peter Ney, Cristina Menghini, Faizan Ahmad, Aidan Boyd, Nathaniel Li, Ziwen Han, Jean-Christophe Testud, Saisuke Okabayashi, Maeve Ryan, Jinpeng Miao, Hamza Kwisaba, Felix Binder, Spencer Whitman, Jim Gust, Esteban Arcaute, Dhaval Kapil, Jacob Kahn, Ayaz Minhas, Tristan Goodman, Lauren Deason, Alexander Vaughan, Shengjia Zhao, Summer Yue 5/11/2026

Code World Model Preparedness Report

Meta's Code World Model preparedness assessment for frontier risks including code generation, reasoning, and misalignment evaluation.

Ax Ruiyang Qin, Qingzhuo Wang, Dongrui Liu, Qiang Li, Zhihua Wei, Wen Shen 5/11/2026

Multilingual Safety Alignment via Self-Distillation

Cross-lingual safety alignment framework using self-distillation to transfer safeguards from high-resource to low-resource languages in LLMs.

Ax Nadav Timor, Ravid Shwartz-Ziv, Micah Goldblum, Yann LeCun, David Harel 5/11/2026

On Training in Imagination

Analysis of model-based RL training on imagined trajectories, quantifying effects of dynamics and reward model errors on policy optimization.

Ax Kuo-Chung Peng, Samuel Yen-Chi Chen, Jiun-Cheng Jiang, Chen-Yu Liu, En-Jui Kuo, Yun-Yuan Wang, Prayag Tiwari, Andrea Ceschini, Chi-Sheng Chen, Yu-Chao Hsu, Chun-Hua Lin, Tai-Yue Li, Antonello Rosato, Massimo Panella, Simon See, Saif Al-Kuwari, Kuan-Cheng Chen, Nan-Yow Chen, Hsi-Sheng Goan 5/11/2026

Gated QKAN-FWP: Scalable Quantum-inspired Sequence Learning

Quantum-inspired fast weight programmer combining KAN and quantum circuits for scalable sequence learning on NISQ devices.

Ax Abhijit Sen, Bikram Keshari Parida, Giridas Maiti, Mahima Arya, Denys I. Bondar 5/11/2026

Geometric Kolmogorov--Arnold Network (GeoKAN)

Geometric Kolmogorov-Arnold Networks using learned Riemannian metrics for geometry-aware approximation in input space warping.

Ax Ismam Nur Swapnil, Aranya Saha, Tanvir Ahmed Khan, Mohammad Ariful Haque, Ser-Nam Lim 5/11/2026

Gradient Extrapolation-Based Policy Optimization

Gradient Extrapolation-Based Policy Optimization for efficient LLM reasoning improvement, reducing computational cost versus multi-step lookahead.

Ax Florin Gogianu, Adrian Catalin Lutu, Razvan Pascanu 5/11/2026

Revisiting Adam for Streaming Reinforcement Learning

Adam optimizer revisited for streaming reinforcement learning without replay buffers, enabling online policy updates from continuous interactions.

Ax Naihe Feng, Yi Sui, Shiyi Hou, Ga Wu, Jesse C. Cresswell 5/11/2026

Conformal Agent Error Attribution

Error attribution framework for multi-agent LLM systems using conformal prediction with distribution-free coverage guarantees.