Ax Haotian Zhao, Yuxin Zhang, Songlin Zhou, Stephen S. -T. Yau, Wenyu Zhang, Lun Tian, Tianshu Zhu, Yifeng Huang, Yucheng Zeng, Jingnan Gu, Daxiang Dong, Jianmin Wu 5/5/2026

AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learning

Research on Adaptive Entropy Modulation for training LLM agents via reinforcement learning, addressing credit assignment in multi-turn tasks through intermediate supervision.

Ax Theodore Papamarkou, Pierre Alquier, Matthias Bauer, Wray Buntine, Andrew Davison, Gintare Karolina Dziugaite, Maurizio Filippone, Andrew Y. K. Foong, Vincent Fortuin, Dimitris Fouskakis, Jes Frellsen, Eyke H\"ullermeier, Theofanis Karaletsos, Mohammad Emtiyaz Khan, Nikita Kotelevskii, Salem Lahlou, Yingzhen Li, Fang Liu, Clare Lyle, Thomas M\"ollenhoff, Konstantina Palla, Maxim Panov, Yusuf Sale, Kajetan Schweighofer, Artem Shelmanov, Siddharth Swaroop, Martin Trapp, Willem Waegeman, Andrew Gordon Wilson, Alexey Zaytsev 5/5/2026

Position: agentic AI orchestration should be Bayes-consistent

Position paper arguing agentic AI systems should use Bayesian approaches for the control layer orchestrating LLMs and tools under uncertainty.

Ax Yu Shen, Shiyang Liu, Qihang He, Yihang Cheng, Haining Xie, Zhiming He, Huahua Fan, Xianzhi Tan, Teng Ma, Shaoquan Zhang, Danqing Huang, Fan Jiang, Yang Li, Chongqing Zhao, Peng Chen, Jie Jiang, Bin Cui 5/5/2026

SiriusHelper: An LLM Agent-Based Operations Assistant for Big Data Platforms

SiriusHelper: LLM agent-based operations assistant for big data platforms with RAG and knowledge retrieval optimization.

Ax Jiutian Zeng, Junjie Li, Chengwei Dai, Jie Liang, Zhaoyu Hu, Yiliang Zhang, Ziang Weng, Longtao Huang, Dongjie Zhang, Libin Dong, Yang Ge, Yuanda Wang, Kaiwen Lv Kacuila, Bingyu Zhu, Jing Wang, Jin Xu 5/5/2026

XekRung Technical Report

XekRung: Cybersecurity-focused large language model with specialized data synthesis pipelines and comprehensive training infrastructure.

Ax Shalini Sarode, Brian Moser, Joachim Folz, Federico Raue, Tobias Nauen, Stanislav Frolov, Andreas Dengel 5/5/2026

Hyperspherical Forward-Forward with Prototypical Representations

Novel reformulation of Forward-Forward algorithm using hyperspherical representations to improve inference efficiency for classification.

Ax Enzo S. N. Silva, Pablo B. Costa, Raphael C. Vlasman, Rosimeire P. Costa, Henrique L. P. Silva, Lucas F. A. O. Pellicer, Guilherme Rinaldo, Renato A. Almeida, Darian S. R. Rabbani, Cinthya O. Oestreich, Vinicius F. Carid\'a 5/5/2026

NorBERTo: A ModernBERT Model Trained for Portuguese with 331 Billion Tokens Corpus

NorBERTo: Portuguese language model based on ModernBERT architecture with 331B token training corpus and long-context support.

Ax Sichang Steven He, Calvin Ardi, Ramesh Govindan, Harsha V. Madhyastha 5/5/2026

DeGenTWeb: A First Look at LLM-dominant Websites

Empirical study examining prevalence of LLM-generated content on websites and evaluating detection methods with transparent methodology.

Ax Muhammad Dehan Al Kautsar, Saeed Almheiri, Momina Ahsan, Bilal Elbouardi, Younes Samih, Sarfraz Ahmad, Amr Keleg, Omar El Herraoui, Kareem Elzeky, Abed Alhakim Freihat, Mohamed Anwar, Zhuohan Xie, Junhong Liang, Mohammad Rustom Al Nasar, Preslav Nakov, Fajri Koto 5/5/2026

Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues

Benchmark dataset (ArabCulture-Dialogue) evaluating LLM cultural reasoning in Standard and dialectal Arabic conversations across 13 countries.

Ax Debasis Dwibedy, Avyay Nishtala, Pranathi Mukku, D Snehaja 5/5/2026

Smart Profit-Aware Crop Advisory System: Kisan AI

Kisan AI: crop advisory system that optimizes for farmer profit rather than just biological yield by incorporating market prices.

Ax Aur\'elien B\"uck-Kaeffer (McGill University, Mila - Quebec Artificial Intelligence Institute, Ubisoft La Forge), Sneheel Sarangi (McGill University, Mila - Quebec Artificial Intelligence Institute), Maximilian Puelma Touzel (McGill University, Universit\'e de Montr\'eal), Reihaneh Rabbany (McGill University, Mila - Quebec Artificial Intelligence Institute), Zachary Yang (McGill University, Mila - Quebec Artificial Intelligence Institute, Ubisoft La Forge), Jean-Fran\c{c}ois Godbout (Mila - Quebec Artificial Intelligence Institute, Universit\'e de Montr\'eal) 5/5/2026

The $\textit{Silicon Society}$ Cookbook: Design Space of LLM-based Social Simulations

Systematic analysis of design space for LLM-based social simulations, examining key design decisions and their consequences for simulating human behavior.

Ax Aviral Srivastava, Sourav Panda 5/5/2026

Attention Is Where You Attack

White-box adversarial attack on safety-aligned LLMs using attention redistribution to identify and exploit safety-critical attention heads with nonsemantic tokens.

Ax Osmar Luiz Ferreira de Carvalho, Osmar Ab\'ilio de Carvalho J\'unior, Anesmar Olino de Albuquerque, Daniel Guerreiro e Silva 5/5/2026

Remote SAMsing: From Segment Anything to Segment Everything

Computer vision method extending Segment Anything Model 2 to remote sensing by addressing quality-coverage trade-offs and image tiling challenges for large-scale segmentation.

Ax Jatin Gupta, Akhil Sharma, Saransh Singhania, Ali Imam Abidi 5/5/2026

Retrieval-Augmented Reasoning for Chartered Accountancy

Research on using RAG with LLMs for Indian Chartered Accountancy tasks, addressing reliability and numerical reasoning challenges in jurisdiction-specific financial applications.

Ax Bingzheng Gan, Tianyi Zhang, Yusu Li, Jing Huang, Wei Shi, Yangkai Ding, Tao Yu 5/5/2026

Caracal: Causal Architecture via Spectral Mixing

Caracal replaces attention with O(L log L) Multi-Head Fourier module using FFT for efficient long-sequence LLM scaling.

Ax Xingyu Hu, Kai Zhang, Jiancan Wu, Shuli Wang, Chi Wang, Wenshuai Chen, Yinhua Zhu, Haitao Wang, Xingxing Wang, Xiang Wang 5/5/2026

DynamicPO: Dynamic Preference Optimization for Recommendation

DynamicPO addresses preference optimization collapse in LLM-based recommendation systems by dynamically managing negative samples.

Ax Khizar Qureshi, Geoffrey Martin, Yifan Peng 5/5/2026

Budget-Aware Routing for Long Clinical Text

Budget-aware context selection for clinical text using knapsack-constrained subset selection to meet token cost and latency constraints.