Ax Yiheng Zhang, Yiming Wang, Kaiyan Zhao, Zhenglin Wan, Jiayu Chen, Leong Hou U 5/6/2026

ANO: A Principled Approach to Robust Policy Optimization

ANO optimizer unifies trust region frameworks to address PPO's hard clipping trade-off between sample efficiency and optimization stability.

Ax Jianing Wang, Linsen Guo, Zhengyu Chen, Qi Guo, Hongyu Zang, Wenjie Shi, Haoxiang Ma, Xiangyu Xi, Xiaoyu Li, Wei Wang, Xunliang Cai 5/6/2026

HeavySkill: Heavy Thinking as the Inner Skill in Agentic Harness

HeavySkill framework analyzes heavy thinking as the core execution unit in agentic systems with orchestration, memory, skills, and tool use.

Ax Kyle Zheng, Han Zhang, Renliang Sun, Chenchen Ye, Wei Wang 5/6/2026

FitText: Evolving Agent Tool Ecologies via Memetic Retrieval

FitText framework makes tool retrieval dynamic in agent reasoning loops, bridging semantic gaps between task descriptions and API documentation across thousands of endpoints.

Ax Munachiso Samuel Nwadike, Zangir Iklassov, Kareem Ali, Rifo Genadi, Kentaro Inui 5/6/2026

Measuring AI Reasoning: A Guide for Researchers

Guide for evaluating LLM reasoning through adaptive multi-step search rather than final-answer accuracy, formalizing reasoning as search procedures.

Ax Xiyuan Wang, Yi Hu, Yanbo Wang, Chuan Shi, Muhan Zhang 5/6/2026

Position: How can Graphs Help Large Language Models?

Position paper exploring how graph structures can enhance LLM capabilities through knowledge representation, up-to-date information, and improved reasoning.

Ax Abolfazl Mohammadi-Seif, Ricardo Baeza-Yates 5/6/2026

Improving Model Safety by Targeted Error Correction

Dual-classifier GBDT pipeline distinguishes routine errors from high-risk misclassifications in critical ML applications across medical and classification domains.

Ax Ruiqing Zhao, Fengzhi Li, Yuan Zuo, Rui Liu, Yansong Liu, Yunfei Ma, Fanyu Meng, Junlan Feng 5/6/2026

Strategy-Aware Optimization Modeling with Reasoning LLMs

SAGE framework teaches LLMs to choose effective modeling strategies for optimization problems through multi-strategy datasets and supervised fine-tuning.

Ax Alberto Pozanco, Daniel Borrajo, Manuela Veloso 5/6/2026

Counterfactual Reasoning in Automated Planning

Survey of counterfactual reasoning techniques in automated planning for handling deviations from fixed task specifications.

Ax Junjie Yu, Pengrui Lu, Weiye Si, Hongliang Lu, Jiabao Wu, Kaiwen Tao, Kun Wang, Lingyu Yang, Qiran Zhang, Xiuting Guo, Xuanyu Wang, Yang Wang, Yanjie Wang, Yi Yang, Zijian Hu, Ziyi Yang, Zonghan Zhou, Binghao Qiang, Borui Zhang, Chenning Li, Enchang Zhang, Feifan Chen, Feng Jian, Fengyin Sun, Hao Qiu, Hao Zheng, Haoran Zhu, Hongyu Liu, Jianbin Deng, Jiaxin Song, Jiaying Chi, Jiayou Shi, Jie Fang, Jinghui Zhong, Jingyu Zhou, Jinze Li, Junfeng Yi, Junyan Yu, Junzhi Xue, Ni Song, Pengyi Chen, Qi Chen, Quansheng Li, Rui Tao, Shenghai Gong, Shenhang Lu, Tianqi Shen, Tianxiang Zhu, Tiehan Kang, Tingyu Li, Wendi Wu, Xiao Shen, Xiao Zhou, Xiaotao Zhang, Xinrong Li, Xuankun Yang, Xun Zhang, Yan Li, Ye Lu, Yi Wang, Yibo Zhou, Yichi Zhang, Yihao Sun, Yijun Huang, Yixin Zhu, Yixuan Wu, Yuchen Sun, Yue Wu, Yuheng Sun, Yukun Li, Yutian Tu, Yuxuan Qin, Yuzhuo Wu, Zeyu Li, Zhengyu Lou, Zhenning Ran, Zizhu He, Pengfei Liu 5/6/2026

AcademiClaw: When Students Set Challenges for AI Agents

AcademiClaw: bilingual benchmark of 80 complex long-horizon academic tasks from real student workflows for evaluating AI agents.

Ax Fan Ma, Yuntian Liu, Xiang Lan, Weipeng Zhou, Jun Ni, Mauro Giuffr\`e, Lingfei Qian, Xueqing Peng, Yujia Zhou, Ruey-Ling Weng, Huan He, Lu Li, Qingyu Chen, Andrew Loza, Laila Rasmy, Degui Zhi, Yuan Lu, Chenjie Zeng, Joshua C Denny, Lee Schwamm, Daniella Meeker, Lucila Ohno-Machado, Yong Chen, Hua Xu 5/6/2026

Foundation Models to Unlock Real-World Evidence from Nationwide Medical Claims

ReClaim: generative transformer foundation model for extracting insights from large-scale medical claims data.

Ax David Mumford 5/6/2026

AIs and Humans with Agency

Philosophical comparison of human agency development with potential LLM agency. Argues for joint action/planning architecture with humans.

Ax Hao Wang, Limeng Qiao, Chi Zhang, Lin Ma, Guanglu Wan, Xiangyuan Lan, Xiaodan Liang 5/6/2026

X2SAM: Any Segmentation in Images and Videos

X2SAM integrates MLLMs with foundation segmentation models enabling pixel-level perception from conversational instructions across images and videos.

Ax Md. Enamul Hoq, Wataru Uegami, Saghir Alfasly, Ghazal Alabtah, Sahar Rahimi Malakshan, Armita Kazemi, Alex T. Schmitgen, Fred Prior, H. R. Tizhoosh 5/6/2026

Retrieval-Guided Generation for Safer Histopathology Image Captioning

Retrieval-guided generation approach for medical image captioning reducing hallucinations and factual inconsistency in histopathology image descriptions.

Ax Anirudh Iyengar Kaniyar Narayana Iyengar, Tampu Ravi Kumar, Manan Suri, Raviteja Bommireddy, Dinesh Manocha, Puneet Mathur, Vivek Gupta 5/6/2026

DIAGRAMS: A Review Framework for Reasoning-Level Attribution in Diagram QA

DIAGRAMS: review framework for creating reasoning-level attribution in diagram QA, providing structured evidence annotation across visual diagrams and infographics.