Ax Lingwei Gu, Nour Jedidi, Jimmy Lin 5/1/2026

NanoKnow: How to Know What Your Language Model Knows

NanoKnow analyzes how LLMs encode knowledge using nanochat family with fully open pre-training data, providing transparent view of parametric knowledge origins.

Ax Yunke Ao, Le Chen, Bruce D. Lee, Assefa S. Wahd, Aline Czarnobai, Philipp F\"urnstahl, Bernhard Sch\"olkopf, Andreas Krause 5/1/2026

Bounded Ratio Reinforcement Learning

BRRL framework bridges gap between trust region methods and PPO's clipped objective for on-policy reinforcement learning with improved theoretical foundations.

Ax Zheng Zhang, Milad Masroor, Cuong Nguyen, Tahir Hassan, Yuanhong Chen, David Rosewarne, Kevin Wells, Thanh-Toan Do, Gustavo Carneiro 5/1/2026

People-Centred Medical Image Analysis

Discusses clinical adoption barriers in medical imaging AI, emphasizing fair performance across diverse populations and workflow integration.

Ax Ali Jaberi (Clean Energy Innovation Research Center, National Research Council Canada, Mississauga, ON, Canada), Yonatan Kurniawan (Department of Material Science and Engineering, University of Toronto, Toronto, ON, Canada), Robert Black (Clean Energy Innovation Research Center, National Research Council Canada, Mississauga, ON, Canada), Shayan Mousavi M. (Clean Energy Innovation Research Center, National Research Council Canada, Mississauga, ON, Canada), Kabir Verma (Cheriton School of Computer Science, University of Waterloo, Waterloo, ON, Canada), Zoya Sadighi (Clean Energy Innovation Research Center, National Research Council Canada, Mississauga, ON, Canada), Santiago Miret (Lila Sciences, San Francisco, CA, USA), Jason Hattrick-Simpers (Department of Material Science and Engineering, University of Toronto, Toronto, ON, Canada) 5/1/2026

AutoREC: A software platform for developing reinforcement learning agents for equivalent circuit model generation from electrochemical impedance spectroscopy data

Open-source Python package for developing RL agents to automatically generate equivalent circuit models from spectroscopy data.

Ax Han Liu, Shanghao Shi, Yevgeniy Vorobeychik, Chongjie Zhang, Ning Zhang 5/1/2026

Low Rank Adaptation for Adversarial Perturbation

arXiv paper exploring whether adversarial perturbations exhibit low-rank structure like LoRA updates in LLMs.

Ax Saeid Asgari Taghanaki, Rakshanda Agarwal, Bruce Sun, Rohan Jha, Elias Stengel-Eskin, Sara Malvar, Rui Ying, Yifei Xu, Guilherme Potje, Tusher Chakraborty, Leonardo de Oliveira Nunes, Ranveer Chandra, Emre Kiciman 5/1/2026

Diagnosing Capability Gaps in Fine-Tuning Data

arXiv paper presenting GoalCover framework to detect capability gaps in LLM fine-tuning datasets before training.