Ax Giulia Lanzillotta, Mandana Samiei, Doina Precup, Razvan Pascanu, Claire Vernade 7/8/2026

To Retain or to Adapt? Generalizing Continual Learning

Continual learning research challenging retention-centered assumptions and prioritizing real-time adaptation in non-stationary environments.

Ax Abu Tyeb Azad, Ishita Sur Apan, Fahim Ahmed, Sumaiya Karim Katha, Ezharuddin Jubaer, Armun Alam, Pranjal Kumar Nandi, Amin Ahsan Ali, Aman Chadha, Md Mofijul Islam, AKM Mahbubur Rahman 7/8/2026

BaFCo: A Document Understanding Benchmark for Complex Bangla Form Comprehension

BaFCo benchmark dataset for Bangla form comprehension using multimodal LLMs, addressing low-resource language document understanding gaps.

Ax Pan Li, Kai Chen, Shuai Chang, Shengzhi Zhang, Peizhuo Lv, Jinwen He 7/8/2026

Differentially Private Natural Gradient Descent

Natural gradient descent variant for differentially private training that accounts for loss curvature to improve optimization efficiency under privacy constraints.

Ax Ryota Tanaka, Taku Hasegawa, Kyosuke Nishida 7/8/2026

CMDR: Contextual Multimodal Document Retrieval

Contextual multimodal document retrieval benchmark and methods that preserve textual/visual content while resolving multi-page aggregation queries.

Ax Krittanon Kaewtawee, Petmongkon Pornpichitsuwan, Natchaya Temyingyong, Nutnicha Laplamoon, Wachiravit Modecrua, Krittin Pachtrachai, Touchapon Kraisingkorn 7/8/2026

InfluMatch: Frontier-Quality KOL Search at 4B-Model Cost

Cost-efficient influencer matching system using three-stage cascade of small open-weight models instead of frontier LLM prompting for semantic matching on Thai marketing criteria.

Ax Daryna Dementieva, Nikolay Babakov, Kathy H\"ammerl, Ilseyar Alimova, Jind\v{r}ich Libovick\'y, Shu Okabe, Miras Baisbay, Lukas Edman, Abrorkhon Inomkhujaev, Antonia Karamolegkou, Mateusz Lango, Volkan \"Ozer, Nikola Selic, Subhankar Swain, Tsedeniya Kinfe Temesgen, Galit Bary Weisberg, Alexander Fraser 7/8/2026

PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages

PluraMath extends mathematical reasoning evaluation to 99 languages beyond English and Chinese, addressing dataset bias in LLM benchmarks.