Ax Faith Wavinya Mutinda, Spandana Makeneni, Anna Lin, Shivaji Dutta, Irit R. Rasooly, Patrick Dibussolo, Shivani Kamath Belman, Hessam Shahriari, Kevin Murphy, Alex B. Ruan, Barbara H. Chaiyachati, Sanjay Chainani, Robert W. Grundmeier, Scott M. Haag, Jeffrey M. Miller, Heather M. Griffis, Ian M. Campbell 7/9/2026

Health System Scale Semantic Search Across Unstructured Clinical Notes

Semantic search system for clinical notes at health system scale using embeddings. LLM application but domain-specific healthcare focus.

Ax Akshansh, Leonardo Rosa Rodrigues, Michael Korostelev, Youssef Hassan, Mark E. Whiting 7/9/2026

Trading Human Curation for Synthetic Augmentation in RLVR

Research on scaling reinforcement learning from verifiable rewards for agentic LLMs using synthetic task augmentation instead of human curation.

Ax Ce Chen, Congrui Wang, Yonglin Li, Zhenchen Wan, Mingyang Geng, Junhao Xiao, Zhengpeng Xing, Yaqing Hu, Yao Wu, Zhaoyang Qu, Long Lan, Xinwang Liu, Yingqi Peng, Shijia Li, Zufeng Zhang, Chen Ma, Jingjing Zhou, Xingyu Wang, Qilin Lu, Bin Jiang, Qilin Sun, Shanzhi Gu, Yaoguang Jin, Tongliang Liu, Kede Ma, Yifan Peng 7/9/2026

JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators

JuZhou 1.0 is ultra-lightweight text-to-image model designed for edge deployment and offline execution on China-developed AI accelerators.

Ax Tianxing Chen, Yue Chen, Zixuan Li, Junyuan Tang, Kailun Su, Haoran Lu, Weijie Wan, Baijun Chen, Songling Liu, Haowen Yan, Honghao Su, Zhiyang Dou, Kaixuan Wang, Dandan Zhang, Yunze Liu, Yan Qin, Qiwei Liang, Qiwei Wu, Zijian Lin, Wenwei Lin, Yuran Wang, Minghua He, Tianshu Wu, Ruihai Wu, Jingquan Zhou, Kai-Chong Lei, Haibao Yu, Yuanfeng Ji, Weiyang Jin, Guanyu Lin, Xiaofan Li, Qi Xiong, Renjing Xu, Zhongyu Li, Wenhao Chai, Enze Xie, Ziwei Wang, Yao Mu, Hao Dong, Wojciech Matusik, Mingyu Ding, Wenbo Ding, Ping Luo, Masayoshi Tomizuka 7/9/2026

RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies

RoboDojo provides unified sim-and-real benchmark for evaluating generalist robot manipulation policies across diverse tasks.

Ax Lianghua Huang, Zhi-Fan Wu, Yupeng Shi, Wei Wang, Mengyang Feng, Junjie He, Chen-Wei Xie, Yu Liu, Jingren Zhou, Ang Wang, Bang Zhang, Baole Ai, Chen Liang, Cheng Yu, Chongyang Zhong, Jinwei Qi, Kai Zhu, Pandeng Li, Peng Zhang, Wenyuan Zhang, Xinhua Cheng, Yitong Huang, Yun Zheng, Yuxiang Bao, Yuzheng Wang, Zoubin Bi 7/9/2026

Wan-Streamer v0.2: Higher Resolution, Same Latency

Wan-Streamer v0.2 improves resolution of native-streaming audio-visual interaction model while maintaining 200ms latency.

Ax Shiyuan Feng, Huan-ang Gao, Haohan Chi, Hanlin Wu, Zhilong Zhang, Zheng Jiang, Bingxiang He, Wei-Ying Ma, Ya-Qin Zhang, Hao Zhou 7/9/2026

Weak-to-Strong Generalization via Direct On-Policy Distillation

Weak-to-Strong Generalization enables cheaper RL post-training by running RL on small models then distilling to larger models for improved reasoning.

Ax Yipeng Liu, Chang Liu, Si Shen, Jiaqi Zheng, Mingfan Li, Yuyang Yang, Guanhua Li, Yuquan Zhang, Yimeng Xu, Zhongzhe Hu, Zhiyuan Huang, Qihang Duan, Junsong Wang, Wenkai Ling, Baochuan Yang, Xianzhi Yu, Han Bao, Yijie Chen, Guihai Chen 7/9/2026

UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods

UBEP optimizes Mixture-of-Experts model communication on high-bandwidth superpods by addressing execution serialization and bandwidth bottlenecks in production deployments.

Ax Xiaolong Huang, Benjamin Th\'erien, James Harrison, Eugene Belilovsky 7/9/2026

Efficient Long-Horizon Learning for Learned Optimization

Meta-learning approach for learned optimizers that efficiently scales to long-horizon inner problems, improving upon hand-designed optimizers like Adam.