Ax Suli Wang, Yiqun Duan, Yu Deng, Rundong Zhao, Dai Shi, Xinliang Zhou 5/14/2026

Cognifold: Always-On Proactive Memory via Cognitive Folding

arXiv paper introducing Cognifold, brain-inspired proactive agent memory that continuously organizes experiences into cognitive structures. Agent architecture research.

Ax Kangning Zhang, Shuai Shao, Qingyao Li, Jianghao Lin, Lingyue Fu, Shijian Wang, Wenxiang Jiao, Yuan Lu, Weiwen Liu, Weinan Zhang, Yong Yu 5/14/2026

MMSkills: Towards Multimodal Skills for General Visual Agents

MMSkills framework for building reusable multimodal skills for visual agents that encode procedural knowledge beyond text/code through visual state recognition.

Ax Juho Leinonen, Lisa Zhang, Arto Hellas 5/14/2026

AI-Generated Slides: Are They Good? Can Students Tell?

Study evaluating GenAI tools (NotebookLM, Claude, Copilot, Cursor) for generating educational slides from course notes, assessing instructor and student perceptions.

Ax Jie Gao, Kaiser Sun, Jen-tse Huang, Katherine Van Koevering, Sijie Ji, Heyuan Huang, Weiyan Shi, Zhuoran Lu, Ziang Xiao, Daniel Khashabi, Mark Dredze 5/14/2026

How to Interpret Agent Behavior

Methods for interpreting autonomous agent behavior by analyzing reasoning trajectories and execution traces from long-running agents like Claude Code.

Ax Jiayi Zhang, Yongfeng Gu, Jianhao Ruan, Maojia Song, Yiran Peng, Zhiguang Han, Jinyu Xiang, Zhitao Wang, Caiyin Yang, Yixi Ouyang, Bang Liu, Chenglin Wu, Yuyu Luo 5/14/2026

Harnessing Agentic Evolution

Framework combining iterative candidate generation, evaluation, and feedback for agentic evolution, balancing modularity and flexibility in long-horizon search.

Ax Junze Liu, Kun Qian, Florian Dubost, Kai Zhong, Arvind Srinivasan, Nan Chen, Anping Wang, Sam Zhang, Alejandro Mottini, Qingjun Cui, Tian Wang 5/14/2026

3D Primitives are a Spatial Language for VLMs

Study showing 3D geometric primitives as intermediate representation improve VLM spatial reasoning and 3D scene reconstruction from code.

Ax Weichen Yu, Xiaomin Li, Yizhou Zhao, Xiaoze Liu, Ruowang Zhang, Haixin Wang, Yinyi Luo, Chen Henry Wu, Gaurav Mittal, Matt Fredrikson, Yu Hu 5/14/2026

Multi-Rollout On-Policy Distillation via Peer Successes and Failures

On-policy distillation method for LLM training that leverages peer rollout successes and failures to provide dense token-level supervision.

Ax Yichen Feng, Yuetai Li, Chunjiang Liu, Yuanyuan Chen, Fengqing Jiang, Yue Huang, Hang Hua, Zhengqing Yuan, Kaiyuan Zheng, Luyao Niu, Bhaskar Ramasubramanian, Basel Alomair, Xiangliang Zhang, Misha Sra, Zichen Chen, Radha Poovendran, Zhangchen Xu 5/14/2026

Visual Aesthetic Benchmark: Can Frontier Models Judge Beauty?

Benchmark evaluating whether multimodal LLMs can make accurate aesthetic judgments compared to human expert annotators on image ranking tasks.

Ax Weitai Kang, Xiaohang Zhan, Yizhou Wang, Mang Tik Chiu, Jason Kuen, Kangning Liu, Yan Yan 5/14/2026

Inline Critic Steers Image Editing

Image editing refinement technique using inline critic signals within forward passes to improve heterogeneous editing difficulty across regions.