HN aarvinroshin 2/19/2026

AI Agents Are Taking America by Storm

Overview of AI agents becoming mainstream, discussing tools like Claude Code and their ability to automate weeks of work into hours.

Ax Martin Klissarov, Jonathan Cook, Diego Antognini, Hao Sun, Jingling Li, Natasha Jaques, Claudiu Musat, Edward Grefenstette 2/19/2026

Improving Interactive In-Context Learning from Natural Language Feedback

Framework for improving LLMs' ability to adapt dynamically using interactive natural language feedback in collaborative settings, beyond static training paradigms.

Ax Kaiqu Liang, Julia Kruk, Shengyi Qian, Xianjun Yang, Shengjie Bi, Yuanshun Yao, Shaoliang Nie, Mingyang Zhang, Lijuan Liu, Jaime Fern\'andez Fisac, Shuyan Zhou, Saghar Hosseini 2/19/2026

Learning Personalized Agents from Human Feedback

PAHF framework enables AI agents to learn and adapt to individual user preferences dynamically through human feedback, addressing personalization and preference drift.

Ax Marissa A. Weis, Maciej Wo{\l}czyk, Rajai Nasser, Rif A. Saurous, Blaise Ag\"uera y Arcas, Jo\~ao Sacramento, Alexander Meulemans 2/19/2026

Multi-agent cooperation through in-context co-player inference

In-context co-player inference enabling multi-agent cooperation through learning-aware agents in reinforcement learning.

Ax Vered Tohar, Tsahi Hayat, Amir Leshem 2/19/2026

Creating a digital poet

Seven-month poetry workshop shaping LLM into digital poet through iterative in-context expert feedback without retraining.

Ax Stephan Rabanser, Sayash Kapoor, Peter Kirgis, Kangheng Liu, Saiteja Utpala, Arvind Narayanan 2/19/2026

Towards a Science of AI Agent Reliability

Framework for evaluating AI agent reliability beyond accuracy metrics, examining consistency, perturbation robustness, and operational flaws.

Ax Chuyang Ye, Haoxian Jing, Qinting Jiang, Yixi Lin, Qiang Li, Xing Tang, Jingyan Jiang 2/19/2026

Test-Time Adaptation for Tactile-Vision-Language Models

Test-time adaptation methods for tactile-vision-language models handling modality-wise reliability under distribution shifts.

Ax Maijunxian Wang, Yijiang Li, Bingyang Wang, Tianwei Zhao, Ran Ji, Qingying Gao, Emmy Liu, Hokin Deng, Dezhi Luo 2/19/2026

Egocentric Bias in Vision-Language Models

FlipSet benchmark evaluates visual perspective taking in 103 vision-language models through 180-degree character rotation tasks.