Teahose.
SIGN IN
NEW HERE — WHAT TEAHOSE DOES
We read the entire AI & tech firehose — so you don't have to.
PODPodcastsAll-In, No Priors, Acquired…
NEWNewslettersStratechery, Newcomer…
PAPPapersPhysical AI research
PHProduct Huntdaily launches
VCInvestor ScoutSequoia, a16z, Benchmark…
CLAUDE DISTILLS →
7 reads, 30 sec each — free, 6 AM ET.
+ a live graph of the companies, people & themes underneath.
HOME/ARXIV PHYSICAL AI
PAPR

arXiv Physical AI

PAPERS 212LATEST JUL 30, 2026HOST YUKANG CAO, ZIWEI LIU, ET AL. (ARXIV PHYSICAL AI)
01
JUL 30, 2026
ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine
YUKANG CAO, ZIWEI LIU, ET AL. (ARXIV PHYSICAL AI)
02
JUL 30, 2026
FA-RDP: A Frequency-Adaptive Reactive Diffusion Policy for Contact-Rich Manipulation
LIFENG ZHUO, CHUAN WEN, ET AL. (ARXIV PHYSICAL AI)
03
JUL 30, 2026
FasTac: A Curved Multispectral Vision-Based Tactile Sensor for High-Speed High-Precision 3D Shape and Force Perception
XIAOFAN LU, ZHOUPING YIN, ET AL. (ARXIV PHYSICAL AI)
04
JUL 30, 2026
PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball
LIZHI YANG, JUNHENG LI, AARON D. AMES
05
JUL 29, 2026
ContactFlow: A video action conditioning that transfers across embodiments
SAMI AZIRAR, HERMANN BLUM, ET AL. (ARXIV PHYSICAL AI)
06
JUL 29, 2026
TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM
HENGYI XIE, HAN DING, ET AL. (ARXIV PHYSICAL AI)
07
JUL 28, 2026
Reeling It In: Flexible Needle Pick Up via Thread Manipulation for Autonomous Suturing
EMMA HUANG, MICHAEL C. YIP, ET AL. (ARXIV PHYSICAL AI)
08
JUL 28, 2026
Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design
HUY HA, C. KAREN LIU, SHURAN SONG
09
JUL 28, 2026
πR2: Reactive Real-time Flow Policies
SUNGJAE PARK, SHUBHAM TULSIANI
10
JUL 27, 2026
Data Pyramid for Embodied Manipulation
YIFAN YE, SHANGHANG ZHANG, ET AL. (ARXIV PHYSICAL AI)
11
JUL 27, 2026
Drop-Then-Recovery: How Redundant Are Vision-Language-Action Models?
GUOHENG SUN, ANG LI, ET AL. (ARXIV PHYSICAL AI)
12
JUL 27, 2026
WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning
MELYA BOUKHEDDIMI, FRANK KIRCHNER, ET AL. (ARXIV PHYSICAL AI)
13
JUL 26, 2026
DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation
TAIYI SU, YI XU, ET AL. (ARXIV PHYSICAL AI)
14
JUL 26, 2026
N0-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation
NEOTEAI TEAM, FUDAN TEAI TEAM
15
JUL 26, 2026
N0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens
NEOTEAI TEAM, FUDAN TEAI TEAM
16
JUL 23, 2026
AXIS: A Growable Community-Driven Data Engine for Scalable Robot Manipulation
MENGFEI ZHAO, JIACHEN LI, ET AL. (ARXIV PHYSICAL AI)
17
JUL 23, 2026
Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories
XIAOMI ROBOTICS TEAM JUN GUO, QUANYUN ZHOU, ET AL. (ARXIV PHYSICAL AI)
18
JUL 22, 2026
Closing the Lab-to-Store Gap: A Data-Efficient Post-Training and Experience-Driven Learning VLA Framework for Retail Humanoids
ROGER SALA SISÓ, TRAN NGUYEN LE, ET AL. (ARXIV PHYSICAL AI)
19
JUL 22, 2026
Exp2VLA: Enabling Vision-Language-Action for Drone Navigation from Expert Demonstrations
V. DANG, ERDAL KAYACAN, ET AL. (ARXIV PHYSICAL AI)
20
JUL 22, 2026
FELT: Generating Tactile Signals from Vision for Visuo-Tactile Manipulation
ZINAN LI, DANIEL SEITA, ET AL. (ARXIV PHYSICAL AI)
21
JUL 22, 2026
LENS: LLM-guided Environment Simplification for Planning and Control in Clutter
AILEEN LIAO, MICHAEL POSA, ET AL. (ARXIV PHYSICAL AI)
22
JUL 22, 2026
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
HONGYU DING, JIEBO LUO, ET AL. (ARXIV PHYSICAL AI)
23
JUL 21, 2026
DiMaS: Distribution Matching for Steering Vision-Language-Action Models
PEGAH KHAYATAN, MATTHIEU CORD, ET AL. (ARXIV PHYSICAL AI)
24
JUL 21, 2026
Directional Constraints for Efficient Exploration in Safe Reinforcement Learning
PAOLO MAGLIANO, R. CAMORIANO, ET AL. (ARXIV PHYSICAL AI)
25
JUL 21, 2026
Masked Visual Actions for Unified World Modeling
HADI ALZAYER, JIA-BIN HUANG, ET AL. (ARXIV PHYSICAL AI)
26
JUL 20, 2026
DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation
JIAN ZHU, YI XU, ET AL. (ARXIV PHYSICAL AI)
27
JUL 20, 2026
Patch Policy: Efficient Embodied Control via Dense Visual Representations
GAOYUE ZHOU, LERREL PINTO, ET AL. (ARXIV PHYSICAL AI)
28
JUL 17, 2026
Handroid: Bridging Dexterous Hand and Humanoid
RUOGU LI, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
29
JUL 16, 2026
Reflex: Real-Time VLA Control through Streaming Inference
YUANCHUN GUO, BINGYAN LIU
30
JUL 16, 2026
RoboTTT: Context Scaling for Robot Policies
YUNFAN JIANG, LINXI "JIM" FAN, ET AL. (ARXIV PHYSICAL AI)
31
JUL 15, 2026
Agile perceptive multi-skill locomotion for quadrupedal robots in the wild
JUN-GILL KANG, HAE-WON PARK, ET AL. (ARXIV PHYSICAL AI)
32
JUL 15, 2026
Never Too Late for Force: Accelerating VLA Post-Training with Reactive Force Injection
YI WANG, CEWU LU, ET AL. (ARXIV PHYSICAL AI)
33
JUL 14, 2026
Worlds in One Demo: A Synthetic Data Engine for Learning Open-World Mobile Manipulation
LINGXIAO GUO, HUANYU LI, GUANYA SHI
34
JUL 13, 2026
Towards Human-level Dexterous Teleoperation
PUHAO LI, SIYUAN HUANG, ET AL. (ARXIV PHYSICAL AI)
35
JUL 13, 2026
VIA: Visual Interface Agent for Robot Control
HENGYUAN HU, DORSA SADIGH, ET AL. (ARXIV PHYSICAL AI)
36
JUL 12, 2026
VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment
GUOYANG XIA, YAN XIE, ET AL. (ARXIV PHYSICAL AI)
37
JUL 10, 2026
B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations
XIAOSHEN HAN, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
38
JUL 10, 2026
DemoBridge: A Simulation-in-the-Loop Toolkit for Single-View Human Demonstration Retargeting
ZEHAO WANG, RAHAF ALJUNDI, ET AL. (ARXIV PHYSICAL AI)
39
JUL 9, 2026
AnyDexRT: Calibration-Free Dexterous Hand Retargeting with Few-Shot Human Guidance
CHENXI WANG, CEWU LU, ET AL. (ARXIV PHYSICAL AI)
40
JUL 9, 2026
ContactMimic: Humanoid Object Interaction via Contact Control
XINYAO LI, SAURABH GUPTA, ET AL. (ARXIV PHYSICAL AI)
41
JUL 9, 2026
DexVerse: A Modular Benchmark for Multi-Task, Multi-Embodiment Dexterous Manipulation
YUNCHAO YAO, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
42
JUL 9, 2026
Native Video-Action Pretraining for Generalizable Robot Control
QIHANG ZHANG, YINGHAO XU, ET AL. (ARXIV PHYSICAL AI)
43
JUL 8, 2026
Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models
HAOQI YUAN, XIONG-HUI CHEN, ET AL. (ARXIV PHYSICAL AI)
44
JUL 8, 2026
TouchWorld: A Predictive and Reactive Tactile Foundation Model for Dexterous Manipulation
JIANYI ZHOU, SHUO YANG, ET AL. (ARXIV PHYSICAL AI)
45
JUL 7, 2026
Calf-Integrated Arms for Bimanual Quadruped Loco-Manipulation
YAN PAN, CHENGXU ZHOU, ET AL. (ARXIV PHYSICAL AI)
46
JUL 7, 2026
LAMP: Latent Motion Prior-Guided Real-World Learning for Dexterous Hand Manipulation
XINYE YANG, CHAO YU, ET AL. (ARXIV PHYSICAL AI)
47
JUL 7, 2026
RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation
HAOYU ZHAO, ZHONGYU LI, ET AL. (ARXIV PHYSICAL AI)
48
JUL 6, 2026
Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation
ZHE ZHAO, MENGSHI QI, ET AL. (ARXIV PHYSICAL AI)
49
JUL 6, 2026
Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision
YUAN XU, LIANG WANG, ET AL. (ARXIV PHYSICAL AI)
50
JUL 6, 2026
S2-VLA: State-Space Guided Vision-Language-Action Models for Long-Horizon Manipulation
ZHIPENG XIE, JING ZHAO, ET AL. (ARXIV PHYSICAL AI)
51
JUL 6, 2026
SILO: Simulation-in-the-Loop Sim-to-Real Transfer for Multi-Stage Cable Routing
STONE TAO, IRETIAYO AKINOLA, ET AL. (ARXIV PHYSICAL AI)
52
JUL 5, 2026
In-Context World Modeling for Robotic Control
SIYIN WANG, XIPENG QIU, ET AL. (ARXIV PHYSICAL AI)
53
JUL 5, 2026
ThinkingVLA: Interleaved Vision and Language Reasoning for Robotic Manipulation
TIANYI LU, YU-GANG JIANG, ET AL. (ARXIV PHYSICAL AI)
54
JUL 4, 2026
Decoupling the Declarative from the Procedural in Vision-Language-Action Models
NIKOLAOS TSAGKAS, ALEXANDROS KOURIS, ET AL. (ARXIV PHYSICAL AI)
55
JUL 3, 2026
CoDex: Learning Compositional Dexterous Functional Manipulation without Demonstrations
BOWEN JIANG, WILLIAM PAINTER REGER, ROBERTO MARTÍN-MARTÍN
56
JUL 3, 2026
Z-1: Efficient Reinforcement Learning for Vision-Language-Action Models
LANG CAO, YITONG LI, ET AL. (ARXIV PHYSICAL AI)
57
JUL 2, 2026
VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation
SHUAI TIAN, DONGBIN ZHAO, ET AL. (ARXIV PHYSICAL AI)
58
JUL 1, 2026
FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model
CHENYANG MA, DIEGO ROMERES, ET AL. (ARXIV PHYSICAL AI)
59
JUN 30, 2026
Adapting Generalist Robot Policies with Semantic Reinforcement Learning
JAGDEEP SINGH BHATIA, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
60
JUN 30, 2026
Human-as-Humanoid: Enabling Zero-Shot Humanoid Learning from Ego-Exo Human Videos with Human-Aligned Embodiments
XIAOPENG LIN, KAI CHEN, ET AL. (ARXIV PHYSICAL AI)
61
JUN 30, 2026
SPACE: Enabling Learning from Cross-Robot Data Toward Generalist Policies
HAEONE LEE, KIMIN LEE, ET AL. (ARXIV PHYSICAL AI)
62
JUN 30, 2026
TactX: Learning Shared Tactile Representations Across Diverse Sensors
JUNSUNG PARK, XIAOLONG WANG, ET AL. (ARXIV PHYSICAL AI)
63
JUN 29, 2026
VLK: Learning Humanoid Loco-Manipulation from Synthetic Interactions in Reconstructed Scenes
YEN-JEN WANG, KAREN LIU, ET AL. (ARXIV PHYSICAL AI)
64
JUN 26, 2026
DexCompose: Reusing Dexterous Policies for Multi-Task Manipulation with a Single Hand
DIHONG HUANG, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
65
JUN 26, 2026
SimFoundry: Modular and Automated Scene Generation for Policy Learning and Evaluation
NADUN RANAWAKA, YUKE ZHU, ET AL. (ARXIV PHYSICAL AI)
66
JUN 25, 2026
Bridging Performance and Generalization in Reinforcement Learning for Agile Flight
JONATHAN GREEN, DAVIDE SCARAMUZZA, ET AL. (ARXIV PHYSICAL AI)
67
JUN 25, 2026
Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking
PRANAV DEBBAD, MAJID KHADIV, ET AL. (ARXIV PHYSICAL AI)
68
JUN 25, 2026
Scalable Behavior Cloning with Open Data, Training, and Evaluation
ARTHUR ALLSHIRE, ANGJOO KANAZAWA, ET AL. (ARXIV PHYSICAL AI)
69
JUN 25, 2026
VibeAct: Vibration to Actions for Contact-Rich Reactive Robot Dexterity
YUEMIN MAO, JEFFREY ICHNOWSKI, ET AL. (ARXIV PHYSICAL AI)
70
JUN 24, 2026
CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation
HAONAN CHEN, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
71
JUN 24, 2026
ForceBand: Learning Forceful Manipulation with sEMG
BOTAO HE, YIANNIS ALOIMONOS, ET AL. (ARXIV PHYSICAL AI)
72
JUN 24, 2026
Play2Perfect: What Matters in Dexterous Play Pretraining for Precise Assembly?
TYLER GA WEI LUM, JEANNETTE BOHG, ET AL. (ARXIV PHYSICAL AI)
73
JUN 23, 2026
InSight: Self-Guided Skill Acquisition via Steerable VLAs
MAGGIE WANG, MAC SCHWAGER, ET AL. (ARXIV PHYSICAL AI)
74
JUN 22, 2026
CoorDex: Coordinating Body and Hand Priors for Continuous Dexterous Humanoid Loco-Manipulation
SIKAI LI, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
75
JUN 22, 2026
Learning What to Say to Your VLA: Mostly Harmless Vision Language Action Model Steering
HYUNDOO JEONG, GOKUL SWAMY, ANDREA V. BAJCSY
76
JUN 22, 2026
PanoVine: Whole-Body Visuomotor Control for Soft Growing Vine Robot
YIMENG QIN, ALLISON OKAMURA, ET AL. (ARXIV PHYSICAL AI)
77
JUN 22, 2026
PhysVLA: Towards Physically-Grounded VLA for Embodied Robotic Manipulation
NAMAI CHANDRA, SHRIRAM DAMODARAN, LIN WANG
78
JUN 22, 2026
SkyJEPA: Learning Long-Horizon World Models for Zero-Shot Sim-to-Real Control of Quadrotors
PRATYAKSH RAO, GIUSEPPE LOIANNO, ET AL. (ARXIV PHYSICAL AI)
79
JUN 20, 2026
HITTER: A HumanoId Table TEnnis Robot via Hierarchical Planning and Learning
ZHI SU, S. SASTRY, ET AL. (ARXIV PHYSICAL AI)
80
JUN 20, 2026
OpenHLM: An Empirical Recipe for Whole-Body Humanoid Loco-Manipulation
YINGDONG HU, YANG GAO, ET AL. (ARXIV PHYSICAL AI)
81
JUN 18, 2026
Co-VLA: Coordination-Aware Structured Action Modeling for Dual-Arm Vision-Language-Action Systems
YANDONG WANG, CHAO ZHANG, ET AL. (ARXIV PHYSICAL AI)
82
JUN 18, 2026
ENPIRE: Agentic Robot Policy Self-Improvement in the Real World
WENLI XIAO, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
83
JUN 18, 2026
Generating Robot Hands from Human Demonstrations
SHA YI, XIAOLONG WANG, ET AL. (ARXIV PHYSICAL AI)
84
JUN 18, 2026
Pose6DAug: Physically Plausible Multi-view Object Swapping for Robot Data Augmentation
JONGHOON LEE, JINWOO SHIN, ET AL. (ARXIV PHYSICAL AI)
85
JUN 17, 2026
Do as I Do: Dexterous Manipulation Data from Everyday Human Videos
BHAWNA PALIWAL, JITENDRA MALIK, ET AL. (ARXIV PHYSICAL AI)
86
JUN 17, 2026
Object-Centric Residual RL for Zero-Shot Sim-to-Real VLA Enhancement
KINAM KIM, YASUYUKI MATSUSHITA, ET AL. (ARXIV PHYSICAL AI)
87
JUN 17, 2026
TactSpace: Learning a Physics-enriched Shared Latent Space for Tactile Sim-to-Real Transfer
ARUNIM JOARDER, MARCO HUTTER, ET AL. (ARXIV PHYSICAL AI)
88
JUN 15, 2026
Kairos: A Native World Model Stack for Physical AI
KAIROS TEAM, XIAOGANG WANG, ET AL. (ARXIV PHYSICAL AI)
89
JUN 15, 2026
T-Rex: Tactile-Reactive Dexterous Manipulation
DANTONG NIU, TREVOR DARRELL, ET AL. (ARXIV PHYSICAL AI)
90
JUN 15, 2026
What Matters in Orchestrating Robot Policies: A Systematic Study of Hierarchical VLA Agents
JIAHENG HU, ANNIE XIE, ET AL. (ARXIV PHYSICAL AI)
91
JUN 12, 2026
Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack
HE ZHANG, ZHENGYOU ZHANG, ET AL. (ARXIV PHYSICAL AI)
92
JUN 11, 2026
Improving Robotic Generalist Policies via Flow Reversal Steering
ANDY TANG, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
93
JUN 11, 2026
Mana: Dexterous Manipulation of Articulated Tools
ZHAO-HENG YIN, C. KAREN LIU, ET AL. (ARXIV PHYSICAL AI)
94
JUN 11, 2026
WEAVER, Better, Faster, Longer: An Effective World Model for Robotic Manipulation
ARNAV KUMAR JAIN, ANDREA BAJCSY, ET AL. (ARXIV PHYSICAL AI)
95
JUN 11, 2026
WT-UMI: Tactile-based Whole-Body Manipulation via Force-Supervised Contact-Aware Planning
JAEHWI JANG, YE ZHAO, ET AL. (ARXIV PHYSICAL AI)
96
JUN 10, 2026
CHORUS: Decentralized Multi-Embodiment Collaboration with One VLA Policy
RIA DOSHI, JEANNETTE BOHG, ET AL. (ARXIV PHYSICAL AI)
97
JUN 10, 2026
FACTR 2: Learning External Force Sensing for Commodity Robot Arms Improves Policy Learning
STEVEN OH, DEEPAK PATHAK, ET AL. (ARXIV PHYSICAL AI)
98
JUN 9, 2026
IMPACT: Learning Internal-Model Predictive Control for Forceful Robotic Manipulation
JIAWEI GAO, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
99
JUN 9, 2026
TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation
YUJIE ZANG, WENCHAO DING, ET AL. (ARXIV PHYSICAL AI)
100
JUN 8, 2026
MotionWAM: Towards Foundation World Action Models for Real-Time Humanoid Loco-Manipulation
JIA ZHENG, JUNWEI LIANG, ET AL. (ARXIV PHYSICAL AI)
101
JUN 7, 2026
OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation
ZEHAO YU, XUELONG LI, ET AL. (ARXIV PHYSICAL AI)
102
JUN 5, 2026
LARA: Latent Action Representation Alignment for Vision-Language-Action Models
MENGYA LIU, SIYUAN HUANG, ET AL. (ARXIV PHYSICAL AI)
103
JUN 5, 2026
Shield-Loco: Shielding Locomotion Policies with Predictive Safety Filtering
ADITYA SHIRWATKAR, MAJID KHADIV, ET AL. (ARXIV PHYSICAL AI)
104
JUN 4, 2026
OneVLA: A Unified Framework for Embodied Tasks
LINGFENG ZHANG, WENBO DING, ET AL. (ARXIV PHYSICAL AI)
105
JUN 4, 2026
ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models
NASTARAN DARABI, A. TRIVEDI
106
JUN 3, 2026
FlowPRO: Reward-Free Reinforced Fine-Tuning of Flow-Matching VLAs via Proximalized Preference Optimization
YIHAO WU, ZHENGYOU ZHANG, ET AL. (ARXIV PHYSICAL AI)
107
JUN 3, 2026
GRAIL: Generating Humanoid Loco-Manipulation from 3D Assets and Video Priors
TIANYI XIE, YE YUAN, ET AL. (ARXIV PHYSICAL AI)
108
JUN 2, 2026
ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models
YE LI, ZHI WANG, ET AL. (ARXIV PHYSICAL AI)
109
JUN 2, 2026
Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
ZEKUN QI, LI YI, ET AL. (ARXIV PHYSICAL AI)
110
JUN 2, 2026
NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
NVIDIA, ZIAN WANG, ET AL. (ARXIV PHYSICAL AI)
111
JUN 2, 2026
RDGen: Demonstration Generation for High-Quality Robot Learning via Reinforcement Learning
ZIJIA ZHU, XINHAI SUN, ET AL. (ARXIV PHYSICAL AI)
112
JUN 1, 2026
Colosseum V2: Benchmarking Generalization for Vision Language Action Models
JEREMY MORGAN, ISHIKA SINGH, ET AL. (ARXIV PHYSICAL AI)
113
JUN 1, 2026
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
SHENGYUN SI, YU-GANG JIANG, ET AL. (ARXIV PHYSICAL AI)
114
MAY 29, 2026
How to Instruct Your Robot: Dense Language Annotations Power Robot Policy Learning
BOSUNG KIM, PRITHVIRAJ AMMANABROLU, ET AL. (ARXIV PHYSICAL AI)
115
MAY 28, 2026
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
ZHONGXI CHEN, WENZHAO LIAN, ET AL. (ARXIV PHYSICAL AI)
116
MAY 28, 2026
EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models
PERRY DONG, CHELSEA FINN, ET AL. (ARXIV PHYSICAL AI)
117
MAY 28, 2026
FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies
XINTONG HU, TAO YU, ET AL. (ARXIV PHYSICAL AI)
118
MAY 28, 2026
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
QIUYUE WANG, XIONGHUI CHEN, ET AL. (ARXIV PHYSICAL AI)
119
MAY 28, 2026
VisualThink-VLA: Visual Intermediate Reasoning for Effective and Low-Latency Vision-Language-Action Policies
MINGJIAN GAO, YUETING ZHUANG, ET AL. (ARXIV PHYSICAL AI)
120
MAY 27, 2026
Beyond Binary: Sim-to-Real Dexterous Manipulation with Physics-Grounded Contact Representation
JIAHE PAN, TORU LIN, ET AL. (ARXIV PHYSICAL AI)
121
MAY 27, 2026
Cybo-Waiter: A Physical Agentic Framework for Humanoid Whole-Body Locomotion-Manipulation
PENGHUA REN, KAIYANG CHEN, ET AL. (ARXIV PHYSICAL AI)
122
MAY 27, 2026
Humanoid Everyday: A Comprehensive Robotic Dataset for Open-World Humanoid Manipulation
ZHENYU ZHAO, YUE WANG, ET AL. (ARXIV PHYSICAL AI)
123
MAY 26, 2026
RIO: Flexible Real-Time Robot I/O for Cross-Embodiment Robot Learning
PABLO ORTEGA-KRAL, JEAN OH, ET AL. (ARXIV PHYSICAL AI)
124
MAY 22, 2026
GuidedVLA: Specifying Task-Relevant Factors via Plug-and-Play Action Attention Specialization
XIAOSONG JIA, YU-GANG JIANG, ET AL. (ARXIV PHYSICAL AI)
125
MAY 22, 2026
Towards Long-horizon Embodied Agents with Tool-Aligned Vision-Language-Action Models
ZIXING LEI, SIHENG CHEN, ET AL. (ARXIV PHYSICAL AI)
126
MAY 21, 2026
Factored Diffusion Policies:Compositionally Generalized Robot Control with a Single Score Network
SAYAN MITRA, ABHISHEK PAI, ET AL. (ARXIV PHYSICAL AI)
127
MAY 21, 2026
Imagine2Real: Towards Zero-shot Humanoid-Object Interaction via Video Generative Priors
JIAHE CHEN, JINGBO WANG, ET AL. (ARXIV PHYSICAL AI)
128
MAY 21, 2026
Judge, Then Drive: A Critic-Centric Vision Language Action Framework for Autonomous Driving
LIJIN YANG, HAO YANG, ET AL. (ARXIV PHYSICAL AI)
129
MAY 21, 2026
PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance
YUPENG ZHENG, WENCHAO DING, ET AL. (ARXIV PHYSICAL AI)
130
MAY 21, 2026
Superhuman Safe and Agile Racing through Multi-Agent Reinforcement Learning
ISMAIL GELES, DAVIDE SCARAMUZZA, ET AL. (ARXIV PHYSICAL AI)
131
MAY 20, 2026
PointACT: Vision-Language-Action Models with Multi-Scale Point-Action Interaction
SHIZHE CHEN, PAUL PACAUD, CORDELIA SCHMID
132
MAY 18, 2026
MolmoAct2: Action Reasoning Models for Real-world Deployment
HAOQUAN FANG, RANJAY KRISHNA, ET AL. (ARXIV PHYSICAL AI)
133
MAY 18, 2026
StableVLA: Towards Robust Vision-Language-Action Models without Extra Data
YIYANG FU, DAQUAN ZHOU, ET AL. (ARXIV PHYSICAL AI)
134
MAY 18, 2026
TacSE3: Equivariant SE(3) Motion Estimation from Low-Texture Visuotactile Images for In-Gripper Tracking and Compensation
ZHONGYUAN LIAO, MICHAEL YU WANG, ET AL. (ARXIV PHYSICAL AI)
135
MAY 17, 2026
Do World Action Models Generalize Better than VLAs? A Robustness Study
ZHANGUANG ZHANG, YINGXUE ZHANG, ET AL. (ARXIV PHYSICAL AI)
136
MAY 17, 2026
VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic Model
WENHAO LI, CHANG XU, ET AL. (ARXIV PHYSICAL AI)
137
MAY 15, 2026
Offline Semantic Guidance for Efficient Vision-Language-Action Policy Distillation
JIN SHI, BRADY ZHANG, YISHUN LU
138
MAY 15, 2026
RLDX-1 Technical Report
DONGYOUNG KIM, JINWOO SHIN, ET AL. (ARXIV PHYSICAL AI)
139
MAY 14, 2026
CoCo-InEKF: State Estimation with Learned Contact Covariances in Dynamic, Contact-Rich Scenarios
MICHAEL BAUMGARTNER, MORITZ BÄCHER, ET AL. (ARXIV PHYSICAL AI)
140
MAY 13, 2026
Realtime-VLA FLASH: Speculative Inference Framework for Diffusion-based VLAs
JIAHUI NIU, HUAWEI LI, ET AL. (ARXIV PHYSICAL AI)
141
MAY 13, 2026
What to Ignore, What to React: Visually Robust RL Fine-Tuning of VLA Models
YUANFANG PENG, RUI WANG, ET AL. (ARXIV PHYSICAL AI)
142
MAY 5, 2026
TiPToP: A Modular Open-Vocabulary Planning System for Robotic Manipulation
WILLIAM SHEN, TOM'AS LOZANO-P'EREZ, ET AL. (ARXIV PHYSICAL AI)
143
MAY 4, 2026
$\Delta$VLA: Prior-Guided Vision-Language-Action Models via World Knowledge Variation
YIJIE ZHU, ZITONG YU, ET AL. (ARXIV PHYSICAL AI)
144
MAY 1, 2026
Learning while Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies
YI WANG, JIANLAN LUO, ET AL. (ARXIV PHYSICAL AI)
145
APR 30, 2026
DOT-Sim: Differentiable Optical Tactile Simulation with Precise Real-to-Sim Physical Calibration
YANG YOU, LEONIDAS GUIBAS, ET AL. (ARXIV PHYSICAL AI)
146
APR 30, 2026
FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems
BINGHAO HUANG, YUNZHU LI
147
APR 30, 2026
LaST-R1: Reinforcing Action via Adaptive Physical Latent Reasoning for VLA Models
HAO CHEN, PHENG-ANN HENG, ET AL. (ARXIV PHYSICAL AI)
148
APR 30, 2026
MotuBrain: An Advanced World Action Model for Robot Control
MOTUBRAIN TEAM, JUN ZHU, ET AL. (ARXIV PHYSICAL AI)
149
APR 30, 2026
RopeDreamer: A Kinematic Recurrent State Space Model for Dynamics of Flexible Deformable Linear Objects
TIM MISSAL, PAULA DORNHOFER PARO COSTA, ET AL. (ARXIV PHYSICAL AI)
150
APR 29, 2026
Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising
JUN GUO, HUAPING LIU, ET AL. (ARXIV PHYSICAL AI)
151
APR 24, 2026
RedVLA: Physical Red Teaming for Vision-Language-Action Models
YUHAO ZHANG, JIAMING JI, ET AL. (ARXIV PHYSICAL AI)
152
APR 24, 2026
dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
YAXUAN LI, YICHEN ZHU, ET AL. (ARXIV PHYSICAL AI)
153
APR 22, 2026
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
ADRIANA AIDA, PAVAN UPPUTURI, ET AL. (ARXIV PHYSICAL AI)
154
APR 21, 2026
EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training
YIYANG DU, CHENYAN XIONG, ET AL. (ARXIV PHYSICAL AI)
155
APR 21, 2026
UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling
BOYU CHEN, YIXIAO GE, ET AL. (ARXIV PHYSICAL AI)
156
APR 20, 2026
AnoleVLA: Lightweight Vision-Language-Action Model with Deep State Space Models for Mobile Manipulation
YUSUKE TAKAGI, KOMEI SUGIURA, ET AL. (ARXIV PHYSICAL AI)
157
APR 19, 2026
FLASH: Fast Learning via GPU-Accelerated Simulation for High-Fidelity Deformable Manipulation in Minutes
SIYUAN LUO, FAN SHI, ET AL. (ARXIV PHYSICAL AI)
158
APR 19, 2026
Novel Algorithms for Smoothly Differentiable and Efficiently Vectorizable Contact Manifold Construction
ONUR BEKER, GEORG MARTIUS, ET AL. (ARXIV PHYSICAL AI)
159
APR 17, 2026
Observing and Controlling Features in Vision-Language-Action Models
HUGO BUURMEIJER, MARCO PAVONE, ET AL. (ARXIV PHYSICAL AI)
160
APR 17, 2026
VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation
XINGLEI YU, YANWEI FU, ET AL. (ARXIV PHYSICAL AI)
161
APR 17, 2026
VP-VLA: Visual Prompting as an Interface for Vision-Language-Action Models
ZIXUAN WANG, JIAYA JIA, ET AL. (ARXIV PHYSICAL AI)
162
APR 16, 2026
DEX-Mouse: A Low-cost Portable and Universal Interface with Force Feedback for Data Collection of Dexterous Robotic Hands
JOONHO KOH, CHANGJOO NAM, ET AL. (ARXIV PHYSICAL AI)
163
APR 16, 2026
R3D: Revisiting 3D Policy Learning
ZHENGDONG HONG, JIAYUAN GU, ET AL. (ARXIV PHYSICAL AI)
164
APR 16, 2026
Switch: Learning Agile Skills Switching for Humanoid Robots
YUEN-FUI LAU, PING TAN, ET AL. (ARXIV PHYSICAL AI)
165
APR 16, 2026
Vision-Based Safe Human-Robot Collaboration with Uncertainty Guarantees
JAKOB THUMM, MARCO PAVONE, ET AL. (ARXIV PHYSICAL AI)
166
APR 15, 2026
A Mechanistic Analysis of Sim-and-Real Co-Training in Generative Robot Policies
YU LEI, YUKE ZHU, ET AL. (ARXIV PHYSICAL AI)
167
APR 14, 2026
Learning Versatile Humanoid Manipulation with Touch Dreaming
YARU NIU, DING ZHAO, ET AL. (ARXIV PHYSICAL AI)
168
APR 13, 2026
Simulator Adaptation for Sim-to-Real Learning of Legged Locomotion via Proprioceptive Distribution Matching
JEREMY DAO, ALAN FERN
169
APR 13, 2026
Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models
ZHILONG ZHANG, YANG YU, ET AL. (ARXIV PHYSICAL AI)
170
APR 13, 2026
ViserDex: Visual Sim-to-Real for Robust Dexterous In-hand Reorientation
ARJUN BHARDWAJ, MARCO HUTTER, ET AL. (ARXIV PHYSICAL AI)
171
APR 10, 2026
Sim-to-Real Transfer for Muscle-Actuated Robots via Generalized Actuator Networks
JAN SCHNEIDER, DIETER BÜCHLER, ET AL. (ARXIV PHYSICAL AI)
172
APR 9, 2026
A-SLIP: Acoustic Sensing for Continuous In-hand Slip Estimation
UKSANG YOO, JEFFREY ICHNOWSKI, ET AL. (ARXIV PHYSICAL AI)
173
APR 9, 2026
HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation
SHUANGHAO BAI, BADONG CHEN, ET AL. (ARXIV PHYSICAL AI)
174
APR 9, 2026
LAMP: Lift Image-Editing as General 3D Priors for Open-world Manipulation
JINGJING WANG, GUOFENG ZHANG, ET AL. (ARXIV PHYSICAL AI)
175
APR 9, 2026
Learning Humanoid Standing-up Control across Diverse Postures
TAO HUANG, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
176
APR 9, 2026
RPL: Learning Robust Humanoid Perceptive Locomotion on Challenging Terrains
YUANHANG ZHANG, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
177
APR 9, 2026
SIM1: Physics-Aligned Simulator as Zero-Shot Data Scaler in Deformable Worlds
YUNSONG ZHOU, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
178
APR 9, 2026
Sumo: Dynamic and Generalizable Whole-Body Loco-Manipulation
JOHN Z. ZHANG, SIMON LE CLÉAC'H, ET AL. (ARXIV PHYSICAL AI)
179
APR 8, 2026
CMP: Robust Whole-Body Tracking for Loco-Manipulation via Competence Manifold Projection
ZIYANG CHENG, JIWEN LU, ET AL. (ARXIV PHYSICAL AI)
180
APR 7, 2026
Action Images: End-to-End Policy Learning via Multiview Video Generation
HAOYU ZHEN, CHUANG GAN, ET AL. (ARXIV PHYSICAL AI)
181
APR 7, 2026
SnapFlow: One-Step Action Generation for Flow-Matching VLAs via Progressive Self-Distillation
WUYANG LUAN, RUI MA, ET AL. (ARXIV PHYSICAL AI)
182
APR 6, 2026
DySL-VLA: Efficient Vision-Language-Action Model Inference via Dynamic-Static Layer-Skipping for Robot Manipulation
ZEBIN YANG, MENG LI, ET AL. (ARXIV PHYSICAL AI)
183
APR 6, 2026
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
YANRU WU, YUE WANG, ET AL. (ARXIV PHYSICAL AI)
184
APR 5, 2026
Adaptive Action Chunking at Inference-time for Vision-Language-Action Models
YUANCHANG LIANG, PRAHLAD VADAKKEPAT, ET AL. (ARXIV PHYSICAL AI)
185
APR 5, 2026
MobileManiBench: Simplifying Model Verification for Mobile Manipulation
WENBO WANG, BAINING GUO, ET AL. (ARXIV PHYSICAL AI)
186
APR 5, 2026
Not All Features Are Created Equal: A Mechanistic Study of Vision-Language-Action Models
BRYCE GRANT, XIJIA ZHAO, PENG WANG
187
APR 5, 2026
frax: Fast Robot Kinematics and Dynamics in JAX
DANIEL MORTON, MARCO PAVONE
188
APR 4, 2026
ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
YANDAN YANG, MU XU, ET AL. (ARXIV PHYSICAL AI)
189
APR 2, 2026
ForeAct: Steering Your VLA with Efficient Visual Foresight Planning
ZHUOYANG ZHANG, SONG HAN, ET AL. (ARXIV PHYSICAL AI)
190
APR 2, 2026
Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution
RUISI CAI, QUAN ZHOU, ET AL. (ARXIV PHYSICAL AI)
191
APR 1, 2026
Functional Force-Aware Retargeting from Virtual Human Demos to Soft Robot Policies
UKSANG YOO, HARSHA PRAHLAD, ET AL. (ARXIV PHYSICAL AI)
192
APR 1, 2026
Learning Humanoid Navigation from Human Data
WEIZHUO WANG, MONROE KENNEDY, ET AL. (ARXIV PHYSICAL AI)
193
APR 1, 2026
SMASH: Mastering Scalable Whole-Body Skills for Humanoid Ping-Pong with Egocentric Vision
JUNLI REN, PING LUO, ET AL. (ARXIV PHYSICAL AI)
194
MAR 31, 2026
Coordinated Humanoid Manipulation with Choice Policies
HAOZHI QI, JITENDRA MALIK, ET AL. (ARXIV PHYSICAL AI)
195
MAR 31, 2026
DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA
YI CHEN, XIHUI LIU, ET AL. (ARXIV PHYSICAL AI)
196
MAR 30, 2026
FocusVLA: Focused Visual Utilization for Vision-Language-Action Models
YICHI ZHANG, JIA WAN, ET AL. (ARXIV PHYSICAL AI)
197
MAR 30, 2026
OmniGuide: Universal Guidance Fields for Enhancing Generalist Robot Policies
YUNZHOU SONG, KOSTAS DANIILIDIS, ET AL. (ARXIV PHYSICAL AI)
198
MAR 30, 2026
SOLE-R1: Video-Language Reasoning as the Sole Reward for On-Robot Reinforcement Learning
PHILIP SCHROEDER, ONDREJ BIZA, ET AL. (ARXIV PHYSICAL AI)
199
MAR 30, 2026
Scaling World Model for Hierarchical Manipulation Policies
QIAN LONG, XINGHANG LI, ET AL. (ARXIV PHYSICAL AI)
200
MAR 29, 2026
Rethinking Visual-Language-Action Model Scaling: Alignment, Mixture, and Regularization
YE WANG, QIN JIN, ET AL. (ARXIV PHYSICAL AI)
201
MAR 29, 2026
ST4VLA: Spatially Guided Training for Vision-Language-Action Models
JI-LU YE, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
202
MAR 28, 2026
VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model
YANJIANG GUO, CHELSEA FINN, ET AL. (ARXIV PHYSICAL AI)
203
MAR 27, 2026
Disentangled Robot Learning via Separate Forward and Inverse Dynamics Pretraining
WENYAO ZHANG, LI ZHANG, ET AL. (ARXIV PHYSICAL AI)
204
MAR 26, 2026
A Unified and General Humanoid Whole-Body Controller for Versatile Locomotion
YUFEI XUE, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
205
MAR 26, 2026
OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction
LUJIE YANG, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
206
MAR 26, 2026
SoftMimicGen: A Data Generation System for Scalable Robot Learning in Deformable Object Manipulation
MASOUD MOGHANI, AJAY MANDLEKAR, ET AL. (ARXIV PHYSICAL AI)
207
MAR 25, 2026
Steerable Vision-Language-Action Policies for Embodied Reasoning and Hierarchical Control
WILLIAM CHEN, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
208
MAR 23, 2026
DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models
ZHIDE ZHONG, HAOANG LI, ET AL. (ARXIV PHYSICAL AI)
209
MAR 23, 2026
UniDex: A Robot Foundation Suite for Universal Dexterous Hand Control from Egocentric Human Videos
GU ZHANG, HUAZHE XU, ET AL. (ARXIV PHYSICAL AI)
210
MAR 23, 2026
WholeBodyVLA: Towards Unified Latent VLA for Whole-Body Loco-Manipulation Control
HAORAN JIANG, HONGYANG LI, ET AL. (ARXIV PHYSICAL AI)
211
MAR 22, 2026
DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos
SHENYUAN GAO, LINXIJIMFAN, ET AL. (ARXIV PHYSICAL AI)
212
MAR 19, 2026
OmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic Manipulation
YUHANG ZHENG, WENCHAO DING, ET AL. (ARXIV PHYSICAL AI)