Teahose.
SIGN IN
NEW HERE — WHAT TEAHOSE DOES
We read the entire AI & tech firehose — so you don't have to.
PODPodcastsAll-In, No Priors, Acquired…
NEWNewslettersStratechery, Newcomer…
PAPPapersPhysical AI research
PHProduct Huntdaily launches
VCInvestor ScoutSequoia, a16z, Benchmark…
CLAUDE DISTILLS →
7 reads, 30 sec each — free, 6 AM ET.
+ a live graph of the companies, people & themes underneath.
HOME/TOPICS/REINFORCEMENT LEARNING
// TOPIC

Reinforcement Learning

ITEMS 188ACROSS PODCASTS · NEWSLETTERS · PAPERS
// TAGGED
188 ITEMS
01
NEWSCOATUEJUL 30, 2026
The New Scaling Law
COATUE MANAGEMENT
02
PAPRARXIV PHYSICAL AIJUL 30, 2026
FA-RDP: A Frequency-Adaptive Reactive Diffusion Policy for Contact-Rich Manipulation
LIFENG ZHUO, CHUAN WEN, ET AL. (ARXIV PHYSICAL AI)
03
PAPRARXIV PHYSICAL AIJUL 30, 2026
PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball
LIZHI YANG, JUNHENG LI, AARON D. AMES
04
PODDIALECTICJUL 29, 2026
53: Zhengdong Wang - Feeling the Wave
JACKSON DAHL, ZHENG DONG WANG
05
PODTRAINING DATAJUL 29, 2026
Building the Automated AGI Lab: Core Automation's Jerry Tworek and Rohan Anil
JERRY TWOREK, PAT GRADY, ROHAN ANIL, SONYA HUANG
06
PAPRARXIV PHYSICAL AIJUL 29, 2026
ContactFlow: A video action conditioning that transfers across embodiments
SAMI AZIRAR, HERMANN BLUM, ET AL. (ARXIV PHYSICAL AI)
07
NEWSAXIOS AI+JUL 28, 2026
⭕ Nvidia's circularity
AXIOS AI+
08
PAPRARXIV PHYSICAL AIJUL 28, 2026
Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design
HUY HA, C. KAREN LIU, SHURAN SONG
09
PAPRARXIV PHYSICAL AIJUL 28, 2026
πR2: Reactive Real-time Flow Policies
SUNGJAE PARK, SHUBHAM TULSIANI
10
PAPRARXIV PHYSICAL AIJUL 27, 2026
Data Pyramid for Embodied Manipulation
YIFAN YE, SHANGHANG ZHANG, ET AL. (ARXIV PHYSICAL AI)
11
PAPRARXIV PHYSICAL AIJUL 27, 2026
WOLF-VLA: Whole-Body Humanoid Optimal Locomotion Framework for Vision-Language-Action Learning
MELYA BOUKHEDDIMI, FRANK KIRCHNER, ET AL. (ARXIV PHYSICAL AI)
12
PAPRARXIV PHYSICAL AIJUL 26, 2026
DeMaVLA: A Vision-Language-Action Foundation Model for Generalizable Deformable Manipulation
TAIYI SU, YI XU, ET AL. (ARXIV PHYSICAL AI)
13
PAPRARXIV PHYSICAL AIJUL 26, 2026
N0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens
NEOTEAI TEAM, FUDAN TEAI TEAM
14
POD20VCJUL 25, 2026
20VC: Mercor CPO on Revenue Concentration from Frontier Labs | Why Large Enterprise is Scared to Partner with Frontier Labs | Why Small Specialised Models is the Future with Osvald Nitski
HARRY STEBBINGS, OSVALD NITSKI
15
NEWSTHE AI CORNERJUL 23, 2026
Yang Zhilin's Agent Playbook: 10 Bets Founders Should Steal
THE AI CORNER
16
PAPRARXIV PHYSICAL AIJUL 22, 2026
Closing the Lab-to-Store Gap: A Data-Efficient Post-Training and Experience-Driven Learning VLA Framework for Retail Humanoids
ROGER SALA SISÓ, TRAN NGUYEN LE, ET AL. (ARXIV PHYSICAL AI)
17
PAPRARXIV PHYSICAL AIJUL 22, 2026
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
HONGYU DING, JIEBO LUO, ET AL. (ARXIV PHYSICAL AI)
18
PAPRARXIV PHYSICAL AIJUL 21, 2026
DiMaS: Distribution Matching for Steering Vision-Language-Action Models
PEGAH KHAYATAN, MATTHIEU CORD, ET AL. (ARXIV PHYSICAL AI)
19
PAPRARXIV PHYSICAL AIJUL 21, 2026
Directional Constraints for Efficient Exploration in Safe Reinforcement Learning
PAOLO MAGLIANO, R. CAMORIANO, ET AL. (ARXIV PHYSICAL AI)
20
POD晚点聊 LATETALKJUL 21, 2026
173: 对话姚颂:深鉴、东方空间、再出发,「天才少年」十年后
MANCHI, 晚点团队
21
PAPRARXIV PHYSICAL AIJUL 20, 2026
DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation
JIAN ZHU, YI XU, ET AL. (ARXIV PHYSICAL AI)
22
PODLIGHTCONEJUL 17, 2026
World Models, Explained
ANKIT GUPTA, FRANCOIS CHAUBARD
23
PAPRARXIV PHYSICAL AIJUL 17, 2026
Handroid: Bridging Dexterous Hand and Humanoid
RUOGU LI, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
24
PAPRSHANGHAI JIAO TONG UNIVERSITY RESEARCHJUL 16, 2026
Scaling Behavior Foundation Model for Humanoid Robots
WEISHUAI ZENG, JINGBO WANG, ET AL. (SHANGHAI JIAO TONG UNIVERSITY)
25
PAPRARXIV PHYSICAL AIJUL 16, 2026
RoboTTT: Context Scaling for Robot Policies
YUNFAN JIANG, LINXI "JIM" FAN, ET AL. (ARXIV PHYSICAL AI)
26
POD张小珺JÙN|商业访谈录JUL 16, 2026
146. 对Physical Intelligence柯丽一鸣4小时访谈:Pi的开源模型研究,机器人的江湖、族谱与主角
ZHANG XIAOJUN, 张小珺
27
PAPRARXIV PHYSICAL AIJUL 15, 2026
Agile perceptive multi-skill locomotion for quadrupedal robots in the wild
JUN-GILL KANG, HAE-WON PARK, ET AL. (ARXIV PHYSICAL AI)
28
PAPRARXIV PHYSICAL AIJUL 15, 2026
Never Too Late for Force: Accelerating VLA Post-Training with Reactive Force Injection
YI WANG, CEWU LU, ET AL. (ARXIV PHYSICAL AI)
29
PAPRARXIV PHYSICAL AIJUL 13, 2026
Towards Human-level Dexterous Teleoperation
PUHAO LI, SIYUAN HUANG, ET AL. (ARXIV PHYSICAL AI)
30
NEWSTHE AI CORNERJUL 10, 2026
Google’s agent broke a 56-year math record. Yours forgets yesterday
THE AI CORNER
31
PAPRARXIV PHYSICAL AIJUL 10, 2026
B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations
XIAOSHEN HAN, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
32
NEWSSTRICTLYVCJUL 9, 2026
Apple Loses Key EU Court Challenge
CONNIE LOIZOS
33
PAPRARXIV PHYSICAL AIJUL 9, 2026
ContactMimic: Humanoid Object Interaction via Contact Control
XINYAO LI, SAURABH GUPTA, ET AL. (ARXIV PHYSICAL AI)
34
PAPRARXIV PHYSICAL AIJUL 9, 2026
DexVerse: A Modular Benchmark for Multi-Task, Multi-Embodiment Dexterous Manipulation
YUNCHAO YAO, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
35
PAPRARXIV PHYSICAL AIJUL 8, 2026
TouchWorld: A Predictive and Reactive Tactile Foundation Model for Dexterous Manipulation
JIANYI ZHOU, SHUO YANG, ET AL. (ARXIV PHYSICAL AI)
36
NEWSTHE AI CORNERJUL 7, 2026
Stop prompting. Start writing loops
THE AI CORNER
37
PAPRARXIV PHYSICAL AIJUL 7, 2026
LAMP: Latent Motion Prior-Guided Real-World Learning for Dexterous Hand Manipulation
XINYE YANG, CHAO YU, ET AL. (ARXIV PHYSICAL AI)
38
PAPRARXIV PHYSICAL AIJUL 6, 2026
Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation
ZHE ZHAO, MENGSHI QI, ET AL. (ARXIV PHYSICAL AI)
39
PAPRARXIV PHYSICAL AIJUL 6, 2026
Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision
YUAN XU, LIANG WANG, ET AL. (ARXIV PHYSICAL AI)
40
PAPRARXIV PHYSICAL AIJUL 6, 2026
SILO: Simulation-in-the-Loop Sim-to-Real Transfer for Multi-Stage Cable Routing
STONE TAO, IRETIAYO AKINOLA, ET AL. (ARXIV PHYSICAL AI)
41
PAPRARXIV PHYSICAL AIJUL 5, 2026
ThinkingVLA: Interleaved Vision and Language Reasoning for Robotic Manipulation
TIANYI LU, YU-GANG JIANG, ET AL. (ARXIV PHYSICAL AI)
42
NEWSTHE AI CORNERJUL 3, 2026
Set a metric. Walk away. Let the agent optimize overnight.
THE AI CORNER
43
PAPRARXIV PHYSICAL AIJUL 3, 2026
CoDex: Learning Compositional Dexterous Functional Manipulation without Demonstrations
BOWEN JIANG, WILLIAM PAINTER REGER, ROBERTO MARTÍN-MARTÍN
44
PAPRARXIV PHYSICAL AIJUL 3, 2026
Z-1: Efficient Reinforcement Learning for Vision-Language-Action Models
LANG CAO, YITONG LI, ET AL. (ARXIV PHYSICAL AI)
45
PAPRARXIV PHYSICAL AIJUL 2, 2026
VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation
SHUAI TIAN, DONGBIN ZHAO, ET AL. (ARXIV PHYSICAL AI)
46
NEWSSTRICTLYVCJUL 1, 2026
Feds Lift Anthropic Export Restrictions
CONNIE LOIZOS
47
POD晚点聊 LATETALKJUL 1, 2026
171: 【AI季报 26Q2】从 coding 到 RSI,强者愈强的未来?
MANCHI, 晚点团队
48
PODDWARKESHJUN 30, 2026
Grant Sanderson – AI and the future of math
DWARKESH PATEL, GRANT SANDERSON
49
PAPRARXIV PHYSICAL AIJUN 30, 2026
Adapting Generalist Robot Policies with Semantic Reinforcement Learning
JAGDEEP SINGH BHATIA, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
50
PAPRARXIV PHYSICAL AIJUN 30, 2026
TactX: Learning Shared Tactile Representations Across Diverse Sensors
JUNSUNG PARK, XIAOLONG WANG, ET AL. (ARXIV PHYSICAL AI)
51
NEWSJACK CLARK FROM IMPORT AIJUN 29, 2026
Import AI 463: Self-improving robots; a 10k Chinese GPU cluster; and an elegiac essay for the human era
JACK CLARK FROM IMPORT AI
52
NEWSPOSTROUNDJUN 29, 2026
Series A activity: Week of June 21, 2026
POSTROUND
53
PODDWARKESHJUN 26, 2026
The next big breakthrough will be AIs learning on the job
DARIO AMODEI, DWARKESH PATEL
54
PODNO PRIORSJUN 26, 2026
Why Traditional Benchmarks Fail Modern AI Models with OpenAI Research Scientist Noam Brown
NOAM BROWN, SARAH GUO
55
PODTHE A16Z SHOWJUN 26, 2026
AI Is Crossing the Frontier of Human Knowledge | Kevin Weil
KEVIN WEIL, SPEAKER_01, SPEAKER_02
56
PAPRARXIV PHYSICAL AIJUN 26, 2026
DexCompose: Reusing Dexterous Policies for Multi-Task Manipulation with a Single Hand
DIHONG HUANG, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
57
PAPRARXIV PHYSICAL AIJUN 26, 2026
SimFoundry: Modular and Automated Scene Generation for Policy Learning and Evaluation
NADUN RANAWAKA, YUKE ZHU, ET AL. (ARXIV PHYSICAL AI)
58
NEWSANIMESH FROM PRAXIS CURRENTSJUN 25, 2026
Moneyball for Physical AI
ANIMESH FROM PRAXIS CURRENTS
59
PODMIT CSAILJUN 25, 2026
(Many) of Us Want Home Robots. What's the Holdup?
PULKIT AGRAWAL (MIT), GIL PRATT (EX-TOYOTA RESEARCH INSTITUTE), NEVILLE HOGAN (MIT)
60
PAPRARXIV PHYSICAL AIJUN 25, 2026
Bridging Performance and Generalization in Reinforcement Learning for Agile Flight
JONATHAN GREEN, DAVIDE SCARAMUZZA, ET AL. (ARXIV PHYSICAL AI)
61
PAPRARXIV PHYSICAL AIJUN 25, 2026
Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking
PRANAV DEBBAD, MAJID KHADIV, ET AL. (ARXIV PHYSICAL AI)
62
PAPRARXIV PHYSICAL AIJUN 24, 2026
CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation
HAONAN CHEN, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
63
PAPRARXIV PHYSICAL AIJUN 24, 2026
Play2Perfect: What Matters in Dexterous Play Pretraining for Precise Assembly?
TYLER GA WEI LUM, JEANNETTE BOHG, ET AL. (ARXIV PHYSICAL AI)
64
NEWSTHE GENERALISTJUN 23, 2026
Own or Be Owned: Why Every Company Needs Its Own AI Model (Yash Patil, Co-Founder & CEO of Applied Compute)
THE GENERALIST
65
PAPRARXIV PHYSICAL AIJUN 23, 2026
InSight: Self-Guided Skill Acquisition via Steerable VLAs
MAGGIE WANG, MAC SCHWAGER, ET AL. (ARXIV PHYSICAL AI)
66
NEWSJACK CLARK FROM IMPORT AIJUN 22, 2026
Import AI 462: Superpersuasion; self-sustaining AI; paths to ASI
JACK CLARK FROM IMPORT AI
67
PAPRARXIV PHYSICAL AIJUN 22, 2026
CoorDex: Coordinating Body and Hand Priors for Continuous Dexterous Humanoid Loco-Manipulation
SIKAI LI, MINGYU DING, ET AL. (ARXIV PHYSICAL AI)
68
PAPRARXIV PHYSICAL AIJUN 22, 2026
Learning What to Say to Your VLA: Mostly Harmless Vision Language Action Model Steering
HYUNDOO JEONG, GOKUL SWAMY, ANDREA V. BAJCSY
69
PAPRARXIV PHYSICAL AIJUN 22, 2026
PhysVLA: Towards Physically-Grounded VLA for Embodied Robotic Manipulation
NAMAI CHANDRA, SHRIRAM DAMODARAN, LIN WANG
70
PAPRARXIV PHYSICAL AIJUN 20, 2026
HITTER: A HumanoId Table TEnnis Robot via Hierarchical Planning and Learning
ZHI SU, S. SASTRY, ET AL. (ARXIV PHYSICAL AI)
71
PAPRARXIV PHYSICAL AIJUN 20, 2026
OpenHLM: An Empirical Recipe for Whole-Body Humanoid Loco-Manipulation
YINGDONG HU, YANG GAO, ET AL. (ARXIV PHYSICAL AI)
72
PODDWARKESHJUN 19, 2026
The data black hole at the center of AI
DWARKESH PATEL
73
PODNO PRIORSJUN 18, 2026
Re-engineering the Semiconductor Supply Chain with Intel CEO Lip Bu Tan
ELAD GIL, LIP BU TAN, SARAH GUO
74
PAPRARXIV PHYSICAL AIJUN 18, 2026
ENPIRE: Agentic Robot Policy Self-Improvement in the Real World
WENLI XIAO, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
75
PAPRARXIV PHYSICAL AIJUN 17, 2026
Object-Centric Residual RL for Zero-Shot Sim-to-Real VLA Enhancement
KINAM KIM, YASUYUKI MATSUSHITA, ET AL. (ARXIV PHYSICAL AI)
76
PODTRAINING DATAJUN 16, 2026
Simulating Humans at Scale: Simile's Joon Sung Park
JOON SUNG PARK, SONYA HUANG
77
PAPRARXIV PHYSICAL AIJUN 15, 2026
Kairos: A Native World Model Stack for Physical AI
KAIROS TEAM, XIAOGANG WANG, ET AL. (ARXIV PHYSICAL AI)
78
PAPRARXIV PHYSICAL AIJUN 15, 2026
T-Rex: Tactile-Reactive Dexterous Manipulation
DANTONG NIU, TREVOR DARRELL, ET AL. (ARXIV PHYSICAL AI)
79
PAPRARXIV PHYSICAL AIJUN 12, 2026
Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack
HE ZHANG, ZHENGYOU ZHANG, ET AL. (ARXIV PHYSICAL AI)
80
PAPRARXIV PHYSICAL AIJUN 11, 2026
Improving Robotic Generalist Policies via Flow Reversal Steering
ANDY TANG, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
81
PAPRARXIV PHYSICAL AIJUN 11, 2026
Mana: Dexterous Manipulation of Articulated Tools
ZHAO-HENG YIN, C. KAREN LIU, ET AL. (ARXIV PHYSICAL AI)
82
PAPRARXIV PHYSICAL AIJUN 10, 2026
CHORUS: Decentralized Multi-Embodiment Collaboration with One VLA Policy
RIA DOSHI, JEANNETTE BOHG, ET AL. (ARXIV PHYSICAL AI)
83
PAPRARXIV PHYSICAL AIJUN 10, 2026
FACTR 2: Learning External Force Sensing for Commodity Robot Arms Improves Policy Learning
STEVEN OH, DEEPAK PATHAK, ET AL. (ARXIV PHYSICAL AI)
84
PAPRARXIV PHYSICAL AIJUN 9, 2026
IMPACT: Learning Internal-Model Predictive Control for Forceful Robotic Manipulation
JIAWEI GAO, YILUN DU, ET AL. (ARXIV PHYSICAL AI)
85
PAPRARXIV PHYSICAL AIJUN 9, 2026
TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation
YUJIE ZANG, WENCHAO DING, ET AL. (ARXIV PHYSICAL AI)
86
NEWSJACK CLARK FROM IMPORT AIJUN 8, 2026
Import AI 460: Reward hacking society, RSI data from Anthropic; and RL-based quadcopter racing
JACK CLARK FROM IMPORT AI
87
PAPRARXIV PHYSICAL AIJUN 5, 2026
Shield-Loco: Shielding Locomotion Policies with Predictive Safety Filtering
ADITYA SHIRWATKAR, MAJID KHADIV, ET AL. (ARXIV PHYSICAL AI)
88
PODSTANFORD ETLJUN 3, 2026
Brendan Foody (Mercor) — Agentic Data and the Future of AI
BRENDAN FOODY (MERCOR FOUNDER/CEO), STANFORD ETL HOST
89
PAPRARXIV PHYSICAL AIJUN 3, 2026
FlowPRO: Reward-Free Reinforced Fine-Tuning of Flow-Matching VLAs via Proximalized Preference Optimization
YIHAO WU, ZHENGYOU ZHANG, ET AL. (ARXIV PHYSICAL AI)
90
PAPRARXIV PHYSICAL AIJUN 3, 2026
GRAIL: Generating Humanoid Loco-Manipulation from 3D Assets and Video Priors
TIANYI XIE, YE YUAN, ET AL. (ARXIV PHYSICAL AI)
91
PAPRARXIV PHYSICAL AIJUN 2, 2026
Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
ZEKUN QI, LI YI, ET AL. (ARXIV PHYSICAL AI)
92
PAPRARXIV PHYSICAL AIJUN 2, 2026
RDGen: Demonstration Generation for High-Quality Robot Learning via Reinforcement Learning
ZIJIA ZHU, XINHAI SUN, ET AL. (ARXIV PHYSICAL AI)
93
PAPRARXIV PHYSICAL AIJUN 1, 2026
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
SHENGYUN SI, YU-GANG JIANG, ET AL. (ARXIV PHYSICAL AI)
94
PAPRARXIV PHYSICAL AIMAY 29, 2026
How to Instruct Your Robot: Dense Language Annotations Power Robot Policy Learning
BOSUNG KIM, PRITHVIRAJ AMMANABROLU, ET AL. (ARXIV PHYSICAL AI)
95
PAPRARXIV PHYSICAL AIMAY 28, 2026
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
ZHONGXI CHEN, WENZHAO LIAN, ET AL. (ARXIV PHYSICAL AI)
96
PAPRARXIV PHYSICAL AIMAY 28, 2026
EXPO-FT: Sample-Efficient Reinforcement Learning Finetuning for Vision-Language-Action Models
PERRY DONG, CHELSEA FINN, ET AL. (ARXIV PHYSICAL AI)
97
PAPRARXIV PHYSICAL AIMAY 27, 2026
Humanoid Everyday: A Comprehensive Robotic Dataset for Open-World Humanoid Manipulation
ZHENYU ZHAO, YUE WANG, ET AL. (ARXIV PHYSICAL AI)
98
PODTRAINING DATAMAY 26, 2026
How Cursor Trained Composer on Fireworks: Distributed Infrastructure for High-Performance RL
DMYTRO DZHULGAKOV, FEDERICO CASSANO, SONYA HUANG
99
PAPRUNIVERSITY OF TOKYO, NABLAS RESEARCHMAY 26, 2026
When Absolute State Fails: Evaluating Proprioceptive Encodings for Robust Manipulation
MAXIME ALVAREZ, GENKI SANO, ET AL. (UNIVERSITY OF TOKYO, NABLAS)
100
PODCHIPSTRATMAY 25, 2026
Deepu Talla (NVIDIA) on the Three-Computer Physical AI Stack
DEEPU TALLA (NVIDIA VP ROBOTICS & EDGE AI), AUSTIN LYONS (CHIPSTRAT)
101
POD晚点聊 LATETALKMAY 25, 2026
166: 许华哲再次具身创业:不想错过最大的西瓜
MANCHI, 晚点团队
102
PAPRARXIV PHYSICAL AIMAY 22, 2026
Towards Long-horizon Embodied Agents with Tool-Aligned Vision-Language-Action Models
ZIXING LEI, SIHENG CHEN, ET AL. (ARXIV PHYSICAL AI)
103
NEWSTHE AI CORNERMAY 21, 2026
How to 10x any AI skill using Karpathy's Autoresearch method
THE AI CORNER
104
PAPRARXIV PHYSICAL AIMAY 21, 2026
Factored Diffusion Policies:Compositionally Generalized Robot Control with a Single Score Network
SAYAN MITRA, ABHISHEK PAI, ET AL. (ARXIV PHYSICAL AI)
105
PAPRARXIV PHYSICAL AIMAY 21, 2026
Judge, Then Drive: A Critic-Centric Vision Language Action Framework for Autonomous Driving
LIJIN YANG, HAO YANG, ET AL. (ARXIV PHYSICAL AI)
106
PAPRARXIV PHYSICAL AIMAY 21, 2026
Superhuman Safe and Agile Racing through Multi-Agent Reinforcement Learning
ISMAIL GELES, DAVIDE SCARAMUZZA, ET AL. (ARXIV PHYSICAL AI)
107
NEWSJACK CLARK FROM IMPORT AIMAY 18, 2026
Import AI 457: AI stuxnet; cursed Muon optimizer; and positive alignment
JACK CLARK FROM IMPORT AI
108
POD晚点聊 LATETALKMAY 18, 2026
165: 英伟达 GEAR 高深远:世界模型、自进化循环、DreamDojo
MANCHI, 晚点团队
109
PODDWARKESHMAY 15, 2026
Eric Jang – Building AlphaGo from scratch
DWARKESH PATEL, ERIC JANG
110
PAPRARXIV PHYSICAL AIMAY 15, 2026
RLDX-1 Technical Report
DONGYOUNG KIM, JINWOO SHIN, ET AL. (ARXIV PHYSICAL AI)
111
PODTHE A16Z SHOWMAY 13, 2026
Energy, Minerals, and the Physical Stack Behind AI
DREW BAGLINO, ERIN PRICE-WRIGHT, TURNER CALDWELL
112
PAPRARXIV PHYSICAL AIMAY 13, 2026
What to Ignore, What to React: Visually Robust RL Fine-Tuning of VLA Models
YUANFANG PENG, RUI WANG, ET AL. (ARXIV PHYSICAL AI)
113
NEWSJACK CLARK FROM IMPORT AIMAY 4, 2026
Import AI 455: AI systems are about to start building themselves.
JACK CLARK FROM IMPORT AI
114
PAPRARXIV PHYSICAL AIMAY 4, 2026
$\Delta$VLA: Prior-Guided Vision-Language-Action Models via World Knowledge Variation
YIJIE ZHU, ZITONG YU, ET AL. (ARXIV PHYSICAL AI)
115
PODLIGHTCONEMAY 1, 2026
Beyond Bigger Models: Recursion As The Next Scaling Law In AI
ANKIT GUPTA, FRANCOIS CHAUBARD
116
PAPRARXIV PHYSICAL AIMAY 1, 2026
Learning while Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies
YI WANG, JIANLAN LUO, ET AL. (ARXIV PHYSICAL AI)
117
PODSEQUOIA AI ASCENTAPR 30, 2026
Jim Fan — VLAs Are Dead, WAMs Are Next
JIM FAN (NVIDIA GEAR), HOST (SEQUOIA)
118
PODTRAINING DATAAPR 30, 2026
Andrej Karpathy: From Vibe Coding to Agentic Engineering
ANDREJ KARPATHY, STEPHANIE ZHAN
119
PAPRARXIV PHYSICAL AIAPR 30, 2026
LaST-R1: Reinforcing Action via Adaptive Physical Latent Reasoning for VLA Models
HAO CHEN, PHENG-ANN HENG, ET AL. (ARXIV PHYSICAL AI)
120
POD晚点聊 LATETALKAPR 30, 2026
163: 详解DeepSeekV4:Infra巨鲸、百万上下文走进现实、极致效率优化
MANCHI, 晚点团队
121
PODAI + A16ZAPR 28, 2026
Why We Need Continual Learning
ELENA BURGER, MALIKA AUBAKIROVA
122
NEWSSTRICTLYVCAPR 28, 2026
OpenAI and Microsoft Make Nice
STRICTLYVC
123
PAPRARXIV PHYSICAL AIAPR 24, 2026
dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
YAXUAN LI, YICHEN ZHU, ET AL. (ARXIV PHYSICAL AI)
124
POD张小珺JÙN|商业访谈录APR 24, 2026
138. 对罗福莉3.5小时访谈:AI范式已然巨变!OpenClaw、Agent范式很吃后训练、卡的分配、组织平权
ZHANG XIAOJUN, 张小珺
125
PAPRARXIV PHYSICAL AIAPR 22, 2026
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
ADRIANA AIDA, PAVAN UPPUTURI, ET AL. (ARXIV PHYSICAL AI)
126
POD张小珺JÙN|商业访谈录APR 20, 2026
137. 对洪乐潼的4小时访谈:AI for Math、把数学变成Lean、数学天书中的证明、直觉、被创造与被发现的
ZHANG XIAOJUN, 张小珺
127
PAPRARXIV PHYSICAL AIAPR 19, 2026
FLASH: Fast Learning via GPU-Accelerated Simulation for High-Fidelity Deformable Manipulation in Minutes
SIYUAN LUO, FAN SHI, ET AL. (ARXIV PHYSICAL AI)
128
PAPRARXIV PHYSICAL AIAPR 19, 2026
Novel Algorithms for Smoothly Differentiable and Efficiently Vectorizable Contact Manifold Construction
ONUR BEKER, GEORG MARTIUS, ET AL. (ARXIV PHYSICAL AI)
129
PODTHE A16Z SHOWAPR 17, 2026
From Models to Mobility: Building Waymo with Dmitri Dolgov
A16Z PRODUCER / ANNOUNCER, DMITRI DOLGOV, JOHN COLLISON, UNLABELED SPEAKER / INTERJECTION
130
PAPRARXIV PHYSICAL AIAPR 16, 2026
DEX-Mouse: A Low-cost Portable and Universal Interface with Force Feedback for Data Collection of Dexterous Robotic Hands
JOONHO KOH, CHANGJOO NAM, ET AL. (ARXIV PHYSICAL AI)
131
PAPRARXIV PHYSICAL AIAPR 16, 2026
Switch: Learning Agile Skills Switching for Humanoid Robots
YUEN-FUI LAU, PING TAN, ET AL. (ARXIV PHYSICAL AI)
132
NEWSTHE GENERALISTAPR 14, 2026
How a 20-Person Startup Won Gold at the Math Olympiad—Tying With OpenAI & DeepMind (Tudor Achim, CEO of Harmonic)
THE GENERALIST
133
PAPRARXIV PHYSICAL AIAPR 14, 2026
Learning Versatile Humanoid Manipulation with Touch Dreaming
YARU NIU, DING ZHAO, ET AL. (ARXIV PHYSICAL AI)
134
PAPRARXIV PHYSICAL AIAPR 13, 2026
Simulator Adaptation for Sim-to-Real Learning of Legged Locomotion via Proprioceptive Distribution Matching
JEREMY DAO, ALAN FERN
135
PAPRARXIV PHYSICAL AIAPR 13, 2026
Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models
ZHILONG ZHANG, YANG YU, ET AL. (ARXIV PHYSICAL AI)
136
NEWSTHE VC CORNERAPR 10, 2026
Jensen Huang: 10 Lessons From the CEO Building the Most Important Company in History
THE VC CORNER
137
PAPRARXIV PHYSICAL AIAPR 9, 2026
Learning Humanoid Standing-up Control across Diverse Postures
TAO HUANG, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
138
PAPRARXIV PHYSICAL AIAPR 9, 2026
RPL: Learning Robust Humanoid Perceptive Locomotion on Challenging Terrains
YUANHANG ZHANG, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
139
PAPRARXIV PHYSICAL AIAPR 9, 2026
Sumo: Dynamic and Generalizable Whole-Body Loco-Manipulation
JOHN Z. ZHANG, SIMON LE CLÉAC'H, ET AL. (ARXIV PHYSICAL AI)
140
PAPRARXIV PHYSICAL AIAPR 8, 2026
CMP: Robust Whole-Body Tracking for Loco-Manipulation via Competence Manifold Projection
ZIYANG CHENG, JIWEN LU, ET AL. (ARXIV PHYSICAL AI)
141
PAPRARXIV PHYSICAL AIAPR 6, 2026
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
YANRU WU, YUE WANG, ET AL. (ARXIV PHYSICAL AI)
142
PAPRARXIV PHYSICAL AIAPR 5, 2026
Adaptive Action Chunking at Inference-time for Vision-Language-Action Models
YUANCHANG LIANG, PRAHLAD VADAKKEPAT, ET AL. (ARXIV PHYSICAL AI)
143
PAPRARXIV PHYSICAL AIAPR 5, 2026
Not All Features Are Created Equal: A Mechanistic Study of Vision-Language-Action Models
BRYCE GRANT, XIJIA ZHAO, PENG WANG
144
PAPRARXIV PHYSICAL AIAPR 4, 2026
ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
YANDAN YANG, MU XU, ET AL. (ARXIV PHYSICAL AI)
145
PODTHE A16Z SHOWAPR 3, 2026
Marc Andreessen on AI Winters and Agent Breakthroughs
ALESSIO FANELLI, ANNOUNCER / EPISODE INTRO, INTERRUPTION / BRIEF INTERJECTION, MARC ANDREESSEN, SWYX (SHAWN WANG)
146
PODLENNY'SAPR 2, 2026
An AI state of the union: We’ve passed the inflection point, dark factories are coming, and automation timelines | Simon Willison
LENNY RACHITSKY, SIMON WILLISON
147
PAPRARXIV PHYSICAL AIAPR 2, 2026
ForeAct: Steering Your VLA with Efficient Visual Foresight Planning
ZHUOYANG ZHANG, SONG HAN, ET AL. (ARXIV PHYSICAL AI)
148
POD晚点聊 LATETALKAPR 2, 2026
157: 具身季报26Q1:人形再思考、英伟达世界模型、高自由度灵巧手
MANCHI, 晚点团队
149
PAPRARXIV PHYSICAL AIAPR 1, 2026
Functional Force-Aware Retargeting from Virtual Human Demos to Soft Robot Policies
UKSANG YOO, HARSHA PRAHLAD, ET AL. (ARXIV PHYSICAL AI)
150
PAPRARXIV PHYSICAL AIAPR 1, 2026
SMASH: Mastering Scalable Whole-Body Skills for Humanoid Ping-Pong with Egocentric Vision
JUNLI REN, PING LUO, ET AL. (ARXIV PHYSICAL AI)
151
PODINVEST LIKE THE BESTMAR 31, 2026
Sergey Levine - Building LLMs for the Physical World - [Invest Like the Best, EP.465]
PATRICK O'SHAUGHNESSY, SERGEY LEVINE, SHOW DISCLAIMER
152
PAPRARXIV PHYSICAL AIMAR 31, 2026
Coordinated Humanoid Manipulation with Choice Policies
HAOZHI QI, JITENDRA MALIK, ET AL. (ARXIV PHYSICAL AI)
153
PAPRARXIV PHYSICAL AIMAR 31, 2026
DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA
YI CHEN, XIHUI LIU, ET AL. (ARXIV PHYSICAL AI)
154
NEWSJACK CLARK FROM IMPORT AIMAR 30, 2026
Import AI 451: Political superintelligence; Google's society of minds, and a robot drummer
JACK CLARK FROM IMPORT AI
155
PAPRARXIV PHYSICAL AIMAR 30, 2026
SOLE-R1: Video-Language Reasoning as the Sole Reward for On-Robot Reinforcement Learning
PHILIP SCHROEDER, ONDREJ BIZA, ET AL. (ARXIV PHYSICAL AI)
156
PAPRARXIV PHYSICAL AIMAR 30, 2026
Scaling World Model for Hierarchical Manipulation Policies
QIAN LONG, XINGHANG LI, ET AL. (ARXIV PHYSICAL AI)
157
POD张小珺JÙN|商业访谈录MAR 30, 2026
134. 和谢晨聊“数据的综述”:AI和机器人数据的历史、版图、金字塔与Recipe
ZHANG XIAOJUN, 张小珺
158
PAPRARXIV PHYSICAL AIMAR 28, 2026
VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model
YANJIANG GUO, CHELSEA FINN, ET AL. (ARXIV PHYSICAL AI)
159
PODLIGHTCONEMAR 27, 2026
How François Chollet Is Building A New Path To AGI
FRANÇOIS CHOLLET, HOST 1 (Y COMBINATOR), HOST 2 (Y COMBINATOR), HOST 3 (Y COMBINATOR), HOST 4 (Y COMBINATOR)
160
PAPRARXIV PHYSICAL AIMAR 26, 2026
A Unified and General Humanoid Whole-Body Controller for Versatile Locomotion
YUFEI XUE, JIANGMIAO PANG, ET AL. (ARXIV PHYSICAL AI)
161
PAPRARXIV PHYSICAL AIMAR 26, 2026
OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction
LUJIE YANG, GUANYA SHI, ET AL. (ARXIV PHYSICAL AI)
162
PAPRMIT RESEARCHMAR 25, 2026
Open-World Task and Motion Planning via Vision-Language Model Generated Constraints
NISHANTH KUMAR, CAELAN REED GARRETT, ET AL. (MIT)
163
PAPRARXIV PHYSICAL AIMAR 25, 2026
Steerable Vision-Language-Action Policies for Embodied Reasoning and Hierarchical Control
WILLIAM CHEN, SERGEY LEVINE, ET AL. (ARXIV PHYSICAL AI)
164
NEWSTHE GENERALISTMAR 24, 2026
Why One Superintelligence Is More Dangerous Than a Thousand (Vincent Weisser, CEO & Co-Founder of Prime Intellect)
THE GENERALIST
165
PODTRAINING DATAMAR 24, 2026
How Autonomous Labs Will Transform Scientific Research: Ginkgo Bioworks’ Jason Kelly
JASON KELLY, PAT GRADY, SONYA HUANG
166
PAPRARXIV PHYSICAL AIMAR 23, 2026
DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models
ZHIDE ZHONG, HAOANG LI, ET AL. (ARXIV PHYSICAL AI)
167
PODNO PRIORSMAR 20, 2026
Andrej Karpathy on Code Agents, AutoResearch, and the Loopy Era of AI
ANDREJ KARPATHY, SARAH GUO
168
PAPRMIT RESEARCHMAR 19, 2026
Scaling Sim-to-Real Reinforcement Learning for Robot VLAs with Generative 3D Worlds
ANDREW CHOI, WEI XU, ET AL. (MIT)
169
PAPRARXIV PHYSICAL AIMAR 19, 2026
OmniVTA: Visuo-Tactile World Modeling for Contact-Rich Robotic Manipulation
YUHANG ZHENG, WENCHAO DING, ET AL. (ARXIV PHYSICAL AI)
170
NEWSTHE GENERALISTMAR 17, 2026
Why Robots Still Struggle With Simple Tasks (And What Might Finally Change That) | Karol Hausman, Co-Founder & CEO…
KAROL HAUSMAN (PHYSICAL INTELLIGENCE CO-FOUNDER/CEO), MARIO GABRIELE
171
PODTEDMAR 13, 2026
Bernt Børnich (1X) — Meet NEO, Your Robot Butler in Training
BERNT BØRNICH (1X FOUNDER/CEO)
172
PODCLIMB BY VSCMAR 12, 2026
Jagdeep Singh (Rhoda AI) — 10 Hours, Not 10,000: $450M to Train Robots on YouTube
JAGDEEP SINGH (RHODA AI CO-FOUNDER/CEO), HOST
173
PODTURN THE LENSJAN 24, 2026
Pete Florence (Generalist) — Scaling Laws, Train One Improve All
PETE FLORENCE (GENERALIST CO-FOUNDER/CEO), JEFF FRICK
174
PODHUMANOIDS SUMMITDEC 11, 2025
Pete Florence (Generalist) — Why Robot Intelligence Will Be General
PETE FLORENCE (GENERALIST CO-FOUNDER/CEO), HUMANOIDS SUMMIT HOST
175
POD晚点聊 LATETALK (INVESTIGATIVE JOURNALISM)DEC 11, 2025
From "Large and Strong" to "Small and Strong": Density Laws, RL Scaling Laws, and the Distributed Future of Intelligence
曼奇, 劉志遠, 蕭朝軍
176
PODNO PRIORSDEC 6, 2025
No Priors Ep. 142 | With Harvey Co-Founder and President Gabe Pereyra
177
POD20VCDEC 1, 2025
Turing CEO, Jonathan Siddharth: Who Wins in Data Labelling & Why SaaS Will Die?
HARRY STEBBINGS, JONATHAN SIDDHARTH
178
PODLEX FRIDMANNOV 30, 2025
Michael Levin: Reality is an Illusion - Alien Intelligence, Biology, Life | Lex Fridman Podcast #486
LEX FRIDMAN, MICHAEL LEVIN
179
POD张小珺JÙN|商业访谈录 (ZHANG XIAOJUN BUSINESS INTERVIEWS)NOV 28, 2025
Interview with DeepMind's Jie Tan: Robotics, Cross-Embodiment, World Models, Gemini Robotics 1.5, and Google
JIE TAN, ZHANG XIAOJUN
180
PODDWARKESHNOV 25, 2025
Ilya Sutskever – We're moving from the age of scaling to the age of research
DWARKESH PATEL, ILYA SUTSKEVER
181
POD晚点聊 LATETALK (INVESTIGATIVE JOURNALISM)NOV 24, 2025
142: How a Self-Teaching AI Product Emerges | Dialogue with Zebra CPO Xiu Jiaming
XIU JIAMING
182
PODNO PRIORSNOV 20, 2025
No Priors Ep. 141 | With Sunday Robotics Co-Founders Tony Zhao and Cheng Chi
UNKNOWN HOST, UNKNOWN GUEST, CHENG CHI, TONY ZHAO
183
POD晚点聊 LATETALK (INVESTIGATIVE JOURNALISM)NOV 10, 2025
140: AI for Science, From the Beginning to Now | Dialogue with Zhang Linfeng and Sun Weijie from DeepWisdom
曼奇, 孫惠傑, 張林峰
184
PODA16Z PODCASTNOV 8, 2025
Amjad Masad & Adam D’Angelo: How Far Are We From AGI?
AMJAD MASAD, AMJAD MASAD, ADAM D'ANGELO
185
PODZHANG XIAOYUN'SOCT 31, 2025
Interview with Li Xiang (Part 2): CEO Large Model, MoE, Liang Wenfeng, VLA, Energy, Memory, Confronting Human Nature, Intimate Relationships, Human Wisdom
LI XIANG
186
PODDWARKESHOCT 17, 2025
Andrej Karpathy — “We’re summoning ghosts, not building animals”
187
PODONE-OFF EPISODESSEP 12, 2025
Fully autonomous robots are much closer than you think – Sergey Levine
SERGEY LEVINE, DWARKESH PATEL
188
PODONE-OFF EPISODESSEP 4, 2025
AI Robots for Your Laundry w/Lindon Gao LIVE FROM CLEAN - S6E103 The Laundromat Millionaire Show✈️
DAVID CARLEMAN, DAVID CARLEMAN, LINDON GAO, CRAIG TAYLOR
Reinforcement Learning: Podcast & Newsletter Summaries | Teahose