Topic
Vision-language-action
Policies that consume pixels and language and emit robot actions directly, usually fine-tuned from a VLM backbone.
139papers in 2026-07
11.92%of all cs.RO that month
+7.1ppshare change, last 6 vs prior 12 months
24-month volume
arXiv query: cat:cs.RO AND (abs:"vision-language-action" OR abs:"VLA")
Presented at reading clubs
These already have a slide kit, so they are the fastest ones to pick up and present.
2026-02-18
Ruijie Zheng, Dantong Niu, Yuqi Xie +12 · 71 citations
2026-01-28
Brian Y. Tsui, Alan Y. Fang, Tiffany J. Hwu · 2 citations
2025-12-27
Simar Kareer, Karl Pertsch, James Darpinian +5 · 39 citations
2025-07-16
Ruihan Yang, Qinxi Yu, Yecheng Wu +12 · 131 citations
Recent work
2026-08-27
Yibo Qiu, Haoliang Ye, Shu'ang Sun +3
2026-08-27
TemporalFlow-VLA: Learning Physically Grounded Execution History for Long-Horizon Robot Manipulation
Jiarui Yang, Yehao Lu, Yuning Su +9
2026-08-27
Zineng Tang, Kelsey R. Allen, Sjoerd van Steenkiste +2
2026-08-27
Hiroki Sawada, Shunichi Kasahara
2026-08-27
Ganlong Zhao, Zijia Tang, Xingping Chen +3
2026-08-27
Jun-Hui Liu, Kun-Yu Lin, Yi-Lin Wei +9
2026-08-26
Xiaomi Embodied Intelligence Team, University of Macau, : +21
2026-08-26
Zaibin Zhang, Junlan Xiao, Zhongbo Zhang +11
2026-08-26
Jianbo Zhou, Boyuan Zhao, Yuzheng Zhang +8
2026-08-26
Yuqing Jiang, Zijian Zhang, Weitao Zhou +8
2026-08-26
Sanghwan Jang, Minjin Jeon, Minsoo Kim +3 · 1 citation
2026-08-26
Sadman Sakib, Zhangyi None Peng, Yujie Pang +2
2026-08-25
Md Selim Sarowar, Md Tanvir Islam, Sungho Kim +1
2026-08-25
Suhwan Choi, Jaeyoon Jung, Sungkyung Kim +2
2026-08-25
Zhi Cao, Howard Ji, Kevin Zhang +4
2026-08-25
Haoran Hao, Shahram Najam Syed, Jeff Schneider +1
2026-08-24
Sangoh Lee, Sangwoo Mo, Wook-Shin Han
2026-08-24
Nils Mandischer, Noah Böckmann, Ludwig Holl +1
2026-08-24
Zhiruo Zhou, Zelin Li, Xiwen Chen +4
2026-08-24
Xiwen Chen, Zelin Li, Zhiruo Zhou +3
2026-08-24
Mengao Zhao, Ziang Li, Chaodong Huang +15
2026-08-24
Lars Osterberg, Maggie Wang, Mac Schwager
2026-08-24
Jianxiang Liu, Gaojing Zhang, Chuan Wen +4
2026-08-23
Dongzhou Cheng, Ziang Li, Yixiao Zhou +6
2026-08-22
Haru Kondoh, Kei Ota, Asako Kanezaki +1
2026-08-21
Zhuoyuan Li, Rui Zhao, Jin Wang +5
2026-08-21
Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang +8
2026-08-21
Jingtao Sun, Xiaohai He, Yike Zhang +4
2026-08-21
Siyuan Ma, Yutian Zhang, Boshi Zhang +4
2026-08-20
Celina Shiyu Wang, Yiqi Zhao, Junjie Ye +2 · 1 citation
2026-08-20
Chi Kit Ng, Yidong Zhang, Lui Siu Hing +9
2026-08-20
Yanchen Guan, Xingcheng Liu, Bin Rao +7
2026-08-20
Jiaqi Wang, Zhou Fang, Qiongfeng Shi +1
2026-08-19
Prachi Garg, Steve Xing, Prahit Yaugand +2
2026-08-19
Yukiyasu Domae, Keisuke Shirai, Hanbit Oh +7
2026-08-18
Ran Chen, Jiaxing Ren, Zhikun Zhang +3
2026-08-18
Zhen Zhang, Ahmad Hafez, Peng Xie +3
2026-08-18
Zhengyan Qian, Rui Yan, Alex Jinpeng Wang +1
2026-08-18
Kaiming Zhong, Tianhua Liu, Yue Wang
269 papers in this corpus carry the vision-language-action tag. How tagging works.