← 开源
zchoi

Awesome-Embodied-Robotics-and-Agent

This is a curated list of "Embodied AI or robot with Large Language Models" research. Watch this repository for the latest updates! 🔥

ListsPaper collections
在 GitHub 打开
增长势头
+-124 小时新增 Star-0.1%
1.90k
Star
99
Fork
+4
本周
22
贡献者
创建于 2023-07-19 · 更新于 2026-10-06 · 今日第 18314 名
主要开发者
README

🤖 Awesome Embodied Robotics and Agent Awesome

This is a curated list of "Embodied robotics or agent with Vision-Language Models (VLMs) and Large Language Models (LLMs)" research which is maintained by haonan.

Watch this repository for the latest updates and feel free to raise pull requests if you find some interesting papers!

News🔥

[2026/09/10] 🎉 Our survey paper "A Survey on Efficient Vision-Language-Action Models" has been accepted by IEEE TPAMI!

[2026/05/11] 🎉 Add NavSpace: How Intelligent Agents Follow Spatial Intelligence Instructions (ICRA 2026), the first benchmark for evaluating spatial intelligence in embodied navigation, with open-sourced dataset, evaluation code, and baseline SNav. [arXiv] [Github]

[2025/10/30] 🎉 Our survey paper "A Survey on Efficient Vision-Language-Action Models" [arXiv] has been released!

[2025/04/23] Add π-0.5, a lightweight and modular framework designed to integrate perception, control, and learning directly within physical systems.

[2025/03/18] Add some popular vision-language action (VLA) models. 🦾

[2024/06/28] Created a new board about agent self-evolutionary research. 🤖

[2024/06/07] Add Mobile-Agent-v2, a mobile device operation assistant with effective navigation via multi-agent collaboration. 🚀

[2024/05/13] Add "Learning Interactive Real-World Simulators"——outstanding paper award in ICLR 2024 🥇.

[2024/04/24] Add "A Survey on Self-Evolution of Large Language Models", a systematic survey on self-evolution in LLMs! 💥

[2024/04/16] Add some CVPR 2024 papers.

[2024/04/15] Add MetaGPT, accepted for oral presentation (top 1.2%) at ICLR 2024, ranking #1 in the LLM-based Agent category. 🚀

[2024/03/13] Add CRADLE, an interesting paper exploring LLM-based agent in Red Dead Redemption II!🎮

Development of Embodied Robotics and Benchmarks

Figure 1. The Organization of Our Survey. We systematically categorize efficient VLAs into three core pillars: (1) Efficient Model Design, encompassing efficient architectures and model compression techniques, (2) Efficient Training, covering efficient pre-training and post-training strategies, and (3) Efficient Data Collection, including efficient data collection and augmentation methods. The framework also reviews VLA foundations, key applications, challenges, and future directions, establishing the groundwork for advancing scalable embodied intelligence.

Table of Contents 🍃

Methods

Survey

Jungseob Lee

Korea University

Zhaoshu Yu1, Bo Wang1, Pengpeng Zeng1, Haonan Zhang1, Ji Zhang1, Lianli Gao3, Jingkuan Song1, Nicu Sebe4, Heng Tao Shen1

1 Tongji University, 2 Southwest Jiaotong University, 3 University of Electronic Science and Technology of China, 4 University of Trento

The Chinese University of Hong Kong, Huawei Noah’s Ark Lab

Junlin Xie♣♡ Zhihong Chen♣♡ Ruifei Zhang♣♡ Xiang Wan♣ Guanbin Li♠

♡The Chinese University of Hong Kong, Shenzhen ♣Shenzhen Research Institute of Big Data, ♠Sun Yat-sen University

Key Lab of HCST (PKU), MOE; School of Computer Science, Peking University, Alibaba Group, Nanyang Technological University

Stanford University, Microsoft Research, Redmond, University of California, Los Angeles, University of Washington, Microsoft Gaming

Shanghai Jiao Tong University, Amazon Web Services, Yale University

Fudan NLP Group, miHoYo Inc

Gaoling School of Artificial Intelligence, Renmin University of China

Vision-Language-Action Model

AMAP CV Lab, Alibaba Group

Stanford University, Seoul National University, MAUM.AI

Michał Zawalski∗1,2, William Chen∗1, Karl Pertsch1,3 Oier Mees1, Chelsea Finn3, Sergey Levine1

1UC Berkeley, 2University of Warsaw, 3Stanford University

Physical Intelligence

Physical Intelligence

Physical Intelligence

Stanford University, UC Berkeley, Toyota Research Institute, Google Deepmind, Physical Intelligence, MIT

Physical Intelligence

Google Deepmind

Zhejiang University; Institute of Software, Chinese Academy of Sciences; Alibaba Group

Self-Evolving Agents

Kui Wu1, Shuhang Xu2, Hao Chen3, Churan Wang4, Zhoujun Li1, Yizhou Wang4, Fangwei Zhong2

1Beihang University, 2Beijing Normal University, 3City University of Macau, 4Peking University

Kui Wu1, Hao Chen2, Churan Wang3, Fakhri Karray4, Zhoujun Li1, Yizhou Wang3, Fangwei Zhong5

1Beihang University, 2City University of Macau, 3Peking University, 4Mohamed bin Zayed University of Artificial Intelligence, 5Beijing Normal University

Kui Wu1, Hao Chen2, Jinzhu Han3, Haijun Liu4, Churan Wang5, Yizhou Wang6, Zhoujun Li1, Si Liu1, Fangwei Zhong3

1Beihang University, 2City University of Macau, 3Beijing Normal University, 4Minzu University of China, 5Peking University Third Hospital, 6Peking University

Tianhao Wei1*, Liqian Ma12*, Rui Chen1, Weiye Zhao1, Changliu Liu1

1Carnegie Mellon University 2Tsinghua University

Fudan NLP Lab & Fudan Vision and Learning Lab

Fangzhi Xu♢♡, Qiushi Sun2, ♡, Kanzhi Cheng1, Jun Liu♢, Yu Qiao♡, Zhiyong Wu♡

♢Xi’an Jiaotong University, ♡Shanghai Artificial Intelligence Laboratory, 1The University of Hong Kong, 2Nanjing Univerisity

Wangchunshu Zhou, Yixin Ou, Shengwei Ding, Long Li, Jialong Wu, Tiannan Wang, Jiamin Chen, Shuai Wang, Xiaohua Xu, Ningyu Zhang, Huajun Chen, Yuchen Eleanor Jiang

AIWaves Inc. https://meta-control-paper.github.io/

Advanced Agent Applications

Tianhao Wei1*, Liqian Ma12*, Rui Chen1, Weiye Zhao1, Changliu Liu1

*Equal Contribution 1Carnegie Mellon University 2Tsinghua University

Seamlessly integrate state-of-the-art transformer models into robotics stacks.

Junyang Wang1, Haiyang Xu2, Haitao Jia1, Xi Zhang2, Ming Yan2, Weizhou Shen2, Ji Zhang2, Fei Huang2, Jitao Sang1

1Beijing Jiaotong University 2Alibaba Group

Junyang Wang1, Haiyang Xu2, Jiabo Ye2, Ming Yan2, Weizhou Shen2, Ji Zhang2, Fei Huang2, Jitao Sang1

1Beijing Jiaotong University 2Alibaba Group

  • [Machinascript-for-robots] [Github]

Build LLM-powered robots in your garage with MachinaScript For Robots!

LLM-powered robot diagnostics for ROS 2 — fault detection, root cause analysis, and self-healing via MCP.

Lirui Zhao1,2 Yue Yang2,4 Kaipeng Zhang2 Wenqi Shao2, Yuxin Zhang1, Yu Qiao2, Ping Luo2,3 Rongrong Ji1

1Xiamen University, 2OpenGVLab, Shanghai AI Laboratory 3The University of Hong Kong, 4Shanghai Jiao Tong University

DeepWisdom, AI Initiative, King Abdullah University of Science and Technology, Xiamen University, The Chinese University of Hong Kong, Shenzhen, Nanjing University, University of Pennsylvania, University of California, Berkeley, The Swiss AI Lab IDSIA/USI/SUPSI

Chi Zhang∗ ZhaoYang∗ JiaxuanLiu∗ YuchengHan XinChen Zebiao Huang BinFu GangYu†

Tencent

LLMs with RL or World Model

Kaixiang Yao1*, Xu Wang1*, Miao Pan1, Hu Xiyue1, Weishi Wang2, Daniel Dahlmeier2, Jintao Chen1, Yongliang Shen1, Xuhong Zhang1, Wenqi Zhang1

*Equal Contribution 1Zhejiang University 2SAP

Kangrui Wang, Pingyue Zhang, Zihan Wang, Yaning Gao, Linjie Li, Qineng Wang, Hanyang Chen, Chi Wan, Yiping Lu, Zhengyuan Yang, Lijuan Wang, Ranjay Krishna, Jiajun Wu, Li Fei-Fei, Yejin Choi, Manling Li

Jing-Cheng Pang, Si-Hang Yang, Kaiyuan Li, Jiaji Zhang, Xiong-Hui Chen, Nan Tang, Yang Yu

1Nanjing University, 2Polixir.ai

Sherry Yang1,2, Yilun Du3, Kamyar Ghasemipour2, Jonathan Tompson2, Leslie Kaelbling3, Dale Schuurmans2, Pieter Abbeel1

1UC Berkeley, 2Google DeepMind, 3MIT

Jonathan Richens*, TomEveritt

Google DeepMind

Yijun Yang154, Tianyi Zhou2, Kanxue Li3, Dapeng Tao3, Lvsong Li4, Li Shen4, Xiaodong He4, Jing Jiang5, Yuhui Shi1

1Southern University of Science and Technology, 2University of Maryland, College Park, 3Yunnan University, 4JD Explore Academy, 5University of Technology Sydney

Lin_Guan1, Karthik Valmeekam1, Sarath Sreedharan2, Subbarao Kambhampati1

1School of Computing & AI Arizona State University Tempe, AZ, 2Department of Computer Science Colorado State University Fort Collins, CO

Jason Ma1,2, William Liang2, Guanzhi Wang1,3, De-An Huang1, Osbert Bastani2, Dinesh Jayaraman2, Yuke Zhu1,4, Linxi "Jim" Fan1, Anima Anandkumar1,3

1NVIDIA; 2UPenn; 3Caltech; 4UT Austin

Ademi Adeniji, Amber Xie, Carmelo Sferrazza, Younggyo Seo, Stephen James, Pieter Abbeel

1UC Berkeley

Yuqing Du1*, Olivia Watkins1*, Zihan Wang2, Cedric Colas ´3,4, Trevor Darrell1, Pieter Abbeel1, Abhishek Gupta2, Jacob Andreas3

1Department of Electrical Engineering and Computer Science, University of California, Berkeley, USA 2University of Washington, Seattle 3Massachusetts Institute of Technology, Computer Science and Artificial Intelligence Laboratory 4 Inria, Flowers Laboratory.

Planning and Manipulation or Pretraining

Kangrui Wang, Linjie Li, Zhengyuan Yang, Shiqi Chen, Zihan Wang, Li Fei-Fei, Jiajun Wu, Leonidas Guibas, Lijuan Wang, Manling Li

Ruiying Li*, Yunlang Zhou*, YuYao Zhu, Kylin Chen, Jingyuan Wang, Sukai Wang, Kongtao Hu, Minhui Yu, Bowen Jiang, Zhan Su, Jiayao Ma, Xin He, Yongjian Shen, Yang Yang, Guanghui Ren, Maoqing Yao, Wenhao Wang†, Yao Mu†

Enshen Zhou1,2,, Jingkun An1,, Cheng Chi2,*

1Beihang University, 2Beijing Academy of Artificial Intelligence

Chan Hee Song1, Valts Blukis2, Jonathan Tremblay2, Stephen Tyree2, Yu Su1, Stan Birchfield2

1The Ohio State University, 2NVIDIA

Taewoong Kim, Byeonghwi Kim, Jonghyun Choi†

Seoul National University

Jinyeon Kim1,2,, Cheolhong Min1,, Byeonghwi Kim1, Jonghyun Choi1

1Seoul National University 2Yonsei University

Tianhao Wei1*, Liqian Ma12*, Rui Chen1, Weiye Zhao1, Changliu Liu1 *Equal Contribution 1Carnegie Mellon University 2Tsinghua University

Guanzhi Wang1,2, Yuqi Xie3, Yunfan Jiang4, Ajay Mandlekar1, Chaowei Xiao1,5, Yuke Zhu1,3, Linxi Fan1, Anima Anandkumar1,2 1NVIDIA, 2Caltech, 3UT Austin, 4Stanford, 5UW Madison

Wenqi Zhang, Ke Tang, Hai Wu, Mengna Wang, Yongliang Shen, Guiyang Hou, Zeqi Tan, Peng Li, Yueting Zhuang, Weiming Lu

Wenqi Zhang, Yongliang Shen, Linjuan Wu, Qiuying Peng, Jun Wang, Yueting Zhuang, Weiming Lu

Enshen Zhou1* Qi Su2* Cheng Chi3*; Zhizheng Zhang4 Zhongyuan Wang3 Tiejun Huang2,3 Lu Sheng1; He Wang2,3,4;

1Beihang University, 2Peking University, 3Beijing Academy of Artificial Intelligence, 4GalBot

Zeyuan Yang1, LIU JIAGENG, Peihao Chen2, Anoop Cherian3, Tim Marks, Jonathan Le Roux4, Chuang Gan5 1Tsinghua University, 2South China University of Technology, 3Mitsubishi Electric Research Labs (MERL), 4Mitsubishi Electric Research Labs, 5MIT-IBM Watson AI Lab

Weihao Tan2, Ziluo Ding1, Wentao Zhang2, Boyu Li1, Bohan Zhou3, Junpeng Yue3, Haochong Xia2, Jiechuan Jiang3, Longtao Zheng2, Xinrun Xu1, Yifei Bi1, Pengjie Gu2,

1Beijing Academy of Artificial Intelligence (BAAI), China; 2Nanyang Technological University, Singapore; 3School of Computer Science, Peking University, China

Zhonghan Zhao1*, Wenhao Chai2*, Xuan Wang1*, Li Boyi1, Shengyu Hao1, Shidong Cao1, Tian Ye3, Jenq-Neng Hwang2, Gaoang Wang1

1Zhejiang University 1University of Washington 1Hong Kong University of Science and Technology (GZ)

Nicholas Crispino1, Kyle Montgomery1, Fankun Zeng1, Dawn Song2, Chenguang Wang1

1Washington University in St. Louis, 2UC Berkeley

Guohao Li, Hasan Abed Al Kader Hammoud, Hani Itani, Dmitrii Khizbullin, Bernard Ghanem

1King Abdullah University of Science and Technology (KAUST)

Wenlong Huang1, Pieter Abbeel1, Deepak Pathak2, Igor Mordatch3

1UC Berkeley, 2Carnegie Mellon University, 3Google

So Yeon Min1, Devendra Singh Chaplot2, Pradeep Ravikumar1, Yonatan Bisk1, Ruslan Salakhutdinov1

1Carnegie Mellon University 2Facebook AI Research

Zhenyu Wu1, Ziwei Wang2,3, Xiuwei Xu2,3, Jiwen Lu2,3, Haibin Yan1*

1School of Automation, Beijing University of Posts and Telecommunications, 2Department of Automation, Tsinghua University, 3Beijing National Research Center for Information Science and Technology

Yue Wu1,4* , Shrimai Prabhumoye2 , So Yeon Min1 , Yonatan Bisk1 , Ruslan Salakhutdinov1 ,Amos Azaria3 , Tom Mitchell1 , Yuanzhi Li1,4

1Carnegie Mellon University, 2NVIDIA, 3Ariel University, 4Microsoft Research

Santhosh Kumar Ramakrishnan1,2, Devendra Singh Chaplot1, Ziad Al-Halah2 Jitendra Malik1,3, Kristen Grauman1,2

1Facebook AI Research, 2UT Austin, 3UC Berkeley

Kuo-Hao Zeng1, Luca Weihs2, Roozbeh Mottaghi1, Ali Farhadi1

1Paul G. Allen School of Computer Science & Engineering, University of Washington, 2PRIOR @ Allen Institute for AI

Andrey Kurenkov1, Michael Lingelbach1, Tanmay Agarwal1, Emily Jin1, Chengshu Li1, Ruohan Zhang1, Li Fei-Fei1, Jiajun Wu1, Silvio Savarese2, Roberto Mart´ın-Mart´ın3

1Department of Computer Science, Stanford University 2Salesforce AI Research 3Department of Computer Science, University of Texas at Austin.

Shibo Hao∗♣, Yi Gu∗♣, Haodi Ma♢, Joshua Jiahua Hong♣, Zhen Wang♣ ♠, Daisy Zhe Wang♢, Zhiting Hu♣

♣UC San Diego, ♢University of Florida, ♠Mohamed bin Zayed University of Artificial Intelligence

Robotics at Google, Everyday Robots

Kolby Nottingham1 Prithviraj Ammanabrolu2 Alane Suhr2 Yejin Choi3,2 Hannaneh Hajishirzi3,2 Sameer Singh1,2 Roy Fox1

1Department of Computer Science, University of California Irvine 2Allen Institute for Artificial Intelligence 3Paul G. Allen School of Computer Science

Byeonghwi Kim Jinyeon Kim Yuyeong Kim1,* Cheolhong Min Jonghyun Choi†

Yonsei University 1Gwangju Institute of Science and Technology

Robotics at Google

Jiannan Xiang∗♠, Tianhua Tao∗♠, Yi Gu♠, Tianmin Shu♢, Zirui Wang♠, Zichao Yang♡, Zhiting Hu♠

♠UC San Diego, ♣UIUC, ♢MIT, ♡Carnegie Mellon University

Chuhao Jin1* , Wenhui Tan1* , Jiange Yang2* , Bei Liu3† , Ruihua Song1 , Limin Wang2 , Jianlong Fu3†

1Renmin University of China, 2Nanjing University, 3Microsoft Research

Valts Blukis1,2, Chris Paxton1, Dieter Fox1,3, Animesh Garg1,4, Yoav Artzi2

1NVIDIA 2Cornell University 3University of Washington 4University of Toronto, Vector Institute

Chan Hee Song1, Jiaman Wu1, Clayton Washington1, Brian M. Sadler2, Wei-Lun Chao1, Yu Su1

1The Ohio State University, 2DEVCOM ARL

Jacky Liang, Wenlong Huang, Fei Xia, Peng Xu, Karol Hausman, Brian Ichter, Pete Florence, Andy Zeng

Robotics at Google

1Yining Hong, 2Haoyu Zhen, 3Peihao Chen, 4Shuhong Zheng, 5Yilun Du, 6Zhenfang Chen, 6,7Chuang Gan

1UCLA 2 SJTU 3 SCUT 4 UIUC 5 MIT 6MIT-IBM Watson AI Lab 7 Umass Amherst

Wenlong Huang1, Chen Wang1, Ruohan Zhang1, Yunzhu Li1,2, Jiajun Wu1, Li Fei-Fei1

1Stanford University 2University of Illinois Urbana-Champaign

1Robotics at Google 2TU Berlin 3Google Research

Zirui Zhao Wee Sun Lee David Hsu

School of Computing National University of Singapore

Jiangyong Huang, Silong Yong, Xiaojian Ma, Xiongkun Linghu, Puhao Li, Yan Wang, Qing Li, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang Beijing Institute for General Artificial Intelligence (BIGAI)

Multi-Agent Learning and Coordination

Yuanfei Wang1, Xinju Huang2, Fangwei Zhong2, Yaodong Yang1, Yizhou Wang1, Yuanpei Chen1, Hao Dong1

1Peking University, 2Beijing Normal University

Hongxin Zhang1*, Weihua Du2*, Jiaming Shan3, Qinhong Zhou1, Yilun Du4, Joshua B. Tenenbaum4, Tianmin Shu4, Chuang Gan1,5

1University of Massachusetts Amherst, 2Tsinghua University, 3Shanghai Jiao Tong University, 4MIT, 5MIT-IBM Watson AI Lab

Wenyue Hua1*, Lizhou Fan2*, Lingyao Li2, Kai Mei1, Jianchao Ji1, Yingqiang Ge1, Libby Hemphill2, Yongfeng Zhang1

1Rutgers University, 2University of Michigan

Jigang Kim1,2 Daesol Cho1,2 H. Jin Kim1,3

1Seoul National University, 2Artificial Intelligence Institute of Seoul National University (AIIS), 3Automation and Systems Research Institute (ASRI).

Note: This paper mainly focuses on reinforcement learning for Embodied AI.

Andrew Szot1,2 Unnat Jain1 Dhruv Batra1,2 Zsolt Kira2 Ruta Desai1 Akshara Rai1

1Meta AI 2Georgia Institute of Technology.

Vision and Language Navigation

Suhwan Choi1 Yongjun Cho1 Minchan Kim1 Jaeyoon Jung1 Myunchul Joe1 Yubeen Park1 Minseo Kim2 Sungwoong Kim2 Sungjae Lee2 Hwiseong Park1 Jiwan Chung2 Youngjae Yu2

1MAUM.AI 2Yonsei University

Joanne Truong1,2, April Zitkovich1, Sonia Chernova2, Dhruv Batra2,3, Tingnan Zhang1, Jie Tan1, Wenhao Yu1

1Robotics at Google 2Georgia Institute of Technology 3Meta AI

Zhaowei Wang1, Hongming Zhang2, Tianqing Fang1,2, Ye Tian3, Yue Yang4, Kaixin Ma2, Xiaoman Pan2, Yangqiu Song1, Dong Yu2

1CSE Department, HKUST  2Tencent AI Lab, Bellevue, USA  3Robotics X, Tencent  4University of Pennsylvania

Kaiwen Zhou1, Kaizhi Zheng1, Connor Pryor1, Yilin Shen2, Hongxia Jin2, Lise Getoor1, Xin Eric Wang1

1University of California, Santa Cruz 2Samsung Research America.

Gengze Zhou1 Yicong Hong2 Qi Wu1

1The University of Adelaide 2The Australian National University

1Shanghai Jiao Tong University, 2Shanghai AI Laboratory, 3CFCS, School of CS, PKU, 4University of Chinese Academy of Sciences, 5The Chinese University of Hong Kong

Detection

Renjie Pi1∗ Jiahui Gao2* Shizhe Diao1∗ Rui Pan1 Hanze Dong1 Jipeng Zhang1 Lewei Yao1 Jianhua Han3 Hang Xu2 Lingpeng Kong2 Tong Zhang1

1The Hong Kong University of Science and Technology 2The University of Hong Kong 3Shanghai Jiao Tong University

3D Grounding

Jianing Yang1,, Xuweiyi Chen1,, Shengyi Qian1, Nikhil Madaan, Madhavan Iyengar1, David F. Fouhey1,2, Joyce Chai1

1University of Michigan, 2New York University

Ziyu Zhu, Xiaojian Ma, Yixin Chen, Zhidong Deng, Siyuan Huang, Qing Li Beijing Institute for General Artificial Intelligence (BIGAI)

Interactive Embodied Learning

Peng Chen*, Pi Bu*, Yingyao Wang, Xinyi Wang, Ziming Wang, Jie Guo, Yingxiu Zhao, Qi Zhu, Jun Song†, Siran Wang, Jiamang Wang, Bo Zheng

Alibaba Group

Tianhao Wei1*, Liqian Ma12*, Rui Chen1, Weiye Zhao1, Changliu Liu1

*Equal Contribution 1Carnegie Mellon University 2Tsinghua University

Thomas Carta1*, Clement Romac ´1,2, Thomas Wolf2, Sylvain Lamprier3, Olivier Sigaud4, Pierre-Yves Oudeyer1

1Inria (Flowers), University of Bordeaux, 2Hugging Face, 3Univ Angers, LERIA, SFR MATHSTIC, F-49000, 4Sorbonne University, ISIR

Tushar Nagarajan, Kristen Grauman

UT Austin and Facebook AI Research, UT Austin and Facebook AI Research

Erik Wijmans1†, Samyak Datta1, Oleksandr Maksymets2†, Abhishek Das1, Georgia Gkioxari2, Stefan Lee1, Irfan Essa1, Devi Parikh1,2, Dhruv Batra1,2

1Georgia Institute of Technology, 2Facebook AI Research

Licheng Yu1, Xinlei Chen3, Georgia Gkioxari3, Mohit Bansal1, Tamara L. Berg1,3, Dhruv Batra2,3

1University of North Carolina at Chapel Hill 2Georgia Tech 3Facebook AI

Abhishek Das1,Georgia Gkioxari2, Stefan Lee1, Devi Parikh1,2, Dhruv Batra1,2

1Georgia Institute of Technology 2Facebook AI Research

Abhishek Das1, Samyak Datta1, Georgia Gkioxari22, Stefan Lee1, Devi Parikh2,1, Dhruv Batra2

1Georgia Institute of Technology, 2Facebook AI Research

Rearrangement

1Brandon Trabucco, 2Gunnar A Sigurdsson, 2Robinson Piramuthu, 2,3Gaurav S. Sukhatme, 1Ruslan Salakhutdinov

1CMU, 2Amazon Alexa AI, 3University of Southern California

Benchmark

Lizhou Liang, Xinyu Zhong, Miao Pan, Xiaohe Zhou, Xuanyu Liu, Qinfeng Li, Peng Li, Jintao Chen, Xuhong Zhang, and Wenqi Zhang

Zhejiang University, Central South University, Institute of Software, Chinese Academy of Sciences

Haolin Yang1,2,, Yuxing Long1,2,, Zhuoyuan Yu1,2, Zihan Yang1, Minghan Wang1, Jiapeng Xu1, Yihan Wang1, Ziyan Yu1, Wenzhe Cai3, Lei Kang1, Hao Dong1,2,†

*Equal Contribution †Corresponding author 1CFCS, School of Computer Science, Peking University, 2PrimeBot, 3Shanghai AI Lab

Enshen Zhou1,2,, Jingkun An1,, Cheng Chi2,*

1Beihang University, 2Beijing Academy of Artificial Intelligence

Zhaowei Wang1, Hongming Zhang2, Tianqing Fang1,2, Ye Tian3, Yue Yang4, Kaixin Ma2, Xiaoman Pan2, Yangqiu Song1, Dong Yu2

1CSE Department, HKUST  2Tencent AI Lab, Bellevue, USA  3Robotics X, Tencent  4University of Pennsylvania

Taewoong Kim1*, Cheolhong Min1*, Byeonghwi Kim1, Jinyeon Kim12, Wonje Jeung1, Jonghyun Choi1

*Equal Contribution 1Seoul National University 2Yonsei University

Byeonghwi Kim1*, Minhyuk Seo1*, Jonghyun Choi2

*Equal Contribution 1Yonsei University 2Seoul National University

Yue Wu1,2, Xuan Tang1, Tom Mitchell1, Yuanzhi Li1,2 1Carnegie Mellon University, 2Microsoft Research

Yufei Wang1, Zhou Xian1, Feng Chen2, Tsun-Hsuan Wang3, Yian Wang4, Katerina Fragkiadaki1, Zackory Erickson1, David Held1, Chuang Gan4,5

1CMU, 2Tsinghua IIIS, 3MIT CSAIL, 4UMass Amherst, 5MIT-IBM AI Lab

Mohit Shridhar† Xingdi Yuan♡ Marc-Alexandre Côté♡ Yonatan Bisk‡ Adam Trischler♡ Matthew Hausknecht♣

‡University of Washington ♡Microsoft Research, Montréal ‡Carnegie Mellon University ♣Microsoft Research

Mohit Shridhar1 Jesse Thomason1 Daniel Gordon1 Yonatan Bisk1,2,3 Winson Han3 Roozbeh Mottaghi1,3 Luke Zettlemoyer1 Dieter Fox1,4

1Paul G. Allen School of Computer Sci. & Eng., Univ. of Washington, 2Language Technologies Institute @ Carnegie Mellon University, 3Allen Institute for AI, 4NVIDIA

Yunfan Jiang1 Agrim Gupta1† Zichen Zhang2† Guanzhi Wang3,4† Yongqiang Dou5 Yanjun Chen1 Li Fei-Fei1 Anima Anandkumar3,4 Yuke Zhu3,6‡ Linxi Fan3‡

Xiaojian Ma2 Silong Yong1,3* Zilong Zheng1 Qing Li1 Yitao Liang1,4 Song-Chun Zhu1,2,3,4 Siyuan Huang1

1Beijing Institute for General Artificial Intelligence (BIGAI) 2UCLA 3Tsinghua University 4Peking University

Danie1 Gordon1 Aniruddha Kembhavi2 Mohammad Rastegari2,4 Joseph Redmon1 Dieter Fox1,3 Ali Farhadi1,2

1Paul G. Allen School of Computer Science, University of Washington 2Allen Institute for Artificial Intelligence 3Nvidia 4Xnor.ai

Difei Gao1,2, Ruiping Wang1,2,3, Ziyi Bai1,2, Xilin Chen1,

1Key Laboratory of Intelligent Information Processing of Chinese Academy of Sciences (CAS), Institute of Computing Technology, CAS, 2University of Chinese Academy of Sciences, 3Beijing Academy of Artificial Intelligence

Simulator

Fangwei Zhong1,6, Kui Wu2, Churan Wang3, Hao Chen4, Hai Ci5, Zhoujun Li2, Yizhou Wang3

1Beijing Normal University, 2Beihang University, 3Peking University, 4City University of Macau, 5National University of Singapore, 6Beijing Institute for General Artificial Intelligence

Tsinghua University

Allen Institute for AI, University of Washington, Stanford University, Carnegie Mellon University

Bokui Shen*, Fei Xia* et al.

Facebook AI Research, Facebook Reality Labs, Georgia Institute of Technology, Simon Fraser University, Intel Labs, UC Berkeley

Facebook AI Research, Georgia Tech, Intel Research, Simon Fraser University, UC Berkeley

Others

Google Research, Brain Team

Shunyu Yao1∗, Jeffrey Zhao2, Dian Yu2, Nan Du2, Izhak Shafran2, Karthik Narasimhan1, Yuan Cao2

1Department of Computer Science, Princeton University 2, Google Research, Brain team

Virginia Tech, Microsoft

ETH Zurich, Cledar, Warsaw University of Technology

Shunyu Yao1, Dian Yu2, Jeffrey Zhao2, Izhak Shafran2, Thomas L. Griffiths1, Yuan Cao2, Karthik Narasimhan1

1Princeton University, 2Google DeepMind

Jason Wei, Xuezhi Wang, Dale Schuurmans, Maarten Bosma, Brian Ichter, Fei Xia, Ed H. Chi, Quoc V. Le, Denny Zhou

Google Research, Brain Team

Linxi Fan1 , Guanzhi Wang2∗ , Yunfan Jiang3* , Ajay Mandlekar1 , Yuncong Yang4 , Haoyi Zhu5 , Andrew Tang4 , De-An Huang1 , Yuke Zhu1,6† , Anima Anandkumar1,2†

1NVIDIA, 2Caltech, 3Stanford, 4Columbia, 5SJTU, 6UT Austin

Theodore Sumers1∗ Kenneth Marino2 Arun Ahuja2 Rob Fergus2 Ishita Dasgupta2

1The Chinese University of Hong Kong 2SmartMore 3MSRA

Tianhao Wei1*, Liqian Ma12*, Rui Chen1, Weiye Zhao1, Changliu Liu1 *Equal Contribution 1Carnegie Mellon University 2Tsinghua University

Acknowledge

Thanks to everyone who has contributed to this repository! Special thanks to those who submitted PRs with solid work—your efforts make this project better and stronger. 🚀✨