Embodied Minds Lab at Harvard

Publications

B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations

B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations

arXiv Preprint • 2026

Xiaoshen Han, Haoyu Xiong, Haonan Chen, Chaoqi Liu, Antonio Torralba, Yuke Zhu, Yilun Du

Economy of Minds: Emerging Multi-Agent Intelligence with Economic Interactions

Economy of Minds: Emerging Multi-Agent Intelligence with Economic Interactions

arXiv Preprint • 2026

Zhenting Qi, Huangyuan Su, Ao Qu, Chenyu Wang, Yu Yao, Han Zheng, Kushal Chattopadhyay, Guowei Xu, Zihan Wang, Weirui Ye, Vijay Janapa Reddi, Ju Li, Paul Pu Liang, Himabindu Lakkaraju, Sham Kakade, Yilun Du

Generative Modeling via Drifting

Generative Modeling via Drifting

arXiv Preprint • 2026

Mingyang Deng, He Li, Tianhong Li, Yilun Du, Kaiming He

GEM-4D: Geometry-Enhanced Video World Models for Robot Manipulation

GEM-4D: Geometry-Enhanced Video World Models for Robot Manipulation

ECCV • 2026

Kaichen Zhou, Yuzhen Chen, Fangneng Zhan, Hang Hua, Grace Chen, Xinhai Chang, Ao Qu, Yilun Du, Zhuang Liu, Paul Pu Liang, Mengyu Wang

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments

ECCV • 2026

Haoyu Chen, Kaichen Zhou, Hang Hua, Kaile Zhang, Jingwen Qian, Wufei Ma, Haonan Chen, Chunjiang Liu, Yizhou Zhao, Xiaoyuan Wang, Weiyue Li, Alan Yuille, Paul Pu Liang, Yilun Du

A Very Big Video Reasoning Suite

A Very Big Video Reasoning Suite

ICML • 2026

Maijunxian Wang, Ruisi Wang, Juyi Lin, Ran Ji, Thaddaus Wiedemer, Qingying Gao, Dezhi Luo, Yaoyao Qian, Lianyu Huang, Zelong Hong, Jiahui Ge, Qianli Ma, Hang He, Yifan Zhou, Lingzi Guo, Lantao Mei, Jiachen Li, Hanwen Xing, Tianqi Zhao, Fengyuan Yu, Weihang Xiao, Yizheng Jiao, Jianheng Hou, Danyang Zhang, Pengcheng Xu, Boyang Zhong, Zehong Zhao, Gaoyun Fang, John Kitaoka, Yile Xu, Hua Xu, Kenton Blacutt, Tin Nguyen, Siyuan Song, Haoran Sun, Shaoyue Wen, Linyang He, Runming Wang, Yanzhi Wang, Mengyue Yang, Ziqiao Ma, Raphaël Millière, Freda Shi, Nuno Vasconcelos, Daniel Khashabi, Alan Yuille, Yilun Du, Ziming Liu, Bo Li, Dahua Lin, Ziwei Liu, Vikash Kumar, Yijiang Li, Lei Yang, Zhongang Cai, Hokin Deng

Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments

Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments

ICML • 2026

Hansen Jin Lillemark, Benhao Huang, Fangneng Zhan, Yilun Du, T. Anderson Keller

From Noise to Control: Parameterized Diffusion Policies

From Noise to Control: Parameterized Diffusion Policies

ICML • 2026

Renhao Zhang, Haotian Fu, Mingxi Jia, George Konidaris, Yilun Du, Bruno Castro da Silva

Model-Based Diffusion Sampling for Predictive Control in Offline Decision Making

Model-Based Diffusion Sampling for Predictive Control in Offline Decision Making

ICML • 2026

Haldun Balim, Na Li, Yilun Du

Structured 4D Latent Predictive Model for Robot Planning

Structured 4D Latent Predictive Model for Robot Planning

ICML • 2026

Zhiyi Li, Peilin Wu, Xiaoshen Han, Ruojin Cai, Yilun Du

Test-Time Graph Search for Goal-Conditioned Reinforcement Learning

Test-Time Graph Search for Goal-Conditioned Reinforcement Learning

ICML • 2026

Evgenii Opryshko*, Junwei Quan*, Claas Voelcker, Yilun Du, Igor Gilitschenski

OAT: Ordered Action Tokenization

OAT: Ordered Action Tokenization

RSS • 2026

Chaoqi Liu, Xiaoshen Han, Jiawei Gao, Yue Zhao, Haonan Chen, Yilun Du

Abstract 3D Perception for Spatial Intelligence in Vision-Language Models

Abstract 3D Perception for Spatial Intelligence in Vision-Language Models

CVPR • 2026

Yifan Liu, Fangneng Zhan, Kaichen Zhou, Yilun Du, Paul Liang, Hanspeter Pfister

CHAI: Building a Precise Video Language with Human–AI Oversight

CHAI: Building a Precise Video Language with Human–AI Oversight

CVPR • 2026

Zhiqiu Lin, Chancharik Mitra, Siyuan Cen, Isaac Li, Yuhan Huang, Yu Tong Tiffany Ling, Hewei Wang, Irene Pi, Shihang Zhu, Ryan Rao, George Liu, Jiaxi Li, Ruojin Li, Yili Han, Yilun Du, Deva Ramanan

SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models

SIMPACT: Simulation-Enabled Action Planning using Vision-Language Models

CVPR • 2026

Haowen Liu*, Shaoxiong Yao*, Haonan Chen, Jiawei Gao, Jiayuan Mao, Jia-Bin Huang, Yilun Du

Any-Order Flexible Length Masked Diffusion

Any-Order Flexible Length Masked Diffusion

ICLR • 2026

Jaeyeon Kim*, Lee Cheuk-Kit*, Carles Domingo-Enrich, Yilun Du, Sham Kakade, Timothy Ngotiaoco, Sitan Chen, Michael Albergo

Energy-Based Transformers are Scalable Learners and Thinkers

Energy-Based Transformers are Scalable Learners and Thinkers

ICLR • 2026

Alexi Gladstone, Ganesh Nanduru, Md Mofijul Islam, Peixuan Han, Hyeonjeong Ha, Aman Chadha, Yilun Du, Heng Ji, Jundong Li, Tariq Iqbal

Geometry-aware Policy Imitation

Geometry-aware Policy Imitation

ICLR • 2026

Yiming Li, Nael Darwiche, Amirreza Razmjoo, Sichao Liu, Yilun Du, Auke Ijspeert, Sylvain Calinon

Long-Text-to-Image Generation via Compositional Prompt Decomposition

Long-Text-to-Image Generation via Compositional Prompt Decomposition

ICLR • 2026

Jen-Yuan Huang, Tong Ling, Yilun Du

Product of Experts for Visual Generation

Product of Experts for Visual Generation

ICLR • 2026

Yunzhi Zhang, Carson Murtuza-Lanier, Zizhang Li, Yilun Du, Jiajun Wu

Reasoning with Sampling: Your Base Model is Smarter Than You Think

Reasoning with Sampling: Your Base Model is Smarter Than You Think

ICLR • 2026

Aayush Karan, Yilun Du

Self-Improving Loops for Visual Robotic Planning

Self-Improving Loops for Visual Robotic Planning

ICLR • 2026

Calvin Luo*, Zilai Zeng*, Mingxi Jia, Yilun Du, Chen Sun

SLM-MUX: Orchestrating Small Language Models for Reasoning

SLM-MUX: Orchestrating Small Language Models for Reasoning

ICLR • 2026

Chenyu Wang*, Zishen Wan*, Hao Kang, Emma Chen, Zhiqiang Xie, Tushar Krishna, Vijay Reddi, Yilun Du

World-in-World: World Models in a Closed-Loop World

World-in-World: World Models in a Closed-Loop World

ICLR • 2026

Jiahan Zhang*, Muqing Jiang*, Nanru Dai, Taiming Lu, Arda Uzunoglu, Shunchi Zhang, Yana Wei, Jiahao Wang, Vishal M. Patel, Paul Liang, Daniel Khashabi, Cheng Peng, Rama Chellappa, Tianmin Shu, Alan Yuille, Yilun Du, Jieneng Chen

Large Language Models Are Bad Dice Players: LLMs Struggle to Generate Random Numbers from Statistical Distributions

Large Language Models Are Bad Dice Players: LLMs Struggle to Generate Random Numbers from Statistical Distributions

ACL • 2026

Minda Zhao, Yilun Du, Mengyu Wang

Flexible Locomotion Learning with Diffusion Model Predictive Control

Flexible Locomotion Learning with Diffusion Model Predictive Control

ICRA • 2026

Runhan Huang, Haldun Balim, Heng Yang, Yilun Du

Multi-Modal Manipulation via Multi-Modal Policy Consensus

Multi-Modal Manipulation via Multi-Modal Policy Consensus

ICRA • 2026

Haonan Chen, Jiaming Xu, Hongyu Chen, Kaiwen Hong, Binghao Huang, Chaoqi Liu, Jiayuan Mao, Yunzhu Li, Yilun Du†, Katherine Driggs-Campbell†,

Flexible Multitask Learning with Factorized Diffusion Policy

Flexible Multitask Learning with Factorized Diffusion Policy

RA-L • 2026

Chaoqi Liu, Haonan Chen, Sigmund H. Hoeg, Shaoxiong Yao, Yunzhu Li, Kris Hauser, Yilun Du

Hybrid Diffusion for Simultaneous Symbolic and Continuous Planning

Hybrid Diffusion for Simultaneous Symbolic and Continuous Planning

RA-L • 2026

Sigmund H. Hoeg, Aksel Vaaler, Chaoqi Liu, Olav Egeland, Yilun Du

Strengthening Generative Robot Policies through Predictive World Modeling

Strengthening Generative Robot Policies through Predictive World Modeling

RA-L • 2026

Han Qi, Haocheng Yin, Aris Zhu, Yilun Du, Heng Yang

Equilibrium Matching: Generative Modeling with Implicit Energy-Based Models

Equilibrium Matching: Generative Modeling with Implicit Energy-Based Models

arXiv Preprint • 2025

Runqian Wang, Yilun Du

Large Video Planner Enables Generalizable Robot Control

Large Video Planner Enables Generalizable Robot Control

arXiv Preprint • 2025

Boyuan Chen*, Tianyuan Zhang*, Haoran Geng*, Kiwhan Song, Caiyi Zhang, Peihao Li, William T. Freeman, Jitendra Malik, Pieter Abbeel, Russ Tedrake, Vincent Sitzmann, Yilun Du

EvoLM: In Search of Lost Language Model Training Dynamics

EvoLM: In Search of Lost Language Model Training Dynamics

NeurIPS • 2025

<strong><u>Zhenting Qi</u></strong>, Fan Nie, Alexandre Alahi, James Zou, Himabindu Lakkaraju, Yilun Du, Eric Xing, Sham Kakade, Hanlin Zhang

Follow the Energy, Find the Path: Riemannian Metrics from Energy-Based Models

Follow the Energy, Find the Path: Riemannian Metrics from Energy-Based Models

NeurIPS • 2025

Louis Béthune, David Vigouroux, Yilun Du, Rufin VanRullen, Thomas Serre, Victor Boutin

Generalizable Reasoning through Compositional Energy Minimization

Generalizable Reasoning through Compositional Energy Minimization

NeurIPS • 2025

Alexandru Oarga, Yilun Du

Generative Trajectory Stitching through Diffusion Composition

Generative Trajectory Stitching through Diffusion Composition

NeurIPS • 2025

Yunhao Luo, Utkarsh A. Mishra, Yilun Du†, Danfei Xu†

Learning 3D Persistent Embodied World Models

Learning 3D Persistent Embodied World Models

NeurIPS • 2025

Siyuan Zhou, Yilun Du, Yuncong Yang, Lei Han, Peihao Chen, Dit-Yan Yeung, Chuang Gan

MindJourney: Test-Time Scaling with World Models for Spatial Reasoning

MindJourney: Test-Time Scaling with World Models for Spatial Reasoning

NeurIPS • 2025

Yuncong Yang*, Jiageng Liu*, Zheyuan Zhang, Siyuan Zhou, Reuben Tan, Jianwei Yang, Yilun Du, Chuang Gan†

Towards Understanding Camera Motion in Any Video

Towards Understanding Camera Motion in Any Video

NeurIPS • 2025

Zhiqiu Lin*, Siyuan Cen*, Daniel Jiang, Jay Karhade, Hewei Wang, Chancharik Mitra, Yo Tong Tiffany Ling, Yuhan Huang, Sifan Liu, Mingyu Chen, Rushikesh Zawar, Xue Bai, Yilun Du, Chuang Gan, Deva Ramanan

Win Fast or Lose Slow: Balancing Speed and Accuracy in Latency-Sensitive Decisions of LLMs

Win Fast or Lose Slow: Balancing Speed and Accuracy in Latency-Sensitive Decisions of LLMs

NeurIPS • 2025

Hao Kang, Qingru Zhang, Han Cai, Weiyuan Xu, Tushar Krishna, Yilun Du, Tsachy Weissman

TesserAct: Learning 4D Embodied World Models

TesserAct: Learning 4D Embodied World Models

ICCV • 2025

Haoyu Zhen*, Qiao Sun*, Hongxin Zhang, Junyan Li, Siyuan Zhou, Yilun Du, Chuang Gan

Multi-Agent Verification: Scaling Test-Time Compute with Multiple Verifiers

Multi-Agent Verification: Scaling Test-Time Compute with Multiple Verifiers

CoLM • 2025

Shalev Lifshitz, Sheila A. McIlraith, Yilun Du

Compositional Scene Understanding through Inverse Generative Modeling

Compositional Scene Understanding through Inverse Generative Modeling

ICML • 2025

Yanbo Wang, Justin Dauwels, Yilun Du

History-Guided Video Diffusion

History-Guided Video Diffusion

ICML • 2025

Kiwhan Song*, Boyuan Chen*, Max Simchowitz, Yilun Du, Russ Tedrake, Vincent Sitzmann

Learning Adaptable World Models with Latent Actions

Learning Adaptable World Models with Latent Actions

ICML • 2025

Shenyuan Gao, Siyuan Zhou, Yilun Du, Jun Zhang, Chuang Gan

3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning

3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning

CVPR • 2025

Yuncong Yang, Han Yang, Jiachen Zhou, Peihao Chen, Hongxin Zhang, Yilun Du, Chuang Gan

AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark

AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark

ICLR • 2025

Wenhao Chai*, Enxin Song*, Yilun Du, Chenlin Meng, Vashisht Madhavan, Omer Bar-Tel, Jenq-Neng Hwang, Saining Xie, Christopher Manning

COMBO: Compositional World Models for Embodied Multi-Agent Cooperation

COMBO: Compositional World Models for Embodied Multi-Agent Cooperation

ICLR • 2025

Hongxin Zhang*, Zeyuan Wang*, Qiushi Lyu*, Zheyuan Zhang, Sunli Chen, Tianmin Shu, Yilun Du, Chuang Gan

Grounding Video Models to Actions through Goal Conditioned Exploration

Grounding Video Models to Actions through Goal Conditioned Exploration

ICLR • 2025

Yunhao Luo, Yilun Du

Looped Transformers for Length Generalization

Looped Transformers for Length Generalization

ICLR • 2025

Ying Fan, Yilun Du, Kannan Ramchandran, Kangwook Lee

Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains

Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains

ICLR • 2025

Vighnesh Subramaniam*, Yilun Du*, Joshua B. Tenenbaum, Antonio Torralba, Shuang Li, Igor Mordatch

Solving New Tasks by Adapting Internet Video Knowledge

Solving New Tasks by Adapting Internet Video Knowledge

ICLR • 2025

Calvin Luo, Zilai Zeng, Yilun Du, Chen Sun

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Blog Post • 2025

Gemini Team

Gemini Robotics 1.5: Pushing the Frontier of Generalist Robots with Advanced Embodied Reasoning, Thinking, and Motion Transfer

Gemini Robotics 1.5: Pushing the Frontier of Generalist Robots with Advanced Embodied Reasoning, Thinking, and Motion Transfer

Blog Post • 2025

Gemini Robotics Team

Gemini Robotics: Bringing AI into the Physical World

Gemini Robotics: Bringing AI into the Physical World

Blog Post • 2025

Gemini Robotics Team

Anomalies-by-Synthesis: Anomaly Detection using Generative Diffusion Models for Off-Road Navigation

Anomalies-by-Synthesis: Anomaly Detection using Generative Diffusion Models for Off-Road Navigation

ICRA • 2025

Siddharth Ancha, Sunshine Jiang, Travis Manderson, Laura Brandt, Yilun Du, Phillip Osteen, Nicholas Roy,

Inference-Time Policy Steering through Human Interactions

Inference-Time Policy Steering through Human Interactions

ICRA • 2025

Yanwei Wang, Lirui Wang, Yilun Du, Balakumar Sundaralingam, Xuning Yang, Yu-Wei Chao, Claudia Perez-D'Arpino, Dieter Fox, Julie Shah,

Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models

Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models

ICRA • 2025

Sigmund H. Hoeg, Yilun Du, Olav Egeland

Compositional Diffusion Models for Powered Descent Trajectory Generation with Flexible Constraints

Compositional Diffusion Models for Powered Descent Trajectory Generation with Flexible Constraints

IEEE Aerospace • 2025

Julia Briden, Yilun Du, Enrico Zucchelli, Richard Linares

MoELoco: Mixture of Experts for Multitask Locomotion

MoELoco: Mixture of Experts for Multitask Locomotion

IROS • 2025

Runhan Huang*, Shaoting Zhu*, Yilun Du, Hang Zhao

Generative AI in Embodied Systems: System-Level Analysis of Performance, Efficiency and Scalability

Generative AI in Embodied Systems: System-Level Analysis of Performance, Efficiency and Scalability

ISPASS • 2025

Zishen Wan, Jiayi Qian, Yuhang Du, Jason Jabbour, Yilun Du, Yang (Katie) Zhao, Arijit Raychowhury, Tushar Krishna, Vijay Reddi

Towards Generalist Robot learning from Internet Video: A Survey

Towards Generalist Robot learning from Internet Video: A Survey

JAIR • 2025

Robert Mccarthy, Daniel C.H Tan, Dominik Schmidt, Fernando Acero, Nathan Herr, Yilun Du, Thomas Thuruthel, Zhibin Li

Inference-time Scaling of Diffusion Models through Classical Search

Inference-time Scaling of Diffusion Models through Classical Search

NeurIPS SPIGM Workshop • 2025

Xiangcheng Zhang, Haowei Lin, Haotian Ye, James Zou, Jianzhu Ma, Yitao Liang, Yilun Du

Deep Generative Models in Robotics: A Survey on Learning from Multimodal Demonstrations

Deep Generative Models in Robotics: A Survey on Learning from Multimodal Demonstrations

TRO • 2025

Julen Urain, Ajay Mandlekar, Yilun Du, Mahi Shafiullah, Danfei Xu, Katerina Fragkiadaki, Georgia Chalvatzaki, Jan Peters

2025

Evaluating Gemini Robotics Policies in a Veo World Simulator

Website • 2025

Gemini Robotics Team

Foundation Models for Decision Making: Problems, Methods, and Opportunities

Foundation Models for Decision Making: Problems, Methods, and Opportunities

arXiv Preprint • 2024

Mengjiao Yang, Ofir Nachum, Yilun Du, Jason Wei, Pieter Abbeel, Dale Schuurmans

Self-conditioned Embedding Diffusion for Text Generation

Self-conditioned Embedding Diffusion for Text Generation

arXiv Preprint • 2024

Robin Strudel, Corentin Tallec, Florent Altche, Yilun Du, Yaroslav Ganin, Arthur Mensch, Will Grathwohl, Nikolay Savinov, Sander Dieleman, Laurent Sifre, Remi Lebond

Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion

Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion

NeurIPS • 2024

Boyuan Chen, Diego Marti Monso, Yilun Du, Max Simchowitz, Russ Tedrake, Vincent Sitzmann

Few-Shot Task Learning through Inverse Generative Modeling

Few-Shot Task Learning through Inverse Generative Modeling

NeurIPS • 2024

Aviv Netanyahu, Yilun Du, Antonia Bronars, Jyotish Pari, Joshua B. Tenenbaum, Tianmin Shu, Pulkit Agrawal

Large-scale Reinforcement Learning for Diffusion Models

Large-scale Reinforcement Learning for Diffusion Models

ECCV • 2024

Yinan Zhang, Eric Tzeng, Yilun Du, Dmitry Kislyuk

3D-VLA: A 3D Vision-Language-Action Generative World Model

3D-VLA: A 3D Vision-Language-Action Generative World Model

ICML • 2024

Haoyu Zhen, Xiaowen Qiu, Peihao Chen, Jincheng Yang, Xin Yan, Yilun Du, Yining Hong, Chuang Gan

Compositional Generative Modeling: A Single Model is Not All You Need

Compositional Generative Modeling: A Single Model is Not All You Need

ICML • 2024

Yilun Du, Leslie Kaelbling

Compositional Image Decomposition with Diffusion Models

Compositional Image Decomposition with Diffusion Models

ICML • 2024

Jocelin Su*, Nan Liu*, Yanbo Wang*, Joshua B. Tenenbaum, Yilun Du

2024

Improving Factuality and Reasoning in Language Models through Multiagent Debate

ICML • 2024

Yilun Du, Shuang Li, Antonio Torralba, Joshua B. Tenenbaum, Igor Mordatch

Learning Iterative Reasoning through Energy Diffusion

Learning Iterative Reasoning through Energy Diffusion

ICML • 2024

Yilun Du*, Jiayuan Mao*, Joshua B. Tenenbaum

Potential Based Diffusion Motion Planning

Potential Based Diffusion Motion Planning

ICML • 2024

Yunhao Luo, Chen Sun, Joshua B. Tenenbaum, Yilun Du

RoboDreamer: Learning Compositional World Models for Robot Imagination

RoboDreamer: Learning Compositional World Models for Robot Imagination

ICML • 2024

Siyuan Zhou, Yilun Du, Jiaben Chen, Yandong Li, Dit-Yan Yeung, Chuang Gan

Video as the New Language for Real-World Decision Making

Video as the New Language for Real-World Decision Making

ICML • 2024

Sherry Yang, Jacob Walker, Jack Parker-Holder, Yilun Du, Jake Bruce, Andre Barreto, Pieter Abbeel, Dale Schuurmans

"Set It Up!": Functional Object Arrangement with Compositional Generative Models

"Set It Up!": Functional Object Arrangement with Compositional Generative Models

RSS • 2024

Yiqing Xu, Jiayuan Mao, Yilun Du, Tomas Lozano-Perez, Leslie Kaelbling, David Hsu

PoCo: Policy Composition from and for Heterogeneous Robot Learning

PoCo: Policy Composition from and for Heterogeneous Robot Learning

RSS • 2024

Lirui Wang, Alan Zhao, Yilun Du, Ted Adelson, Russ Tedrake

Building Cooperative Embodied Agents Modularly with Large Language Models

Building Cooperative Embodied Agents Modularly with Large Language Models

ICLR • 2024

Hongxin Zhang, Weihua Du, Jiaming Shan, Qinhong Zhou, Yilun Du, Joshua B. Tenenbaum, Tianmin Shu, Chuang Gan

Compositional Generative Inverse Design

Compositional Generative Inverse Design

ICLR • 2024

Tailin Wu*, Takashi Maruyama*, Long Wei*, Tao Zhang*, Yilun Du*, Gianluca Iaccarino, Jure Leskovec

HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments

HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments

ICLR • 2024

Qinhong Zhou, Sunli Chen, Yisong Wang, Haozhe Xu, Weihua Du, Hongxin Zhang, Yilun Du, Joshua B. Tenenbaum, Chuang Gan

Learning Interactive Real-World Simulators

Learning Interactive Real-World Simulators

ICLR • 2024

Mengjiao Yang, Yilun Du, Kamyar Ghasemipour, Jonathan Tompson, Leslie Kaelbling, Dale Schuurmans, Pieter Abbeel

Learning to Act from Actionless Video through Dense Correspondences

Learning to Act from Actionless Video through Dense Correspondences

ICLR • 2024

Po-Chen Ko, Jiayuan Mao, Yilun Du, Shao-Hua Sun, Joshua B. Tenenbaum

Learning to Jointly Understand Visual and Tactile Signals

Learning to Jointly Understand Visual and Tactile Signals

ICLR • 2024

Yichen Li, Yilun Du, Chao Liu, Chao Liu, Francis Williams, Michael Foshey, Benjamin Eckart, Jan Kautz, Joshua B. Tenenbaum, Antonio Torralba, Wojciech Matusik

2024

Probabilistic Adaptation of Text-to-Video Models

ICLR • 2024

Mengjiao Yang*, Yilun Du*, Bo Dai, Dale Schuurmans, Joshua B. Tenenbaum, Pieter Abbeel

Training Diffusion Models with Reinforcement Learning

Training Diffusion Models with Reinforcement Learning

ICLR • 2024

Kevin Black*, Michael Janner*, Yilun Du, Ilya Kostrikov, Sergey Levine

2024

Video Language Planning

ICLR • 2024

Yilun Du, Sherry Yang, Pete Florence, Fei Xia, Ayzaan Wahid, Brian Ichter, Pierre Sermanet, Tianhe Yu, Pieter Abbeel, Joshua B. Tenenbaum, Leslie Kaelbling, Andy Zeng, Jonathan Tompson

Language Models Generalize Beyond Natural Proteins

Language Models Generalize Beyond Natural Proteins

bioRxiv Preprint • 2024

Robert Verkuil*, Ori Kabeli*, Yilun Du, Basile Wicky, Lukas Milles, Justas Dauparas, David Baker, Sergey Ovchinnikov, Tom Sercu, Alexander Rives

Disentangled Acoustic Fields For Multimodal Physical Scene Understanding

Disentangled Acoustic Fields For Multimodal Physical Scene Understanding

IROS • 2024

Jie Yie, Andrew Luo, Yilun Du, Anoop Cherian, Tim K. Marks, Jonathan Le Roux, Chuang Gan

Learning Generalizable Systems by Learning Composable Energy Landscapes

Learning Generalizable Systems by Learning Composable Energy Landscapes

PhD Thesis • 2024

Yilun Du

3D-LLM: Injecting the 3D World into Large Language Models

3D-LLM: Injecting the 3D World into Large Language Models

NeurIPS • 2023

Yining Hong, Haoyu Zhen, Peihao Chen, Shuhong Zheng, Yilun Du, Zhenfang Chen, Chuang Gan

Adaptive Online Replanning with Diffusion Models

Adaptive Online Replanning with Diffusion Models

NeurIPS • 2023

Siyuan Zhou, Yilun Du, Shun Zhang, Mengdi Xu, Yikang Shen, Wei Xiao, Dit-Yan Yeung, Chuang Gan

2023

Compositional Foundation Models for Hierarchical Planning

NeurIPS • 2023

Anurag Ajay*, Seungwook Han*, Yilun Du*, Shuang Li, Abhi Gupta, Tommi Jaakkola, Joshua B. Tenenbaum, Leslie Kaelbling, Akash Srivastava, Pulkit Agrawal

DiffuseBot: Breeding Soft Robots With Physics-Augmented Generative Diffusion Models

DiffuseBot: Breeding Soft Robots With Physics-Augmented Generative Diffusion Models

NeurIPS • 2023

Tsun-Hsuan Wang, Juntian Zheng, Pingchuan Ma, Yilun Du, Byungchul Kim, Andrew Spielberg, Joshua Tenenbaum, Chuang Gan, Daniela Rus

FlowCam: Training Generalizable 3D Radiance Fields without Camera Poses via Pixel-Aligned Scene Flow

FlowCam: Training Generalizable 3D Radiance Fields without Camera Poses via Pixel-Aligned Scene Flow

NeurIPS • 2023

Cameron Smith, Yilun Du, Ayush Tewari, Vincent Sitzmann

2023

Learning Universal Policies via Text-Guided Video Generation

NeurIPS • 2023

Yilun Du*, Mengjiao Yang*, Bo Dai, Hanjun Dai, Ofir Nachum, Joshua B. Tenenbaum, Dale Schuurmans, Pieter Abbeel

Secure Out-of-Distribution Task Generalization with Energy-Based Models

Secure Out-of-Distribution Task Generalization with Energy-Based Models

NeurIPS • 2023

Shengzhuang Chen, Long-Kai Huang, Jonathan Schwarz, Yilun Du, Ying Wei

Compositional Diffusion-Based Continuous Constraint Solvers

Compositional Diffusion-Based Continuous Constraint Solvers

CoRL • 2023

Zhutian Yang, Jiayuan Mao, Yilun Du, Jiajun Wu, Joshua B. Tenenbaum, Tomas Lozano-Perez, Leslie Kaelbling

2023

Unsupervised Compositional Concepts Discovery with Text-to-Image Generative Models

ICCV • 2023

Nan Liu*, Yilun Du*, Shuang Li*, Joshua B. Tenenbaum, Antonio Torralba

Inferring Relational Potentials in Interacting Systems

Inferring Relational Potentials in Interacting Systems

ICML • 2023

Armand Comas, Yilun Du, Christian Fernandez, Sandesh Ghimire, Mario Sznaier, Joshua B. Tenenbaum, Octavia Camps

2023

Reduce, Reuse, Recycle: Compositional Generation with Energy-Based Diffusion Models and MCMC

ICML • 2023

Yilun Du, Conor Durkan, Robin Strudel, Joshua B. Tenenbaum, Sander Dieleman, Rob Fergus, Jascha Sohl-Dickstein, Arnaud Doucet, Will Grathwohl

Diffusion Policy: Visuomotor Policy Learning via Action Diffusion

Diffusion Policy: Visuomotor Policy Learning via Action Diffusion

RSS • 2023

Cheng Chi, Siyuan Feng, Yilun Du, Zhenjia Xu, Eric Cousineau, Benjamin Burchfiel, Shuran Song

NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects

NeuSE: Neural SE(3)-Equivariant Embedding for Consistent Spatial Understanding with Objects

RSS • 2023

Jiahui Fu, Yilun Du, Kurran Singh, Joshua B. Tenenbaum, John J. Leonard

StructDiffusion: Language-Guided Creation of Physically-Valid Structures using Unseen Objects

StructDiffusion: Language-Guided Creation of Physically-Valid Structures using Unseen Objects

RSS • 2023

Weiyu Liu, Yilun Du, Tucker Hermans, Sonia Chernova, Chris Paxton

3D Concept Learning and Reasoning from Multi-View Images

3D Concept Learning and Reasoning from Multi-View Images

CVPR • 2023

Yining Hong, Chunru Lin, Yilun Du, Zhenfang Chen, Joshua B. Tenenbaum, Chuang Gan

Learning to Render Novel Views from Wide-Baseline Stereo Pairs

Learning to Render Novel Views from Wide-Baseline Stereo Pairs

CVPR • 2023

Yilun Du, Cameron Smith, Ayush Tewari†, Vincent Sitzmann†

Composing Ensembles of Pre-trained Models via Iterative Consensus

Composing Ensembles of Pre-trained Models via Iterative Consensus

ICLR • 2023

Shuang Li*, Yilun Du*, Joshua B. Tenenbaum, Antonio Torralba, Igor Mordatch

Is Conditional Generative Modeling all You Need for Decision-Making?

Is Conditional Generative Modeling all You Need for Decision-Making?

ICLR • 2023

Anurag Ajay*, Yilun Du*, Ahbi Gupta*, Joshua B. Tenenbaum, Tommi S. Jaakkola, Pulkit Agrawal

Planning with Sequence Models through Iterative Energy Minimization

Planning with Sequence Models through Iterative Energy Minimization

ICLR • 2023

Hongyi Chen*, Yilun Du*, Yiye Chen*, Joshua B. Tenenbaum, Patricio Antonio Vela

Seeing 3D Objects in a Single Image via Self-Supervised Static-Dynamic Disentanglement

Seeing 3D Objects in a Single Image via Self-Supervised Static-Dynamic Disentanglement

ICLR • 2023

Prafull Sharma, Ayush Tewari, Yilun Du, Sergey Zakharov, Rares Ambrus, Adrien Gaidon, William T. Freeman, Fredo Durand, Joshua B. Tenenbaum, Vincent Sitzmann

Local Neural Descriptor Fields: Locally Conditioned Object Representations for Manipulation

Local Neural Descriptor Fields: Locally Conditioned Object Representations for Manipulation

ICRA • 2023

Ethan Chun, Yilun Du, Anthony Simeonov, Tomas Lozano-Perez, Leslie Kaelbling

Visibility-Aware Navigation Among Movable Objects

Visibility-Aware Navigation Among Movable Objects

ICRA • 2023

Jose Iturralde*, Aiden Curtis*, Yilun Du, Leslie Kaelbling, Tomas Lozano-Perez