Skip to content

Publications

Browse by year and date, with conference papers grouped together. Search by title, author, topic, venue, or year.

393 publications

SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control

Zhengyi Luo, Ye Yuan, Tingwu Wang, Chenran Li, Fernando Castañeda, Sirui Chen, Zi-Ang Cao, Jiefeng Li, David Minor, Qingwei Ben, Jinhyung Park, David Sami, Zi Wang, Xingye Da, Runyu Ding, Cyrus Hogg, Lina Song, Edy Lim, Eugene Jeong, Tairan He, Haoru Xue, Wenli Xiao, Simon Yuen, Jan Kautz, Yan Chang, Umar Iqbal, Linxi “Jim” Fan, Yuke Zhu

Science Robotics · 2026

RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies

Xuning Yang, Rishit Dagli, Alex Zook, Hugo Hadfield, Ankit Goyal, Stan Birchfield, Fabio Ramos, Jonathan Tremblay

Robotics: Science and Systems (RSS) · 2026

RADIO1D: Elastic Representations for Condensed Vision Modeling

Greg Heinrich, Mike Ranzinger, Collin McCarthy, Natan Bagrov, Eugene Khvedchenya, Bryan Catanzaro, Jan Kautz, Andrew Tao, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2026

Flex-Forcing: Towards a Unified Autoregressive and Bidirectional Video Diffusion Model

Xinyin Ma, Julius Berner, Chao Liu, Arash Vahdat, Weili Nie, Xinchao Wang

International Conference on Machine Learning (ICML) · 2026

Star Elastic: Many-in-One Reasoning LLMs with Efficient Budget Control

Ali Taghibakhshi, Ruisi Cai, Saurav Muralidharan, Sharath Turuvekere Sreenivas, Ameya Sunil Mahabaleshwarkar, Marcin Chochowski, Akhiad Bercovich, Ran Zilberstein, Ran El-Yaniv, Yonatan Geifman, Daniel Korzekwa, Yoshi Suhara, Oluwatobi Olabiyi, Ashwath Aithal, Nima Tajbakhsh, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2026

SpaCeFormer: Space-Curve Transformer for Open-Vocabulary 3D Instance Segmentation without Proposals

Chris Choy, Junha Lee, Chunghyun Park, Minsu Cho, Jan Kautz

International Conference on Machine Learning (ICML) · 2026

Mode Seeking meets Mean Seeking for Long Video Generation

Shengqu Cai, Weili Nie, Chao Liu, Julius Berner, Lvmin Zhang, Nanye Ma, Hansheng Chen, Maneesh Agrawala, Leonidas Guibas, Gordon Wetzstein, Arash Vahdat

International Conference on Machine Learning (ICML) · 2026

Golden Goose: A Simple Trick to Synthesize Unlimited RLVR Tasks from Unverifiable Internet Text

Ximing Lu, David Acuna, Jaehun Jung, Jian Hu, Di Zhang, Shizhe Diao, Yunheng Zou, Shaokun Zhang, Brandon Cui, Mingjie Liu, Hyunwoo Kim, Prithviraj Ammanabrolu, Jan Kautz, Yi Dong, Yejin Choi

International Conference on Machine Learning (ICML) · 2026

Learning to Discover at Test Time

Mert Yuksekgonul, Daniel Koceja, Xinhao Li, Federico Bianchi, Jed McCaleb, Xiaolong Wang, Jan Kautz, Yejin Choi, James Zou, Carlos Guestrin, Yu Sun

International Conference on Machine Learning (ICML) · 2026

GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

Shih-Yang Liu, Xin Dong, Ximing Lu, Shizhe Diao, Peter Belcak, Mingjie Liu, Min-Hung Chen, Hongxu Yin, Yu-Chiang Frank Wang, Kwang-Ting Cheng, Yejin Choi, Jan Kautz, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2026

Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed

Yonggan Fu, Lexington Whalen, Zhifan Ye, Xin Dong, Shizhe Diao, Jingyu Liu, Chengyue Wu, Hao Zhang, Enze Xie, Song Han, Maksim Khadkevich, Jan Kautz, Yingyan Lin, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2026

ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration

Hongjin SU, Shizhe Diao, Ximing Lu, Mingjie Liu, Jiacheng Xu, Xin Dong, Yonggan Fu, Peter Belcak, Hanrong Ye, Hongxu Yin, Yi Dong, Evelina Bakhturina, Tao Yu, Yejin Choi, Jan Kautz, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2026

BroRL: Scaling Reinforcement Learning via Broadened Exploration

Jian Hu, Mingjie Liu, Ximing Lu, Fang Wu, Zaid Harchaoui, Shizhe Diao, Yejin Choi, Pavlo Molchanov, Jun Yang, Jan Kautz, Yi Dong

International Conference on Machine Learning (ICML) · 2026

Enhancing Vision Language Models for 4D Perception

Seokju Cho, Abhishek Badki, Hang Su, Jindong Jiang, Ziyao Zeng, Seungryong Kim, Sifei Liu, Orazio Gallo

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Scaling Parallel Sequence Models to Vision Foundation Models

Yitong Jiang, Collin McCarthy, Hongjun Wang, Hanrong Ye, Qi Dou, Tianfan Xue, Jinwei Gu, Jan Kautz, Hongxu Yin, Pavlo Molchanov, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

GraspGen-X: Cross-Embodiment 6-DOF Diffusion-based Grasping

Beining Han, Yu-Wei Chao, Erwin Coumans, Clemens Eppner, Jia Deng, Stan Birchfield, Adithyavairavan Murali

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Grounded 3D-Aware Spatial Vision-Language Modeling

An-Chieh Cheng, Yang Fu, Yatai Ji, Ligeng Zhu, Guanqi Zhan, Zhuoyang Zhang, Zhaojing Yang, Song Han, Yao Lu, Pavlo Molchanov, Vidya Nariyambut Murali, Jan Kautz, Xiaolong Wang, Hongxu Yin, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Attend Before Attention: Efficient and Scalable Video Understanding via Autoregressive Gazing

Baifeng Shi, Stephanie Fu, Long Lian, Hanrong Ye, David Eigen, Aaron Reite, Jan Kautz, Boyi Li, David M. Chan, Trevor Darrell, Pavlo Molchanov, Hongxu Yin

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

PhyCritic: Multimodal Critic Models for Physical AI

Tianyi Xiong, Shihao Wang, Guilin Liu, Yi Dong, Ming Li, Heng Huang, Jan Kautz, Zhiding Yu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Transition Matching Distillation for Fast Video Generation

Weili Nie, Julius Berner, Nanye Ma, Chao Liu, Saining Xie, Arash Vahdat

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning

Chi-Pin Huang, Yunze Man, Zhiding Yu, Min-Hung Chen, Jan Kautz, Yu-Chiang Frank Wang, Fu-En Yang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

NitroGen: An Open Foundation Model for Generalist Gaming Agents

Loïc Magne, Anas Awadalla, Guanzhi Wang, Yinzhen Xu, Joshua Belofsky, Fengyuan Hu, Joohwan Kim, Ludwig Schmidt, Georgia Gkioxari, Jan Kautz, Yisong Yue, Yejin Choi, Yuke Zhu, Linxi Fan

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

M^3KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation

Hyeongcheol Park, Jiyoung Seo, Jaewon Mun, Hogun Park, Wonmin Byeon, Sung June Kim, Hyeonsoo Im, JeungSub Lee, Sangpil Kim

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

CARI4D: Category Agnostic 4D Reconstruction of Human-Object Interaction

Xianghui Xie, Bowen Wen, Yan Chang, Hesam Rabeti, Jiefeng Li, Ye Yuan, Gerard Pons-Moll, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Fast-FoundationStereo: Real-Time Zero-Shot Stereo Matching

Bowen Wen, Shaurya Rajat Dewan, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

SpaceTools: Tool-Augmented Spatial Reasoning via Double Interactive RL

Siyi Chen, Mikaela Angelina Uy, Chan Hee Song, Faisal Ladhak, Adithyavairavan Murali, Qing Qu, Stan Birchfield, Valts Blukis, Jonathan Tremblay

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Opening the Sim-to-Real Door for Humanoid Pixel-to-Action Policy Transfer

Haoru Xue, Tairan He, Zi Wang, Qingwei Ben, Wenli Xiao, Zhengyi Luo, Xingye Da, Fernando Castañeda, Guanya Shi, Shankar Sastry, Linxi Fan, Yuke Zhu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

LocateAnything3D: Vision-Language 3D Detection with Chain-of-Sight

Yunze Man, Shihao Wang, Guowen Zhang, Johan Bjorck, Liangyan Gui, Linxi Fan, Jan Kautz, Yu-Xiong Wang, Zhiding Yu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

EgoControl: Controllable Egocentric Video Generation via 3D Full-Body Poses

Enrico Pallotta, Sina Mokhtarzadeh Azar, Lars Doorenbos, Serdar Ozsoy, Umar Iqbal, Juergen Gall

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

BOP-ASK: Object-Interaction Reasoning for Vision-Language Models

Vineet Bhat, Sungsu Kim, Valts Blukis, Greg Heinrich, Prashanth Krishnamurthy, Ramesh Karri, Stan Birchfield, Farshad Khorrami, Jonathan Tremblay

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

VIRAL: Visual Sim-to-Real at Scale for Humanoid Loco-Manipulation

Tairan He, Zi Wang, Haoru Xue, Qingwei Ben, Zhengyi Luo, Wenli Xiao, Ye Yuan, Xingye Da, Fernando Castañeda, Shankar Sastry, Changliu Liu, Guanya Shi, Linxi Fan, Yuke Zhu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

VideoITG: Multimodal Video Understanding with Instructed Temporal Grounding

Shihao Wang, Guo Chen, De-An Huang, Zhiqi Li, Minghan Li, Guilin Liu, Jan Kautz, Jose M. Alvarez, Lei Zhang, Zhiding Yu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2026

Refinery: Active Fine-tuning and Deployment-time Optimization for Contact-Rich Policies

Bingjie Tang, Iretiayo Akinola, Jie Xu, Bowen Wen, Michael Andres Lin, Dieter Fox, Gaurav S. Sukhatme, Fabio Ramos, Abhishek Gupta, Yashraj Narang

International Conference on Robotics and Automation (ICRA) · 2026

Grasp-MPC: Closed-Loop Visual Grasping via Value-Guided Model Predictive Control

Jun Yamada, Adithyavairavan Murali, Ajay Mandlekar, Clemens Eppner, Ingmar Posner, Balakumar Sundaralingam

International Conference on Robotics and Automation (ICRA) · 2026

GraspGen: A Diffusion-based Framework for 6-DOF Grasping with On-Generator Training

Adithyavairavan Murali, Balakumar Sundaralingam, Yu-Wei Chao, Wentao Yuan, Jun Yamada, Mark Carlson, Fabio Ramos, Stan Birchfield, Dieter Fox, Clemens Eppner

International Conference on Robotics and Automation (ICRA) · 2026

Scaling Atomistic Protein Binder Design with Generative Pretraining and Test-Time Compute

Kieran Didi, Zuobai Zhang, Guoqing Zhou, Danny Reidenbach, Zhonglin Cao, Sooyoung Cha, Tomas Geffner, Christian Dallago, Jian Tang, Michael M. Bronstein, Martin Steinegger, Emine Kucukbenli, Arash Vahdat, Karsten Kreis

International Conference on Learning Representations (ICLR) · 2026

OmniVinci: Enhancing Architecture and Data for Omni-Modal Understanding LLM

Hanrong Ye, Chao-Han Huck Yang, Arushi Goel, Wei Huang, Zhen Wan, Jinchuan Tian, An-Chieh Cheng, Ligeng Zhu, Yuanhang Su, Yuming Lou, Yong-Xiang Lin, Dong Yang, Sreyan Ghosh, Zhijian Liu, Yukang Chen, Ehsan Jahangiri, Ambrish Dantrey, Daguang Xu, Ehsan Hosseini-Asl, Seyed Danial Mohseni Taheri, Vidya Nariyambut Murali, Sifei Liu, Yao Lu, Oluwatobi Olabiyi, Yu-Chiang Frank Wang, Rafael Valle, Bryan Catanzaro, Andrew Tao, Song Han, Jan Kautz, Hongxu Yin, Pavlo Molchanov

International Conference on Learning Representations (ICLR) · 2026

RLP: Reinforcement Learning Pre-training

Ali Hatamizadeh, Syeda Nahida Akter, Shrimai Prabhumoye, Jan Kautz, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro, Yejin Choi

International Conference on Learning Representations (ICLR) · 2026

Exploring Synthesizable Chemical Space with Iterative Pathway Refinements

Seul Lee, Karsten Kreis, Srimukh Prasad Veccham, Meng Liu, Danny Reidenbach, Saee Gopal Paliwal, Weili Nie, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2026

3D Aware Region Prompted Vision Language Model

An-Chieh Cheng, Yang Fu, Yukang Chen, Zhijian Liu, Xiaolong Li, Subhashree Radhakrishnan, Song Han, Yao Lu, Jan Kautz, Pavlo Molchanov, Hongxu Yin, Xiaolong Wang, Sifei Liu

International Conference on Learning Representations (ICLR) · 2026

La-Proteina: Atomistic Protein Generation via Partially Latent Flow Matching

Tomas Geffner, Kieran Didi, Zhonglin Cao, Danny Reidenbach, Zuobai Zhang, Christian Dallago, Emine Kucukbenli, Karsten Kreis, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2026

Nemotron-Research-Tool-N1: Exploring Tool-Using Language Models with Reinforced Reasoning

Shaokun Zhang, Yi Dong, Jieyu Zhang, Jan Kautz, Bryan Catanzaro, Andrew Tao, Qingyun Wu, Zhiding Yu, Guilin Liu

International Conference on Learning Representations (ICLR) · 2026

ProfBench: Multi-Domain Rubrics requiring Professional Knowledge to Answer and Judge

Zhilin Wang, Jaehun Jung, Ximing Lu, Shizhe Diao, Ellie Evans, Jiaqi Zeng, Pavlo Molchanov, Yejin Choi, Jan Kautz, Yi Dong

International Conference on Learning Representations (ICLR) · 2026

Dream, Lift, Animate: From Single Images to Animatable Gaussian Avatars

Marcel Buehler, Ye Yuan, Xueting Li, Yangyi Huang, Koki Nagano, Umar Iqbal

International Conference on 3D Vision (3DV) · 2026

L4P: Low-Level 4D Vision Perception Unified

Abhishek Badki, Hang Su, Bowen Wen, Orazio Gallo

International Conference on 3D Vision (3DV) · 2026

Demystifying Data-Driven Probabilistic Medium-Range Weather Forecasting

Jean Kossaifi, Nikola Kovachki, Morteza Mardani, Daniel Leibovici, Suman Ravuri, Ira Shokar, Edoardo Calvello, Mohammad Shoaib Abbas, Peter Harrington, Ashay Subramaniam, Noah Brenowitz, Boris Bonev, Wonmin Byeon, Karsten Kreis, Dale Durran, Arash Vahdat, Mike Pritchard, Jan Kautz

arXiv · 2026

Data Complexity Estimates for Operator Learning

Nikola B Kovachki, Samuel Lanthaler, Hrushikesh Mhaskar

Journal of Machine Learning Research · 2026

GSPN-2: Efficient Parallel Sequence Modeling

Hongjun Wang, Yitong Liang, David Wehr, Hanrong Ye, Xinhao Li, Ka Chun Cheung, Kai Han, Hongxu Yin, Pavlo Molchanov, Sifei Liu, Wonmin Byeon, Collin McCarthy, Jinwei Gu, Jan Kautz, Ke Chen

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Fast-SLM: Towards Latency-Optimal Hybrid Small Language Models

Yonggan Fu, Xin Dong, Shizhe Diao, Matthijs Van Keirsbilck, Hanrong Ye, Wonmin Byeon, Yashaswi Karnati, Lucas Liebenwein, Maksim Khadkevich, Alexander Keller, Jan Kautz, Yingyan Celine Lin, Pavlo Molchanov

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Trust Region Constrained Measure Transport in Path Space for Stochastic Optimal Control and Inference

Denis Blessing, Julius Berner, Lorenz Richter, Carles Domingo-Enrich, Yuanqi Du, Arash Vahdat, Gerhard Neumann

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Scaling RL to Long Videos

Yukang Chen, Wei Huang, Baifeng Shi, Qinghao Hu, Hanrong Ye, Ligeng Zhu, Zhijian Liu, Pavlo Molchanov, Jan Kautz, Xiaojuan Qi, Sifei Liu, Hongxu Yin, Yao Lu, Song Han

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Elucidated Rolling Diffusion Models for Probabilistic Weather Forecasting

Salva Rühling Cachay, Miika Aittala, Karsten Kreis, Noah Brenowitz, Arash Vahdat, Morteza Mardani, Rose Yu

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Align Your Flow: Scaling Continuous-Time Flow Map Distillation

Amirmojtaba Sabour, Sanja Fidler, Karsten Kreis

Advances in Neural Information Processing Systems (NeurIPS) · 2025

RaySt3R: Predicting Novel Depth Maps for Zero-Shot Object Completion

Bardienus Pieter Duisterhof, Jan Oberst, Bowen Wen, Stan Birchfield, Deva Ramanan, Jeffrey Ichnowski

Advances in Neural Information Processing Systems (NeurIPS) · 2025

ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models

Mingjie Liu, Shizhe Diao, Ximing Lu, Jian Hu, Xin Dong, Yejin Choi, Jan Kautz, Yi Dong

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Test-Time Scaling of Diffusion Models via Noise Trajectory Search

Vignav Ramesh, Morteza Mardani

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Eagle 2.5: Boosting Long-Context Post-Training for Frontier Vision-Language Models

Guo Chen, Zhiqi Li, Shihao Wang, Jindong Jiang, Yicheng Liu, Lidong Lu, De-An Huang, Wonmin Byeon, Matthieu Le, Tuomas Rintamaki, Tyler Poon, Max Ehrlich, Tong Lu, Limin Wang, Bryan Catanzaro, Jan Kautz, Andrew Tao, Zhiding Yu, Guilin Liu

Advances in Neural Information Processing Systems (NeurIPS) · 2025

CLIMB: Clustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training

Shizhe Diao, Yu Yang, Yonggan Fu, Xin Dong, Dan Su, Markus Kliegl, Zijia Chen, Peter Belcak, Yoshi Suhara, Hongxu Yin, Mostofa Patwary, Yingyan Celine Lin, Jan Kautz, Pavlo Molchanov

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning

Ali Taghibakhshi, Sharath Turuvekere Sreenivas, Saurav Muralidharan, Marcin Chochowski, Yashaswi Karnati, Raviraj Bhuminand Joshi, Ameya Sunil Mahabaleshwarkar, Zijia Chen, Yoshi Suhara, Oluwatobale Olabiyi, Daniel Korzekwa, Mostofa Patwary, Mohammad Shoeybi, Jan Kautz, Bryan Catanzaro

Advances in Neural Information Processing Systems (NeurIPS) · 2025

HO-Cap: A Capture System and Dataset for 3D Reconstruction and Pose Tracking of Hand-Object Interaction

Jikai Wang, Qifan Zhang, Yu-Wei Chao, Bowen Wen, Xiaohu Guo, Yu Xiang

Advances in Neural Information Processing Systems (NeurIPS) · 2025

Continuum Attention for Neural Operators

Edoardo Calvello, Nikola B Kovachki, Matthew E Levine, Andrew M Stuart

Journal of Machine Learning Research · 2025

Token-Efficient VLM: High-Resolution Image Understanding via Dynamic Region Proposal

Yitong Jiang, Jinwei Gu, Tianfan Xue, Ka Chun Cheung, Pavlo Molchanov, Hongxu Yin, Sifei Liu

IEEE International Conference on Computer Vision (ICCV) · 2025

HumanOLAT: A Large-Scale Dataset for Full-Body Human Relighting and Novel-View Synthesis

Timo Teufel, Xilong Zhou, Umar Iqbal, Pramod Rao, Pulkit Gera, Jan Kautz, Vladislav Golyanik, Christian Theobalt

IEEE International Conference on Computer Vision (ICCV) · 2025

AdaHuman: Animatable Detailed 3D Human Generation with Compositional Multiview Diffusion

Yangyi Huang, Ye Yuan, Xueting Li, Jan Kautz, Umar Iqbal

IEEE International Conference on Computer Vision (ICCV) · 2025

GeoMan: Temporally Consistent Human Geometry Estimation using Image-to-Video Diffusion

Gwanghyun Kim, Xueting Li, Ye Yuan, Koki Nagano, Tianye Li, Jan Kautz, Se Young Chun, Umar Iqbal

IEEE International Conference on Computer Vision (ICCV) · 2025

GEM: A GENeralist Model for Human MOtion

Jiefeng Li, Jinkun Cao, Haotian Zhang, Davis Rempe, Jan Kautz, Umar Iqbal, Ye Yuan

IEEE International Conference on Computer Vision (ICCV) · 2025

Hydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training

Zhenxin Li, Shihao Wang, Shiyi Lan, Zhiding Yu, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang, Jose M. Alvarez

IEEE International Conference on Computer Vision (ICCV) · 2025

RoboArena: Distributed Real-World Evaluation of Generalist Robot Policies

Pranav Atreya, Karl Pertsch, Tony Lee, Moo Jin Kim, Arhan Jain, Artur Kuramshin, Clemens Eppner, Cyrus Neary, Edward Hu, Fabio Ramos, Jonathan Tremblay, Kanav Arora, Kirsty Ellis, Luca Macesanu, Matthew Leonard, Meedeum Cho, Ozgur Aslan, Shivin Dass, Jie Wang, Xingfang Yuan, Xuning Yang, Abhishek Gupta, Dinesh Jayaraman, Glen Berseth, Kostas Daniilidis, Roberto Martin-Martin, Youngwoon Lee, Percy Liang, Chelsea Finn, Sergey Levine

Conference on Robot Learning (CoRL) · 2025

FLARE: Robot Learning with Implicit World Modeling

Ruijie Zheng, Jing Wang, Scott Reed, Yu Fang, Fengyuan Hu, Joel Jang, Kaushil Kundalia, Zongyu Lin, Loïc Magne, Avnish Narayan, You Liang Tan, Guanzhi Wang, Qi Wang, Jiannan Xiang, Yinzhen Xu, Seonghyeon Ye, Jan Kautz, Furong Huang, Yuke Zhu, Linxi Fan

Conference on Robot Learning (CoRL) · 2025

DreamGen: Unlocking Generalization in Robot Learning through Video World Models

Joel Jang, Seonghyeon Ye, Zongyu Lin, Jiannan Xiang, Johan Bjorck, Yu Fang, Fengyuan Hu, Spencer Huang, Kaushil Kundalia, Loïc Magne, Ajay Mandlekar, Avnish Narayan, You Liang Tan, Guanzhi Wang, Jing Wang, Qi Wang, Yinzhen Xu, Kaiyuan Zheng, Ruijie Zheng, Luke Zettlemoyer, Dieter Fox, Jan Kautz, Scott Reed, Yuke Zhu, Linxi Fan

Conference on Robot Learning (CoRL) · 2025

Wolf: Dense Video Captioning with a World Summarization Framework

Boyi Li, Ligeng Zhu, Ran Tian, Shuhan Tan, Yuxiao Chen, Yao Lu, Yin Cui, Sushant Veer, Max Ehrlich, Jonah Philion, Xinshuo Weng, Fuzhao Xue, Linxi Fan, Yuke Zhu, Jan Kautz, Andrew Tao, Ming-Yu Liu, Sanja Fidler, Boris Ivanovic, Trevor Darrell, Jitendra Malik, Song Han, Marco Pavone

Transactions on Machine Learning Research · 2025

LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models

Dachuan Shi, Yonggan Fu, Xiangchi Yuan, Zhongzhi Yu, Haoran You, Sixu Li, Xin Dong, Jan Kautz, Pavlo Molchanov, Yingyan Celine Lin

International Conference on Machine Learning (ICML) · 2025

Adaptive Flow Matching for Resolving Small-Scale Physics

Stathi Fotiadis, Noah Brenowitz, Tomas Geffner, Yair Cohen, Mike Pritchard, Arash Vahdat, Morteza Mardani

International Conference on Machine Learning (ICML) · 2025

FeatSharp: Your Vision Model Features, Sharper

Mike Ranzinger, Greg Heinrich, Pavlo Molchanov, Jan Kautz, Bryan Catanzaro, Andrew Tao

International Conference on Machine Learning (ICML) · 2025

GenMol: A Drug Discovery Generalist with Discrete Diffusion

Seul Lee, Karsten Kreis, Srimukh Prasad Veccham, Meng Liu, Danny Reidenbach, Saee Paliwal, Weili Nie, Arash Vahdat

International Conference on Machine Learning (ICML) · 2025

Puzzle: Distillation-Based NAS for Inference-Optimized LLMs

Akhiad Bercovich, Tomer Ronen, Talor Abramovich, Nir Ailon, Nave Assaf, Mohammed Dabbah, Ido Galil, Amnon Geifman, Yonatan Geifman, Izhak Golan, Netanel Haber, Ehud Dov Karpas, Roi Koren, Itay Levy, Pavlo Molchanov, Shahar Mor, Zach Moshe, Najeeb Nabwani, Omri Puny, Ran Rubin, Itamar Schen, Ido Shahaf, Oren Tropp, Omer Ullman Argov, Ran Zilberstein, Ran El-Yaniv

International Conference on Machine Learning (ICML) · 2025

Sim-and-Real Co-Training: A Simple Recipe for Vision-Based Robotic Manipulation

Abhiram Maddukuri, Zhenyu Jiang, Lawrence Yunliang Chen, Soroush Nasiriany, Yuqi Xie, Yu Fang, Wenqi Huang, Zu Wang, Zhenjia Xu, Nikita Chernyadev, Scott Reed, Ken Goldberg, Ajay Mandlekar, Linxi Fan, Yuke Zhu

Robotics: Science and Systems (RSS) · 2025

ASAP: Aligning Simulation and Real-World Physics for Learning Agile Humanoid Whole-Body Skills

Tairan He, Jiawei Gao, Wenli Xiao, Yuanhang Zhang, Zi Wang, Jiashun Wang, Zhengyi Luo, Guanqi He, Nikhil Sobanbabu, Chaoyi Pan, Zeji Yi, Guannan Qu, Kris Kitani, Jessica Hodgins, Linxi “Jim” Fan, Yuke Zhu, Changliu Liu, Guanya Shi

Robotics: Science and Systems (RSS) · 2025

NaVILA: Legged Robot Vision-Language-Action Model for Navigation

An-Chieh Cheng, Yandong Ji, Zhaojing Yang, Zaitan Gongye, Xueyan Zou, Jan Kautz, Erdem Biyik, Hongxu Yin, Sifei Liu, Xiaolong Wang

Robotics: Science and Systems (RSS) · 2025

Argus: Vision-Centric Reasoning with Grounded Chain-of-Thought

Yunze Man, De-An Huang, Guilin Liu, Shiwei Sheng, Shilong Liu, Liangyan Gui, Jan Kautz, Yu-Xiong Wang, Zhiding Yu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

One-Minute Video Generation with Test-Time Training

Jiarui Xu, Shihao Han, Karan Dalal, Daniel Koceja, Xinhao Li, Yue Zhao, Ka Chun Cheung, Yejin Choi, Jan Kautz, Sifei Liu, Yu Sun, Xiaolong Wang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Scaling Vision Pre-Training to 4K Resolution

Baifeng Shi, Boyi Li, Han Cai, Yao Lu, Sifei Liu, Marco Pavone, Jan Kautz, Song Han, Trevor Darrell, Pavlo Molchanov, Hongxu Yin

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Mosaic3D: Foundation Dataset and Model for Open-Vocabulary 3D Segmentation

Junha Lee, Chunghyun Park, Jaesung Choe, Yu-Chiang Frank Wang, Jan Kautz, Minsu Cho, Chris Choy

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Parallel Sequence Modeling via Generalization Spatial Propagation Network (GSPN)

Hongjun Wang, Wonmin Byeon, Jiarui Xu, Jinwei Gu, Ka Chun Cheung, Xiaolong Wang, Kai Han, Jan Kautz, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Zero-Shot Monocular Scene Flow Estimation in the Wild

Yiqing Liang, Abhishek Badki, Hang Su, James Tompkin, Orazio Gallo

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

FoundationStereo: Zero-Shot Stereo Matching

Bowen Wen, Matthew Trepte, Oluwaseun Joseph Aribido, Jan Kautz, Orazio Gallo, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Omni-RGPT: Unifying Image and Video Region-level Understanding via Token Marks

Miran Heo, Min-Hung Chen, De-An Huang, Sifei Liu, Subhashree Radhakrishnan, Seon Joo Kim, Yu-Chiang Frank Wang, Ryo Hachiuma

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

BlobGEN-Vid: Compositional Text-to-Video Generation with Blob Video Representations

Weixi Feng, Chao Liu, Sifei Liu, William Yang Wang, Arash Vahdat, Weili Nie

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

SimAvatar: Simulation-Ready Avatars with Layered Hair and Clothing

Xueting Li, Ye Yuan, Shalini De Mello, Gilles Daviet, Jonathan Leaf, Miles Macklin, Jan Kautz, Umar Iqbal

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

RADIO Amplified: Improved Baselines for Agglomerative Vision Foundation Models

Greg Heinrich, Mike Ranzinger, Hongxu Yin, Yao Lu, Jan Kautz, Bryan Catanzaro, Andrew Tao, Pavlo Molchanov

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

NVILA: Efficient Frontier Visual Language Models

Zhijian Liu, Ligeng Zhu, Baifeng Shi, Zhuoyang Zhang, Yuming Lou, Shang Yang, Haocheng Xi, Shiyi Cao, Yuxian Gu, Dacheng Li, Xiuyu Li, Yunhao Fang, Yukang Chen, Cheng-Yu Hsieh, De-An Huang, An-Chieh Cheng, Vishwesh Nath, Andriy Myronenko, Jinyi Hu, Sifei Liu, Ranjay Krishna, Daguang Xu, Xiaolong Wang, Pavlo Molchanov, Jan Kautz, Hongxu Yin, Song Han, and Yao Lu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics

Chan Hee Song, Valts Blukis, Jonathan Tremblay, Stephen Tyree, Yu Su, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

MambaVision: A Hybrid Mamba-Transformer Vision Backbone

Ali Hatamizadeh, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

3D-MVP: 3D Multiview Pretraining for Robotic Manipulation

Shengyi Qian, Kaichun Mo, Valts Blukis, David Fouhey, Dieter Fox, Ankit Goyal

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counter Factual Reasoning

Shihao Wang, Zhiding Yu, Xiaohui Jiang, Shiyi Lan, Min Shi, Nadine Chang, Jan Kautz, Ying Li, Jose M. Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2025

Dynamic Non-Prehensile Object Transport via Model-Predictive Reinforcement Learning

Neel Anand Jawale, Byron Boots, Balakumar Sundaralingam, Mohak Bhardwaj

International Conference on Robotics and Automation (ICRA) · 2025

Inference-Time Policy Steering with Human Interactions

Yanwei Wang, Lirui Wang, Yilun Du, Balakumar Sundaralingam, Xuning Yang, Yu-Wei Chao, Claudia Pérez-D'Arpino, Dieter Fox, Julie A. Shah

International Conference on Robotics and Automation (ICRA) · 2025

SPOT: SE(3) Pose Trajectory Diffusion for Object-Centric Manipulation

Cheng-Chun Hsu, Bowen Wen, Jie Xu, Yashraj Narang, Xiaolong Wang, Yuke Zhu, Joydeep Biswas, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2025

HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots

Tairan He, Wenli Xiao, Toru Lin, Zhengyi Luo, Zhenjia Xu, Zhenyu Jiang, Jan Kautz, Changliu Liu, Guanya Shi, Xiaolong Wang, Linxi “Jim” Fan, Yuke Zhu

International Conference on Robotics and Automation (ICRA) · 2025

Modeling Visually-Guided Aim-and-Shoot Behavior in First-Person Shooters

June-Seop Yoon, Hee-Seung Moon, Ben Boudaoud, Josef Spjut, Iuri Frosio, Byungjoo Lee, Joohwan Kim

International Journal of Human-Computer Studies · 2025

LlamaFlex: Many-in-One LLMs via Generalized Pruning and Weight Sharing

Ruisi Cai, Saurav Muralidharan, Hongxu Yin, Zhangyang Wang, Jan Kautz, Pavlo Molchanov

International Conference on Learning Representations (ICLR) · 2025

LongMamba: Enhancing Mamba's Long-Context Capabilities via Training-Free Receptive Field Enlargement

Zhifan Ye, Kejing Xia, Yonggan Fu, Xin Dong, Jihoon Hong, Xiangchi Yuan, Shizhe Diao, Jan Kautz, Pavlo Molchanov, Yingyan (Celine) Lin

International Conference on Learning Representations (ICLR) · 2025

InverseBench: Benchmarking Plug-and-Play Diffusion Models for Scientific Inverse Problems

Hongkai Zheng, Wenda Chu, Bingliang Zhang, Zihui Wu, Austin Wang, Berthy Feng, Caifeng Zou, Yu Sun, Nikola Kovachki, Zachary E Ross, Katherine Bouman, Yisong Yue

International Conference on Learning Representations (ICLR) · 2025

ProtComposer: Compositional Protein Structure Generation with 3D Ellipsoids

Hannes Stark, Bowen Jing, Tomas Geffner, Jason Yim, Tommi Jaakkola, Arash Vahdat, Karsten Kreis

International Conference on Learning Representations (ICLR) · 2025

Proteina: Scaling Flow-based Protein Structure Generative Models

Tomas Geffner, Kieran Didi, Zuobai Zhang, Danny Reidenbach, Zhonglin Cao, Jason Yim, Mario Geiger, Christian Dallago, Emine Kucukbenli, Arash Vahdat, Karsten Kreis

International Conference on Learning Representations (ICLR) · 2025

Not-So-Optimal Transport Flows for 3D Point Cloud Generation

Ka-Hei Hui, Chao Liu, Xiaohui Zeng, Chi-Wing Fu, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2025

Gated Delta Networks: Improving Mamba2 with Delta Rule

Songlin Yang, Jan Kautz, Ali Hatamizadeh

International Conference on Learning Representations (ICLR) · 2025

Hymba: A Hybrid-head Architecture for Small Language Models

Xin Dong, Yonggan Fu, Shizhe Diao, Wonmin Byeon, Zijia Chen, Ameya Sunil Mahabaleshwarkar, Shih-Yang Liu, Matthijs Van Keirsbilck, Min-Hung Chen, Yoshi Suhara, Yingyan Celine Lin, Jan Kautz, Pavlo Molchanov

International Conference on Learning Representations (ICLR) · 2025

Energy-based Diffusion Language Models for Text Generation

Minkai Xu, Tomas Geffner, Karsten Kreis, Weili Nie, Yilun Xu, Jure Leskovec, Stefano Ermon, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2025

Truncated Consistency Models

Sangyun Lee, Yilun Xu, Tomas Geffner, Giulia Fanti, Karsten Kreis, Arash Vahdat, Weili Nie

International Conference on Learning Representations (ICLR) · 2025

Heavy-Tailed Diffusion Models

Kushagra Pandey, Jaideep Pathak, Yilun Xu, Stephan Mandt, Mike Pritchard, Arash Vahdat, Morteza Mardani

International Conference on Learning Representations (ICLR) · 2025

Think while You Generate: Discrete Diffusion with Planned Denoising

Sulin Liu, Juno Nam, Andrew Campbell, Hannes Stark, Yilun Xu, Tommi Jaakkola, Rafael Gomez-Bombarelli

International Conference on Learning Representations (ICLR) · 2025

Neural Eulerian Scene Flow Fields

Kyle Vedder, Neehar Peri, Ishan Khatri, Siyi Li, Eric Eaton, Mehmet Kemal Kocamaz, Yue Wang, Zhiding Yu, Deva Ramanan, Joachim Pehserl

International Conference on Learning Representations (ICLR) · 2025

VILA-U: Efficient and Unified Visual Language Understanding and Generation

Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu

International Conference on Learning Representations (ICLR) · 2025

Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders

Min Shi, Fuxiao Liu, Shihao Wang, Shijia Liao, Subhashree Radhakrishnan, De-An Huang, Hongxu Yin, Karan Sapra, Yaser Yacoob, Humphrey Shi, Bryan Catanzaro, Andrew Tao, Jan Kautz, Guilin Liu, Zhiding Yu

International Conference on Learning Representations (ICLR) · 2025

LongVILA: Scaling Long-Context Visual Language Models for Long Videos

Yukang Chen, Fuzhao Xue, Dacheng Li, Qinghao Hu, Ligeng Zhu, Xiuyu Li, Yunhao Fang, Haotian Tang, Shang Yang, Zhijian Liu, Yihui He, Hongxu Yin, Pavlo Molchanov, Jan Kautz, Linxi Fan, Yuke Zhu, Yao Lu, Song Han

International Conference on Learning Representations (ICLR) · 2025

Repulsive Latent Score Distillation Sampling for Diverse Sampling of Diffusion Models

Nicols Zilberstein, Morteza Mardani, Santiago Seggara

International Conference on Learning Representations (ICLR) · 2025

T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching

Zizheng Pan, Bohan Zhuang, De-An Huang, Weili Nie, Zhiding Yu, Chaowei Xiao, Jianfei Cai, Anima Anandkumar

International Conference on Learning Representations (ICLR) · 2025

Snap-it, Tap-it, Splat-it: Tactile-Informed 3D Gaussian Splatting for Reconstructing Challenging Surfaces

Mauro Comi, Alessio Tonioni, Max Yang, Jonathan Tremblay, Valts Blukis, Yijiong Lin, Nathan F. Lepora, Laurence Aitchison

International Conference on 3D Vision (3DV) · 2025

GR00T N1: An Open Foundation Model for Generalist Humanoid Robots

NVIDIA, Johan Bjorck, Fernando Castañeda, Nikita Cherniadev, Xingye Da, Runyu Ding, Linxi "Jim" Fan, Yu Fang, Dieter Fox, Fengyuan Hu, Spencer Huang, Joel Jang, Zhenyu Jiang, Jan Kautz, Kaushil Kundalia, Lawrence Lao, Zhiqi Li, Zongyu Lin, Kevin Lin, Guilin Liu, Edith Llontop, Loic Magne, Ajay Mandlekar, Avnish Narayan, Soroush Nasiriany, Scott Reed, You Liang Tan, Guanzhi Wang, Zu Wang, Jing Wang, Qi Wang, Jiannan Xiang, Yuqi Xie, Yinzhen Xu, Zhenjia Xu, Seonghyeon Ye, Zhiding Yu, Ao Zhang, Hao Zhang, Yizhou Zhao, Ruijie Zheng, Yuke Zhu

arXiv · 2025

HybridDepth: Robust Metric Depth Fusion by Leveraging Depth from Focus and Single-Image Priors

Ashkan Ganj, Hang Su, Tian Guo

IEEE Winter Conference on Applications of Computer Vision (WACV) · 2025

Residual corrective diffusion modeling for km-scale atmospheric downscaling

Morteza Mardani, Noah Brenowitz, Yair Cohen, Jaideep Pathak, Chieh-Yu Chen, Cheng-Chin Liu, Arash Vahdat, Mohammad Amin Nabian, Tao Ge, Akshay Subramaniam, Karthik Kashinath, Jan Kautz, Mike Pritchard

Nature Communications Earth & Environment · 2025

Directed Graph Generation with Heat Kernels

Marc T. Law, Karsten Kreis, Haggai Maron

Transactions on Machine Learning Research · 2025

CosAE: Learnable Fourier Series for Image Restoration

Sifei Liu, Shalini De Mello, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Molecule Generation with Fragment Retrieval Augmentation

Seul Lee, Karsten Kreis, Srimukh Prasad Veccham, Meng Liu, Danny Reidenbach, Saee Paliwal, Arash Vahdat, Weili Nie

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Warped Diffusion: Solving Video Inverse Problems with Image Diffusion Models

Giannis Daras, Weili Nie, Karsten Kreis, Alex Dimakis, Morteza Mardani, Nikola Kovachki, Arash Vahdat

Advances in Neural Information Processing Systems (NeurIPS) · 2024

FACTORSIM: Generative Simulation via Factorized Representation

Fan-Yun Sun, Harini S I, Angela Yi, Yihan Zhou, Alex Zook, Jonathan Tremblay, Logan Cross, Jiajun Wu, Nick Haber

Advances in Neural Information Processing Systems (NeurIPS) · 2024

MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models

Gongfan Fang, Hongxu Yin, Saurav Muralidharan, Greg Heinrich, Jeff Pool, Jan Kautz, Pavlo Molchanov, Xinchao Wang

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Compact Language Models via Pruning and Knowledge Distillation

Saurav Muralidharan, Sharath Turuvekere Sreenivas, Raviraj Joshi, Marcin Chochowski, Mostofa Patwary, Mohammad Shoeybi, Bryan Catanzaro, Jan Kautz, Pavlo Molchanov

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Aligning Target-Aware Molecule Diffusion Models with Exact Energy Optimization

Siyi Gu, Minkai Xu, Alexander S Powers, Weili Nie, Tomas Geffner, Karsten Kreis, Jure Leskovec, Arash Vahdat, Stefano Ermon

Advances in Neural Information Processing Systems (NeurIPS) · 2024

L4GM: Large 4D Gaussian Reconstruction Model

Jiawei Ren, Kevin Xie, Ashkan Mirzaei, Hanxue Liang, Xiaohui Zeng, Karsten Kreis, Ziwei Liu, Antonio Torralba, Sanja Fidler, Seung Wook Kim, Huan Ling

Advances in Neural Information Processing Systems (NeurIPS) · 2024

SpatialRGPT: Grounded Spatial Reasoning in Vision-Language Models

An-Chieh Cheng, Hongxu Yin, Yang Fu, Qiushan Guo, Ruihan Yang, Jan Kautz, Xiaolong Wang, Sifei Liu

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Memorize What Matters: Emergent Scene Decomposition from Multitraverse

Yiming Li, Zehong Wang, Yue Wang, Zhiding Yu, Zan Gojcic, Marco Pavone, Chen Feng, Jose M. Alvarez

Advances in Neural Information Processing Systems (NeurIPS) · 2024

LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning

Rui Pan, Xiang Liu, Shizhe Diao, Renjie Pi, Jipeng Zhang, Chi Han, Tong Zhang

Advances in Neural Information Processing Systems (NeurIPS) · 2024

Pretraining Codomain Attention Neural Operators for Solving Multiphysics PDEs

Md Ashiqur Rahman, Robert Joseph George, Mogab Elleithy, Daniel Leibovici, Zongyi Li, Boris Bonev, Colin White, Julius Berner, Raymond A Yeh, Jean Kossaifi, others

Advances in Neural Information Processing Systems (NeurIPS) · 2024

BlobGEN-3D: Compositional 3D-Consistent Freeview Image Generation with 3D Blobs

Chao Liu, Weili Nie, Sifei Liu, Abhishek Badki, Hang Su, Morteza Mardani, Benjamin Eckart, Arash Vahdat

ACM Transactions on Graphics (SIGGRAPH ASIA) · 2024

DiffUHaul: A Training-Free Method for Object Dragging in Images

Omri Avrahami, Rinon Gal, Gal Chechik, Ohad Fried, Dani Lischinski, Arash Vahdat, Weili Nie

ACM Transactions on Graphics (SIGGRAPH ASIA) · 2024

Promoting best practices in ocean forecasting through an Operational Readiness Level

E. Alvarez Fanjul, S. Ciliberti, J. Pearlman, K. Wilmer-Becker, P. Bahurel, F. Ardhuin, A. Arnaud, K. Azizzadenesheli, Others Others

Frontiers in Marine Science · 2024

Avoid Everything: Model-Free Collision Avoidance with Expert-Guided Fine-Tuning

Adam Fishman, Aaron Walsman, Mohak Bhardwaj, Wentao Yuan, Balakumar Sundaralingam, Byron Boots, Dieter Fox

Conference on Robot Learning (CoRL) · 2024

SkillMimicGen: Automated Demonstration Generation for Efficient Skill Learning and Deployment

Caelan Reed Garrett, Ajay Mandlekar, Bowen Wen, Dieter Fox

Conference on Robot Learning (CoRL) · 2024

DiffusionSeeder: Seeding Motion Optimization with Diffusion for Rapid Motion Planning

Huang Huang, Balakumar Sundaralingam, Arsalan Mousavian, Adithyavairavan Murali, Ken Goldberg, Dieter Fox

Conference on Robot Learning (CoRL) · 2024

Harmon: Whole-Body Motion Generation of Humanoid Robots from Language Descriptions

Zhenyu Jiang, Yuqi Xie, Jinhan Li, Ye Yuan, Yifeng Zhu, Yuke Zhu

Conference on Robot Learning (CoRL) · 2024

RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics

Wentao Yuan, Jiafei Duan, Valts Blukis, Wilbert Pumacay, Ranjay Krishna, Adithyavairavan Murali, Arsalan Mousavian, Dieter Fox

Conference on Robot Learning (CoRL) · 2024

SSCBench: Monocular 3D Semantic Scene Completion Benchmark in Street Views

Yiming Li, Sihang Li, Xinhao Liu, Moonjun Gong, Kenan Li, Nuo Chen, Zijun Wang, Zhiheng Li, Tao Jiang, Fisher Yu, Yue Wang, Hang Zhao, Zhiding Yu, Chen Feng

International Conference on Intelligent Robots and Systems (IROS) · 2024

DeformGS: Scene Flow in Highly Deformable Scenes for Deformable Object Manipulation

Bardienus P. Duisterhof, Mandi Zhao, Yunchao Yao, Jia-Wei Liu, Jenny Seidenschwarz, Mike Zheng Shou, Deva Ramanan, Shuran Song, Stan Birchfield, Bowen Wen, Jeffrey Ichnowski

Workshop on the Algorithmic Foundations of Robotics (WAFR) · 2024

COIN: Control-Inpainting Diffusion Prior for Human and Camera Motion Estimation

Jifeng Li, Ye Yuan, Davis Rempe, Haotian Zhang, Pavlo Molchanov, Cewu Lu, Jan Kautz, Umar Iqbal

European Conference on Computer Vision (ECCV) · 2024

LITA: Language Instructed Temporal-localization Assistant

De-An Huang, Shijia Liao, Subhashree Radhakrishnan, Hongxu Yin, Pavlo Molchanov, Zhiding Yu, Jan Kautz

European Conference on Computer Vision (ECCV) · 2024

A Semantic Space is Worth 256 Language Descriptions: Make Stronger Segmentation Models with Descriptive Properties

Junfei Xiao, Ziqi Zhou, Wenxuan Li, Shiyi Lan, Jieru Mei, Zhiding Yu, Alan Yuille, Yuyin Zhou, Cihang Xie

European Conference on Computer Vision (ECCV) · 2024

MEVG: Multi-event Video Generation with Text-to-Video Models

Gyeongrok Oh, Jaehwan Jeong, Sieun Kim, Wonmin Byeon, Jinkyu Kim, Sungwoong Kim, Sangpil Kim

European Conference on Computer Vision (ECCV) · 2024

DiffiT: Diffusion Vision Transformers for Image Generation

Ali Hatamizadeh, Jiaming Song, Guilin Liu, Jan Kautz, Arash Vahdat

European Conference on Computer Vision (ECCV) · 2024

Avatar Fingerprinting for Authorized Use of Synthetic Talking-Head Videos

Ekta Prashnani, Koki Nagano, Shalini De Mello, David Luebke, Orazio Gallo

European Conference on Computer Vision (ECCV) · 2024

AGG: Amortized Generative 3D Gaussians for Single Image to 3D

Dejia Xu, Ye Yuan, Morteza Mardani, Sifei Liu, Jiaming Song, Zhangyang Wang, Arash Vahdat

Transactions on Machine Learning Research · 2024

Universal Functional Regression with Neural Operator Flows

Yaozhong Shi, Angela F Gao, Zachary E Ross, Kamyar Azizzadenesheli

Transactions on Machine Learning Research · 2024

FALCON: Fourier Adaptive Learning and Control for Disturbance Rejection Under Extreme Turbulence

Sahin Lale, Peter I. Renn, Kamyar Azizzadenesheli, Babak Hassibi, Morteza Gharib, Anima Anandkumar

npj Robotics · 2024

Deep Neural Helmholtz Operators for 3D Elastic Wave Propagation and Inversion

Caifeng Zou, Kamyar Azizzadenesheli, Zachary E. Ross, and Robert W. Clayton

Geophysical Journal International · 2024

Calibrated Uncertainty Quantification for Operator Learning via Conformal Prediction

Ziqi Ma, David Pitt, Kamyar Azizzadenesheli, Anima Anandkumar

Transactions on Machine Learning Research · 2024

Incremental Spatial and Spectral Learning of Neural Operators for Solving Large-Scale PDEs

Robert Joseph George, Jiawei Zhao, Jean Kossaifi, Zongyi Li, Anima Anandkumar

Transactions on Machine Learning Research · 2024

Multi-Grid Tensorized Fourier Neural Operator for High-Resolution PDEs

Jean Kossaifi, Nikola Kovachki, Kamyar Azizzadenesheli, Anima Anandkumar

Transactions on Machine Learning Research · 2024

Learning to Move Like Professional Counter-Strike Players Learning to Move Like Professional Counter-Strike Players

David Durst, Vishnu Sarukkai, Brennan Shacklett, Iuri Frosio, Chen Tessler, Joohwan Kim, Carly Wolfbrandt, Gilbert Bernstein, Sanjiban Choudhury, Pat Hanrahan, Kayvon Fatahalian

ACM SIGGRAPH / Eurographics Symposium on Computer Animation · 2024

Learning Homogenization For Elliptic Operators

Kaushik Bhattacharya, Nikola Kovachki, Aakila Rajan, Andrew M Stuart, Margaret Trautner

SIAM Journal on Numerical Analysis · 2024

LISA: Localized Image Stylization with Audio via Implicit Neural Representation

Seung Hyun Lee, Chanyoung Kim, Wonmin Byeon, Sang Ho Yoon, Jinkyu Kim, Sangpil Kim

Computational Visual Media · 2024

DisCo-Diff: Enhancing Continuous Diffusion Models with Discrete Latents

Yilun Xu, Gabriele Corso, Tommi Jaakkola, Arash Vahdat, Karsten Kreis

International Conference on Machine Learning (ICML) · 2024

Flextron: Many-in-One Flexible Large Language Model

Ruisi Cai, Saurav Muralidharan, Greg Heinrich, Hongxu Yin, Zhangyang Wang, Jan Kautz, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2024

Compositional Text-to-Image Generation with Dense Blob Representations

Weili Nie, Sifei Liu, Morteza Mardani, Chao Liu, Benjamin Eckart, Arash Vahdat

International Conference on Machine Learning (ICML) · 2024

Align Your Steps: Optimizing Sampling Schedules in Diffusion Models

Amirmojtaba Sabour, Sanja Fidler, Karsten Kreis

International Conference on Machine Learning (ICML) · 2024

Neural Operators with Localized Integral and Differential Kernels

Miguel Liu-Schiaffini, Julius Berner, Boris Bonev, Thorsten Kurth, Kamyar Azizzadenesheli, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2024

DoRA: Weight-decomposed Low-rank Adaptation

Shi-yang Liu, Chien-yi Wang, Hongxu Yin, Yu-Chiang Frank Wang, Kwang-Ting Cheng, Min-Hung Chen

International Conference on Machine Learning (ICML) · 2024

Equivariant Graph Neural Operator for Modeling 3D Dynamics

Minkai Xu, Jiaqi Han, Aaron Lou, Jean Kossaifi, Arvind Ramanathan, Kamyar Azizzadenesheli, Jure Leskovec, Stefano Ermon, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2024

FedBPT: Efficient Federated Black-box Prompt Tuning for Large Language Models

Jingwei Sun, Ziyue Xu, Hongxu Yin, Dong Yang, Daguang Xu, Yudong Liu, Zhixu Du, Yiran Chen, Holger Roth

International Conference on Machine Learning (ICML) · 2024

AutoMate: Specialist and Generalist Assembly Policies over Diverse Geometries

Bingjie Tang, Iretiayo Akinola, Jie Xu, Bowen Wen, Ankur Handa, Karl Van Wyk, Dieter Fox, Gaurav S. Sukhatme, Fabio Ramos, Yashraj Narang

Robotics: Science and Systems (RSS) · 2024

RVT-2: Learning Precise Manipulation from Few Demonstrations

Ankit Goyal, Valts Blukis, Jie Xu, Yijie Guo, Yu-Wei Chao, Dieter Fox

Robotics: Science and Systems (RSS) · 2024

Sparse Contextual CDF Regression

Kamyar Azizzadenesheli, William Lu, Anuran Makur, Qian Zhang

Transactions on Machine Learning Research · 2024

Outdoor Scene Extrapolation with Hierarchical Generative Cellular Automata

Dongsu Zhang, Francis Williams, Zan Gojcic, Karsten Kreis, Sanja Fidler, Young Min Kim, Amlan Kar

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

NeRFDeformer: NeRF Transformation from a Single View via 3D Scene Flows

Zhenggang Tang, Zhongzheng Ren, Xiaoming Zhao, Bowen Wen, Jonathan Tremblay, Stan Birchfield, Alex Schwing

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

PACER+: On-Demand Pedestrian Animation Controller in Driving Scenarios

Jingbo Wang, Ye Yuan Zhengyi Luo, Yixuan Li, Bo Dai

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Neural Implicit Representation for Building Digital Twins of Unknown Articulated Objects

Yijia Weng, Bowen Wen, Jonathan Tremblay, Valts Blukis, Dieter Fox, Leonidas Guibas, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data

Mengqi Zhang, Yang Fu, Zheng Ding, Sifei Liu, Zhuowen Tu, Xiaolong Wang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Improving Distant 3D Object Detection Using 2D Box Supervision

Zetong Yang, Zhiding Yu, Chris Choy, Renhao Wang, Anima Anandkumar, Jose M. Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

RegionGPT: Towards Region Understanding Vision Language Model

Qiushan Guo, Shalini De Mello, Hongxu Yin, Wonmin Byeon, Ka Chun Cheung, Yizhou Yu, Ping Luo, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

RGBD Objects in the Wild: Scaling Real-World 3D Object Learning from RGB-D Videos

Hongchi Xia, Yang Fu, Sifei Liu, Xiaolong Wang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Rendering Every Pixel for High-Fidelity Geometry in 3D GANs

Alex Trevithick, Matthew Chan, Towaki Takikawa, Umar Iqbal, Shalini De Mello, Manmohan Chandraker, Ravi Ramamoorthi, Koki Nagano

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Align Your Gaussians: Text-to-4D with Dynamic 3D Gaussians and Composed Diffusion Models

Huan Ling, Seung Wook Kim, Antonio Torralba, Sanja Fidler, Karsten Kreis

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

GAvatar: Animatable 3D Gaussian Avatars with Implicit Mesh Learning

Ye Yuan, Xueting Li, Yangyi Huang, Shalini De Mello, Koki Nagano, Jan Kautz, Umar Iqbal

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects

Bowen Wen, Wei Yang, Jan Kautz, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

VILA: On pretraining for vision language models

Ji Lin, Hongxu Yin, Wei Ping, Yao Lu, Pavlo Molchanov, Andrew Tao, Huizi Mao, Jan Kautz, Mohammad Shoeybi, Song Han

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

COLMAP-Free 3D Gaussian Splatting

Yang Fu, Sifei Liu, Amey Kulkarni, Jan Kautz, Alexei A. Efros, Xiaolong Wang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

AM-RADIO: Agglomerative Model - Reduce All Domains Into One

Mike Ranzinger, Greg Heinrich, Pavlo Molchanov, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving?

Zhiqi Li, Zhiding Yu, Shiyi Lan, Jiahan Li, Jan Kautz, Tong Lu, Jose M. Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Dream-in-4D: A Unified Approach for Text- and Image-guided 4D Scene Generation

Yufeng Zheng, Xueting Li, Koki Nagano, Sifei Liu, Karsten Kreis, Otmar Hilliges, Shalini De Mello

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

PerAda: Parameter-Efficient Federated Learning Personalization with Generalization Guarantees

Chulin Xie, De-An Huang, Wenda Chu, Daguang Xu, Chaowei Xiao, Bo Li, Anima Anandkumar

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2024

Multi-Track Timeline Control for Text-Driven 3D Human Motion Generation

Mathis Petrovich, Or Litany, Umar Iqbal, Michael J. Black, Gül Varol, Xue Bin Peng, Davis Rempe

CVPR Workshop on Human Motion Generation (HuMoGen) · 2024

An Empirical Study of Mamba-based Language Models

Roger Waleffe, Wonmin Byeon, Duncan Riach, Brandon Norick, Vijay Korthikanti, Tri Dao, Albert Gu, Ali Hatamizadeh, Sudhakar Singh, Deepak Narayanan, Garvit Kulshreshtha, Vartika Singh, Jared Casper, Jan Kautz, Mohammad Shoeybi, Bryan Catanzaro

arXiv · 2024

Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation

Zhenxin Li, Kailin Li, Shihao Wang, Shiyi Lan, Zhiding Yu, Yishen Ji, Zhiqi Li, Ziyue Zhu, Jan Kautz, Zuxuan Wu, Yu-Gang Jiang, Jose M. Alvarez

arXiv · 2024

AI-driven emulation of ocean dynamics on sub-seasonal scales

Suyash Bire, Jean Kossaifi, Simone Silvestri, Nikola Kovachki, Kamyar Azizzadenesheli, Chris N Hill, Anima Anandkumar

ICLR Workshop on Climate Change AI · 2024

Guaranteed Approximation Bounds for Mixed-Precision Neural Operators

Colin White, Renbo Tu, Jean Kossaifi, Gennady Pekhimenko, Kamyar Azizzadenesheli, Anima Anandkumar

International Conference on Learning Representations (ICLR) · 2024

Learning to Jointly Understand Visual and Tactile Signals

Yichen Li, Yilun Du, Chao Liu, Francis Williams, Michael Foshey, Benjamin Eckart, Jan Kautz, Joshua B. Tenenbaum, Antonio Torralba, Wojciech Matusik

International Conference on Learning Representations (ICLR) · 2024

Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo

Haque Ishfaq, Qingfeng Lan, Pan Xu, A Rupam Mahmood, Doina Precup, Anima Anandkumar, Kamyar Azizzadenesheli

International Conference on Learning Representations (ICLR) · 2024

Efficient Video Diffusion Models via Content-Frame Motion-Latent Decomposition

Sihyun Yu, Weili Nie, De-An Huang, Boyi Li, Jinwoo Shin, Anima Anandkumar

International Conference on Learning Representations (ICLR) · 2024

WildFusion: Learning 3D-Aware Latent Diffusion Models in View Space

Katja Schwarz, Seung Wook Kim, Jun Gao, Sanja Fidler, Andreas Geiger, Karsten Kreis

International Conference on Learning Representations (ICLR) · 2024

3D Reconstruction with Generalizable Neural Fields using Scene Priors

Yang Fu, Shalini De Mello, Xueting Li, Amey Kulkarni, Jan Kautz, Xiaolong Wang, Sifei Liu

International Conference on Learning Representations (ICLR) · 2024

FasterViT: Fast Vision Transformers with Hierarchical Attention

Ali Hatamizadeh, Greg Heinrich, Hongxu Yin, Andrew Tao, Jose M. Alvarez, Jan Kautz, Pavlo Molchanov

International Conference on Learning Representations (ICLR) · 2024

A Variational Perspective on Solving Inverse Problems with Diffusion Models

Morteza Mardani, Jiaming Song, Jan Kautz, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2024

Timing as an Action: Learning When to Observe and Act

Helen Zhou, Audrey Huang, Kamyar Azizzadenesheli, David Childers, Zachary Lipton

International Conference on Artificial Intelligence and Statistics (AISTATS) · 2024

Neural operators for accelerating scientific simulations and design

Kamyar Azizzadenesheli, Nikola Kovachki, Zongyi Li, Miguel Liu-Schiaffini, Jean Kossaifi, Anima Anandkumar

Nature Reviews Physics · 2024

Robust Sound-Guided Image Manipulation

Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, Sang Ho Yoon, Jinkyu Kim, Sangpil Kim

Neural Networks · 2024

Broadband ground motion synthesis via generative adversarial neural operators: Development and validation

Yaozhong Shi, Grigorios Lavrentiadis, Domniki Asimaki, Zachary E Ross, Kamyar Azizzadenesheli

Bulletin of the Seismological Society of America · 2024

FoVA-Depth: Field-of-View Agnostic Depth Estimation for Cross-Dataset Generalization

Daniel Lichy, Hang Su, Abhishek Badki, Jan Kautz, Orazio Gallo

International Conference on 3D Vision (3DV) · 2024

PACE: Human and Camera Motion Estimation from in-the-wild Videos

Muhammed Kocabas, Ye Yuan, Pavlo Molchanov, Yunrong Guo, Michael Black, Otmar Hilliges, Jan Kautz, Umar Iqbal

International Conference on 3D Vision (3DV) · 2024

Partial-View Object View Synthesis via Filtering Inversion

Fan-Yun Sun, Jonathan Tremblay, Valts Blukis, Kevin Lin, Danfei Xu, Boris Ivanovic, Peter Karkus, Stan Birchfield, Dieter Fox, Ruohan Zhang, Yunzhu Li, Jiajun Wu, Marco Pavone, Nick Haber

International Conference on 3D Vision (3DV) · 2024

Fast Training of Diffusion Models with Masked Transformers

Hongkai Zheng, Weili Nie, Arash Vahdat, Anima Anandkumar

Transactions on Machine Learning Research · 2024

Functional Linear Regression of Cumulative Distribution Functions

Qian Zhang, Anuran Makur, Kamyar Azizzadenesheli

Transactions on Machine Learning Research · 2024

Mobile AR Depth Estimation: Challenges & Prospects

Ashkan Ganj, Yiqin Zhao, Hang Su, Tian Guo

International Workshop on Mobile Computing Systems and Applications · 2024

Operator Learning: Algorithms and Analysis

Nikola B Kovachki, Samuel Lanthaler, Andrew M Stuart

Handbook of Numerical Analysis · 2024

Physics-informed neural operators with exact differentiation on arbitrary geometries

Colin White, Julius Berner, Jean Kossaifi, Mogab Elleithy, David Pitt, Daniel Leibovici, Zongyi Li, Kamyar Azizzadenesheli, Anima Anandkumar

Symbiosis of Deep Learning and Differential Equations III, Neural Information Processing Systems (NeurIPS) · 2023

Geometry-informed neural operator for large-scale 3D PDEs

Zongyi Li, Nikola Kovachki, Chris Choy, Boyi Li, Jean Kossaifi, Shourya Otta, Mohammad Amin Nabian, Maximilian Stadler, Christian Hundt, Kamyar Azizzadenesheli, Anima Anandkumar

Advances in Neural Information Processing Systems (NeurIPS) · 2023

Convolutional State Space Models for Long-Range Spatiotemporal Modeling

Jimmy T.H. Smith, Shalini De Mello, Jan Kautz, Scott Linderman, Wonmin Byeon

Advances in Neural Information Processing Systems (NeurIPS) · 2023

Generalizable One-shot Neural Head Avatar

Xueting Li, Shalini De Mello, Sifei Liu, Koki Nagano, Umar Iqbal, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2023

MimicGen: A Data Generation System for Scalable Robot Learning using Human Demonstrations

Ajay Mandlekar, Soroush Nasiriany, Bowen Wen, Iretiayo Akinola, Yashraj Narang, Linxi Fan, Yuke Zhu, Dieter Fox

Conference on Robot Learning (CoRL) · 2023

SMRD: SURE-based Robust MRI Reconstruction with Diffusion Models

Batu Ozturkler, Chao Liu, Benjamin Eckart, Morteza Mardani, Jiaming Song, Jan Kautz

International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI) · 2023

TexFusion: Synthesizing 3D Textures with Text-Guided Image Diffusion Models

Tianshi Cao, Karsten Kreis, Sanja Fidler, Nicholas Sharp, Kangxue Yin

IEEE International Conference on Computer Vision (ICCV) · 2023

End-to-end 3D Tracking with Decoupled Queries

Yanwei Li, Zhiding Yu, Jonah Philion, Anima Anandkumar, Sanja Fidler, Jiaya Jia, Jose M. Alvarez

IEEE International Conference on Computer Vision (ICCV) · 2023

Fully Attentional Networks with Self-emerging Token Labeling

Bingyin Zhao, Zhiding Yu, Shiyi Lan, Yutao Cheng, Anima Anandkumar, Yingjie Lao, Jose M. Alvarez

IEEE International Conference on Computer Vision (ICCV) · 2023

Learning Human Dynamics in Autonomous Driving Scenarios

Jingbo Wang, Ye Yuan, Zhengyi Luo, Kevin Xie, Dahua Lin, Umar Iqbal, Sanja Fidler, Sameh Khamis

IEEE International Conference on Computer Vision (ICCV) · 2023

The Power of Sound (TPoS): Audio Reactive Video Generation with Stable Diffusion

Yujin Jeong, Won Jeong Ryoo, Seung Hyun Lee, Da Bin Seo, Wonmin Byeon, Sangpil Kim, Jinkyu Kim

IEEE International Conference on Computer Vision (ICCV) · 2023

FocalFormer3D: Focusing on Hard Instance for 3D Object Detection

Yilun Chen, Zhiding Yu, Yukang Chen, Shiyi Lan, Anima Anandkumar, Jiaya Jia, Jose M. Alvarez

IEEE International Conference on Computer Vision (ICCV) · 2023

FB-BEV: BEV Representation from Forward-Backward View Transformations

Zhiqi Li, Zhiding Yu, Wenhai Wang, Anima Anandkumar, Tong Lu, Jose M. Alvarez

IEEE International Conference on Computer Vision (ICCV) · 2023

DreamTeacher: Pretraining Image Backbones with Deep Generative Models

Daiqing Li, Huan Ling, Amlan Kar, David Acuna, Seung Wook Kim, Karsten Kreis, Antonio Torralba, Sanja Fidler

IEEE International Conference on Computer Vision (ICCV) · 2023

Generative Novel View Synthesis with 3D-Aware Diffusion Models

Eric Ryan Chan, Koki Nagano, Jeong Joon Park, Matthew Chan, Alexander William Bergman, Axel Levy, Miika Aittala, Shalini De Mello, Tero Karras, Gordon Wetzstein

IEEE International Conference on Computer Vision (ICCV) · 2023

RANA: Relightable and Articulated Neural Avatars

Umar Iqbal, Akin Caliskan, Koki Nagano, Sameh Khamis, Pavlo Molchanov, Jan Kautz

IEEE International Conference on Computer Vision (ICCV) · 2023

PhysDiff: Physics-Guided Human Motion Diffusion Model

Ye Yuan, Jiaming Song, Umar Iqbal, Arash Vahdat, Jan Kautz

IEEE International Conference on Computer Vision (ICCV) · 2023

HANDAL: A Dataset of Real-World Manipulable Object Categories with Pose Annotations, Affordances, and Reconstructions

Andrew Guo, Bowen Wen, Jianhe Yuan, Jonathan Tremblay, Stephen Tyree, Jeffrey Smith, Stan Birchfield

International Conference on Intelligent Robots and Systems (IROS) · 2023

Vicinity Vision Transformer

Weixuan Sun, Zhen Qin, Hui Deng, Jianyuan Wang, Yi Zhang, Kaihao Zhang, Nick Barnes, Stan Birchfield, Lingpeng Kong, Yiran Zhong

IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) · 2023

Differentially Private Diffusion Models

Tim Dockhorn, Tianshi Cao, Arash Vahdat, Karsten Kreis

Transactions on Machine Learning Research · 2023

Learning Physically Simulated Tennis Players from Broadcast Videos

Haotian Zhang, Ye Yuan, Viktor Makoviychuk, Yunrong Guo, Sanja Fidler, Xue Bin Peng, Kayvon Fatahalian

ACM Transactions on Graphics (SIGGRAPH) · 2023

Single-Shot Implicit Morphable Faces with Consistent Texture Parameterization

Connor Lin, Koki Nagano, Jan Kautz, Eric Chan, Umar Iqbal, Leonidas Guibas, Gordon Wetzstein, Sameh Khamis

ACM Transactions on Graphics (SIGGRAPH) · 2023

Real-Time Radiance Fields for Single-Image Portrait View Synthesis

Alexander Trevithick, Matthew Chan, Michael Stengel, Eric Ryan Chan, Chao Liu, Zhiding Yu, Sameh Khamis, Manmohan Chandraker, Ravi Ramamoorthi, Koki Nagano

ACM Transactions on Graphics (SIGGRAPH) · 2023

Loss-Guided Diffusion Models for Plug-and-Play Controllable Generation

Jiaming Song, Qinsheng Zhang, Hongxu Yin, Morteza Mardani, Ming-Yu Liu, Jan Kautz, Yongxin Chen, Arash Vahdat

International Conference on Machine Learning (ICML) · 2023

I^2SB: Image-to-Image Schrödinger Bridge

Guan-Horng Liu, Arash Vahdat, De-An Huang, Evangelos Theodorou, Weili Nie, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2023

Fast Sampling of Diffusion Models via Operator Learning

Hongkai Zheng, Weili Nie, Arash Vahdat, Kamyar Azizzadenesheli, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2023

Global Context Vision Transformers

Ali Hatamizadeh, Hongxu Yin, Greg Heinrich, Jan Kautz, Pavlo Molchanov

International Conference on Machine Learning (ICML) · 2023

Heterogeneous Continual Learning

Divyam Madaan, Hongxu Yin, Wonmin Byeon, Jan Kautz, Pavlo Molchanov

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Zero-shot Pose Transfer for Unrigged Stylized 3D Characters

Jiashun Wang, Xueting Li, Sifei Liu, Shalini De Mello, Orazio Gallo, Xiaolong Wang, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

The Best Defense is a Good Offense: Adversarial Augmentation Against Adversarial Attacks

Iuri Frosio, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Fast Monocular Scene Reconstruction with Global-Sparse Local-Dense Grids

Wei Dong, Chris Choy, Charles Loop, Or Litany, Yuke Zhu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Seung Wook Kim, Bradley Brown, Kangxue Yin, Karsten Kreis, Katja Schwarz, Daiqing Li, Robin Rombach, Antonio Torralba, Sanja Fidler

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Align your Latents: High-Resolution Video Synthesis with Latent Diffusion Models

Andreas Blattmann, Robin Rombach, Huan Ling, Tim Dockhorn, Seung Wook Kim, Sanja Fidler, Karsten Kreis

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Trace and Pace: Controllable Pedestrian Animation via Guided Trajectory Diffusion

Davis Rempe, Zhengyi Luo, Xue Bin Peng, Ye Yuan, Kris Kitani, Karsten Kreis, Sanja Fidler, Or Litany

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Recurrence without Recurrence: Stable Video Landmark Detection with Deep Equilibrium Models

Paul Micaelli, Pavlo Molchanov, Arash Vahdat, Hongxu Yin, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

TTA-COPE: Test-Time Adaptation for Category-Level Object Pose Estimation

Taeyeop Lee, Jonathan Tremblay, Valts Blukis, Bowen Wen, Byeong-Uk Lee, Inkyu Shin, Stan Birchfield, In So Kweon, Kuk-Jin Yoon

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

BundleSDF: Neural 6-DoF Tracking and 3D Reconstruction of Unknown Objects

Bowen Wen, Jonathan Tremblay, Valts Blukis, Stephen Tyree, Thomas Müller, Alex Evans, Dieter Fox, Jan Kautz, Stan Birchfield

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Affordance Diffusion: Synthesizing Hand-Object Interactions

Yufei Ye, Xueting Li, Abhinav Gupta, Shalini De Mello, Stan Birchfield, Jiaming Song, Shubham Tulsiani, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Open-Vocabulary Panoptic Segmentation with Text-to-Image Diffusion Models

Jiarui Xu, Sifei Liu, Arash Vahdat, Wonmin Byeon, Xiaolong Wang, Shalini De Mello

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

VoxFormer: Sparse voxel transformer for camera-based 3D semantic scene completion

Yiming Li, Zhiding Yu, Christopher Choy, Chaowei Xiao, Jose M Alvarez, Sanja Fidler, Chen Feng, Anima Anandkumar

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Vision Transformers Are Good Mask Auto-Labelers

Shiyi Lan, Xitong Yang, Zhiding Yu, Zuxuan Wu, Jose M Alvarez, Anima Anandkumar

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

GazeNeRF: 3D-Aware Gaze Redirection with Neural Radiance Fields

Alessandro Ruzzi, Xiangwei Shi, Xi Wang, Gengyan Li, Shalini De Mello, Hyung Jin Chang, Xucong Zhang, Otmar Hilliges

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Magic3D: High-Resolution Text-to-3D Content Creation

Chen-Hsuan Lin, Jun Gao, Luming Tang, Towaki Takikawa, Xiaohui Zeng, Xun Huang, Karsten Kreis, Sanja Fidler, Ming-Yu Liu, Tsung-Yi Lin

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

Global Vision Transformer Pruning with Hessian-Aware Saliency

Huanrui Yang, Hongxu Yin, Maying Shen, Pavlo Molchanov, Hai Li, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2023

One-Shot Neural Fields for 3D Object Understanding

Valts Blukis, Taeyeop Lee, Jonathan Tremblay, Bowen Wen, In So Kweon, Kuk-Jin Yoon, Dieter Fox, Stan Birchfield

CVPR Workshop on Advances in NeRF for the Metaverse (XRNeRF) · 2023

FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation

Zhiqi Li, Zhiding Yu, David Austin, Mingsheng Fang, Shiyi Lan, Jan Kautz, Jose M. Alvarez

CVPR Workshop on End-to-end Autonomous Driving · 2023

Augmenting Legacy Networks for Flexible Inference

Jason Clemons, Iuri Frosio, Maying Shen, Jose M. Alvarez, Stephen W. Keckler

IEEE Intelligent Vehicles Symposium · 2023

Online Consistent Video Depth using Continuous Geometric Representations

Chao Liu, Benjamin Eckart, Jan Kautz

International Conference on Robotics and Automation (ICRA) · 2023

RGB-Only Reconstruction of Tabletop Scenes for Collision-Free Manipulator Control

Zhenggang Tang, Balakumar Sundaralingam, Jonathan Tremblay, Bowen Wen, Ye Yuan, Stephen Tyree, Charles Loop, Alexander Schwing, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2023

Parallel Inversion of Neural Radiance Fields for Robust Pose Estimation

Yunzhi Lin, Thomas Muller, Jonathan Tremblay, Bowen Wen, Stephen Tyree, Alex Evans, Patricio A. Vela, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2023

PROGPROMPT: Generating Situated Robot Task Plans using Large Language Models

Ishika Singh, Valts Blukis, Arsalan Mousavian, Ankit Goyal, Danfei Xu, Jonathan Tremblay, Dieter Fox, Jesse Thomason, Animesh Garg

International Conference on Robotics and Automation (ICRA) · 2023

Pseudoinverse-Guided Diffusion Models for Inverse Problems

Jiaming Song, Arash Vahdat, Morteza Mardani, Jan Kautz

International Conference on Learning Representations (ICLR) · 2023

GPViT: A High Resolution Non-Hierarchical Vision Transformer with Group Propagation

Chenhongyi Yang, Jiarui Xu, Shalini De Mello, Elliot J. Crowley, Xiaolong Wang

International Conference on Learning Representations (ICLR) · 2023

Dual Diffusion Implicit Bridges for Image-to-Image Translation

Xuan Su, Jiaming Song, Chenlin Meng, Stefano Ermon

International Conference on Learning Representations (ICLR) · 2023

Prismer: A Vision-Language Model with An Ensemble of Experts

Shikun Liu, Linxi Fan, Edward Johns, Zhiding Yu, Chaowei Xiao, Anima Anandkumar

arXiv · 2023

Re-ViLM: Retrieval-Augmented Visual Language Model for Zero and Few-Shot Image Captioning

Zhuolin Yang, Wei Ping, Zihan Liu, Vijay Korthikanti, Weili Nie, De-An Huang, Linxi Fan, Zhiding Yu, Shiyi Lan, Bo Li, others

arXiv · 2023

MegaPose: 6D Pose Estimation of Novel Objects via Render and Compare

Yann Labbè, Lucas Manuelli, Arsalan Mousavian, Stephen Tyree, Stan Birchfield, Jonathan Tremblay, Justin Carpentier, Mathieu Aubry, Dieter Fox, Josef Sivic

Conference on Robot Learning (CoRL) · 2022

Concrete Score Matching: Generalized Score Matching for Discrete Data

Chenlin Meng, Kristy Choi, Jiaming Song, Stefano Ermon

Advances in Neural Information Processing Systems (NeurIPS) · 2022

Structural Pruning via Latency-Saliency Knapsack

Maying Shen, Hongxu Yin, Pavlo Molchanov, Lei Mao, Jianna Liu, Jose M Alvarez

Advances in Neural Information Processing Systems (NeurIPS) · 2022

LION: Latent Point Diffusion Models for 3D Shape Generation

Xiaohui Zeng, Arash Vahdat, Francis Williams, Zan Gojcic, Or Litany, Sanja Fidler, Karsten Kreis

Advances in Neural Information Processing Systems (NeurIPS) · 2022

GENIE: Higher-Order Denoising Diffusion Solvers

Tim Dockhorn, Arash Vahdat, Karsten Kreis

Advances in Neural Information Processing Systems (NeurIPS) · 2022

Test-time prompt tuning for zero-shot generalization in vision-language models

Manli Shu, Weili Nie, De-An Huang, Zhiding Yu, Tom Goldstein, Anima Anandkumar, Chaowei Xiao

Advances in Neural Information Processing Systems (NeurIPS) · 2022

MinVIS: A minimal video instance segmentation framework without video-based training

De-An Huang, Zhiding Yu, Anima Anandkumar

Advances in Neural Information Processing Systems (NeurIPS) · 2022

Embodied Scene-aware Human Pose Estimation

Zhengyi Luo, Shun Iwase, Ye Yuan, Kris Kitani

Advances in Neural Information Processing Systems (NeurIPS) · 2022

LISA: Learning Interpretable Skill Abstractions from Language

Divyansh Garg, Sakanda Vaidyanath, Kuno Kim, Jiaming Song, Stefano Ermon

Advances in Neural Information Processing Systems (NeurIPS) · 2022

Denoising Diffusion Restoration Models

Bahjat Kawar, Michael Elad, Stefano Ermon, Jiaming Song

Advances in Neural Information Processing Systems (NeurIPS) · 2022

Privacy Vulnerability of Split Computing to Data-Free Model Inversion Attacks

Xin Dong, Hongxu Yin, Jose M Alvarez, Jan Kautz, Pavlo Molchanov

British Machine Vision Conference (BMVC) · 2022

Scraping Textures from Natural Images for Synthesis and Editing

Xueting Li, Sifei Liu, Xiaolong Wang, Ming-Hsuan Yang, Alyosha Efros

European Conference on Computer Vision (ECCV) · 2022

Neural Light Field Estimation for Outdoor Scenes with Differentiable Virtual Object Insertion

Zian Wang, Wenzheng Chen, David Acuna, Jan Kautz, Sanja Fidler

eccv · 2022

Audio-Visual Segmentation

Jinxing Zhou, Jianyuan Wang, Jiayi Zhang, Weixuan Sun, Jing Zhang, Stan Birchfield, Dan Guo, Lingpeng Kong, Meng Wang, Yiran Zhong

European Conference on Computer Vision (ECCV) · 2022

Sound-Guided Semantic Video Generation

Seung Hyun Lee, Gyeongrok Oh, Wonmin Byeon, Jihyun Bae, Chanyoung Kim, Won Jeong Ryoo, Sang Ho Yoon, Jinkyu Kim, Sangpil Kim

European Conference on Computer Vision (ECCV) · 2022

Autoregressive 3D shape generation via canonical mapping

An-Chieh Cheng, Xueting Li, Sifei Liu, Min Sun, Ming-Hsuan Yang

European Conference on Computer Vision (ECCV) · 2022

Multimodal Conditional Image Synthesis with Product-of-Experts GANs

Xun Huang, Arun Mallya, Ting-Chun Wang, Ming-Yu Liu

European Conference on Computer Vision (ECCV) · 2022

LANA: Latency Aware Network Acceleration

Pavlo Molchanov, Jimmy Hall, Hongxu Yin, Jan Kautz, Nicolo Fusi, Arash Vahdat

European Conference on Computer Vision (ECCV) · 2022

6-DoF Pose Estimation of Household Objects for Robotic Manipulation: An Accessible Dataset and Benchmark

Stephen Tyree, Jonathan Tremblay, Thang To, Jia Cheng, Terry Mosier, Jeffrey Smith, Stan Birchfield

International Conference on Intelligent Robots and Systems (IROS) · 2022

RTMV: A Ray-Traced Multi-View Synthetic Dataset for Novel View Synthesis

Jonathan Tremblay, Moustafa Meshry, Alex Evans, Jan Kautz, Alexander Keller, Sameh Khamis, Thomas Müller, Charles Loop, Nathan Morrical, Koki Nagano, Towaki Takikawa, Stan Birchfield

ECCV Workshop on Learning to Generate 3D Shapes and Scenes · 2022

Towards Annotation-efficient Segmentation via Image-to-image Translation

Eugene Vorontsov, Pavlo Molchanov, Matej Gazda, Christopher Beckham, Jan Kautz, Samuel Kadoury

Medical Image Analysis · 2022

Partial Convolution for Padding, Inpainting, and Image Synthesis

Guilin Liu, Aysegul Dundar, Kevin J Shih, Ting-Chun Wang, Fitsum A Reda, Karan Sapra, Zhiding Yu, Xiaodong Yang, Andrew Tao, Bryan Catanzaro

IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) · 2022

Diffusion Models for Adversarial Purification

Weili Nie, Brandon Guo, Yujia Huang, Chaowei Xiao, Arash Vahdat, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2022

Understanding The Robustness in Vision Transformers

Daquan Zhou, Zhiding Yu, Enze Xie, Chaowei Xiao, Animashree Anandkumar, Jiashi Feng, Jose M Alvarez

International Conference on Machine Learning (ICML) · 2022

Scaling-up Diverse Orthogonal Convolutional Networks with a Paraunitary Framework

Jiahao Su, Wonmin Byeon, Furong Huang

International Conference on Machine Learning (ICML) · 2022

CoordGAN: Self-Supervised Dense Correspondences Emerge from GANs

Jiteng Mu, Shalini De Mello, Zhiding Yu, Nuno Vasconcelos, Xiaolong Wang, Jan Kautz, Sifei Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

GroupViT: Semantic Segmentation Emerges From Text Supervision

Jiarui Xu, Shalini De Mello, Sifei Liu, Wonmin Byeon, Thomas Breuel, Jan Kautz, Xiaolong Wang

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

Panoptic SegFormer: Delving deeper into panoptic segmentation with transformers

Zhiqi Li, Wenhai Wang, Enze Xie, Zhiding Yu, Anima Anandkumar, Jose M Alvarez, Ping Luo, Tong Lu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

GradViT: Gradient Inversion of Vision Transformers

Ali Hatamizadeh, Hongxu Yin, Holger R Roth, Wenqi Li, Jan Kautz, Daguang Xu, Pavlo Molchanov

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

FreeSOLO: Learning to Segment Objects without Annotations

Xinlong Wang, Zhiding Yu, Shalini De Mello, Jan Kautz, Animashree Anandkumar, Chunhua Shen, Jose M. Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

Watch It Move: Unsupervised Discovery of 3D Joints for Re-Posing of Articulated Objects

Atsuhiro Noguchi, Umar Iqbal, Jonathan Tremblay, Tatsuya Harada, Orazio Gallo

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

Efficient Geometry-aware 3D Generative Adversarial Networks

Eric Chan, Connor Z. Lin, Matthew A. Chan, Koki Nagano, Boxiao Pan, Shalini De Mello, Orazio Gallo, Leonidas J. Guibas, Jonathan Tremblay, Sameh Khamis, Tero Karras, Gordon Wetzstein

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

A-ViT: Adaptive Tokens for Efficient Vision Transformer

Hongxu Yin, Arash Vahdat, Jose M. Alvarez, Arun Mallya, Jan Kautz, Pavlo Molchanov

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

GLAMR: Global Occlusion-Aware Human Mesh Recovery with Dynamic Cameras

Ye Yuan, Umar Iqbal, Pavlo Molchanov, Kris Kitani, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

Sound-Guided Semantic Image Manipulation

Seung Hyun Lee, Wonseok Roh, Wonmin Byeon, Sang Ho Yoon, Chan Young Kim, Jinkyu Kim, Sangpil Kim

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

When to Prune? A Policy towards Early Structural Pruning

Maying Shen, Pavlo Molchanov, Hongxu Yin, Jose M Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2022

Physics Informed RNN-DCT Networks for Time-Dependent Partial Differential Equations

Benjamin Wu, Oliver Hennigh, Jan Kautz, Sanjay Choudhry, Wonmin Byeon

International Conference on Computational Science (ICCS) · 2022

Keypoint-Based Category-Level Object Pose Tracking from an RGB Sequence with Uncertainty Estimation

Yunzhi Lin, Jonathan Tremblay, Stephen Tyree, Patricio A. Vela, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2022

PredictionNet: Real-Time Joint Probabilistic Traffic Prediction for Planning, Control, and Simulation

Alexey Kamenev, Lirui Wang, Ollin Boer Bohan, Ishwar Kulkarni, Bilal Kartal, Artem Molchanov, Stan Birchfield, David Nistér, Nikolai Smolyanskiy

International Conference on Robotics and Automation (ICRA) · 2022

Single-Stage Keypoint-Based Category-Level Object Pose Estimation from an RGB Image

Yunzhi Lin, Jonathan Tremblay, Stephen Tyree, Patricio A. Vela, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2022

Learning contrastive representation for semantic correspondence

Taihong Xiao, Sifei Liu, Shalini De Mello, Zhiding Yu, Jan Kautz, Ming-Hsuan Yang

International Journal of Computer Vision (IJCV) · 2022

Displacement-Invariant Cost Computation for Efficient Stereo Matching

Yiran Zhong, Charles Loop, Wonmin Byeon, Stan Birchfield, Yuchao Dai, Kaihao Zhang, Alexey Kamenev, Thomas Breuel, Hongdong Li, Jan Kautz

International Journal of Computer Vision (IJCV) · 2022

Tackling the Generative Learning Trilemma with Denoising Diffusion GANs

Zhisheng Xiao, Karsten Kreis, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2022

Score-Based Generative Modeling with Critically-Damped Langevin Diffusion

Tim Dockhorn, Arash Vahdat, Karsten Kreis

International Conference on Learning Representations (ICLR) · 2022

M$^2$BEV: Multi-camera joint 3D detection and segmentation with unified birds-eye view representation

Enze Xie, Zhiding Yu, Daquan Zhou, Jonah Philion, Anima Anandkumar, Sanja Fidler, Ping Luo, Jose M Alvarez

arXiv · 2022

DRaCoN--Differentiable Rasterization Conditioned Neural Radiance Fields for Articulated Avatars

Amit Raj, Umar Iqbal, Koki Nagano, Sameh Khamis, Pavlo Molchanov, James Hays, Jan Kautz

arXiv · 2022

Neural Interferometry: Image Reconstruction from Astronomical Interferometers using Transformer-Conditioned Neural Fields

Ben Wu, Chao Liu, Benjamin Eckart, Jan Kautz

AAAI Conference on Artificial Intelligence (AAAI) · 2022

Do Gradient Inversion Attacks Make Federated Learning Unsafe?

Ali Hatamizadeh, Hongxu Yin, Pavlo Molchanov, Andriy Myronenko, Wenqi Li, Prerna Dogra, Andrew Feng, Mona G Flores, Jan Kautz, Daguang Xu, others

arXiv · 2022

Coupled Segmentation and Edge Learning Using Dynamic Graph Propagation

Zhiding Yu, Rui Huang, Wonmin Byeon, Sifei Liu, Guilin Liu, Thomas Breuel, Animashree Anandkumar, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2021

Coupled Segmentation and Edge Learning via Dynamic Graph Propagation

Zhiding Yu, Rui Huang, Wonmin Byeon, Sifei Liu, Guilin Liu, Thomas Breuel, Anima Anandkumar, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2021

Don't Generate Me: Training Differentially Private Generative Models with Sinkhorn Divergence

Tianshi Cao, Alex Bie, Arash Vahdat, Sanja Fidler, Karsten Kreis

Advances in Neural Information Processing Systems (NeurIPS) · 2021

Controllable and Compositional Generation with Latent-Space Energy-Based Models

Weili Nie, Arash Vahdat, Anima Anandkumar

Advances in Neural Information Processing Systems (NeurIPS) · 2021

Improve Agents without Retraining: Parallel Tree Search with Off-Policy Correction

Gal Dalal, Assaf Hallak, Steven Dalton, Iuri Frosio, Shie Mannor, Gal Chechik

Advances in Neural Information Processing Systems (NeurIPS) · 2021

Score-based Generative Modeling in Latent Space

Arash Vahdat, Karsten Kreis, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2021

SegFormer: Simple and efficient design for semantic segmentation with transformers

Enze Xie, Wenhai Wang, Zhiding Yu, Anima Anandkumar, Jose M Alvarez, Ping Luo

Advances in Neural Information Processing Systems (NeurIPS) · 2021

A Contrastive Learning Approach for Training Variational Autoencoder Priors

Jyoti Aneja, Alexander Schwing, Jan Kautz, Arash Vahdat

Advances in Neural Information Processing Systems (NeurIPS) · 2021

KAMA: 3D Keypoint Aware Body Mesh Articulation

Umar Iqbal, Kevin Xie, Yunrong Guo, Jan Kautz, Pavlo Molchanov

International Conference on 3D Vision (3DV) · 2021

Noise-Aware Video Saliency Prediction

Ekta Prashnani, Orazio Gallo, Joohwan Kim, Josef B. Spjut, Pradeep Sen, Iuri Frosio

British Machine Vision Conference (BMVC) · 2021

Hierarchical Contrastive Motion Learning for Video Action Recognition

Xitong Yang, Xiaodong Yang, Sifei Liu, Deqing Sun, Larry Davis, Jan Kautz

British Machine Vision Conference (BMVC) · 2021

Optimizing Selective Protection for CNN Resilience

Abdulrahman Mahmoud, Siva Kumar Sastry Hari, Christopher W Fletcher, Sarita V Adve, Charbel Sakr, Naresh Shanbhag, Pavlo Molchanov, Michael B Sullivan, Timothy Tsai, Stephen W Keckler

International Symposium on Software Reliability Engineering (ISSRE) · 2021

Self-Supervised Object Detection via Generative Image Synthesis

Siva Karthik Mustikovela, Shalini De Mello, Aayush Prakash, Umar Iqbal, Sifei Liu, Thu Nguyen-Phuoc, Carsten Rother, Jan Kautz

IEEE International Conference on Computer Vision (ICCV) · 2021

Learning Indoor Inverse Rendering with 3D Spatially-Varying Lighting

Zian Wang, Jonah Philion, Sanja Fidler, Jan Kautz

IEEE International Conference on Computer Vision (ICCV) · 2021

GANcraft: Unsupervised 3D Neural Rendering of Minecraft Worlds

Zekun Hao, Arun Mallya, Serge Belongie, Ming-Yu Liu

IEEE International Conference on Computer Vision (ICCV) · 2021

Self-Supervised Real-to-Sim Scene Generation

Aayush Prakash, Shoubhik Debnath, Jean-Francois Lafleche, Eric Cameracci, Gavriel State, Stan Birchfield, Marc T. Law

IEEE International Conference on Computer Vision (ICCV) · 2021

NViT: Vision Transformer Compression and Parameter Redistribution

Huanrui Yang, Hongxu Yin, Pavlo Molchanov, Hai Li, Jan Kautz

arXiv · 2021

Multi-View Fusion for Multi-Level Robotic Scene Understanding

Yunzhi Lin, Jonathan Tremblay, Stephen Tyree, Patricio A. Vela, Stan Birchfield

International Conference on Intelligent Robots and Systems (IROS) · 2021

Joint Space Control via Deep Reinforcement Learning

Visak Kumar, David Hoeller, Balakumar Sundaralingam, Jonathan Tremblay, Stan Birchfield

International Conference on Intelligent Robots and Systems (IROS) · 2021

Generating and Characterizing Scenarios for Safety Testing of Autonomous Vehicles

Zahra Ghodsi, Siva Hari, Iuri Frosio, Timothy Tsai, Alejandro Troccoli, Stephen Keckler, Siddharth Garg, Anima Anandkumar

IEEE Intelligent Vehicles Symposium · 2021

Domain Stylization: A Fast Covariance Matching Framework towards Domain Adaptation

Aysegul Dundar, Ming-Yu Liu, Zhiding Yu, Ting-Chun Wang, John Zedlewski, Jan Kautz

IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) · 2021

RMPflow: A Geometric Framework for Generation of Multi-Task Motion Policies

Ching-An Cheng, Mustafa Mukadam, Jan Issac, Stan Birchfield, Dieter Fox, Byron Boots, Nathan Ratliff

IEEE Transactions on Automation Science and Engineering (TASE) · 2021

View Generalization for Single Image Textured 3D Models

Anand Bhattad, Aysegul Dundar, Guilin Liu, Andrew Tao, Bryan Catanzaro

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

DiscoBox: Weakly Supervised Instance Segmentation and Semantic Correspondence from Box Supervision

Shiyi Lan, Zhiding Yu, Christopher Choy, Subhashree Radhakrishnan, Guilin Liu, Yuke Zhu, Larry S Davis, Anima Anandkumar

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Learning to Track Instances without Video Annotations

Yang Fu, Sifei Liu, Umar Iqbal, Shalini De Mello, Humphrey Shi, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Optimal Quantization Using Scaled Codebook

Yerlan Idelbayev, Pavlo Molchanov, Maying Shen, Hongxu Yin, Miguel A Carreira-Perpinán, Jose M Alvarez

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Self-Supervised Learning on 3D Point Clouds by Learning Discrete Generative Models

Benjamin Eckart, Wentao Yuan, Chao Liu, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Weakly-Supervised Physically Unconstrained Gaze Estimation

Rakshit Kothari, Shalini De Mello, Umar Iqbal, Wonmin Byeon, Seonwook Park, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

See through Gradients: Image Batch Recovery via GradInversion

Hongxu Yin, Arun Mallya, Arash Vahdat, Jose M. Alvarez, Jan Kautz, Pavlo Molchanov

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

DexYCB: A Benchmark for Capturing Hand Grasping of Objects

Yu-Wei Chao, Wei Yang, Yu Xiang, Pavlo Molchanov, Ankur Handa, Jonathan Tremblay, Yashraj S. Narang, Karl Van Wyk, Umar Iqbal, Stan Birchfield, Jan Kautz, Dieter Fox

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Deep Two-View Structure-from-Motion Revisited

Jianyuan Wang, Yiran Zhong, Yuchao Dai, Stan Birchfield, Kaihao Zhang, Nikolai Smolyanskiy, Hongdong Li

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Dual Contrastive Loss and Attention for GANs

Ning Yu, Guilin Liu, Aysegul Dundar, Andrew Tao, Bryan Catanzaro, Larry S Davis, Mario Fritz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

Binary TTC: A Temporal Geofence for Autonomous Navigation

Abhishek Badki, Orazio Gallo, Jan Kautz, Pradeep Sen

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

One-Shot Free-View Neural Talking-Head Synthesis for Video Conferencing

Ting-Chun Wang, Arun Mallya, Ming-Yu Liu

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2021

NVIDIA SimNet: An AI-accelerated multi-physics simulation framework

Oliver Hennigh, Susheela Narasimhan, Mohammad Amin Nabian, Akshay Subramaniam, Kaustubh Tangsali, Max Rietmann, Jose del Aguila Ferrandis, Wonmin Byeon, Zhiwei Fang, Sanjay Choudhry

International Conference on Computational Science (ICCS) · 2021

Adversarial Motion Modelling Helps Semi-Supervised Hand Pose Estimation

Adrian Spurr, Pavlo Molchanov, Umar Iqbal, Jan Kautz, Otmar Hilliges

arXiv · 2021

Hierarchical Planning for Long-Horizon Manipulation with Geometric and Symbolic Scene Graphs

Yifeng Zhu, Jonathan Tremblay, Stan Birchfield, Yuke Zhu

International Conference on Robotics and Automation (ICRA) · 2021

Fast Uncertainty Quantification for Deep Object Pose Estimation

Guanya Shi, Yifeng Zhu, Jonathan Tremblay, Stan Birchfield, Fabio Ramos, Animashree Anandkumar, Yuke Zhu

International Conference on Robotics and Automation (ICRA) · 2021

Neural Trajectory Fields for Dynamic Novel View Synthesis

Chaoyang Wang, Ben Eckart, Simon Lucey, Orazio Gallo

arXiv · 2021

NViSII: A Scriptable Tool for Photorealistic Image Generation

Nathan Morrical, Jonathan Tremblay, Yunzhi Lin, Stephen Tyree, Stan Birchfield, Valerio Pascucci, Ingo Wald

ICLR Workshop on Synthetic Data Generation · 2021

Learning continuous environment fields via implicit functions

Xueting Li, Shalini De Mello, Xiaolong Wang, Ming-Hsuan Yang, Jan Kautz, Sifei Liu

International Conference on Learning Representations (ICLR) · 2021

Parameter Efficient Multimodal Transformers for Video Representation Learning

Sangho Lee, Youngjae Yu, Gunhee Kim, Thomas Breuel, Jan Kautz, Yale Song

International Conference on Learning Representations (ICLR) · 2021

VAEBM: A Symbiosis between Variational Autoencoders and Energy-based Models

Zhisheng Xiao, Karsten Kreis, Jan Kautz, Arash Vahdat

International Conference on Learning Representations (ICLR) · 2021

Robust Vision-Based Cheat Detection in Competitive Gaming

Aditya Jonnalagadda, Iuri Frosio, Seth Schneider, Morgan McGuire, Joohwan Kim

ACM SIGGRAPH Symposium on Interactive 3D Graphics and Games · 2021

Neural FFTs for Universal Texture Image Synthesis

Morteza Mardani, Guilin Liu, Aysegul Dundar, Shiqiu Liu, Andrew Tao, Bryan Catanzaro

Advances in Neural Information Processing Systems (NeurIPS) · 2020

Online adaptation for consistent mesh reconstruction in the wild

Xueting Li, Sifei Liu, Shalini De Mello, Kihwan Kim, Xiaolong Wang, Ming-Hsuan Yang, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2020

Generative View Synthesis: From Single-view Semantics to Novel-view Images

Tewodros Amberbir Habtegebrial, Varun Jampani, Orazio Gallo, Didier Stricker

Advances in Neural Information Processing Systems (NeurIPS) · 2020

NVAE: A Deep Hierarchical Variational Autoencoder

Arash Vahdat, Jan Kautz

Advances in Neural Information Processing Systems (NeurIPS) · 2020

Convolutional Tensor-Train LSTM for Spatio-temporal Learning

Jiahao Su, Wonmin Byeon, Furong Huang, Jan Kautz, Animashree Anandkumar

Advances in Neural Information Processing Systems (NeurIPS) · 2020

On the Distance between Two Neural Networks and the Stability of Learning

Jeremy Bernstein, Arash Vahdat, Yisong Yue, Ming-Yu Liu

Advances in Neural Information Processing Systems (NeurIPS) · 2020

Accelerating reinforcement learning through GPU atari emulation

Steven Dalton, Iuri Frosio

Advances in Neural Information Processing Systems (NeurIPS) · 2020

Indirect Object-to-Robot Pose Estimation from an External Monocular RGB Camera

Jonathan Tremblay, Stephen Tyree, Terry Mosier, Stan Birchfield

International Conference on Intelligent Robots and Systems (IROS) · 2020

MVLidarNet: Real-Time Multi-Class Scene Understanding for Autonomous Driving Using Multiple Views

Ke Chen, Ryan Oldja, Nikolai Smolyanskiy, Stan Birchfield, Alexander Popov, David Wehr, Ibrahim Eden, Joachim Pehserl

International Conference on Intelligent Robots and Systems (IROS) · 2020

UFO2: A Unified Framework towards Omni-supervised Object Detection

Zhongzheng Ren, Zhiding Yu, Xiaodong Yang, Ming-Yu Liu, Alexander Schwing, Jan Kautz

European Conference on Computer Vision (ECCV) · 2020

Self-supervised single-view 3D reconstruction via semantic consistency

Xueting Li, Sifei Liu, Kihwan Kim, Shalini De Mello, Varun Jampani, Ming-Hsuan Yang, Jan Kautz

European Conference on Computer Vision (ECCV) · 2020

Joint Disentangling and Adaptation for Cross-Domain Person Re-Identification

Yang Zou, Xiaodong Yang, Zhiding Yu, B. V. K. Vijaya Kumar, Jan Kautz

European Conference on Computer Vision (ECCV) · 2020

World-Consistent Video-to-Video Synthesis

Arun Mallya, Ting-Chun Wang, Karan Sapra, Ming-Yu Liu

European Conference on Computer Vision (ECCV) · 2020

Contrastive Learning for Weakly Supervised Phrase Grounding

Tanmay Gupta, Arash Vahdat, Gal Chechik, Xiaodong Yang, Jan Kautz, Derek Hoiem

European Conference on Computer Vision (ECCV) · 2020

Angular Visual Hardness

Beidi Chen, Weiyang Liu, Animesh Garg, Zhiding Yu, Anshumali Shrivastava, Jan Kautz, Anima Anandkumar

International Conference on Machine Learning (ICML) · 2020

Undirected Graphical Models as Approximate Posteriors

Arash Vahdat, Evgeny Andriyash, William G Macready

International Conference on Machine Learning (ICML) · 2020

Transposer: Universal Texture Synthesis Using Feature Maps as Transposed Convolution Filter

Guilin Liu, Rohan Taori, Ting-Chun Wang, Zhiding Yu, Shiqiu Liu, Fitsum A Reda, Karan Sapra, Andrew Tao, Bryan Catanzaro

arXiv · 2020

PyTorchFI: A Runtime Perturbation Tool for DNNs

Abdulrahman Mahmoud, Neeraj Aggarwal, Alex Nobbe, Jose Rodrigo Sanchez Vicarte, Sarita V. Adve, Christopher W. Fletcher, Iuri Frosio, Siva Kumar Sastry Hari

IEEE/IFIP International Conference on Dependable Systems and Networks Workshops (DSN-W) · 2020

Bi3D: Stereo Depth Estimation via Binary Classifications

Abhishek Badki, Alejandro Troccoli, Kihwan Kim, Jan Kautz, Pradeep Sen, Orazio Gallo

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Instance-aware, Context-focused, and Memory-efficient Weakly-Supervised Object Detection

Zhongzheng Ren, Zhiding Yu, Xiaodong Yang, Ming-Yu Liu, Yong Jae Lee, Alexander Schwing, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Self-Supervised Viewpoint Learning from Image Collections

Siva Karthik Mustikovela, Varun Jampani, Shalini De Mello, Umar Iqbal, Sifei Liu, Carsten Rother, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Novel View Synthesis of Dynamic Scenes With Globally Coherent Depths From a Monocular Camera

Jae Shin Yoon, Kihwan Kim, Orazio Gallo, Hyun Soo Park, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Two-shot Spatially-varying BRDF and Shape Estimation

Mark Boss, Varun Jampani, Kihwan Kim, Hendrik Lensch, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Weakly-Supervised 3D Human Pose Learning via Multi-view Images in the Wild

Umar Iqbal, Pavlo Molchanov, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Meshlet Priors for 3D Mesh Reconstruction

Abhishek Badki, Orazio Gallo, Jan Kautz, Pradeep Sen

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

UNAS: Differentiable Architecture Search Meets Reinforcement Learning

Arash Vahdat, Arun Mallya, Ming-Yu Liu, Jan Kautz

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Semi-Supervised Semantic Image Segmentation with Self-correcting Networks

Moustafa S. Ibrahim, Arash Vahdat, Mani Ranjbar, William G. Macready

IEEE Conference on Computer Vision and Pattern Recognition (CVPR) · 2020

Camera-to-robot pose estimation from a single image

Timothy E Lee, Jonathan Tremblay, Thang To, Jia Cheng, Terry Mosier, Oliver Kroemer, Dieter Fox, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2020

DexPilot: Vision Based Teleoperation of Dexterous Robotic Hand-Arm System

Ankur Handa, Karl Van Wyk, Wei Yang, Jacky Liang, Yu-Wei Chao, Qian Wan, Stan Birchfield, Nathan Ratliff, Dieter Fox

International Conference on Robotics and Automation (ICRA) · 2020

Toward Sim-to-Real Directional Semantic Grasping

Shariq Iqbal, Jonathan Tremblay, Thang To, Jia Cheng, Erik Leitch, Andy Campbell, Kirby Leung, Duncan McKay, Stan Birchfield

International Conference on Robotics and Automation (ICRA) · 2020

NRMVS: Non-Rigid Multi-View Stereo

Matthias Innmann, Kihwan Kim, Jinwei Gu, Matthias Niessner, Charles Loop, Marc Stamminger, Jan Kautz

IEEE Winter Conference on Applications of Computer Vision (WACV) · 2020

Download all BibTeXReturn to homepage