Research Labs
All Research Labs
Spatial Intelligence
Applied Research
Autonomous Vehicles
Deep Imagination
Publications
AI Playground
New and Featured
AI Art Gallery
NGC Demos
Research Areas
AI & Machine Learning
3D Deep Learning
Computer Vision
Robotics
All Areas
Careers
Academic Collaborations
Government Collaborations
Graduate Fellowship
Internships
Research Openings
Research Scientists
Meet the Team
Licensing
Skip to main content
Artificial Intelligence Computing Leadership from NVIDIA
Login
Research Labs
All Research Labs
Spatial Intelligence
Applied Research
Autonomous Vehicles
Deep Imagination
Publications
AI Playground
New and Featured
AI Art Gallery
NGC Demos
Research Areas
AI & Machine Learning
3D Deep Learning
Computer Vision
Robotics
All Areas
Careers
Academic Collaborations
Government Collaborations
Graduate Fellowship
Internships
Research Openings
Research Scientists
Meet the Team
Licensing
Search
Search
Enter the terms you wish to search for.
Publications
Our publications provide insight into some of our leading-edge research.
Filters
Search
Apply
Filters
Filters
Publication Year
2026
(17)
2025
(32)
2024
(29)
2023
(48)
2022
(52)
2021
(31)
2020
(48)
2019
(37)
2018
(43)
2017
(19)
2016
(6)
2015
(7)
2014
(2)
2013
(3)
2012
(3)
2011
(1)
2010
(1)
Facet Publication Year
Research Areas
Computer Vision
(380)
Artificial Intelligence and Machine Learning
(228)
Generative AI
(71)
Robotics
(57)
Computer Graphics
(53)
Autonomous Vehicles
(22)
Computational Photography and Imaging
(20)
VR, AR and Display Technology
(19)
Human Computer Interaction
(16)
Natural Language Processing
(16)
Applied Perception
(13)
Medical
(9)
Real-Time Rendering
(7)
Algorithms and Numerical Methods
(6)
Physical AI
(6)
Resilience and Safety
(6)
Hyperscale Graphics
(5)
World Simulation
(5)
Esports
(3)
High Performance Computing
(3)
Computer Architecture
(2)
Circuits and VLSI Design
(1)
Speech Processing
(1)
Events
CORL
(6)
CVPR
(58)
ECCV
(9)
ICCV
(8)
ICLR
(12)
ICML
(3)
ICRA
(17)
IROS
(7)
NeurIPS
(25)
RSS
(3)
SIGGRAPH
(12)
380 results found
Computer Vision
Clear all
Computer Vision
2025
RL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression
Uri Gadot, Assaf Shocher,
Shie Mannor
,
Gal Chechik
,
Assaf Hallak
CVPR
TriTex: Learning Texture from a Single Mesh via Triplane Semantic Features
Dana Cohen-Bar, Daniel Cohen-Or,
Gal Chechik
,
Yoni Kasten
CVPR
BLADE: Single-view Body Mesh Estimation through Accurate Depth Estimation
Shengze Wang,
Jiefeng Li
,
Tianye Li
,
Ye Yuan
, Henry Fuchs,
Koki Nagano
,
Shalini De Mello
,
Michael Stengel
CVPR
Coherent 3D Portrait Video Reconstruction via Triplane Fusion
Shengze Wang,
Xueting Li
,
Chao Liu
, Matthew Chan,
Michael Stengel
, Henry Fuchs,
Shalini De Mello
,
Koki Nagano
CVPR
SimAvatar: Simulation-Ready Clothed Gaussian Avatars from Text
Xueting Li
,
Ye Yuan
,
Shalini De Mello
, Gilles Daviet, Jonathan Leaf, Miles Macklin,
Jan Kautz
,
Umar Iqbal
CVPR
GRS: Generating robotic simulation tasks from real-world images
Alex Zook
,
Josef Spjut
,
Jonathan Tremblay
CVPR
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
Ali Hatamizadeh ,
Jan Kautz
CVPR
RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics
Chan Hee Song,
Valts Blukis
,
Jonathan Tremblay
,
Stephen Tyree
, Yu Su,
Stan Birchfield
CVPR
VLsI: Verbalized Layers-to-Interactions from Large to Small Vision Language Models
Byung-Kwan Lee
,
Ryo Hachiuma
, Yong Man Ro,
Yu-Chiang Frank Wang
, Yueh-Hua Wu
CVPR
SPOT: SE(3) Pose Trajectory Diffusion for Object-Centric Manipulation
Cheng-Chun Hsu,
Bowen Wen
,
Jie Xu
,
Yashraj Narang
, ,
Yuke Zhu
, Joydeep Biswas,
Stan Birchfield
ICRA
AI 3D Selfie: Real-Time Single-Image 3D Face Reconstruction for Light-Field Displays
Jonghyun Kim
,
Michael Stengel
, Matthew Chan,
Koki Nagano
,
Shalini De Mello
,
David Luebke
LongVILA: Scaling Long-Context Visual Language Models for Long Videos
Yukang Chen
, Fuzhao Xue, Dacheng Li, Qinghao Hu,
Ligeng Zhu
, Xiuyu Li, Yunhao Fang, Haotian Tang, Shang Yang, Zhijian Liu, Ethan He, Hongxu Yin,
Pavlo Molchanov
,
Jan Kautz
, Linxi Fan,
Yuke Zhu
, Yao Lu (Jason),
Song Han
ICLR
Multi-student Diffusion Distillation for Better One-step Generators
Yanke Song,
Jonathan Lorraine
, Weili Nie,
Karsten Kreis
, James Lucas
ICML
LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models
Zhengyi Wang,
Jonathan Lorraine
, Yikai Wang,
Hang Su
, Jun Zhu, Sanja Fidler, Xiaohui Zeng
Spatio-Temporal Context Prompting for Zero-Shot Action Detection
Wei-Jhe Huang,
Min-Hung Chen
, Shang-Hong Lai
Semantic Prompt Learning for Weakly-Supervised Semantic Segmentation
Ci-Siang Lin, Chien-Yi Wang,
Frank Wang
,
Min-Hung Chen
CorrFill: Enhancing Faithfulness in Reference-based Inpainting with Correspondence Guidance in Diffusion Models
Kuan-Hung Liu, Cheng-Kun Yang,
Min-Hung Chen
, Yu-Lun Liu, Yen-Yu Lin
2024
L4GM: Large 4D Gaussian Reconstruction Model
Jiawei Ren, Kevin Xie, Ashkan Mirzaei, Hanxue Liang, Xiaohui Zeng,
Karsten Kreis
, Ziwei Liu, Antonio Torralba, Sanja Fidler, Seung Wook Kim, Huan Ling
NeurIPS
Warped Diffusion: Solving Video Inverse Problems with Image Diffusion Models
Giannis Daras, Weili Nie,
Karsten Kreis
, Alexandros G. Dimakis,
Morteza Mardani
,
Nikola Kovachki
,
Arash Vahdat
NeurIPS
QUEEN: QUantized Efficient ENcoding for Streaming Free-viewpoint Videos
Sharath Girish,
Tianye Li
,
Amrita Mazumdar
, Abhinav Shrivastava,
David Luebke
,
Shalini De Mello
NeurIPS
CosAE: Learnable Fourier Series for Image Restoration
Sifei Liu
,
Shalini De Mello
,
Jan Kautz
NeurIPS
Fast Encoder-Based 3D from Casual Videos via Point Track Processing
Yoni Kasten
, Wuyue Lu,
Haggai Maron
NeurIPS
Bayesian Example Selection Improves In-Context Learning for Speech, Text, and Visual Modalities
Siyin Wang,
Huck Yang
, Ji Wu, Chao Zhang
From Descriptive Richness to Bias: Unveiling the Dark Side of Generative Image Caption Enrichment
Yusuke Hirota,
Ryo Hachiuma
,
Huck Yang
, Yuta Nakashima
ReMatching Dynamic Reconstruction Flow
Sara Oblak, Despoina Paschalidou, Sanja Fidler, Matan Atzmon
ICLR
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
Jishnu Jaykumar P, Kamalesh Palanisamy,
Yu-Wei Chao
, Xinya Du, Yu Xiang
IROS
Mitigating Covariate Shift in Imitation Learning for Autonomous Vehicles Using Latent Space Generative World Models
Alexander Popov, Alperen Degirmenci, David Wehr, Shashank Hegde , Ryan Oldja, Alexey Kamenev, Bertrand Douillard, David Nistér, Urs Muller, Ruchi Bhargava,
Stan Birchfield
, Nikolai Smolyanskiy
TurboEdit: Text-Based Image Editing Using Few-Step Diffusion Models
Gilad Deutch, Rinon Gal, Daniel Garibi, Or Patashnik, Daniel Cohen-Or
SIGGRAPH
DoRA: Weight-Decomposed Low-Rank Adaptation
Shih-Yang Liu, Chien-Yi Wang, Hongxu Danny Yin,
Pavlo Molchanov
,
Frank Wang
, Kwang-Ting Cheng,
Min-Hung Chen
ICML
RVT-2: Learning Precise Manipulation from Few Examples
Ankit Goyal
,
Valts Blukis
,
Jie Xu
,
Yijie Guo
,
Yu-Wei Chao
, Dieter Fox
RSS
Breathing Life Into Sketches Using Text-to-Video Priors
Rinon Gal, Yael Vinker, Yuval Alaluf, Amit Bermano, Daniel Cohen-Or, Ariel Shamir,
Gal Chechik
CVPR
Align Your Gaussians: Text-to-4D with Dynamic 3D Gaussians and Composed Diffusion Models
Huan Ling, Seung Wook Kim, Antonio Torralba, Sanja Fidler,
Karsten Kreis
CVPR
Pagination
First page
« First
Previous page
‹ Previous
Page
1
Current page
2
Page
3
Page
4
Page
5
Page
6
Page
7
Page
8
Page
9
…
Next page
Next ›
Last page
Last »