Princeton University at ECCV 2026

The 19th European Conference on Computer Vision, better known as ECCV 2026, is happening this week in Malmö, Sweden. Below is a roundup of AI-related work from Princeton researchers published at the conference.


Spotlight presentation:

Zero-shot Depth from Defocus

Authors: Yiming Zuo, Hongyu Wen, Venkat Subramanian, Patrick Chen, Karhan Kayan, Mario Bijelic, Felix Heide, Jia Deng

Links: Paper, Video


Dense Video Understanding with Inter-tokenization Acceleration

Authors: Haichao Zhang, Wenhao Chai, Shwai He, Ang Li, Yun Fu

Links: Paper, Project Page


EgoPolice: A Benchmark for Egocentric Video Understanding in High-Stakes Police Body-Worn Camera Footage

Authors: Max Gonzalez Saez-Diez, Jihoon Chung, Adam D. Wolsky, Greg Lanzalotto, Dean Knox, Jonathan Mummolo, Brandon Stewart, Olga Russakovsky

Links: Paper, Video


InFlux++: Real and Synthetic Data for Estimating Dynamic Camera Intrinsics

Authors: Erich Liang, Caleb Kha-Uong, Chinmaya Saran, Sreemanti Dey, David Liu, Junhan Ouyang, Benjamin Zhou, Jia Deng

Links: Paper, Project Page, Video


Kilometer-Vision: A New Frontier for Large-Scale Spatial Awareness in VLMs

Authors: Aravindh Mahendran, Michael King, Matthew Grimes, Antoine Yang, Tyler Zhu, Joseph Heyward, Tengda Han, Shiry Ginosar, Chen Sun, Dima Damen, Simon Osindero, Noah Snavely, Simon Lynen, Joao Carreira, Viorica Patraucean

Links: Paper, Video


Recurrent Autoregressive Diffusion: Global Memory Meets Local Attention

Authors: Taiye Chen, Zihan Ding, Anjian Li, Christina Zhang, Zeqi Xiao, Yisen Wang, Chi Jin

Links: Paper, Video


Reinforcement Learning for Multimodal Diffusion Language Models via Bidimensional Trajectory and Thought Optimization

Authors: Bowen Li, Yinjie Wang, Yunzhi Zhang, Junhong Liu, Yingqing Guo, Jiajun Wu, Mengdi Wang, Ling Yang

Links: Paper, Video


Reinforcing Vision-Language Models for Image Quality Assessment with Grounding Process Rewards

Authors: Jingwei Liu, Hongyan Li, Bo Liu, Tianlin Zhang, Yifei Qian, Congyang Zhao, Junhong Liu, Yang Cai, Ling Yang

Links: Paper


RoMan-4D: Learning Robot Arm Manipulation from 4D World Models

Authors: Kaichen Zhou, Yuzhen Chen, Fangneng Zhan, Hang Hua, Grace Chen, Xinhai Chang, Ao Qu, Yilun Du, Zhuang Liu, Paul Pu Liang, Mengyu Wang

Links: Paper


ScenarioControl: Vision-language Controllable Vectorized Latent Scenario Generation

Authors: Lili Gao, Yanbo Xu, William Koch, Samuele Ruffino, Luke Rowe, Behdad Chalaki, Dmitriy Rivkin, Julian Ost, Roger Girgis, Mario Bijelic, Felix Heide

Links: Paper, Project Page, Video


Sticking Information in Plain Sight: Encoding and Detecting Hidden Stickers in the Real World

Authors: Christina Shatford, Szymon Rusinkiewicz

Links: Paper, Video


UEval: A Benchmark for Unified Multimodal Generation

Authors: Bo Li, Yida Yin, Wenhao Chai, Xingyu Fu, Zhuang Liu

Links: Paper, Project Page


Vero: Open Reinforcement Learning Recipes for Visual Reasoning

Authors: Gabriel Sarch, Linrong Cai, Qunzhong Wang, Haoyang Wu, Danqi Chen, Zhuang Liu

Links: Paper


WAFT-Stereo: Warping-Alone Field Transforms for Stereo Matching

Authors: Yihan Wang, Jia Deng

Links: Paper, Video


WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation

Authors: Amogh Joshi, Julian Ost, Felix Heide

Links: Paper, Video

Leave a Reply

Your email address will not be published. Required fields are marked *


Discover more from Princeton Laboratory for Artificial Intelligence Research Blog

Subscribe to get the latest posts sent to your email.