Skip to yearly menu bar Skip to main content


CVPR 2025 Accepted Papers

This page is cached for 1 hour.  Changes to affiliation or name in your local profile may take up to 60 minutes to appear here.

Title Where and When
Accelerating Multimodal Large Language Models by Searching Optimal Vision Token Reduction
Shiyu Zhao ⋅ Zhenting Wang ⋅ Felix Juefei-Xu ⋅ Xide Xia ⋅ Miao Liu ⋅ Xiaofang Wang ⋅ Mingfu Liang ⋅ Ning Zhang ⋅ Dimitris N. Metaxas ⋅ Licheng Yu
In Room: ExHall D Poster Location: Poster #356 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hierarchical Compact Clustering Attention (COCA) for Unsupervised Object-Centric Learning
Can Küçüksözen ⋅ Yucel Yemez
In Room: ExHall D Poster Location: Poster #415 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics Project Page ↗
Lee Chae-Yeon ⋅ Oh Hyun-Bin ⋅ Han EunGi ⋅ Kim Sung-Bin ⋅ Suekyeong Nam ⋅ Tae-Hyun Oh
In Room: ExHall D Poster Location: Poster #2 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MambaOut: Do We Really Need Mamba for Vision? Project Page ↗
Weihao Yu ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #414 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GigaHands: A Massive Annotated Dataset of Bimanual Hand Activities Project Page ↗
Rao Fu ⋅ Dingxi Zhang ⋅ Alex Jiang ⋅ Wanjia Fu ⋅ Austin Funk ⋅ Daniel Ritchie ⋅ Srinath Sridhar
In Room: ExHall D Poster Location: Poster #159 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VidComposition: Can MLLMs Analyze Compositions in Compiled Videos? Project Page ↗
Yunlong Tang ⋅ JunJia Guo ⋅ Hang Hua ⋅ Susan Liang ⋅ Mingqian Feng ⋅ Xinyang Li ⋅ Rui Mao ⋅ Chao Huang ⋅ Jing Bi ⋅ Zeliang Zhang ⋅ Pooyan Fazli ⋅ Chenliang Xu
In Room: ExHall D Poster Location: Poster #297 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DIFIX3D+: Improving 3D Reconstructions with Single-Step Diffusion Models Project Page ↗
Jay Zhangjie Wu ⋅ Yuxuan Zhang ⋅ Haithem Turki ⋅ Xuanchi Ren ⋅ Jun Gao ⋅ Mike Zheng Shou ⋅ Sanja Fidler ⋅ Žan Gojčič ⋅ Huan Ling
In Room: ExHall D Poster Location: Poster #57 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
K-Sort Arena: Efficient and Reliable Benchmarking for Generative Models via K-wise Human Preferences
Zhikai Li ⋅ Xuewen Liu ⋅ Dongrong Joe Fu ⋅ Jianquan Li ⋅ Qingyi Gu ⋅ Kurt Keutzer ⋅ Zhen Dong
In Room: ExHall D Poster Location: Poster #359 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A3: Few-shot Prompt Learning of Unlearnable Examples with Cross-Modal Adversarial Feature Alignment
Xuan Wang ⋅ Xitong Gao ⋅ Dongping Liao ⋅ Tianrui Qin ⋅ Yu-liang Lu ⋅ Cheng-Zhong Xu
In Room: ExHall D Poster Location: Poster #394 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Adapting Pre-trained 3D Models for Point Cloud Video Understanding via Cross-frame Spatio-temporal Perception
Baixuan Lv ⋅ Yaohua Zha ⋅ Tao Dai ⋅ Xue Yuerong ⋅ Ke Chen ⋅ Shu-Tao Xia
In Room: ExHall D Poster Location: Poster #168 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mamba4D: Efficient 4D Point Cloud Video Understanding with Disentangled Spatial-Temporal State Space Models
Jiuming Liu ⋅ Jinru Han ⋅ Lihao Liu ⋅ Angelica I Aviles-Rivero ⋅ Chaokang Jiang ⋅ Zhe Liu ⋅ Hesheng Wang
In Room: ExHall D Poster Location: Poster #174 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Birth and Death of a Rose Project Page ↗
Chen Geng ⋅ Yunzhi Zhang ⋅ Shangzhe Wu ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #11 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Everything to the Synthetic: Diffusion-driven Test-time Adaptation via Synthetic-Domain Alignment
Jiayi Guo ⋅ Zhao Junhao ⋅ Chaoqun Du ⋅ Yulin Wang ⋅ Chunjiang Ge ⋅ Zanlin Ni ⋅ Shiji Song ⋅ Humphrey Shi ⋅ Gao Huang
In Room: ExHall D Poster Location: Poster #417 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MExD: An Expert-Infused Diffusion Model for Whole-Slide Image Classification
Jianwei Zhao ⋅ XIN LI ⋅ Fan Yang ⋅ Qiang Zhai ⋅ Ao Luo ⋅ Yang Zhao ⋅ Hong Cheng ⋅ Huazhu Fu
In Room: ExHall D Poster Location: Poster #474 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Optimal Transport-Guided Source-Free Adaptation for Face Anti-Spoofing
Zhuowei Li ⋅ Tianchen Zhao ⋅ Xiang Xu ⋅ Zheng Zhang ⋅ Zhihua Li ⋅ Xuanbai Chen ⋅ Qin ZHANG ⋅ Alessandro Bergamo ⋅ Anil Kumar Jain ⋅ Yifan Xing
In Room: ExHall D Poster Location: Poster #318 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HyperFree: A Channel-adaptive and Tuning-free Foundation Model for Hyperspectral Remote Sensing Imagery
Jingtao Li ⋅ Yingyi Liu ⋅ XINYU WANG ⋅ Yunning Peng ⋅ Chen Sun ⋅ Shaoyu Wang ⋅ Zhendong Sun ⋅ Tian Ke ⋅ Xiao Jiang ⋅ Tangwei Lu ⋅ Anran Zhao ⋅ Yanfei Zhong
In Room: ExHall D Poster Location: Poster #189 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FastVLM: Efficient Vision Encoding for Vision Language Models Project Page ↗
Pavan Kumar Anasosalu Vasu ⋅ Fartash Faghri ⋅ Chun-Liang Li ⋅ Cem Koc ⋅ Nate True ⋅ Gokula Krishnan Santhanam ⋅ Albert Antony ⋅ James Gabriel ⋅ Peter Grasch ⋅ Oncel Tuzel ⋅ Hadi Pouransari
In Room: ExHall D Poster Location: Poster #378 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Heterogeneous Tissues with Mixture of Experts for Gigapixel Whole Slide Images Project Page ↗
Junxian Wu ⋅ Minheng Chen ⋅ Xinyi Ke ⋅ Tianwang Xun ⋅ Xiaoming Jiang ⋅ Hongyu Zhou ⋅ Lizhi Shao ⋅ Youyong Kong
In Room: ExHall D Poster Location: Poster #476 in Poster Session 1.
ByTheWay: Boost Your Text-to-Video Generation Model to Higher Quality in a Training-free Way
Jiazi Bu ⋅ Pengyang Ling ⋅ Pan Zhang ⋅ Tong Wu ⋅ Xiaoyi Dong ⋅ Yuhang Zang ⋅ Yuhang Cao ⋅ Dahua Lin ⋅ Jiaqi Wang
In Room: ExHall D Poster Location: Poster #224 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Theoretical Insights in Model Inversion Robustness and Conditional Entropy Maximization for Collaborative Inference Systems
Song Xia ⋅ Yi Yu ⋅ Wenhan Yang ⋅ MEIWEN DING ⋅ Zhuo Chen ⋅ Ling-Yu Duan ⋅ Alex C. Kot ⋅ Xudong Jiang
In Room: ExHall D Poster Location: Poster #323 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Flexible Frame Selection for Efficient Video Reasoning
Shyamal Buch ⋅ Arsha Nagrani ⋅ Anurag Arnab ⋅ Cordelia Schmid
In Room: ExHall D Poster Location: Poster #280 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Pippo: High-Resolution Multi-View Humans from a Single Image Project Page ↗
Yash Kant ⋅ Ethan Weber ⋅ Jin Kyu Kim ⋅ Rawal Khirodkar ⋅ Zhaoen Su ⋅ Julieta Martinez ⋅ Igor Gilitschenski ⋅ Shunsuke Saito ⋅ Timur Bagautdinov
In Room: ExHall D Poster Location: Poster #55 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences Project Page ↗
Hongyan Zhi ⋅ Peihao Chen ⋅ Junyan Li ⋅ Shuailei Ma ⋅ Xinyu Sun ⋅ Tianhang Xiang ⋅ Yinjie Lei ⋅ Mingkui Tan ⋅ Chuang Gan
In Room: ExHall D Poster Location: Poster #342 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Scaling Down Text Encoders of Text-to-Image Diffusion Models
Lifu Wang ⋅ Daqing Liu ⋅ Xinchen Liu ⋅ Xiaodong He
In Room: ExHall D Poster Location: Poster #253 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FOCUS: Knowledge-enhanced Adaptive Visual Compression for Few-shot Whole Slide Image Classification Project Page ↗
Zhengrui Guo ⋅ Conghao Xiong ⋅ Jiabo MA ⋅ Qichen Sun ⋅ Lishuang Feng ⋅ Jinzhuo Wang ⋅ Hao Chen
In Room: ExHall D Poster Location: Poster #473 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LLMDet: Learning Strong Open-Vocabulary Object Detectors under the Supervision of Large Language Models Project Page ↗
Shenghao Fu ⋅ Qize Yang ⋅ Qijie Mo ⋅ Junkai Yan ⋅ Xihan Wei ⋅ Jingke Meng ⋅ Xiaohua Xie ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #415 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Spectral Informed Mamba for Robust Point Cloud Processing
Ali Bahri ⋅ Moslem Yazdanpanah ⋅ Mehrdad Noori ⋅ Sahar Dastani ⋅ Milad Cheraghalikhani ⋅ David OSOWIECHI ⋅ Gustavo Vargas Hakim ⋅ Farzad Beizaee ⋅ Ismail Ben Ayed ⋅ Christian Desrosiers
In Room: ExHall D Poster Location: Poster #112 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Shading Meets Motion: Self-supervised Indoor 3D Reconstruction Via Simultaneous Shape-from-Shading and Structure-from-Motion
Guoyu Lu
In Room: ExHall D Poster Location: Poster #64 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MarkushGrapher: Joint Visual and Textual Recognition of Markush Structures Project Page ↗
Lucas Morin ⋅ Valery Weber ⋅ Ahmed Nassar ⋅ Gerhard Ingmar Meijer ⋅ Luc Van Gool ⋅ Yawei Li ⋅ Peter W. J. Staar
In Room: ExHall D Poster Location: Poster #368 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
What Makes a Good Dataset for Knowledge Distillation?
Logan Frank ⋅ Jim Davis
In Room: ExHall D Poster Location: Poster #262 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Removing Reflections from RAW Photos
Eric Kee ⋅ Adam Pikielny ⋅ Kevin Blackburn-Matzen ⋅ Marc Levoy
In Room: ExHall D Poster Location: Poster #169 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RNG: Relightable Neural Gaussians Project Page ↗
Jiahui Fan ⋅ Fujun Luan ⋅ Jian Yang ⋅ Milos Hasan ⋅ Beibei Wang
In Room: ExHall D Poster Location: Poster #35 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
Jun Zhou ⋅ Jiahao Li ⋅ Zunnan Xu ⋅ Hanhui Li ⋅ Yiji Cheng ⋅ Fa-Ting Hong ⋅ Qin Lin ⋅ qinglin lu ⋅ Xiaodan Liang
In Room: ExHall D Poster Location: Poster #233 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Descriptor-In-Pixel : Point-Feature Tracking For Pixel Processor Arrays Project Page ↗
Laurie Bose ⋅ Piotr Dudek ⋅ Jianing Chen
In Room: ExHall D Poster Location: Poster #88 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Joint Optimization of Neural Radiance Fields and Continuous Camera Motion from a Monocular Video
Hoang Chuong Nguyen ⋅ Wei Mao ⋅ Jose M. Alvarez ⋅ Miaomiao Liu
In Room: ExHall D Poster Location: Poster #79 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ECBench: Can Multi-modal Foundation Models Understand the Egocentric World? A Holistic Embodied Cognition Benchmark
Ronghao Dang ⋅ Yuqian Yuan ⋅ Wenqi Zhang ⋅ Yifei Xin ⋅ Boqiang Zhang ⋅ Long Li ⋅ Liuyi Wang ⋅ qinyang zeng ⋅ Xin Li ⋅ Lidong Bing
In Room: ExHall D Poster Location: Poster #341 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AniGS: Animatable Gaussian Avatar from a Single Image with Inconsistent Gaussian Reconstruction
Lingteng Qiu ⋅ Shenhao Zhu ⋅ Qi Zuo ⋅ Xiaodong Gu ⋅ Yuan Dong ⋅ Junfei Zhang ⋅ Chao Xu ⋅ Zhe Li ⋅ Weihao Yuan ⋅ Liefeng Bo ⋅ Guanying Chen ⋅ Zilong Dong
In Room: ExHall D Poster Location: Poster #10 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Few-Shot Recognition via Stage-Wise Retrieval-Augmented Finetuning Project Page ↗
Tian Liu ⋅ Huixin Zhang ⋅ Shubham Parashar ⋅ Shu Kong
In Room: ExHall D Poster Location: Poster #425 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Matrix-Free Shared Intrinsics Bundle Adjustment
Daniel Safari
In Room: ExHall D Poster Location: Poster #83 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Doppelgängers and Adversarial Vulnerability
George Kamberov
In Room: ExHall D Poster Location: Poster #464 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Not All Parameters Matter: Masking Diffusion Models for Enhancing Generation Ability
Lei Wang ⋅ Senmao Li ⋅ Fei Yang ⋅ Jianye Wang ⋅ Ziheng Zhang ⋅ Yuhan Liu ⋅ Yaxing Wang ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #213 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ResCLIP: Residual Attention for Training-free Dense Vision-language Inference Project Page ↗
Jinhong Deng ⋅ Yuhang Yang ⋅ Wen Li ⋅ Lixin Duan
In Room: ExHall D Poster Location: Poster #365 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Federated Learning with Domain Shift Eraser
Zheng Wang ⋅ Zihui Wang ⋅ Zheng Wang ⋅ Xiaoliang Fan ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #460 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Customized Condition Controllable Generation for Video Soundtrack
Fan Qi ⋅ KunSheng Ma ⋅ Changsheng Xu
In Room: ExHall D Poster Location: Poster #277 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ViCaS: A Dataset for Combining Holistic and Pixel-level Video Understanding using Captions with Grounded Segmentation
Ali Athar ⋅ Xueqing Deng ⋅ Liang-Chieh Chen
In Room: ExHall D Poster Location: Poster #308 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SKDream: Controllable Multi-view and 3D Generation with Arbitrary Skeletons
Yuanyou Xu ⋅ Zongxin Yang ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #14 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AnimateAnything: Consistent and Controllable Animation for Video Generation Project Page ↗
guojun lei ⋅ Chi Wang ⋅ Rong Zhang ⋅ Yikai Wang ⋅ Hong Li ⋅ Weiwei Xu
In Room: ExHall D Poster Location: Poster #169 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SplineGS: Robust Motion-Adaptive Spline for Real-Time Dynamic 3D Gaussians from Monocular Video Project Page ↗
Jongmin Park ⋅ Minh-Quan Viet Bui ⋅ Juan Luis Gonzalez Bello ⋅ Jaeho Moon ⋅ Jihyong Oh ⋅ Munchurl Kim
In Room: ExHall D Poster Location: Poster #69 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mask^2DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation Project Page ↗
Tianhao Qi ⋅ Jianlong Yuan ⋅ Wanquan Feng ⋅ Shancheng Fang ⋅ Jiawei Liu ⋅ SiYu Zhou ⋅ Qian HE ⋅ Hongtao Xie ⋅ Yongdong Zhang
In Room: ExHall D Poster Location: Poster #291 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CPath-Omni: A Unified Multimodal Foundation Model for Patch and Whole Slide Image Analysis in Computational Pathology
Yuxuan Sun ⋅ Yixuan Si ⋅ Chenglu Zhu ⋅ Xuan Gong ⋅ Kai Zhang ⋅ Pingyi Chen ⋅ Ye Zhang ⋅ Zhongyi Shui ⋅ Tao Lin ⋅ Lin Yang
In Room: ExHall D Poster Location: Poster #475 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Uncertain Multimodal Intention and Emotion Understanding in the Wild
Qu Yang ⋅ QingHongYa Shi ⋅ Tongxin Wang ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #351 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LIM: Large Interpolator Model for Dynamic Reconstruction Project Page ↗
Remy Sabathier ⋅ Niloy J. Mitra ⋅ David Novotny
In Room: ExHall D Poster Location: Poster #68 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DiverseFlow: Sample-Efficient Diverse Mode Coverage in Flows
Mashrur M. Morshed ⋅ Vishnu Naresh Boddeti
In Room: ExHall D Poster Location: Poster #215 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PartRM: Modeling Part-Level Dynamics with Large Cross-State Reconstruction Model
Mingju Gao ⋅ Yike Pan ⋅ Huan-ang Gao ⋅ Zongzheng Zhang ⋅ Wenyi Li ⋅ Hao Dong ⋅ Hao Tang ⋅ Li Yi ⋅ Hao Zhao
In Room: ExHall D Poster Location: Poster #156 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Reasoning in Visual Navigation of End-to-end Trained Agents: A Dynamical Systems Approach
Steeven JANNY ⋅ Hervé Poirier ⋅ Leonid Antsfeld ⋅ Guillaume Bono ⋅ Gianluca Monaci ⋅ Boris Chidlovskii ⋅ Francesco Giuliari ⋅ Alessio Del Bue ⋅ Christian Wolf
In Room: ExHall D Poster Location: Poster #141 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LotusFilter: Fast Diverse Nearest Neighbor Search via a Learned Cutoff Table Project Page ↗
Yusuke Matsui
In Room: ExHall D Poster Location: Poster #410 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Sea-ing in Low-light
Nisha Varghese ⋅ A. N. Rajagopalan
In Room: ExHall D Poster Location: Poster #76 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Exploring Simple Open-Vocabulary Semantic Segmentation
Zihang Lai
In Room: ExHall D Poster Location: Poster #390 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
iSegMan: Interactive Segment-and-Manipulate 3D Gaussians Project Page ↗
Yian Zhao ⋅ Wanshi Xu ⋅ Ruochong Zheng ⋅ Pengchong Qiao ⋅ Chang Liu ⋅ Jie Chen
In Room: ExHall D Poster Location: Poster #46 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation
Tianxing Chen ⋅ Yao Mu ⋅ Zhixuan Liang ⋅ Zanxin Chen ⋅ ShijiaPeng ⋅ Qiangyu Chen ⋅ Mingkun Xu ⋅ Ruizhen Hu ⋅ Hongyuan Zhang ⋅ Xuelong Li ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #146 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FeedEdit: Text-Based Image Editing with Dynamic Feedback Regulation
Fengyi Fu ⋅ Lei Zhang ⋅ Mengqi Huang ⋅ Zhendong Mao
In Room: ExHall D Poster Location: Poster #239 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DropoutGS: Dropping Out Gaussians for Better Sparse-view Rendering Project Page ↗
Yexing Xu ⋅ Longguang Wang ⋅ Minglin Chen ⋅ Sheng Ao ⋅ Li Li ⋅ Yulan Guo
In Room: ExHall D Poster Location: Poster #50 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Symbolic Representation for Any-to-Any Generative Tasks
Jiaqi Chen ⋅ Xiaoye Zhu ⋅ Yue Wang ⋅ Tianyang Liu ⋅ Xinhui Chen ⋅ Ying Chen ⋅ Chak Tou Leong ⋅ Yifei Ke ⋅ Joseph Liu ⋅ Yiwen Yuan ⋅ Julian McAuley ⋅ Li-jia Li
In Room: ExHall D Poster Location: Poster #157 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Shape Abstraction via Marching Differentiable Support Functions Project Page ↗
Sunkyung Park ⋅ Jeongmin Lee ⋅ Dongjun Lee
In Room: ExHall D Poster Location: Poster #104 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ILIAS: Instance-Level Image retrieval At Scale Project Page ↗
Giorgos Kordopatis-Zilos ⋅ Vladan Stojnić ⋅ Anna Manko ⋅ Pavel Suma ⋅ Nikolaos-Antonios Ypsilantis ⋅ Nikos Efthymiadis ⋅ Zakaria Laskar ⋅ Jiri Matas ⋅ Ondrej Chum ⋅ Giorgos Tolias
In Room: ExHall D Poster Location: Poster #395 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Universal Scene Graph Generation Project Page ↗
Shengqiong Wu ⋅ Hao Fei ⋅ Tat-seng Chua
In Room: ExHall D Poster Location: Poster #336 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Omni-RGPT: Unifying Image and Video Region-level Understanding via Token Marks
Miran Heo ⋅ Min-Hung Chen ⋅ De-An Huang ⋅ Sifei Liu ⋅ Subhashree Radhakrishnan ⋅ Seon Joo Kim ⋅ Yu-Chiang Frank Wang ⋅ Ryo Hachiuma
In Room: ExHall D Poster Location: Poster #357 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
Xuanchi Ren ⋅ Tianchang Shen ⋅ Jiahui Huang ⋅ Huan Ling ⋅ Yifan Lu ⋅ Merlin Nimier-David ⋅ Thomas Müller ⋅ Alexander Keller ⋅ Sanja Fidler ⋅ Jun Gao
In Room: ExHall D Poster Location: Poster #65 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Parameter Efficient Mamba Tuning via Projector-targeted Diagonal-centric Linear Transformation
Seokil Ham ⋅ Hee-Seon Kim ⋅ Sangmin Woo ⋅ Changick Kim
In Room: ExHall D Poster Location: Poster #378 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiskVPS: Vanishing Point Detector via Hough Transform in a Disk Region
Jianping Wu
In Room: ExHall D Poster Location: Poster #86 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RoomTour3D: Geometry-Aware Video-Instruction Tuning for Embodied Navigation Project Page ↗
Mingfei Han ⋅ Liang Ma ⋅ Kamila Zhumakhanova ⋅ Ekaterina Radionova ⋅ Jingyi Zhang ⋅ Xiaojun Chang ⋅ Xiaodan Liang ⋅ Ivan Laptev
In Room: ExHall D Poster Location: Poster #136 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Structure from Collision
Takuhiro Kaneko
In Room: ExHall D Poster Location: Poster #44 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Prosody-Enhanced Acoustic Pre-training and Acoustic-Disentangled Prosody Adapting for Movie Dubbing Project Page ↗
Zhedong Zhang ⋅ Liang Li ⋅ Chenggang Yan ⋅ Chunshan Liu ⋅ Anton van den Hengel ⋅ Yuankai Qi
In Room: ExHall D Poster Location: Poster #1 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
Xiaozhong Ji ⋅ Xiaobin Hu ⋅ Zhihong Xu ⋅ Junwei Zhu ⋅ Chuming Lin ⋅ Qingdong He ⋅ Jiangning Zhang ⋅ Donghao Luo ⋅ Yi Chen ⋅ Qin Lin ⋅ qinglin lu ⋅ Chengjie Wang
In Room: ExHall D Poster Location: Poster #3 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Hypergraph Vision Transformers: Images are More than Nodes, More than Edges Project Page ↗
Joshua Fixelle
In Room: ExHall D Poster Location: Poster #417 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SEEN-DA: SEmantic ENtropy guided Domain-aware Attention for Domain Adaptive Object Detection
Haochen Li ⋅ Rui Zhang ⋅ Hantao Yao ⋅ Xin Zhang ⋅ Yifan Hao ⋅ Xinkai Song ⋅ Shaohui Peng ⋅ Yongwei Zhao ⋅ Zhao Chen ⋅ Yanjun Wu ⋅ Ling Li
In Room: ExHall D Poster Location: Poster #422 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Marten: Visual Question Answering with Mask Generation for Multi-modal Document Understanding Project Page ↗
Zining Wang ⋅ Tongkun Guan ⋅ Pei Fu ⋅ Chen Duan ⋅ Qianyi Jiang ⋅ Zhentao Guo ⋅ Shan Guo ⋅ Junfeng Luo ⋅ Wei Shen ⋅ Xiaokang Yang
In Room: ExHall D Poster Location: Poster #364 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GaPT-DAR: Category-level Garments Pose Tracking via Integrated 2D Deformation and 3D Reconstruction
Li Zhang ⋅ mingliang xu ⋅ Jianan Wang ⋅ Qiaojun Yu ⋅ Lixin Yang ⋅ Yonglu Li ⋅ Cewu Lu ⋅ RujingWang ⋅ Liu Liu
In Room: ExHall D Poster Location: Poster #150 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SimLTD: Simple Supervised and Semi-Supervised Long-Tailed Object Detection Project Page ↗
Phi Vu Tran
In Room: ExHall D Poster Location: Poster #431 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OffsetOPT: Explicit Surface Reconstruction without Normals
Huan Lei
In Room: ExHall D Poster Location: Poster #104 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Antidote: A Unified Framework for Mitigating LVLM Hallucinations in Counterfactual Presupposition and Object Perception
Yuanchen Wu ⋅ Lu Zhang ⋅ Hang Yao ⋅ Junlong Du ⋅ Ke Yan ⋅ Shouhong Ding ⋅ Yunsheng Wu ⋅ Xiaoqiang Li
In Room: ExHall D Poster Location: Poster #383 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Apollo: An Exploration of Video Understanding in Large Multimodal Models
Orr Zohar ⋅ Xiaohan Wang ⋅ Yann Dubois ⋅ Nikhil Mehta ⋅ Tong Xiao ⋅ Philippe Hansen-Estruch ⋅ Licheng Yu ⋅ Xiaofang Wang ⋅ Felix Juefei-Xu ⋅ Ning Zhang ⋅ Serena Yeung ⋅ Xide Xia
In Room: ExHall D Poster Location: Poster #296 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Visual Lexicon: Rich Image Features in Language Space
XuDong Wang ⋅ Xingyi Zhou ⋅ Alireza Fathi ⋅ Trevor Darrell ⋅ Cordelia Schmid
In Room: ExHall D Poster Location: Poster #375 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Event-based Video Super-Resolution via State Space Models
Zeyu Xiao ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #182 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BiM-VFI: Bidirectional Motion Field-Guided Frame Interpolation for Video with Non-uniform Motions Project Page ↗
Wonyong Seo ⋅ Jihyong Oh ⋅ Munchurl Kim
In Room: ExHall D Poster Location: Poster #180 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Curriculum Coarse-to-Fine Selection for High-IPC Dataset Distillation
Yanda Chen ⋅ Gongwei Chen ⋅ Miao Zhang ⋅ Weili Guan ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #441 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step Project Page ↗
Hanyang Wang ⋅ Fangfu Liu ⋅ Jiawei Chi ⋅ Yueqi Duan
In Room: ExHall D Poster Location: Poster #61 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PMA: Towards Parameter-Efficient Point Cloud Understanding via Point Mamba Adapter
Yaohua Zha ⋅ Yanzi Wang ⋅ Hang Guo ⋅ Jinpeng Wang ⋅ Tao Dai ⋅ Bin Chen ⋅ Zhihao Ouyang ⋅ Xue Yuerong ⋅ Ke Chen ⋅ Shu-Tao Xia
In Room: ExHall D Poster Location: Poster #111 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
RORem: Training a Robust Object Remover with Human-in-the-Loop
Ruibin Li ⋅ Tao Yang ⋅ Song Guo ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #323 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FineVQ: Fine-Grained User Generated Content Video Quality Assessment
Huiyu Duan ⋅ Qiang Hu ⋅ Wang Jiarui ⋅ Liu Yang ⋅ Zitong Xu ⋅ Lu Liu ⋅ Xiongkuo Min ⋅ Chunlei Cai ⋅ Tianxiao Ye ⋅ Xiaoyun Zhang ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #291 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Uncertainty Weighted Gradients for Model Calibration
Jinxu Lin ⋅ Linwei Tao ⋅ Minjing Dong ⋅ Chang Xu
In Room: ExHall D Poster Location: Poster #464 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ATA: Adaptive Transformation Agent for Text-Guided Subject-Position Variable Background Inpainting
Yizhe Tang ⋅ Zhimin Sun ⋅ Yuzhen Du ⋅ Ran Yi ⋅ Guangben Lu ⋅ Teng Hu ⋅ LUYING LI ⋅ Lizhuang Ma ⋅ FangYuan Zou
In Room: ExHall D Poster Location: Poster #242 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SceneDiffuser++: City-Scale Traffic Simulation via a Generative World Model
Shuhan Tan ⋅ John Wheatley Lambert ⋅ Hong Jeon ⋅ Sakshum Kulshrestha ⋅ Yijing Bai ⋅ Jing Luo ⋅ Dragomir Anguelov ⋅ Mingxing Tan ⋅ Chiyu “Max” Jiang
In Room: ExHall D Poster Location: Poster #131 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FG^2: Fine-Grained Cross-View Localization by Fine-Grained Feature Matching
Zimin Xia ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #94 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model
Ziyu Yao ⋅ Xuxin Cheng ⋅ Zhiqi Huang ⋅ Lei Li
In Room: ExHall D Poster Location: Poster #319 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SapiensID: Foundation for Human Recognition
Minchul Kim ⋅ Dingqiang Ye ⋅ Yiyang Su ⋅ Feng Liu ⋅ Xiaoming Liu
In Room: ExHall D Poster Location: Poster #314 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Causal Composition Diffusion Model for Closed-loop Traffic Generation Project Page ↗
Haohong Lin ⋅ Xin Huang ⋅ Tung Phan-Minh ⋅ David S Hayden ⋅ Huan Zhang ⋅ DING ZHAO ⋅ Siddhartha Srinivasa ⋅ Eric M. Wolff ⋅ Hongge Chen
In Room: ExHall D Poster Location: Poster #132 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BADGR: Bundle Adjustment Diffusion Conditioned by Gradients for Wide-Baseline Floor Plan Reconstruction Project Page ↗
Yuguang Li ⋅ Ivaylo Boyadzhiev ⋅ Zixuan Liu ⋅ Linda Shapiro ⋅ Alex Colburn
In Room: ExHall D Poster Location: Poster #92 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Scaling Mesh Generation via Compressive Tokenization Project Page ↗
Haohan Weng ⋅ Zibo Zhao ⋅ Biwen Lei ⋅ Xianghui Yang ⋅ Jian Liu ⋅ Zeqiang Lai ⋅ Zhuo Chen ⋅ Liu Yuhong ⋅ Jie Jiang ⋅ Chunchao Guo ⋅ Tong Zhang ⋅ Shenghua Gao ⋅ C.L.Philip Chen
In Room: ExHall D Poster Location: Poster #42 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Odd-One-Out: Anomaly Detection by Comparing with Neighbors
Ankan Kumar Bhunia ⋅ Changjian Li ⋅ Hakan Bilen
In Room: ExHall D Poster Location: Poster #437 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Population Normalization for Federated Learning
Zhuoyao Wang ⋅ Fan Yi ⋅ Peizhu Gong ⋅ Caitou He ⋅ Cheng Jin ⋅ Weizhong Zhang
In Room: ExHall D Poster Location: Poster #461 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RipVIS: Rip Currents Video Instance Segmentation Benchmark for Beach Monitoring and Safety Project Page ↗
Andrei Dumitriu ⋅ Florin Tatui ⋅ Florin Miron ⋅ Aakash Ralhan ⋅ Radu Tudor Ionescu ⋅ Radu Timofte
In Room: ExHall D Poster Location: Poster #311 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Low-Rank Adaptation in Multilinear Operator Networks for Security-Preserving Incremental Learning
Huu Binh Ta ⋅ Duc Nguyen ⋅ Quyen Tran ⋅ Toan Tran ⋅ Tung Pham
In Room: ExHall D Poster Location: Poster #317 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
T-FAKE: Synthesizing Thermal Images for Facial Landmarking
Philipp Flotho ⋅ Moritz Piening ⋅ Anna Kukleva ⋅ Gabriele Steidl
In Room: ExHall D Poster Location: Poster #16 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AnyDressing: Customizable Multi-Garment Virtual Dressing via Latent Diffusion Models Project Page ↗
Xinghui Li ⋅ Qichao Sun ⋅ Pengze Zhang ⋅ Fulong Ye ⋅ Zhichao Liao ⋅ Wanquan Feng ⋅ Songtao Zhao ⋅ Qian HE
In Room: ExHall D Poster Location: Poster #258 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Self-Supervised Spatial Correspondence Across Modalities Project Page ↗
Ayush Shrivastava ⋅ Andrew Owens
In Room: ExHall D Poster Location: Poster #96 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Mind the Gap: Confidence Discrepancy Can Guide Federated Semi-Supervised Learning Across Pseudo-Mismatch Project Page ↗
Yijie Liu ⋅ Xinyi Shang ⋅ Yiqun Zhang ⋅ Yang Lu ⋅ Chen Gong ⋅ Jing-Hao Xue ⋅ Hanzi Wang
In Room: ExHall D Poster Location: Poster #457 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VisionArena: 230k Real World User-VLM Conversations with Preference Labels
Christopher Chou ⋅ Lisa Dunlap ⋅ Wei-Lin Chiang ⋅ Koki Mashita ⋅ Krishna Mandal ⋅ Trevor Darrell ⋅ Ion Stoica ⋅ Joseph Gonzalez
In Room: ExHall D Poster Location: Poster #353 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Geometric Knowledge-Guided Localized Global Distribution Alignment for Federated Learning Project Page ↗
Yanbiao Ma ⋅ Wei Dai ⋅ Wenke Huang ⋅ Jiayi Chen
In Room: ExHall D Poster Location: Poster #443 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Focal Split: Untethered Snapshot Depth from Differential Defocus
Junjie Luo ⋅ John Mamish ⋅ Alan Fu ⋅ Thomas Concannon ⋅ Josiah Hester ⋅ Emma Alexander ⋅ Qi Guo
In Room: ExHall D Poster Location: Poster #78 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Generative Hard Example Augmentation for Semantic Point Cloud Segmentation
Qi Zhang ⋅ Jibin Peng ⋅ Zhao Huang ⋅ Wei Feng ⋅ Di Lin
In Room: ExHall D Poster Location: Poster #110 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling Project Page ↗
Yifang Men ⋅ Yuan Yao ⋅ Miaomiao Cui ⋅ Liefeng Bo
In Room: ExHall D Poster Location: Poster #13 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Data-free Universal Adversarial Perturbation with Pseudo-semantic Prior
Chanhui Lee ⋅ Yeonghwan Song ⋅ Jeany Son
In Room: ExHall D Poster Location: Poster #311 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Point Clouds Meets Physics: Dynamic Acoustic Field Fitting Network for Point Cloud Understanding
Changshuo Wang ⋅ Shuting He ⋅ Xiang Fang ⋅ Jiawei Han ⋅ Zhonghang Liu ⋅ Xin Ning ⋅ Weijun Li ⋅ Prayag Tiwari
In Room: ExHall D Poster Location: Poster #108 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
A Unified Model for Compressed Sensing MRI Across Undersampling Patterns Project Page ↗
Armeet Singh Jatyani ⋅ Jiayun Wang ⋅ Aditi Chandrashekar ⋅ Zihui Wu ⋅ Miguel Liu-Schiaffini ⋅ Bahareh Tolooshams ⋅ Anima Anandkumar
In Room: ExHall D Poster Location: Poster #477 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
The Scene Language: Representing Scenes with Programs, Words, and Embeddings
Yunzhi Zhang ⋅ Zizhang Li ⋅ Matt Zhou ⋅ Shangzhe Wu ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #344 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hyperbolic Uncertainty-Aware Few-Shot Incremental Point Cloud Segmentation
Tanuj Sur ⋅ Samrat Mukherjee ⋅ Kaizer Rahaman ⋅ Subhasis Chaudhuri ⋅ Muhammad Haris Khan ⋅ Biplab Banerjee
In Room: ExHall D Poster Location: Poster #113 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Free on the Fly: Enhancing Flexibility in Test-Time Adaptation with Online EM
Qiyuan Dai ⋅ Sibei Yang
In Room: ExHall D Poster Location: Poster #397 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FRAME: Floor-aligned Representation for Avatar Motion from Egocentric Video
Andrea Boscolo Camiletto ⋅ Jian Wang ⋅ Eduardo Alvarado ⋅ Rishabh Dabral ⋅ Thabo Beeler ⋅ Marc Habermann ⋅ Christian Theobalt
In Room: ExHall D Poster Location: Poster #162 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DRiVE: Diffusion-based Rigging Empowers Generation of Versatile and Expressive Characters Project Page ↗
Mingze Sun ⋅ Junting Dong ⋅ Junhao Chen ⋅ Yurun Chen ⋅ Xinyu Jiang ⋅ Shiwei Mao ⋅ Puhua Jiang ⋅ Jingbo Wang ⋅ Bo Dai ⋅ Ruqi Huang
In Room: ExHall D Poster Location: Poster #12 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MDP: Multidimensional Vision Model Pruning with Latency Constraint
Xinglong Sun ⋅ Barath Lakshmanan ⋅ Maying Shen ⋅ Shiyi Lan ⋅ Jingde Chen ⋅ Jose M. Alvarez
In Room: ExHall D Poster Location: Poster #411 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Tracktention: Leveraging Point Tracking to Attend Videos Faster and Better
Zihang Lai ⋅ Andrea Vedaldi
In Room: ExHall D Poster Location: Poster #167 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
End-to-End Implicit Neural Representations for Classification
Alexander Gielisse ⋅ Jan van Gemert
In Room: ExHall D Poster Location: Poster #281 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Understanding Multi-Task Activities from Single-Task Videos
Yuhan Shen ⋅ Ehsan Elhamifar
In Room: ExHall D Poster Location: Poster #317 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MaDCoW: Marginal Distortion Correction for Wide-Angle Photography with Arbitrary Objects
Kevin Zhang ⋅ Jia-Bin Huang ⋅ Jose Echevarria ⋅ Stephen DiVerdi ⋅ Aaron Hertzmann
In Room: ExHall D Poster Location: Poster #25 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Audio-Visual Semantic Graph Network for Audio-Visual Event Localization
Liang Liu ⋅ Shuaiyong Li ⋅ Yongqiang Zhu
In Room: ExHall D Poster Location: Poster #281 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Gaussian Splatting for Efficient Satellite Image Photogrammetry
Luca Savant Aira ⋅ Gabriele Facciolo ⋅ Thibaud Ehret
In Room: ExHall D Poster Location: Poster #49 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CATANet: Efficient Content-Aware Token Aggregation for Lightweight Image Super-Resolution Project Page ↗
Xin Liu ⋅ Jie Liu ⋅ Jie Tang ⋅ Gangshan Wu
In Room: ExHall D Poster Location: Poster #200 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration Project Page ↗
Chaojun Ni ⋅ Guosheng Zhao ⋅ Xiaofeng Wang ⋅ Zheng Zhu ⋅ Wenkang Qin ⋅ Guan Huang ⋅ Chen Liu ⋅ Yuyin Chen ⋅ Yida Wang ⋅ Xueyang Zhang ⋅ Yifei Zhan ⋅ Kun Zhan ⋅ Peng Jia ⋅ XianPeng Lang ⋅ Xingang Wang ⋅ Wenjun Mei
In Room: ExHall D Poster Location: Poster #130 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
WeatherGen: A Unified Diverse Weather Generator for LiDAR Point Clouds via Spider Mamba Diffusion
Yang Wu ⋅ Yun Zhu ⋅ Kaihua Zhang ⋅ Jianjun Qian ⋅ Jin Xie ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #115 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Balanced Direction from Multifarious Choices: Arithmetic Meta-Learning for Domain Generalization
Xiran Wang ⋅ Jian Zhang ⋅ Lei Qi ⋅ Yinghuan Shi
In Room: ExHall D Poster Location: Poster #424 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hybrid Concept Bottleneck Models Project Page ↗
Yang Liu ⋅ Tianwei Zhang ⋅ Shi Gu
In Room: ExHall D Poster Location: Poster #417 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Anatomical Consistency and Adaptive Prior-informed Transformation for Multi-contrast MR Image Synthesis via Diffusion Model
Yejee Shin ⋅ Yeeun Lee ⋅ Hanbyol Jang ⋅ Geonhui Son ⋅ Hyeongyu Kim ⋅ Dosik Hwang
In Room: ExHall D Poster Location: Poster #456 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Interleaved-Modal Chain-of-Thought
Jun Gao ⋅ Yongqi Li ⋅ Ziqiang Cao ⋅ Wenjie Li
In Room: ExHall D Poster Location: Poster #354 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Uni-Renderer: Unifying Rendering and Inverse Rendering Via Dual Stream Diffusion
ZhiFei Chen ⋅ Tianshuo Xu ⋅ Wenhang Ge ⋅ Leyi Wu ⋅ Dongyu Yan ⋅ Jing He ⋅ Luozhou Wang ⋅ Lu Zeng ⋅ Shunsi Zhang ⋅ Ying-Cong Chen
In Room: ExHall D Poster Location: Poster #33 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
S^3-Face: SSS-Compliant Facial Reflectance Estimation via Diffusion Priors Project Page ↗
Xingyu Ren ⋅ Jiankang Deng ⋅ Yuhao Cheng ⋅ Wenhan Zhu ⋅ Yichao Yan ⋅ Xiaokang Yang ⋅ Stefanos Zafeiriou ⋅ Chao Ma
In Room: ExHall D Poster Location: Poster #18 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Interactive Medical Image Analysis with Concept-based Similarity Reasoning Project Page ↗
Ta Duc Huy ⋅ Sen Kim Tran ⋅ Phan Nguyen ⋅ Nguyen Hoang Tran ⋅ Tran Bao Sam ⋅ Anton van den Hengel ⋅ Zhibin Liao ⋅ Johan Verjans ⋅ Minh-Son To ⋅ Vu Minh Hieu Phan
In Room: ExHall D Poster Location: Poster #445 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MLVU: Benchmarking Multi-task Long Video Understanding Project Page ↗
Junjie Zhou ⋅ Yan Shu ⋅ Bo Zhao ⋅ Boya Wu ⋅ Zhengyang Liang ⋅ Shitao Xiao ⋅ Minghao Qin ⋅ Xi Yang ⋅ yongping xiong ⋅ Bo Zhang ⋅ Tiejun Huang ⋅ Zheng Liu
In Room: ExHall D Poster Location: Poster #291 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Unified, Resilient, and Explainable Adversarial Patch Detector Project Page ↗
Vishesh Kumar ⋅ Akshay Agarwal
In Room: ExHall D Poster Location: Poster #406 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Go-with-the-Flow: Motion-Controllable Video Diffusion Models Using Real-Time Warped Noise
Ryan Burgert ⋅ Yuancheng Xu ⋅ Wenqi Xian ⋅ Oliver Pilarski ⋅ Pascal Clausen ⋅ Mingming He ⋅ Li Ma ⋅ Yitong Deng ⋅ Lingxiao Li ⋅ Mohsen Mousavi ⋅ Michael Ryoo ⋅ Paul Debevec ⋅ Ning Yu
In Room: ExHall D Poster Location: Poster #174 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
STOP: Integrated Spatial-Temporal Dynamic Prompting for Video Understanding
Zichen Liu ⋅ Kunlun Xu ⋅ Bing Su ⋅ Xu Zou ⋅ Yuxin Peng ⋅ Jiahuan Zhou
In Room: ExHall D Poster Location: Poster #299 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Improving the Training of Data-Efficient GANs via Quality Aware Dynamic Discriminator Rejection Sampling
Zhaoyu Zhang ⋅ Yang Hua ⋅ Guanxiong Sun ⋅ Hui Wang ⋅ Seán F. McLoone
In Room: ExHall D Poster Location: Poster #434 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Believing is Seeing: Unobserved Object Detection using Generative Models Project Page ↗
Subhransu S. Bhattacharjee ⋅ Dylan Campbell ⋅ Rahul Shome
In Room: ExHall D Poster Location: Poster #340 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
NLPrompt: Noise-Label Prompt Learning for Vision-Language Models
Bikang Pan ⋅ Qun Li ⋅ Xiaoying Tang ⋅ Wei Huang ⋅ Zhen Fang ⋅ Feng Liu ⋅ Jingya Wang ⋅ Jingyi Yu ⋅ Ye Shi
In Room: ExHall D Poster Location: Poster #397 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MEGA: Masked Generative Autoencoder for Human Mesh Recovery
Guénolé Fiche ⋅ Simon Leglaive ⋅ Xavier Alameda-Pineda ⋅ Francesc Moreno-Noguer
In Room: ExHall D Poster Location: Poster #90 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Empowering Vector Graphics with Consistently Arbitrary Viewing and View-dependent Visibility
Yidi Li ⋅ Jun Xiao ⋅ Zhengda Lu ⋅ Yiqun Wang ⋅ Haiyong Jiang
In Room: ExHall D Poster Location: Poster #263 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Semantic and Expressive Variations in Image Captions Across Languages
Andre Ye ⋅ Sebastin Santy ⋅ Jena D. Hwang ⋅ Amy X Zhang ⋅ Ranjay Krishna
In Room: ExHall D Poster Location: Poster #337 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models
Xubing Ye ⋅ Yukang Gan ⋅ Yixiao Ge ⋅ Xiao-Ping Zhang ⋅ Yansong Tang
In Room: ExHall D Poster Location: Poster #376 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DIFFER: Disentangling Identity Features via Semantic Cues for Clothes-Changing Person Re-ID
Xin Liang ⋅ Yogesh S. Rawat
In Room: ExHall D Poster Location: Poster #318 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Critic-V: VLM Critics Help Catch VLM Errors in Multimodal Reasoning Project Page ↗
Di Zhang ⋅ Jingdi Lei ⋅ Junxian Li ⋅ Xunzhi Wang ⋅ Yujie Liu ⋅ Zonglin Yang ⋅ Jiatong LI ⋅ Weida Wang ⋅ Suorong Yang ⋅ Jianbo Wu ⋅ Peng Ye ⋅ Wanli Ouyang ⋅ Dongzhan Zhou
In Room: ExHall D Poster Location: Poster #352 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Explicit Geometry-Reflectance Collaboration for Generalized LiDAR Segmentation in Adverse Weather
Longyu Yang ⋅ Ping Hu ⋅ Shangbo Yuan ⋅ Lu Zhang ⋅ Jun Liu ⋅ Heng Tao Shen ⋅ Xiaofeng Zhu
In Room: ExHall D Poster Location: Poster #117 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Mono3DVLT: Monocular-Video-Based 3D Visual Language Tracking
Hongkai Wei ⋅ YANG YANG ⋅ Shijie Sun ⋅ Mingtao Feng ⋅ Xiangyu Song ⋅ Qi Lei ⋅ Hongli Hu ⋅ Rong Wang ⋅ Huansheng Song ⋅ Naveed Akhtar ⋅ Ajmal Mian
In Room: ExHall D Poster Location: Poster #309 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Universal Dataset Distillation via Task-Driven Diffusion
Ding Qi ⋅ Jian Li ⋅ Junyao Gao ⋅ Shuguang Dou ⋅ Ying Tai ⋅ Jianlong Hu ⋅ Bo Zhao ⋅ Yabiao Wang ⋅ Chengjie Wang ⋅ Cai Rong Zhao
In Room: ExHall D Poster Location: Poster #262 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Parametric Point Cloud Completion for Polygonal Surface Reconstruction Project Page ↗
Zhaiyu Chen ⋅ Yuqing Wang ⋅ Liangliang Nan ⋅ Xiao Xiang Zhu
In Room: ExHall D Poster Location: Poster #106 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SEAL: Semantic Attention Learning for Long Video Representation
Lan Wang ⋅ Yujia Chen ⋅ Wen-Sheng Chu ⋅ Vishnu Naresh Boddeti ⋅ Du Tran
In Room: ExHall D Poster Location: Poster #268 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LookingGlass: Generative Anamorphoses via Laplacian Pyramid Warping Project Page ↗
Pascal Chang ⋅ Sergio Sancho ⋅ Jingwei Tang ⋅ Markus Gross ⋅ Vinicius C. Azevedo
In Room: ExHall D Poster Location: Poster #215 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Paint by Inpaint: Learning to Add Image Objects by Removing Them First Project Page ↗
Navve Wasserman ⋅ Noam Rotstein ⋅ Roy Ganz ⋅ Ron Kimmel
In Room: ExHall D Poster Location: Poster #240 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Dual Semantic Guidance for Open Vocabulary Semantic Segmentation
ZhengYang Wang ⋅ Tingliang Feng ⋅ Fan Lyu ⋅ Fanhua Shang ⋅ Wei Feng ⋅ Liang Wan
In Room: ExHall D Poster Location: Poster #420 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CroCoDL: Cross-device Collaborative Dataset for Localization Project Page ↗
Hermann Blum ⋅ Alessandro Mercurio ⋅ Joshua O'Reilly ⋅ Tim Engelbracht ⋅ Mihai Dusmanu ⋅ Marc Pollefeys ⋅ Zuria Bauer
In Room: ExHall D Poster Location: Poster #121 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Glossy Object Reconstruction with Cost-effective Polarized Acquisition
Bojian Wu ⋅ YIFAN PENG ⋅ Ruizhen Hu ⋅ Xiaowei Zhou
In Room: ExHall D Poster Location: Poster #24 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PURA: Parameter Update-Recovery Test-Time Adaption for RGB-T Tracking Project Page ↗
Zekai Shao ⋅ Yufan Hu ⋅ Bin Fan ⋅ Hongmin Liu
In Room: ExHall D Poster Location: Poster #99 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Generalizable Object Keypoint Localization from Generative Priors
Dongkai Wang ⋅ Jiang Duan ⋅ Liangjian Wen ⋅ Shiyu Xuan ⋅ Hao CHEN ⋅ Shiliang Zhang
In Room: ExHall D Poster Location: Poster #425 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
L-SWAG: Layer-Sample Wise Activation with Gradients Information for Zero-Shot NAS on Vision Transformers
Sofia Casarin ⋅ Sergio Escalera ⋅ Oswald Lanz
In Room: ExHall D Poster Location: Poster #410 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Lifelong Knowledge Editing for Vision Language Models with Low-Rank Mixture-of-Experts
Qizhou Chen ⋅ Chengyu Wang ⋅ Dakan Wang ⋅ Taolin Zhang ⋅ Wangyue Li ⋅ Xiaofeng He
In Room: ExHall D Poster Location: Poster #389 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
PartGen: Part-level 3D Generation and Reconstruction with Multi-view Diffusion Models
Minghao Chen ⋅ Roman Shapovalov ⋅ Iro Laina ⋅ Tom Monnier ⋅ Jianyuan Wang ⋅ David Novotny ⋅ Andrea Vedaldi
In Room: ExHall D Poster Location: Poster #42 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Chebyshev Attention Depth Permutation Texture Network with Latent Texture Attribute Loss
Ravishankar Evani ⋅ Deepu Rajan ⋅ Shangbo Mao
In Room: ExHall D Poster Location: Poster #226 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FedCALM: Conflict-aware Layer-wise Mitigation for Selective Aggregation in Deeper Personalized Federated Learning
Hao Zheng ⋅ Zhigang Hu ⋅ Boyu Wang ⋅ Liu Yang ⋅ Meiguang Zheng ⋅ Aikun Xu
In Room: ExHall D Poster Location: Poster #459 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FlexGS: Train Once, Deploy Everywhere with Many-in-One Flexible 3D Gaussian Splatting
Hengyu Liu ⋅ Yuehao Wang ⋅ Chenxin Li ⋅ Ruisi Cai ⋅ Kevin Wang ⋅ Wuyang Li ⋅ Pavlo Molchanov ⋅ Peihao Wang ⋅ Zhangyang Wang
In Room: ExHall D Poster Location: Poster #47 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Precise, Fast, and Low-cost Concept Erasure in Value Space: Orthogonal Complement Matters
Yuan Wang ⋅ Ouxiang Li ⋅ Tingting Mu ⋅ Yanbin Hao ⋅ Kuien Liu ⋅ Xiang Wang ⋅ Xiangnan He
In Room: ExHall D Poster Location: Poster #247 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HOIGen-1M: A Large-scale Dataset for Human-Object Interaction Video Generation
Kun Liu ⋅ Qi Liu ⋅ Xinchen Liu ⋅ Jie Li ⋅ Yongdong Zhang ⋅ Jiebo Luo ⋅ Xiaodong He ⋅ Wu Liu
In Room: ExHall D Poster Location: Poster #285 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
T2ISafety: Benchmark for Assessing Fairness, Toxicity, and Privacy in Image Generation
Lijun Li ⋅ Zhelun Shi ⋅ Xuhao Hu ⋅ Bowen Dong ⋅ Yiran Qin ⋅ Xihui Liu ⋅ Lu Sheng ⋅ Jing Shao
In Room: ExHall D Poster Location: Poster #260 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Order-One Rolling Shutter Cameras
Marvin Anas Hahn ⋅ Kathlén Kohn ⋅ Orlando Marigliano ⋅ Tomas Pajdla
In Room: ExHall D Poster Location: Poster #82 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mind the Gap: Detecting Black-box Adversarial Attacks in the Making through Query Update Analysis Project Page ↗
Jeonghwan Park ⋅ Niall McLaughlin ⋅ Ihsen Alouani
In Room: ExHall D Poster Location: Poster #463 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Consistent Normal Orientation for 3D Point Clouds via Least Squares on Delaunay Graph Project Page ↗
Rao Fu ⋅ Jianmin Zheng ⋅ Liang Yu
In Room: ExHall D Poster Location: Poster #107 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ICP: Immediate Compensation Pruning for Mid-to-high Sparsity
Xin Luo ⋅ Fu Xueming ⋅ Zihang Jiang ⋅ S Kevin Zhou
In Room: ExHall D Poster Location: Poster #392 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Optimizing for the Shortest Path in Denoising Diffusion Model
Ping Chen ⋅ Xingpeng Zhang ⋅ Zhaoxiang Liu ⋅ Huan Hu ⋅ Xiang Liu ⋅ Kai Wang ⋅ Min Wang ⋅ Yanlin Qian ⋅ Shiguo Lian
In Room: ExHall D Poster Location: Poster #211 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Dynamic Pseudo Labeling via Gradient Cutting for High-Low Entropy Exploration
Jae Hyeon Park ⋅ Joo Hyeon Jeon ⋅ Jae Yun Lee ⋅ Sangyeon Ahn ⋅ MinHee Cha ⋅ Min Geol Kim ⋅ Hyeok Nam ⋅ Sung In Cho
In Room: ExHall D Poster Location: Poster #456 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VODiff: Controlling Object Visibility Order in Text-to-Image Generation
Dong Liang ⋅ Jinyuan Jia ⋅ Yuhao Liu ⋅ Zhanghan Ke ⋅ Hongbo Fu ⋅ Rynson W.H. Lau
In Room: ExHall D Poster Location: Poster #246 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CAD-Llama: Leveraging Large Language Models for Computer-Aided Design Parametric 3D Model Generation
Jiahao Li ⋅ Weijian Ma ⋅ Xueyang Li ⋅ Yunzhong Lou ⋅ Guichun Zhou ⋅ Xiangdong Zhou
In Room: ExHall D Poster Location: Poster #266 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Seeing the Abstract: Translating the Abstract Language for Vision Language Models Project Page ↗
Davide Talon ⋅ Federico Girella ⋅ Ziyue Liu ⋅ Marco Cristani ⋅ Yiming Wang
In Room: ExHall D Poster Location: Poster #370 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Leveraging SD Map to Augment HD Map-based Trajectory Prediction
Zhiwei Dong ⋅ Ran Ding ⋅ Wei Li ⋅ Zhang Peng ⋅ Guobin Tang ⋅ Jia Guo
In Room: ExHall D Poster Location: Poster #134 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
4DGC: Rate-Aware 4D Gaussian Compression for Efficient Streamable Free-Viewpoint Video
Qiang Hu ⋅ Zihan Zheng ⋅ Houqiang Zhong ⋅ Sihua Fu ⋅ Li Song ⋅ Xiaoyun Zhang ⋅ Guangtao Zhai ⋅ Yanfeng Wang
In Room: ExHall D Poster Location: Poster #66 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Apply Hierarchical-Chain-of-Generation to Complex Attributes Text-to-3D Generation
Yiming Qin ⋅ Zhu Xu ⋅ Yang Liu
In Room: ExHall D Poster Location: Poster #262 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MAD: Memory-Augmented Detection of 3D Objects
Ben Agro ⋅ Sergio Casas ⋅ Patrick Wang ⋅ Thomas Gilles ⋅ Raquel Urtasun
In Room: ExHall D Poster Location: Poster #120 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MegaSaM: Accurate, Fast and Robust Structure and Motion from Casual Dynamic Videos
Zhengqi Li ⋅ Richard Tucker ⋅ Forrester Cole ⋅ Qianqian Wang ⋅ Linyi Jin ⋅ Vickie Ye ⋅ Angjoo Kanazawa ⋅ Aleksander Holynski ⋅ Noah Snavely
In Room: ExHall D Poster Location: Poster #78 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Distilled Prompt Learning for Incomplete Multimodal Survival Prediction
Yingxue Xu ⋅ Fengtao ZHOU ⋅ Chenyu Zhao ⋅ Yihui Wang ⋅ Can Yang ⋅ Hao Chen
In Room: ExHall D Poster Location: Poster #472 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PersonaHOI: Effortlessly Improving Face Personalization in Human-Object Interaction Generation Project Page ↗
Xinting Hu ⋅ Haoran Wang ⋅ Jan Lenssen ⋅ Bernt Schiele
In Room: ExHall D Poster Location: Poster #264 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Video-Panda: Parameter-efficient Alignment for Encoder-free Video-Language Models
Jinhui Yi ⋅ Syed Talal Wasim ⋅ Yanan Luo ⋅ Muzammal Naseer ⋅ Jürgen Gall
In Room: ExHall D Poster Location: Poster #296 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MonoSplat: Generalizable 3D Gaussian Splatting from Monocular Depth Foundation Models
Yifan Liu ⋅ Keyu Fan ⋅ Weihao Yu ⋅ Chenxin Li ⋅ Hao Lu ⋅ Yixuan Yuan
In Room: ExHall D Poster Location: Poster #49 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
Xuesong Chen ⋅ Linjiang Huang ⋅ Tao Ma ⋅ Rongyao Fang ⋅ Shaoshuai Shi ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #137 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Shift the Lens: Environment-Aware Unsupervised Camouflaged Object Detection
Ji Du ⋅ Fangwei Hao ⋅ Mingyang Yu ⋅ Desheng Kong ⋅ Jiesheng Wu ⋅ Bin Wang ⋅ Jing XU ⋅ Ping Li
In Room: ExHall D Poster Location: Poster #331 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Probability Density Geodesics in Image Diffusion Latent Space
Qingtao Yu ⋅ Jaskirat Singh ⋅ Zhaoyuan Yang ⋅ Peter Henry Tu ⋅ Jing Zhang ⋅ Richard Hartley ⋅ Hongdong Li ⋅ Dylan Campbell
In Room: ExHall D Poster Location: Poster #173 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
High-quality Point Cloud Oriented Normal Estimation via Hybrid Angular and Euclidean Distance Encoding
Yuanqi Li ⋅ Jingcheng Huang ⋅ Hongshen Wang ⋅ Peiyuan Lv ⋅ Yansong Liu ⋅ Jiuming Zheng ⋅ Jie Guo ⋅ Yanwen Guo
In Room: ExHall D Poster Location: Poster #104 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DriveScape: High-Resolution Driving Video Generation by Multi-View Feature Fusion
Wei Wu ⋅ Xi Guo ⋅ Weixuan TANG ⋅ Tingxuan Huang ⋅ Chiyu Wang ⋅ Chenjing Ding
In Room: ExHall D Poster Location: Poster #131 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Advancing Manga Analysis: Comprehensive Segmentation Annotations for the Manga109 Dataset
Minshan Xie ⋅ Jian Lin ⋅ Hanyuan Liu ⋅ Chengze Li ⋅ Tien-Tsin Wong
In Room: ExHall D Poster Location: Poster #335 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Training-free Neural Architecture Search through Variance of Knowledge of Deep Network Weights
Ondrej Tybl ⋅ Lukas Neumann
In Room: ExHall D Poster Location: Poster #404 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Every SAM Drop Counts: Embracing Semantic Priors for Multi-Modality Image Fusion and Beyond
Guanyao Wu ⋅ Haoyu Liu ⋅ Hongming Fu ⋅ Yichuan Peng ⋅ Jinyuan Liu ⋅ Xin Fan ⋅ Risheng Liu
In Room: ExHall D Poster Location: Poster #198 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EgoLife: Towards Egocentric Life Assistant Project Page ↗
Jingkang Yang ⋅ Shuai Liu ⋅ Hongming Guo ⋅ Yuhao Dong ⋅ Xiamengwei Zhang ⋅ Sicheng Zhang ⋅ Pengyun Wang ⋅ Zitang Zhou ⋅ Binzhu Xie ⋅ Ziyue Wang ⋅ Bei Ouyang ⋅ Zhengyu Lin ⋅ Marco Cominelli ⋅ Zhongang Cai ⋅ Bo Li ⋅ Yuanhan Zhang ⋅ Peiyuan Zhang ⋅ Fangzhou Hong ⋅ Joerg Widmer ⋅ Francesco Gringoli ⋅ Lei Yang ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #259 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RAEncoder: A Label-Free Reversible Adversarial Examples Encoder for Dataset Intellectual Property Protection
Fan Xing ⋅ Zhuo Tian ⋅ Xuefeng Fan ⋅ Xiaoyi Zhou
In Room: ExHall D Poster Location: Poster #462 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
NTR-Gaussian: Nighttime Dynamic Thermal Reconstruction with 4D Gaussian Splatting Based on Thermodynamics
Kun Yang ⋅ Yuxiang Liu ⋅ Zeyu Cui ⋅ Yu Liu ⋅ Maojun Zhang ⋅ Shen Yan ⋅ Qing Wang
In Room: ExHall D Poster Location: Poster #49 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BrepGiff: Lightweight Generation of Complex B-rep with 3D GAT Diffusion
Hao Guo ⋅ Xiaoshui Huang ⋅ Hao jiacheng ⋅ Yunpeng Bai ⋅ Hongping Gan ⋅ Yilei Shi
In Room: ExHall D Poster Location: Poster #41 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Towards Fine-Grained Interpretability: Counterfactual Explanations for Misclassification with Saliency Partition
ZHANG LINTONG ⋅ Kang Yin ⋅ Seong-Whan Lee
In Room: ExHall D Poster Location: Poster #373 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Spotting the Unexpected (STU): A 3D LiDAR Dataset for Anomaly Segmentation in Autonomous Driving Project Page ↗
Alexey Nekrasov ⋅ Malcolm Burdorf ⋅ Stewart Worrall ⋅ Bastian Leibe ⋅ Julie Stephany Berrio Perez
In Room: ExHall D Poster Location: Poster #119 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Is `Right' Right? Enhancing Object Orientation Understanding in Multimodal Large Language Models through Egocentric Instruction Tuning Project Page ↗
JiHyeok Jung ⋅ EunTae Kim ⋅ SeoYeon Kim ⋅ Joo Ho Lee ⋅ Bumsoo Kim ⋅ Buru Chang
In Room: ExHall D Poster Location: Poster #345 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GCC: Generative Color Constancy via Diffusing a Color Checker Project Page ↗
Chen-Wei Chang ⋅ Cheng-De Fan ⋅ Chia-Che Chang ⋅ Yi-Chen Lo ⋅ Yu-Chee Tseng ⋅ Jiun-Long Huang ⋅ Yu-Lun Liu
In Room: ExHall D Poster Location: Poster #20 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Blind Bitstream-corrupted Video Recovery via Metadata-guided Diffusion Model
Shuyun Wang ⋅ Hu Zhang ⋅ Xin Shen ⋅ Dadong Wang ⋅ Xin Yu
In Room: ExHall D Poster Location: Poster #182 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
On Denoising Walking Videos for Gait Recognition
Dongyang Jin ⋅ Chao Fan ⋅ Jingzhe Ma ⋅ Jingkai Zhou ⋅ Weihua Chen ⋅ Shiqi Yu
In Room: ExHall D Poster Location: Poster #162 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Conformal Prediction for Zero-Shot Models Project Page ↗
Julio Silva-Rodríguez ⋅ Ismail Ben Ayed ⋅ Jose Dolz
In Room: ExHall D Poster Location: Poster #393 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PhysAnimator: Physics-Guided Generative Cartoon Animation Project Page ↗
Tianyi Xie ⋅ Yiwei Zhao ⋅ Ying Jiang ⋅ Chenfanfu Jiang
In Room: ExHall D Poster Location: Poster #13 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SeriesBench: A Benchmark for Narrative-Driven Drama Series Understanding
chenkai zhang ⋅ Yiming Lei ⋅ Zeming Liu ⋅ Haitao Leng ⋅ Shaoguo Liu ⋅ Tingting Gao ⋅ Qingjie Liu ⋅ Yunhong Wang
In Room: ExHall D Poster Location: Poster #273 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Weakly Supervised Temporal Action Localization via Dual-Prior Collaborative Learning Guided by Multimodal Large Language Models
Quan Zhang ⋅ Jinwei Fang ⋅ Rui Yuan ⋅ Xi Tang ⋅ Yuxin Qi ⋅ Ke Zhang ⋅ Chun Yuan
In Room: ExHall D Poster Location: Poster #298 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HotSpot: Signed Distance Function Optimization with an Asymptotically Sufficient Condition
Zimo Wang ⋅ Cheng Wang ⋅ Taiki Yoshino ⋅ Sirui Tao ⋅ Ziyang Fu ⋅ Tzu-Mao Li
In Room: ExHall D Poster Location: Poster #103 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BACON: Improving Clarity of Image Captions via Bag-of-Concept Graphs
Zhantao Yang ⋅ Ruili Feng ⋅ Keyu Yan ⋅ Huangji Wang ⋅ Zhicai Wang ⋅ Shangwen Zhu ⋅ Han Zhang ⋅ Jie Xiao ⋅ Pingyu Wu ⋅ Kai Zhu ⋅ Jixuan Chen ⋅ Chen-Wei Xie ⋅ Yue Yang ⋅ Hongyang Zhang ⋅ Yu Liu ⋅ Fan Cheng
In Room: ExHall D Poster Location: Poster #356 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EntitySAM: Segment Everything in Video
Mingqiao Ye ⋅ Seoung Wug Oh ⋅ Lei Ke ⋅ Joon-Young Lee
In Room: ExHall D Poster Location: Poster #307 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Scene-agnostic Pose Regression for Visual Localization Project Page ↗
Junwei Zheng ⋅ Ruiping Liu ⋅ Yufan Chen ⋅ Zhenfang Chen ⋅ Kailun Yang ⋅ Jiaming Zhang ⋅ Rainer Stiefelhagen
In Room: ExHall D Poster Location: Poster #90 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GS-2DGS: Geometrically Supervised 2DGS for Reflective Object Reconstruction
Jinguang Tong ⋅ Xuesong li ⋅ Fahira Afzal Maken ⋅ Sundaram Muthu ⋅ Lars Petersson ⋅ Chuong Nguyen ⋅ Hongdong Li
In Room: ExHall D Poster Location: Poster #47 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Libra-Merging: Importance-redundancy and Pruning-merging Trade-off for Acceleration Plug-in in Large Vision-Language Model
Longrong Yang ⋅ Dong Shen ⋅ Chaoxiang Cai ⋅ Kaibing Chen ⋅ Fan Yang ⋅ Tingting Gao ⋅ Di ZHANG ⋅ Xi Li
In Room: ExHall D Poster Location: Poster #384 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GenFusion: Closing the Loop between Reconstruction and Generation via Videos
Sibo Wu ⋅ Congrong Xu ⋅ Binbin Huang ⋅ Andreas Geiger ⋅ Anpei Chen
In Room: ExHall D Poster Location: Poster #61 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VasTSD: Learning 3D Vascular Tree-state Space Diffusion Model for Angiography Synthesis
Zhifeng Wang ⋅ Renjiao Yi ⋅ Xin Wen ⋅ Chenyang Zhu ⋅ Kai Xu
In Room: ExHall D Poster Location: Poster #483 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PanSplat: 4K Panorama Synthesis with Feed-Forward Gaussian Splatting
Cheng Zhang ⋅ Haofei Xu ⋅ Qianyi Wu ⋅ Camilo Cruz Gambardella ⋅ Dinh Phung ⋅ Jianfei Cai
In Room: ExHall D Poster Location: Poster #74 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Realistic Example-based Modeling via 3D Gaussian Stitching
Xinyu Gao ⋅ Ziyi Yang ⋅ Bingchen Gong ⋅ Xiaoguang Han ⋅ Sipeng Yang ⋅ Xiaogang Jin
In Room: ExHall D Poster Location: Poster #42 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
WISNet: Pseudo Label Generation on Unbalanced and Patch Annotated Waste Images
Shifan Zhang ⋅ Hongzi Zhu ⋅ Yinan He ⋅ Minyi Guo ⋅ Ziyang Lou ⋅ Shan Chang
In Room: ExHall D Poster Location: Poster #424 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Saliuitl: Ensemble Salience Guided Recovery of Adversarial Patches against CNNs
Mauricio Byrd Victorica ⋅ György Dán ⋅ Henrik Sandberg
In Room: ExHall D Poster Location: Poster #434 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
RaSS: Improving Denoising Diffusion Samplers with Reinforced Active Sampling Scheduler
Xin Ding ⋅ Lei Yu ⋅ Xin Li ⋅ Zhijun Tu ⋅ Hanting Chen ⋅ Jie Hu ⋅ Zhibo Chen
In Room: ExHall D Poster Location: Poster #217 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MixerMDM: Learnable Composition of Human Motion Diffusion Models Project Page ↗
Pablo Ruiz-Ponce ⋅ German Barquero ⋅ Cristina Palmero ⋅ Sergio Escalera ⋅ Jose Garcia-Rodriguez
In Room: ExHall D Poster Location: Poster #165 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LEDiff: Latent Exposure Diffusion for HDR Generation
Chao Wang ⋅ Zhihao Xia ⋅ Thomas Leimkuehler ⋅ Karol Myszkowski ⋅ Xuaner Zhang
In Room: ExHall D Poster Location: Poster #27 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Video Depth Anything: Consistent Depth Estimation for Super-Long Videos Project Page ↗
Sili Chen ⋅ Hengkai Guo ⋅ Shengnan Zhu ⋅ Feihu Zhang ⋅ Zilong Huang ⋅ Jiashi Feng ⋅ Bingyi Kang
In Room: ExHall D Poster Location: Poster #169 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RaCFormer: Towards High-Quality 3D Object Detection via Query-based Radar-Camera Fusion Project Page ↗
Xiaomeng Chu ⋅ Jiajun Deng ⋅ Guoliang You ⋅ Yifan Duan ⋅ Houqiang Li ⋅ Yanyong Zhang
In Room: ExHall D Poster Location: Poster #121 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption
Tiehan Fan ⋅ Kepan Nan ⋅ Rui Xie ⋅ Penghao Zhou ⋅ Zhenheng Yang ⋅ Chaoyou Fu ⋅ Xiang Li ⋅ Jian Yang ⋅ Ying Tai
In Room: ExHall D Poster Location: Poster #270 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Jiazhi Guan ⋅ Kaisiyuan Wang ⋅ Zhiliang Xu ⋅ Quanwei Yang ⋅ Yasheng SUN ⋅ Shengyi He ⋅ Borong Liang ⋅ Yukang Cao ⋅ Yingying Li ⋅ Haocheng Feng ⋅ Errui Ding ⋅ Jingdong Wang ⋅ Youjian Zhao ⋅ Hang Zhou ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #3 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Luminance-GS: Adapting 3D Gaussian Splatting to Challenging Lighting Conditions with View-Adaptive Curve Adjustment Project Page ↗
Ziteng Cui ⋅ Xuangeng Chu ⋅ Tatsuya Harada
In Room: ExHall D Poster Location: Poster #27 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FloVD: Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis
Wonjoon Jin ⋅ Qi Dai ⋅ Chong Luo ⋅ Seung-Hwan Baek ⋅ Sunghyun Cho
In Room: ExHall D Poster Location: Poster #176 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RAD: Region-Aware Diffusion Models for Image Inpainting
Sora Kim ⋅ Sungho Suh ⋅ Minsik Lee
In Room: ExHall D Poster Location: Poster #216 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Supervising Sound Localization by In-the-wild Egomotion
Anna Min ⋅ Ziyang Chen ⋅ Hang Zhao ⋅ Andrew Owens
In Room: ExHall D Poster Location: Poster #279 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AutoLUT: LUT-Based Image Super-Resolution with Automatic Sampling and Adaptive Residual Learning Project Page ↗
Yuheng Xu ⋅ Shijie Yang ⋅ Xin Liu ⋅ Jie Liu ⋅ Jie Tang ⋅ Gangshan Wu
In Room: ExHall D Poster Location: Poster #197 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Understanding Fine-tuning CLIP for Open-vocabulary Semantic Segmentation in Hyperbolic Space
Zelin Peng ⋅ Zhengqin Xu ⋅ Zhilin Zeng ⋅ Changsong Wen ⋅ Yu Huang ⋅ Menglin Yang ⋅ feilong tang ⋅ Wei Shen
In Room: ExHall D Poster Location: Poster #421 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TexGaussian: Generating High-quality PBR Material via Octree-based 3D Gaussian Splatting Project Page ↗
Bojun Xiong ⋅ Jialun Liu ⋅ JiaKui Hu ⋅ Chenming Wu ⋅ Jinbo Wu ⋅ Xing Liu ⋅ Chen Zhao ⋅ Errui Ding ⋅ Zhouhui Lian
In Room: ExHall D Poster Location: Poster #36 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OSV: One Step is Enough for High-Quality Image to Video Generation
Xiaofeng Mao ⋅ Zhengkai Jiang ⋅ Fu-Yun Wang ⋅ Jiangning Zhang ⋅ Hao Chen ⋅ Mingmin Chi ⋅ Yabiao Wang ⋅ Wenhan Luo
In Room: ExHall D Poster Location: Poster #185 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BlobGEN-Vid: Compositional Text-to-Video Generation with Blob Video Representations Project Page ↗
Weixi Feng ⋅ Chao Liu ⋅ Sifei Liu ⋅ William Yang Wang ⋅ Arash Vahdat ⋅ Weili Nie
In Room: ExHall D Poster Location: Poster #223 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Scaling Vision Pre-Training to 4K Resolution
Baifeng Shi ⋅ Boyi Li ⋅ Han Cai ⋅ Yao Lu ⋅ Sifei Liu ⋅ Marco Pavone ⋅ Jan Kautz ⋅ Song Han ⋅ Trevor Darrell ⋅ Pavlo Molchanov ⋅ Danny Yin
In Room: ExHall D Poster Location: Poster #406 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
NVILA: Efficient Frontier Visual Language Models
Zhijian Liu ⋅ Ligeng Zhu ⋅ Baifeng Shi ⋅ Zhuoyang Zhang ⋅ Yuming Lou ⋅ Shang Yang ⋅ Haocheng Xi ⋅ Shiyi Cao ⋅ Yuxian Gu ⋅ Dacheng Li ⋅ Xiuyu Li ⋅ Haotian Tang ⋅ Yunhao Fang ⋅ Yukang Chen ⋅ Cheng-Yu Hsieh ⋅ De-An Huang ⋅ An-Chieh Cheng ⋅ Jinyi Hu ⋅ Sifei Liu ⋅ Ranjay Krishna ⋅ Pavlo Molchanov ⋅ Jan Kautz ⋅ Danny Yin ⋅ Song Han ⋅ Yao Lu
In Room: ExHall D Poster Location: Poster #377 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Fuzzy Multimodal Learning for Trusted Cross-modal Retrieval
Siyuan Duan ⋅ Yuan Sun ⋅ Dezhong Peng ⋅ Zheng Liu ⋅ Xiaomin Song ⋅ Peng Hu
In Room: ExHall D Poster Location: Poster #470 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GUI-Xplore: Empowering Generalizable GUI Agents with One Exploration
Yuchen Sun ⋅ Shanhui Zhao ⋅ Tao Yu ⋅ Hao Wen ⋅ Samith Va ⋅ Mengwei Xu ⋅ Yuanchun Li ⋅ Chongyang Zhang
In Room: ExHall D Poster Location: Poster #350 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Concept Replacer: Replacing Sensitive Concepts in Diffusion Models via Precision Localization
lingyun zhang ⋅ Yu Xie ⋅ Yanwei Fu ⋅ Ping Chen
In Room: ExHall D Poster Location: Poster #267 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LineArt: A Knowledge-guided Training-free High-quality Appearance Transfer for Design Drawing with Diffusion Model Project Page ↗
Xi Wang ⋅ Hongzhen Li ⋅ Heng Fang ⋅ YICHEN PENG ⋅ Haoran Xie ⋅ Xi Yang ⋅ Chuntao Li
In Room: ExHall D Poster Location: Poster #263 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UniPhy: Learning a Unified Constitutive Model for Inverse Physics Simulation
Himangi Mittal ⋅ Peiye Zhuang ⋅ Hsin-Ying Lee ⋅ Shubham Tulsiani
In Room: ExHall D Poster Location: Poster #34 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SparseAlign: a Fully Sparse Framework for Cooperative Object Detection
Yunshuang Yuan ⋅ Yan Xia ⋅ Daniel Cremers ⋅ Monika Sester
In Room: ExHall D Poster Location: Poster #119 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
4Real-Video: Learning Generalizable Photo-Realistic 4D Video Diffusion
Chaoyang Wang ⋅ Peiye Zhuang ⋅ Tuan Duc Ngo ⋅ Willi Menapace ⋅ Aliaksandr Siarohin ⋅ Michael Vasilkovsky ⋅ Ivan Skorokhodov ⋅ Sergey Tulyakov ⋅ Peter Wonka ⋅ Hsin-Ying Lee
In Room: ExHall D Poster Location: Poster #183 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Scene Map-based Prompt Tuning for Navigation Instruction Generation
Sheng Fan ⋅ Rui Liu ⋅ Wenguan Wang ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #146 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Zero-Shot Image Restoration Using Few-Step Guidance of Consistency Models (and Beyond) Project Page ↗
Tomer Garber ⋅ Tom Tirer
In Room: ExHall D Poster Location: Poster #210 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HOIGPT: Learning Long-Sequence Hand-Object Interaction with Language Models
Mingzhen Huang ⋅ Fu-Jen Chu ⋅ Bugra Tekin ⋅ Kevin Liang ⋅ Haoyu Ma ⋅ Weiyao Wang ⋅ Xingyu Chen ⋅ Pierre Gleize ⋅ Hongfei Xue ⋅ Siwei Lyu ⋅ Kris Kitani ⋅ Matt Feiszli ⋅ Hao Tang
In Room: ExHall D Poster Location: Poster #170 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LidarGait++: Learning Local Features and Size Awareness from LiDAR Point Clouds for 3D Gait Recognition Project Page ↗
Chuanfu Shen ⋅ Rui Wang ⋅ Lixin Duan ⋅ Shiqi Yu
In Room: ExHall D Poster Location: Poster #120 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UrbanCAD: Towards Highly Controllable and Photorealistic 3D Vehicles for Urban Scene Simulation
Yichong Lu ⋅ Yichi Cai ⋅ Shangzhan Zhang ⋅ Hongyu Zhou ⋅ Haoji Hu ⋅ Huimin Yu ⋅ Andreas Geiger ⋅ Yiyi Liao
In Room: ExHall D Poster Location: Poster #130 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Diff-Palm: Realistic Palmprint Generation with Polynomial Creases and Intra-Class Variation Controllable Diffusion Models Project Page ↗
Jianlong Jin ⋅ Chenglong Zhao ⋅ Ruixin Zhang ⋅ Sheng Shang ⋅ Jianqing Xu ⋅ Jingyun Zhang ⋅ ShaoMing Wang ⋅ Yang Zhao ⋅ Shouhong Ding ⋅ Wei Jia ⋅ Yunsheng Wu
In Room: ExHall D Poster Location: Poster #17 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Arbitrary-steps Image Super-resolution via Diffusion Inversion Project Page ↗
Zongsheng Yue ⋅ Kang Liao ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #199 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UniNet: A Contrastive Learning-guided Unified Framework with Feature Selection for Anomaly Detection Project Page ↗
Shun Wei ⋅ Jielin Jiang ⋅ Xiaolong Xu
In Room: ExHall D Poster Location: Poster #440 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
3DEnhancer: Consistent Multi-View Diffusion for 3D Enhancement
Yihang Luo ⋅ Shangchen Zhou ⋅ Yushi Lan ⋅ Xingang Pan ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #56 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Chain of Semantics Programming in 3D Gaussian Splatting Representation for 3D Vision Grounding
Jiaxin Shi ⋅ Mingyue Xiang ⋅ Hao Sun ⋅ Yixuan Huang ⋅ Zhi Weng
In Room: ExHall D Poster Location: Poster #338 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
On the Zero-shot Adversarial Robustness of Vision-Language Models: A Truly Zero-shot and Training-free Approach
Baoshun Tong ⋅ Hanjiang Lai ⋅ Yan Pan ⋅ Jian Yin
In Room: ExHall D Poster Location: Poster #392 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards General Visual-Linguistic Face Forgery Detection
Ke Sun ⋅ Shen Chen ⋅ Taiping Yao ⋅ Ziyin Zhou ⋅ Jiayi Ji ⋅ Xiaoshuai Sun ⋅ Chia-Wen Lin ⋅ Rongrong Ji
In Room: ExHall D Poster Location: Poster #359 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
Jianyi Wang ⋅ Zhijie Lin ⋅ Meng Wei ⋅ Yang Zhao ⋅ Ceyuan Yang ⋅ Chen Change Loy ⋅ Lu Jiang
In Room: ExHall D Poster Location: Poster #187 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BOLT: Boost Large Vision-Language Model Without Training for Long-form Video Understanding
Shuming Liu ⋅ Chen Zhao ⋅ Tianqi Xu ⋅ Bernard Ghanem
In Room: ExHall D Poster Location: Poster #301 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Efficient Data Driven Mixture-of-Expert Extraction from Trained Networks
Uranik Berisha ⋅ Jens Mehnert ⋅ Alexandru Paul Condurache
In Room: ExHall D Poster Location: Poster #408 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Structured 3D Latents for Scalable and Versatile 3D Generation Project Page ↗
Jianfeng XIANG ⋅ Zelong Lv ⋅ Sicheng Xu ⋅ Yu Deng ⋅ Ruicheng Wang ⋅ Bowen Zhang ⋅ Dong Chen ⋅ Xin Tong ⋅ Jiaolong Yang
In Room: ExHall D Poster Location: Poster #40 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards All-in-One Medical Image Re-Identification
Yuan Tian ⋅ Kaiyuan Ji ⋅ Rongzhao Zhang ⋅ Yankai Jiang ⋅ Chunyi Li ⋅ Xiaosong Wang ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #443 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories
Muzhi Zhu ⋅ Yuzhuo Tian ⋅ Hao Chen ⋅ Chunluan Zhou ⋅ Qingpei Guo ⋅ Yang Liu ⋅ Ming Yang ⋅ Chunhua Shen
In Room: ExHall D Poster Location: Poster #335 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SceneCrafter: Controllable Multi-View Driving Scene Editing
Zehao Zhu ⋅ Yuliang Zou ⋅ Chiyu “Max” Jiang ⋅ Bo Sun ⋅ Vincent Casser ⋅ XIUKUN HUANG ⋅ Jiahao Wang ⋅ Zhenpei Yang ⋅ Ruiqi Gao ⋅ Leonidas Guibas ⋅ Mingxing Tan ⋅ Dragomir Anguelov
In Room: ExHall D Poster Location: Poster #138 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AMO Sampler: Enhancing Text Rendering with Overshooting Project Page ↗
Xixi Hu ⋅ Keyang Xu ⋅ Bo Liu ⋅ Hongliang Fei ⋅ Qiang Liu
In Room: ExHall D Poster Location: Poster #239 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Disentangling Safe and Unsafe Image Corruptions via Anisotropy and Locality
Ramchandran Muthukumar ⋅ Ambar Pal ⋅ Jeremias Sulam ⋅ Rene Vidal
In Room: ExHall D Poster Location: Poster #436 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
I2VGuard: Safeguarding Images against Misuse in Diffusion-based Image-to-Video Models
Dongnan Gui ⋅ Xun Guo ⋅ Wengang Zhou ⋅ Yan Lu
In Room: ExHall D Poster Location: Poster #186 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Rashomon Sets for Prototypical-Part Networks: Editing Interpretable Models in Real-Time
Jon Donnelly ⋅ Zhicheng Guo ⋅ Alina Jade Barnett ⋅ Hayden McTavish ⋅ Chaofan Chen ⋅ Cynthia Rudin
In Room: ExHall D Poster Location: Poster #418 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HeatFormer: A Neural Optimizer for Multiview Human Mesh Recovery Project Page ↗
Yuto Matsubara ⋅ Ko Nishino
In Room: ExHall D Poster Location: Poster #99 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GPS as a Control Signal for Image Generation
Chao Feng ⋅ Ziyang Chen ⋅ Aleksander Holynski ⋅ Alexei A. Efros ⋅ Andrew Owens
In Room: ExHall D Poster Location: Poster #250 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MAGiC-SLAM: Multi-Agent Gaussian Globally Consistent SLAM Project Page ↗
Vladimir Yugay ⋅ Theo Gevers ⋅ Martin R. Oswald
In Room: ExHall D Poster Location: Poster #131 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
Chenjie Cao ⋅ Chaohui Yu ⋅ Shang Liu ⋅ Fan Wang ⋅ Xiangyang Xue ⋅ Yanwei Fu
In Room: ExHall D Poster Location: Poster #58 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Bayesian Test-Time Adaptation for Vision-Language Models
Lihua Zhou ⋅ Mao Ye ⋅ Shuaifeng Li ⋅ Nianxin Li ⋅ Xiatian Zhu ⋅ Lei Deng ⋅ Hongbin Liu ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #368 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ACE: Anti-Editing Concept Erasure in Text-to-Image Models Project Page ↗
Zihao Wang ⋅ Yuxiang Wei ⋅ Fan Li ⋅ Renjing Pei ⋅ Hang Xu ⋅ Wangmeng Zuo
In Room: ExHall D Poster Location: Poster #234 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Change3D: Revisiting Change Detection and Captioning from A Video Modeling Perspective Project Page ↗
Duowang Zhu ⋅ Xiaohu Huang ⋅ Haiyan Huang ⋅ Hao Zhou ⋅ Zhenfeng Shao
In Room: ExHall D Poster Location: Poster #286 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling Project Page ↗
Xin Xie ⋅ Dong Gong
In Room: ExHall D Poster Location: Poster #245 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HiMoR: Monocular Deformable Gaussian Reconstruction with Hierarchical Motion Representation Project Page ↗
Yiming Liang ⋅ Tianhan Xu ⋅ Yuta Kikuchi
In Room: ExHall D Poster Location: Poster #67 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Enhanced Visual-Semantic Interaction with Tailored Prompts for Pedestrian Attribute Recognition
Junyi Wu ⋅ Yan Huang ⋅ Min Gao ⋅ Yuzhen Niu ⋅ Yuzhong Chen ⋅ Qiang Wu
In Room: ExHall D Poster Location: Poster #400 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SF3D: Stable Fast 3D Mesh Reconstruction with UV-unwrapping and Illumination Disentanglement
Mark Boss ⋅ Zixuan Huang ⋅ Aaryaman Vasishta ⋅ Varun Jampani
In Room: ExHall D Poster Location: Poster #37 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion
Haoyu Wang ⋅ Le Wang ⋅ Sanping Zhou ⋅ Jingyi Tian ⋅ Zheng Qin ⋅ Yabing Wang ⋅ Gang Hua ⋅ Wei Tang
In Room: ExHall D Poster Location: Poster #257 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation
Yukang Lin ⋅ Hokit Fung ⋅ Jianjin Xu ⋅ Zeping Ren ⋅ Adela S.M. Lau ⋅ Guosheng Yin ⋅ Xiu Li
In Room: ExHall D Poster Location: Poster #4 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ProbPose: A Probabilistic Approach to 2D Human Pose Estimation Project Page ↗
Miroslav Purkrábek ⋅ Jiri Matas
In Room: ExHall D Poster Location: Poster #93 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EfficientViM: Efficient Vision Mamba with Hidden State Mixer based State Space Duality Project Page ↗
Sanghyeok Lee ⋅ Joonmyung Choi ⋅ Hyunwoo J. Kim
In Room: ExHall D Poster Location: Poster #408 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A4A: Adapter for Adapter Transfer via All-for-All Mapping for Cross-Architecture Models
Keyu Tu ⋅ Mengqi Huang ⋅ Zhuowei Chen ⋅ Zhendong Mao
In Room: ExHall D Poster Location: Poster #258 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LPOSS: Label Propagation Over Patches and Pixels for Open-vocabulary Semantic Segmentation Project Page ↗
Vladan Stojnić ⋅ Yannis Kalantidis ⋅ Jiri Matas ⋅ Giorgos Tolias
In Room: ExHall D Poster Location: Poster #421 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Neural Inverse Rendering from Propagating Light
Anagh Malik ⋅ Benjamin Attal ⋅ Andrew Xie ⋅ Matthew O’Toole ⋅ David B. Lindell
In Room: ExHall D Poster Location: Poster #30 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LUCAS: Layered Universal Codec Avatars
Di Liu ⋅ Teng Deng ⋅ Giljoo Nam ⋅ Yu Rong ⋅ Stanislav Pidhorskyi ⋅ Junxuan Li ⋅ Jason Saragih ⋅ Dimitris N. Metaxas ⋅ Chen Cao
In Room: ExHall D Poster Location: Poster #8 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
A Universal Scale-Adaptive Deformable Transformer for Image Restoration across Diverse Artifacts
Xuyi He ⋅ Yuhui Quan ⋅ Ruotao Xu ⋅ Hui Ji
In Room: ExHall D Poster Location: Poster #199 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CASP: Consistency-aware Audio-induced Saliency Prediction Model for Omnidirectional Video
Zhaolin Wan ⋅ Han Qin ⋅ Zhiyang Li ⋅ Xiaopeng Fan ⋅ Wangmeng Zuo ⋅ Debin Zhao
In Room: ExHall D Poster Location: Poster #187 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
WISE: A Framework for Gigapixel Whole-Slide-Image Lossless Compression
Yu Mao ⋅ Jun Wang ⋅ Nan Guan ⋅ Chun Jason Xue
In Room: ExHall D Poster Location: Poster #305 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary
Kevin Qinghong Lin ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #292 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Learnable Infinite Taylor Gaussian for Dynamic View Rendering
Bingbing Hu ⋅ Yanyan Li ⋅ rui xie ⋅ Bo Xu ⋅ Haoye Dong ⋅ Junfeng Yao ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #67 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HyperPose: Hypernetwork-Infused Camera Pose Localization and an Extended Cambridge Landmarks Dataset Project Page ↗
Ron Ferens ⋅ Yosi Keller
In Room: ExHall D Poster Location: Poster #86 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EAP-GS: Efficient Augmentation of Pointcloud for 3D Gaussian Splatting in Few-shot Scene Reconstruction
Dongrui Dai ⋅ Yuxiang Xing
In Room: ExHall D Poster Location: Poster #63 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Thin-Shell-SfT: Fine-Grained Monocular Non-rigid 3D Surface Tracking with Neural Deformation Fields Project Page ↗
Navami Kairanda ⋅ Marc Habermann ⋅ Shanthika Shankar Naik ⋅ Christian Theobalt ⋅ Vladislav Golyanik
In Room: ExHall D Poster Location: Poster #68 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Large Self-Supervised Models Bridge the Gap in Domain Adaptive Object Detection
Marc-Antoine Lavoie ⋅ Anas Mahmoud ⋅ Steven L. Waslander
In Room: ExHall D Poster Location: Poster #433 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ERUPT: Efficient Rendering with Unposed Patch Transformer
Maxim Shugaev ⋅ Vincent Chen ⋅ Maxim Karrenbach ⋅ Kyle Ashley ⋅ Bridget Kennedy ⋅ Naresh Cuntoor
In Room: ExHall D Poster Location: Poster #59 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Empowering Large Language Models with 3D Situation Awareness
Zhihao Yuan ⋅ Yibo Peng ⋅ Jinke Ren ⋅ Yinghong Liao ⋅ Yatong Han ⋅ Chun-Mei Feng ⋅ Hengshuang Zhao ⋅ Guanbin Li ⋅ Shuguang Cui ⋅ Zhen Li
In Room: ExHall D Poster Location: Poster #346 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EchoTraffic: Enhancing Traffic Anomaly Understanding with Audio-Visual Insights Project Page ↗
Zhenghao Xing ⋅ Hao Chen ⋅ Binzhu Xie ⋅ Jiaqi Xu ⋅ Ziyu Guo ⋅ Xuemiao Xu ⋅ Jianye Hao ⋅ Chi-Wing Fu ⋅ Xiaowei Hu ⋅ Pheng-Ann Heng
In Room: ExHall D Poster Location: Poster #315 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Improved Monocular Depth Prediction Using Distance Transform Over Pre-semantic Contours with Self-supervised Neural Networks
Marwane Hariat ⋅ Antoine Manzanera ⋅ David Filliat
In Room: ExHall D Poster Location: Poster #78 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FlexDrive: Toward Trajectory Flexibility in Driving Scene Gaussian Splatting Reconstruction and Rendering
Jingqiu Zhou ⋅ Lue Fan ⋅ Linjiang Huang ⋅ Zhaoxiang Zhang ⋅ Xiaoyu Shi ⋅ Si Liu ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #129 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs
Yingji Zhong ⋅ Zhihao Li ⋅ Dave Zhenyu Chen ⋅ Lanqing Hong ⋅ Dan Xu
In Room: ExHall D Poster Location: Poster #66 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Interactive Medical Image Segmentation: A Benchmark Dataset and Baseline Project Page ↗
Junlong Cheng ⋅ Bin Fu ⋅ Jin Ye ⋅ Guoan Wang ⋅ Tianbin Li ⋅ Haoyu Wang ⋅ Ruoyu Li ⋅ He Yao ⋅ Chen Junren ⋅ Jingwen Li ⋅ Yanzhou Su ⋅ Min Zhu ⋅ Junjun He
In Room: ExHall D Poster Location: Poster #479 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Magma: A Foundation Model for Multimodal AI Agents Project Page ↗
Jianwei Yang ⋅ Reuben Tan ⋅ Qianhui Wu ⋅ Ruijie Zheng ⋅ Baolin Peng ⋅ Yongyuan Liang ⋅ Yu Gu ⋅ Mu Cai ⋅ Seonghyeon Ye ⋅ Joel Jang ⋅ Yuquan Deng ⋅ Jianfeng Gao
In Room: ExHall D Poster Location: Poster #340 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing Project Page ↗
Niu Lian ⋅ Jun Li ⋅ Jinpeng Wang ⋅ Ruisheng Luo ⋅ Yaowei Wang ⋅ Shu-Tao Xia ⋅ Bin Chen
In Room: ExHall D Poster Location: Poster #295 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Augmenting Multimodal LLMs with Self-Reflective Tokens for Knowledge-based Visual Question Answering Project Page ↗
Federico Cocchi ⋅ Nicholas Moratelli ⋅ Marcella Cornia ⋅ Lorenzo Baraldi ⋅ Rita Cucchiara
In Room: ExHall D Poster Location: Poster #365 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DifIISR: A Diffusion Model with Gradient Guidance for Infrared Image Super-Resolution
Xingyuan Li ⋅ Zirui Wang ⋅ Yang Zou ⋅ Zhixin Chen ⋅ Jun Ma ⋅ Zhiying Jiang ⋅ Long Ma ⋅ Jinyuan Liu
In Room: ExHall D Poster Location: Poster #207 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
3D-GSW: 3D Gaussian Splatting for Robust Watermarking Project Page ↗
Youngdong Jang ⋅ Hyunje Park ⋅ Feng Yang ⋅ Heeju Ko ⋅ Euijin Choo ⋅ Sangpil Kim
In Room: ExHall D Poster Location: Poster #47 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Sketch Down the FLOPs: Towards Efficient Networks for Human Sketch Project Page ↗
Aneeshan Sain ⋅ Subhajit Maity ⋅ Pinaki Nath Chowdhury ⋅ Subhadeep Koley ⋅ Ayan Kumar Bhunia ⋅ Yi-Zhe Song
In Room: ExHall D Poster Location: Poster #211 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning
Maosen Zhao ⋅ Pengtao Chen ⋅ Chong Yu ⋅ Yan Wen ⋅ Xudong Tan ⋅ Tao Chen
In Room: ExHall D Poster Location: Poster #222 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation
Pengfei Zhou ⋅ Xiaopeng Peng ⋅ Jiajun Song ⋅ Chuanhao Li ⋅ Zhaopan Xu ⋅ Yue Yang ⋅ Ziyao Guo ⋅ Hao Zhang ⋅ Yuqi Lin ⋅ Yefei He ⋅ Lirui Zhao ⋅ Shuo Liu ⋅ Tianhua Li ⋅ Yuxuan Xie ⋅ Xiaojun Chang ⋅ Yu Qiao ⋅ Wenqi Shao ⋅ Kaipeng Zhang
In Room: ExHall D Poster Location: Poster #245 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EMOVA: Empowering Language Models to See, Hear and Speak with Vivid Emotions Project Page ↗
Kai Chen ⋅ Yunhao Gou ⋅ Runhui Huang ⋅ Zhili Liu ⋅ Daxin Tan ⋅ Jing Xu ⋅ Chunwei Wang ⋅ Yi Zhu ⋅ yihan zeng ⋅ Kuo Yang ⋅ Dingdong WANG ⋅ Kun Xiang ⋅ Haoyuan Li ⋅ Haoli Bai ⋅ Jianhua Han ⋅ Xiao-Hui Li ⋅ Weike Jin ⋅ Nian Xie ⋅ Yu Zhang ⋅ James Kwok ⋅ Hengshuang Zhao ⋅ Xiaodan Liang ⋅ Dit-Yan Yeung ⋅ Xiao Chen ⋅ Zhenguo Li ⋅ Wei Zhang ⋅ Qun Liu ⋅ Lanqing Hong ⋅ Lu Hou ⋅ Hang Xu
In Room: ExHall D Poster Location: Poster #1 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dual Exposure Stereo for Extended Dynamic Range 3D Imaging
Juhyung Choi ⋅ Jinneyong Kim ⋅ Seokjun Choi ⋅ Jinwoo Lee ⋅ Samuel Brucker ⋅ Mario Bijelic ⋅ Felix Heide ⋅ Seung-Hwan Baek
In Room: ExHall D Poster Location: Poster #83 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A New Statistical Model of Star Speckles for Learning to Detect and Characterize Exoplanets in Direct Imaging Observations
Theo Bodrito ⋅ Olivier Flasseur ⋅ Julien Mairal ⋅ Jean Ponce ⋅ Maud Langlois ⋅ Anne-Marie Lagrange
In Room: ExHall D Poster Location: Poster #99 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CompGS: Unleashing 2D Compositionality for Compositional Text-to-3D via Dynamically Optimizing 3D Gaussians
Chongjian GE ⋅ Chenfeng Xu ⋅ Yuanfeng Ji ⋅ Chensheng Peng ⋅ Masayoshi Tomizuka ⋅ Ping Luo ⋅ Mingyu Ding ⋅ Varun Jampani ⋅ Wei Zhan
In Room: ExHall D Poster Location: Poster #261 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SOLAMI: Social Vision-Language-Action Modeling for Immersive Interaction with 3D Autonomous Characters
Jianping Jiang ⋅ Weiye Xiao ⋅ Zhengyu Lin ⋅ Huaizhong Zhang ⋅ Tianxiang Ren ⋅ Yang Gao ⋅ Zhiqian Lin ⋅ Zhongang Cai ⋅ Lei Yang ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #71 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MicroVQA: A Multimodal Reasoning Benchmark for Microscopy-Based Scientific Research
James Burgess ⋅ Jeffrey J Nirschl ⋅ Laura Bravo-Sánchez ⋅ Alejandro Lozano ⋅ Sanket Rajan Gupte ⋅ Jesus G. Galaz-Montoya ⋅ Yuhui Zhang ⋅ Yuchang Su ⋅ Disha Bhowmik ⋅ Zachary Coman ⋅ Sarina M. Hasan ⋅ Alexandra Johannesson ⋅ William D. Leineweber ⋅ Malvika G Nair ⋅ Ridhi Yarlagadda ⋅ Connor Zuraski ⋅ Wah Chiu ⋅ Sarah Cohen ⋅ Jan N. Hansen ⋅ Manuel D Leonetti ⋅ Chad Liu ⋅ Emma Lundberg ⋅ Serena Yeung
In Room: ExHall D Poster Location: Poster #357 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Temporally Consistent Video Depth from Video Diffusion Priors Project Page ↗
Jiahao Shao ⋅ Yuanbo Yang ⋅ Hongyu Zhou ⋅ Youmin Zhang ⋅ Yujun Shen ⋅ Vitor Guizilini ⋅ Yue Wang ⋅ Matteo Poggi ⋅ Yiyi Liao
In Room: ExHall D Poster Location: Poster #170 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FIRE: Robust Detection of Diffusion-Generated Images via Frequency-Guided Reconstruction Error
Beilin Chu ⋅ Xuan Xu ⋅ Xin Wang ⋅ Yufei Zhang ⋅ Weike You ⋅ Linna Zhou
In Room: ExHall D Poster Location: Poster #208 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Collaborative Tree Search for Enhancing Embodied Multi-Agent Collaboration
Lizheng Zu ⋅ Lin Lin ⋅ Song Fu ⋅ Na Zhao ⋅ Pan Zhou
In Room: ExHall D Poster Location: Poster #321 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature
Alejandro Lozano ⋅ Min Woo Sun ⋅ James Burgess ⋅ Liangyu Chen ⋅ Jeffrey J Nirschl ⋅ Jeffrey Gu ⋅ Ivan Lopez ⋅ Josiah Aklilu ⋅ Austin Wolfgang Katzer ⋅ Collin Chiu ⋅ Anita Rau ⋅ Xiaohan Wang ⋅ Yuhui Zhang ⋅ Alfred Seunghoon Song ⋅ Robert Tibshirani ⋅ Serena Yeung
In Room: ExHall D Poster Location: Poster #374 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Assessing and Learning Alignment of Unimodal Vision and Language Models Project Page ↗
Le Zhang ⋅ Qian Yang ⋅ Aishwarya Agrawal
In Room: ExHall D Poster Location: Poster #379 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Benchmarking Object Detectors under Real-World Distribution Shifts in Satellite Imagery Project Page ↗
Sara Al-Emadi ⋅ Yin Yang ⋅ Ferda Ofli
In Room: ExHall D Poster Location: Poster #280 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SAIST: Segment Any Infrared Small Target Model Guided by Contrastive Language-Image Pretraining
Mingjin Zhang ⋅ Xiaolong Li ⋅ Fei Gao ⋅ Jie Guo ⋅ Xinbo Gao ⋅ Jing Zhang
In Room: ExHall D Poster Location: Poster #398 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Closed-Loop Supervised Fine-Tuning of Tokenized Traffic Models
Zhejun Zhang ⋅ Peter Karkus ⋅ Maximilian Igl ⋅ Wenhao Ding ⋅ Yuxiao Chen ⋅ Boris Ivanovic ⋅ Marco Pavone
In Room: ExHall D Poster Location: Poster #334 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Time of the Flight of the Gaussians: Optimizing Depth Indirectly in Dynamic Radiance Fields Project Page ↗
Runfeng Li ⋅ Mikhail Okunev ⋅ Zixuan Guo ⋅ Anh H Duong ⋅ Christian Richardt ⋅ Matthew O’Toole ⋅ James Tompkin
In Room: ExHall D Poster Location: Poster #85 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Align3R: Aligned Monocular Depth Estimation for Dynamic Videos
Edward LOO ⋅ Tianyu HUANG ⋅ Peng Li ⋅ Zhiyang Dou ⋅ Cheng Lin ⋅ Zhiming Cui ⋅ Zhen Dong ⋅ Sai-Kit Yeung ⋅ Wenping Wang ⋅ Yuan Liu
In Room: ExHall D Poster Location: Poster #168 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Compositional Caching for Training-free Open-vocabulary Attribute Detection Project Page ↗
Marco Garosi ⋅ Alessandro Conti ⋅ Gaowen Liu ⋅ Elisa Ricci ⋅ Massimiliano Mancini
In Room: ExHall D Poster Location: Poster #426 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Seek Common Ground While Reserving Differences: Semi-Supervised Image-Text Sentiment Recognition
Wuyou Xia ⋅ Guoli Jia ⋅ Sicheng Zhao ⋅ Jufeng Yang
In Room: ExHall D Poster Location: Poster #330 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CoLLM: A Large Language Model for Composed Image Retrieval Project Page ↗
Chuong Huynh ⋅ Jinyu Yang ⋅ Ashish Tawari ⋅ Mubarak Shah ⋅ Son Dinh Tran ⋅ Raffay Hamid ⋅ Trishul Chilimbi ⋅ Abhinav Shrivastava
In Room: ExHall D Poster Location: Poster #364 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Efficient Diffusion as Low Light Enhancer
Guanzhou Lan ⋅ Qianli Ma ⋅ YUQI YANG ⋅ Zhigang Wang ⋅ Dong Wang ⋅ Xuelong Li ⋅ Bin Zhao
In Room: ExHall D Poster Location: Poster #22 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Electromyography-Informed Facial Expression Reconstruction for Physiological-Based Synthesis and Analysis Project Page ↗
Tim Büchner ⋅ Christoph Anders ⋅ Orlando Guntinas-Lichius ⋅ Joachim Denzler
In Room: ExHall D Poster Location: Poster #5 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VI^3NR: Variance Informed Initialization for Implicit Neural Representations
Chamin Hewa Koneputugodage ⋅ Yizhak Ben-Shabat ⋅ Sameera Ramasinghe ⋅ Stephen Gould
In Room: ExHall D Poster Location: Poster #270 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
M-LLM Based Video Frame Selection for Efficient Video Understanding
Kai Hu ⋅ Feng Gao ⋅ Xiaohan Nie ⋅ Peng Zhou ⋅ Son Dinh Tran ⋅ Tal Neiman ⋅ Lingyun Wang ⋅ Mubarak Shah ⋅ Raffay Hamid ⋅ Bing Yin ⋅ Trishul Chilimbi
In Room: ExHall D Poster Location: Poster #292 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Search and Detect: Training-Free Long Tail Object Detection via Web-Image Retrieval
Mankeerat Sidhu ⋅ Hetarth Chopra ⋅ Ansel Blume ⋅ Jeonghwan Kim ⋅ Revanth Gangi Reddy ⋅ Heng Ji
In Room: ExHall D Poster Location: Poster #429 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EgoLM: Multi-Modal Language Model of Egocentric Motions
Fangzhou Hong ⋅ Vladimir Guzov ⋅ Hyo Jin Kim ⋅ Yuting Ye ⋅ Richard Newcombe ⋅ Ziwei Liu ⋅ Lingni Ma
In Room: ExHall D Poster Location: Poster #69 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Ges3ViG : Incorporating Pointing Gestures into Language-Based 3D Visual Grounding for Embodied Reference Understanding Project Page ↗
Atharv Mahesh Mane ⋅ Dulanga Weerakoon ⋅ Vigneshwaran Subbaraju ⋅ Sougata Sen ⋅ Sanjay Sarma ⋅ Archan Misra
In Room: ExHall D Poster Location: Poster #349 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Unleashing the Potential of Multi-modal Foundation Models and Video Diffusion for 4D Dynamic Physical Scene Simulation Project Page ↗
Zhuoman Liu ⋅ Weicai Ye ⋅ Yan Luximon ⋅ Pengfei Wan ⋅ Di ZHANG
In Room: ExHall D Poster Location: Poster #35 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation Project Page ↗
Xin Yan ⋅ Yuxuan Cai ⋅ Qiuyue Wang ⋅ Yuan Zhou ⋅ Wenhao Huang ⋅ Huan Yang
In Room: ExHall D Poster Location: Poster #289 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HyperNVD: Accelerating Neural Video Decomposition via Hypernetworks Project Page ↗
Maria Pilligua ⋅ Danna Xue ⋅ Javier Vazquez-Corral
In Room: ExHall D Poster Location: Poster #178 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UnCommon Objects in 3D
Xingchen Liu ⋅ Piyush Tayal ⋅ Jianyuan Wang ⋅ Jesus Zarzar ⋅ Tom Monnier ⋅ Konstantinos Tertikas ⋅ Jiali Duan ⋅ Antoine Toisoul ⋅ Jason Y. Zhang ⋅ Natalia Neverova ⋅ Andrea Vedaldi ⋅ Roman Shapovalov ⋅ David Novotny
In Room: ExHall D Poster Location: Poster #331 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Disentangled Pose and Appearance Guidance for Multi-Pose Generation
Tengfei Xiao ⋅ Yue Wu ⋅ Yuelong Li ⋅ Can Qin ⋅ Maoguo Gong ⋅ Qiguang Miao ⋅ Wenping Ma
In Room: ExHall D Poster Location: Poster #19 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Instant Adversarial Purification with Adversarial Consistency Distillation
Chun Tong Lei ⋅ Hon Ming Yam ⋅ Zhongliang Guo ⋅ Yifei Qian ⋅ Chun Pong Lau
In Room: ExHall D Poster Location: Poster #316 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Mask-Adapter: The Devil is in the Masks for Open-Vocabulary Segmentation
Yongkang Li ⋅ Tianheng Cheng ⋅ Bin Feng ⋅ Wenyu Liu ⋅ Xinggang Wang
In Room: ExHall D Poster Location: Poster #416 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MPDrive: Improving Spatial Understanding with Marker-Based Prompt Learning for Autonomous Driving
Zhi-Yuan Zhang ⋅ Xiaofan Li ⋅ Zhihao Xu ⋅ Wenjie Peng ⋅ Zijian Zhou ⋅ Miaojing Shi ⋅ Shuangping Huang
In Room: ExHall D Poster Location: Poster #139 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
Jiho Choi ⋅ Seonho Lee ⋅ Minhyun Lee ⋅ Seungho Lee ⋅ Hyunjung Shim
In Room: ExHall D Poster Location: Poster #420 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
NitroFusion: High-Fidelity Single-Step Diffusion through Dynamic Adversarial Training Project Page ↗
Dar-Yen Chen ⋅ Hmrishav Bandyopadhyay ⋅ Kai Zou ⋅ Yi-Zhe Song
In Room: ExHall D Poster Location: Poster #218 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CMMLoc: Advancing Text-to-PointCloud Localization with Cauchy-Mixture-Model Based Framework
Yanlong Xu ⋅ Haoxuan Qu ⋅ Jun Liu ⋅ Wenxiao Zhang ⋅ Xun Yang
In Room: ExHall D Poster Location: Poster #121 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Masked Point-Entity Contrast for Open-Vocabulary 3D Scene Understanding Project Page ↗
Yan Wang ⋅ Baoxiong Jia ⋅ Ziyu Zhu ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #333 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Decoupling Training-Free Guided Diffusion by ADMM
Youyuan Zhang ⋅ Zehua Liu ⋅ Zenan Li ⋅ Zhaoyu Li ⋅ James Clark ⋅ Xujie Si
In Room: ExHall D Poster Location: Poster #213 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SwiftEdit: Lightning Fast Text-Guided Image Editing via One-Step Diffusion Project Page ↗
Trong-Tung Nguyen ⋅ Quang Nguyen ⋅ Khoi Nguyen ⋅ Anh Tran ⋅ Cuong Pham
In Room: ExHall D Poster Location: Poster #42 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Deep Change Monitoring: A Hyperbolic Representative Learning Framework and a Dataset for Long-term Fine-grained Tree Change Detection
Yante Li ⋅ Hanwen Qi ⋅ Haoyu Chen ⋅ Liang Xinlian ⋅ Guoying Zhao
In Room: ExHall D Poster Location: Poster #114 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
Kai Wang ⋅ Mingjia Shi ⋅ YuKun Zhou ⋅ Zekai Li ⋅ Xiaojiang Peng ⋅ Zhihang Yuan ⋅ Yuzhang Shang ⋅ Hanwang Zhang ⋅ Yang You
In Room: ExHall D Poster Location: Poster #218 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Empowering LLMs to Understand and Generate Complex Vector Graphics
XiMing Xing ⋅ Juncheng Hu ⋅ Guotao Liang ⋅ Jing Zhang ⋅ Dong Xu ⋅ Qian Yu
In Room: ExHall D Poster Location: Poster #351 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding Project Page ↗
Hongjia Zhai ⋅ Hai Li ⋅ Zhenzhe Li ⋅ Xiaokun Pan ⋅ Yijia He ⋅ Guofeng Zhang
In Room: ExHall D Poster Location: Poster #332 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Watermarking One for All: A Robust Watermarking Scheme Against Partial Image Theft
Gaozhi Liu ⋅ Silu Cao ⋅ Zhenxing Qian ⋅ Xinpeng Zhang ⋅ Sheng Li ⋅ Wanli Peng
In Room: ExHall D Poster Location: Poster #272 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On Project Page ↗
Ji Woo Hong ⋅ Tri Ton ⋅ Trung X. Pham ⋅ Gwanhyeong Koo ⋅ Sunjae Yoon ⋅ Chang D. Yoo
In Room: ExHall D Poster Location: Poster #202 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VolFormer: Explore More Comprehensive Cube Interaction for Hyperspectral Image Restoration and Beyond
Dabing Yu ⋅ Zheng Gao
In Room: ExHall D Poster Location: Poster #183 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Recovering Dynamic 3D Sketches from Videos Project Page ↗
Jaeah Lee ⋅ Changwoon Choi ⋅ Young Min Kim ⋅ Jaesik Park
In Room: ExHall D Poster Location: Poster #169 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
IM-Zero: Instance-level Motion Controllable Video Generation in a Zero-shot Manner
Yuyang Huang ⋅ Yabo Chen ⋅ Li Ding ⋅ Xiaopeng Zhang ⋅ Wenrui Dai ⋅ Junni Zou ⋅ Hongkai Xiong ⋅ Qi Tian
In Room: ExHall D Poster Location: Poster #182 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
EigenGS Representation: From Eigenspace to Gaussian Image Space
LO-WEI TAI ⋅ Ching-En Ching En, Li ⋅ Cheng-Lin Chen ⋅ Chih-Jung Tsai ⋅ Hwann-Tzong Chen ⋅ Tyng-Luh Liu
In Room: ExHall D Poster Location: Poster #271 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SmartCLIP: Modular Vision-language Alignment with Identification Guarantees
Shaoan Xie ⋅ Lingjing Kong ⋅ Yujia Zheng ⋅ Yu Yao ⋅ Zeyu Tang ⋅ Eric P. Xing ⋅ Guangyi Chen ⋅ Kun Zhang
In Room: ExHall D Poster Location: Poster #348 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
UniMamba: Unified Spatial-Channel Representation Learning with Group-Efficient Mamba for LiDAR-based 3D Object Detection
Xin Jin ⋅ Haisheng Su ⋅ Kai Liu ⋅ CONG MA ⋅ Wei Wu ⋅ Fei HUI ⋅ Junchi Yan
In Room: ExHall D Poster Location: Poster #115 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MaSS13K: A Matting-level Semantic Segmentation Benchmark
Chenxi Xie ⋅ Minghan LI ⋅ Hui Zeng ⋅ Jun Luo ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #325 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EntropyMark: Towards More Harmless Backdoor Watermark via Entropy-based Constraint for Open-source Dataset Copyright Protection
Ming Sun ⋅ Rui Wang ⋅ Zixuan Zhu ⋅ Lihua Jing ⋅ Yuanfang Guo
In Room: ExHall D Poster Location: Poster #435 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Rethinking the Adversarial Robustness of Multi-Exit Neural Networks in an Attack-Defense Game
Keyizhi Xu ⋅ Chi Zhang ⋅ Zhan Chen ⋅ Zhongyuan Wang ⋅ Chunxia Xiao ⋅ Chao Liang
In Room: ExHall D Poster Location: Poster #466 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers Project Page ↗
Lei Chen ⋅ Yuan Meng ⋅ Chen Tang ⋅ Xinzhu Ma ⋅ Jingyan Jiang ⋅ Xin Wang ⋅ Zhi Wang ⋅ Wenwu Zhu
In Room: ExHall D Poster Location: Poster #204 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ROD-MLLM: Towards More Reliable Object Detection in Multimodal Large Language Models
Heng Yin ⋅ Yuqiang Ren ⋅ Ke Yan ⋅ Shouhong Ding ⋅ Yongtao Hao
In Room: ExHall D Poster Location: Poster #354 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors Project Page ↗
Haifeng Huang ⋅ Xinyi Chen ⋅ Yilun Chen ⋅ Hao Li ⋅ Xiaoshen Han ⋅ zehan wang ⋅ Tai Wang ⋅ Jiangmiao Pang ⋅ Zhou Zhao
In Room: ExHall D Poster Location: Poster #141 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VideoGuide: Improving Video Diffusion Models without Training Through a Teacher's Guide Project Page ↗
Dohun Lee ⋅ Bryan Sangwoo Kim ⋅ Geon Yeong Park ⋅ Jong Chul Ye
In Room: ExHall D Poster Location: Poster #233 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Improving Transferable Targeted Attacks with Feature Tuning Mixup Project Page ↗
Kaisheng Liang ⋅ Xuelong Dai ⋅ Yanjie Li ⋅ Dong Wang ⋅ Bin Xiao
In Room: ExHall D Poster Location: Poster #457 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OmniStereo: Real-time Omnidireactional Depth Estimation with Multiview Fisheye Cameras
Jiaxi Deng ⋅ Yushen Wang ⋅ Haitao Meng ⋅ Zuoxun Hou ⋅ Yi Chang ⋅ Gang Chen
In Room: ExHall D Poster Location: Poster #78 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DroneSplat: 3D Gaussian Splatting for Robust 3D Reconstruction from In-the-Wild Drone Imagery
Jiadong Tang ⋅ Yu Gao ⋅ Dianyi Yang ⋅ Liqi Yan ⋅ Yufeng Yue ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #62 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DrivingSphere: Building a High-fidelity 4D World for Closed-loop Simulation
Tianyi Yan ⋅ Dongming Wu ⋅ Wencheng Han ⋅ Junpeng Jiang ⋅ xia zhou ⋅ Kun Zhan ⋅ Cheng-Zhong Xu ⋅ Jianbing Shen
In Room: ExHall D Poster Location: Poster #131 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency
Yutong Wang ⋅ Jiajie Teng ⋅ Jiajiong Cao ⋅ Yuming Li ⋅ Chenguang Ma ⋅ Hongteng Xu ⋅ Dixin Luo
In Room: ExHall D Poster Location: Poster #189 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VELOCITI: Benchmarking Video-Language Compositional Reasoning with Strict Entailment
Darshana Saravanan ⋅ Varun Gupta ⋅ Darshan Singh S ⋅ Zeeshan Khan ⋅ Vineet Gandhi ⋅ Makarand Tapaswi
In Room: ExHall D Poster Location: Poster #298 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
Yiren Song ⋅ Pei Yang ⋅ Hai Ci ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #273 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Lessons and Insights from a Unifying Study of Parameter-Efficient Fine-Tuning (PEFT) in Visual Recognition Project Page ↗
Zheda Mai ⋅ Ping Zhang ⋅ Cheng-Hao Tu ⋅ Hong-You Chen ⋅ Quang-Huy Nguyen ⋅ Li Zhang ⋅ Wei-Lun Chao
In Room: ExHall D Poster Location: Poster #401 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
2DMamba: Efficient State Space Model for Image Representation with Applications on Giga-Pixel Whole Slide Image Classification Project Page ↗
Jingwei Zhang ⋅ Anh Tien Nguyen ⋅ Xi Han ⋅ Vincent Quoc-Huy Trinh ⋅ Hong Qin ⋅ Dimitris Samaras ⋅ Mahdi Hosseini
In Room: ExHall D Poster Location: Poster #325 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
H2ST: Hierarchical Two-Sample Tests for Continual Out-of-Distribution Detection
Yuhang Liu ⋅ Wenjie Zhao ⋅ Yunhui Guo
In Room: ExHall D Poster Location: Poster #456 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Bridge Frame and Event: Common Spatiotemporal Fusion for High-Dynamic Scene Optical Flow Project Page ↗
Hanyu Zhou ⋅ Haonan Wang ⋅ Haoyue Liu ⋅ Yuxing Duan ⋅ Yi Chang ⋅ Luxin Yan
In Room: ExHall D Poster Location: Poster #165 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EVPGS: Enhanced View Prior Guidance for Splatting-based Extrapolated View Synthesis Project Page ↗
Jiahe Li ⋅ Feiyu Wang ⋅ Xiaochao Qu ⋅ WU CHENGJING ⋅ Luoqi Liu ⋅ Ting Liu
In Room: ExHall D Poster Location: Poster #53 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
Yawen Shao ⋅ Wei Zhai ⋅ Yuhang Yang ⋅ Hongchen Luo ⋅ Yang Cao ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #147 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Inversion Circle Interpolation: Diffusion-based Image Augmentation for Data-scarce Classification
Yanghao Wang ⋅ Long Chen
In Room: ExHall D Poster Location: Poster #432 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MASH-VLM: Mitigating Action-Scene Hallucination in Video-LLMs through Disentangled Spatial-Temporal Representations
Kyungho Bae ⋅ Jinhyung Kim ⋅ Sihaeng Lee ⋅ Soonyoung Lee ⋅ Gunhee Lee ⋅ Jinwoo Choi
In Room: ExHall D Poster Location: Poster #296 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Unbiasing through Textual Descriptions: Mitigating Representation Bias in Video Benchmarks Project Page ↗
Nina Shvetsova ⋅ Arsha Nagrani ⋅ Bernt Schiele ⋅ Hilde Kuehne ⋅ Christian Rupprecht
In Room: ExHall D Poster Location: Poster #278 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Scene-Centric Unsupervised Panoptic Segmentation Project Page ↗
Oliver Hahn ⋅ Christoph Reich ⋅ Nikita Araslanov ⋅ Daniel Cremers ⋅ Christian Rupprecht ⋅ Stefan Roth
In Room: ExHall D Poster Location: Poster #330 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UWAV: Uncertainty-weighted Weakly-supervised Audio-Visual Video Parsing
Yung-Hsuan Lai ⋅ Janek Ebbers ⋅ Yu-Chiang Frank Wang ⋅ François Germain ⋅ Michael J. Jones ⋅ Moitreya Chatterjee
In Room: ExHall D Poster Location: Poster #278 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mosaic of Modalities: A Comprehensive Benchmark for Multimodal Graph Learning
Jing Zhu ⋅ Yuhang Zhou ⋅ Shengyi Qian ⋅ Zhongmou He ⋅ Tong Zhao ⋅ Neil Shah ⋅ Danai Koutra
In Room: ExHall D Poster Location: Poster #341 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement
Ian Huang ⋅ Yanan Bao ⋅ Karen Truong ⋅ Howard Zhou ⋅ Cordelia Schmid ⋅ Leonidas Guibas ⋅ Alireza Fathi
In Room: ExHall D Poster Location: Poster #269 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
Zhenxing Zhang ⋅ Yaxiong Wang ⋅ Lechao Cheng ⋅ Zhun Zhong ⋅ Dan Guo ⋅ Meng Wang
In Room: ExHall D Poster Location: Poster #365 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MITracker: Multi-View Integration for Visual Object Tracking Project Page ↗
Mengjie Xu ⋅ Yitao Zhu ⋅ Haotian Jiang ⋅ Jiaming Li ⋅ Zhenrong Shen ⋅ Sheng Wang ⋅ Haolin Huang ⋅ Xinyu Wang ⋅ Han Zhang ⋅ Qing Yang ⋅ Qian Wang
In Room: ExHall D Poster Location: Poster #98 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dual Diffusion for Unified Image Generation and Understanding
Zijie Li ⋅ Henry Li ⋅ Yichun Shi ⋅ Amir Barati Farimani ⋅ Yuval Kluger ⋅ Linjie Yang ⋅ Peng Wang
In Room: ExHall D Poster Location: Poster #251 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Layered Motion Fusion: Lifting Motion Segmentation to 3D in Egocentric Videos
Vadim Tschernezki ⋅ Diane Larlus ⋅ Andrea Vedaldi ⋅ Iro Laina
In Room: ExHall D Poster Location: Poster #175 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FADE: Frequency-Aware Diffusion Model Factorization for Video Editing
Yixuan Zhu ⋅ Haolin Wang ⋅ Shilin Ma ⋅ Wenliang Zhao ⋅ Yansong Tang ⋅ Lei Chen ⋅ Jie Zhou
In Room: ExHall D Poster Location: Poster #216 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MotiF: Making Text Count in Image Animation with Motion Focal Loss Project Page ↗
Shijie Wang ⋅ Samaneh Azadi ⋅ Rohit Girdhar ⋅ Sai Saketh Rambhatla ⋅ Chen Sun ⋅ Xi Yin
In Room: ExHall D Poster Location: Poster #230 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Data Synthesis with Diverse Styles for Face Recognition via 3DMM-Guided Diffusion
Yuxi Mi ⋅ Zhizhou Zhong ⋅ Yuge Huang ⋅ Qiuyang Yuan ⋅ Xuan Zhao ⋅ Jianqing Xu ⋅ Shouhong Ding ⋅ ShaoMing Wang ⋅ Rizen Guo ⋅ Shuigeng Zhou
In Room: ExHall D Poster Location: Poster #15 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Uncertainty-guided Perturbation for Image Super-Resolution Diffusion Model
Leheng Zhang ⋅ Weiyi You ⋅ Kexuan Shi ⋅ Shuhang Gu
In Room: ExHall D Poster Location: Poster #207 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
StoryGPT-V: Large Language Models as Consistent Story Visualizers Project Page ↗
Xiaoqian Shen ⋅ Mohamed Elhoseiny
In Room: ExHall D Poster Location: Poster #250 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing
Jinlu Zhang ⋅ Yixin Chen ⋅ Zan Wang ⋅ Jie Yang ⋅ Yizhou Wang ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #157 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Human-Understandable Multi-Dimensional Concept Discovery
Arne Grobrügge ⋅ Niklas Kühl ⋅ Gerhard Satzger ⋅ Philipp Spitzer
In Room: ExHall D Poster Location: Poster #402 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
Tong Wang ⋅ Ting Liu ⋅ Xiaochao Qu ⋅ WU CHENGJING ⋅ Luoqi Liu ⋅ Xiaolin Hu
In Room: ExHall D Poster Location: Poster #225 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Perturb-and-Revise: Flexible 3D Editing with Generative Trajectories Project Page ↗
Susung Hong ⋅ Johanna Suvi Karras ⋅ Ricardo Martin ⋅ Ira Kemelmacher-Shlizerman
In Room: ExHall D Poster Location: Poster #42 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Compatible Multi-Prize Subnetworks for Asymmetric Retrieval
Yushuai Sun ⋅ Zikun Zhou ⋅ Dongmei Jiang ⋅ Yaowei Wang ⋅ Jun Yu ⋅ Guangming Lu ⋅ Wenjie Pei
In Room: ExHall D Poster Location: Poster #441 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CLIP Under the Microscope: A Fine-Grained Analysis of Multi-Object Representation
Reza Abbasi ⋅ Ali Nazari ⋅ Aminreza Sefid ⋅ Mohammadali Banayeeanzade ⋅ Mohammad Rohban ⋅ Mahdieh Baghshah
In Room: ExHall D Poster Location: Poster #375 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MetricGrids: Arbitrary Nonlinear Approximation with Elementary Metric Grids based Implicit Neural Representation
Shu Wang ⋅ Yanbo Gao ⋅ Shuai Li ⋅ Chong Lv ⋅ Xun Cai ⋅ chuankun Li ⋅ Hui Yuan ⋅ jinglin zhang
In Room: ExHall D Poster Location: Poster #32 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FoundationStereo: Zero-Shot Stereo Matching
Bowen Wen ⋅ Matthew Trepte ⋅ Oluwaseun Joseph Aribido ⋅ Jan Kautz ⋅ Orazio Gallo ⋅ Stan Birchfield
In Room: ExHall D Poster Location: Poster #81 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Low-Biased General Annotated Dataset Generation Project Page ↗
Dengyang Jiang ⋅ Haoyu Wang ⋅ Lei Zhang ⋅ Wei Wei ⋅ Guang Dai ⋅ Mengmeng Wang ⋅ Jingdong Wang ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #389 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Deterministic Image-to-Image Translation via Denoising Brownian Bridge Models with Dual Approximators
Bohan Xiao ⋅ PEIYONG WANG ⋅ Qisheng He ⋅ Ming Dong
In Room: ExHall D Poster Location: Poster #197 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ADD: Attribution-Driven Data Augmentation Framework for Boosting Image Super-Resolution
Zeyu Mi ⋅ Yu-Bin Yang
In Room: ExHall D Poster Location: Poster #194 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Toward Generalized Image Quality Assessment: Relaxing the Perfect Reference Quality Assumption Project Page ↗
Du CHEN ⋅ Tianhe Wu ⋅ Kede Ma ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #200 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Explaining Domain Shifts in Language: Concept Erasing for Interpretable Image Classification
Zequn Zeng ⋅ Yudi Su ⋅ Jianqiao Sun ⋅ Tiansheng Wen ⋅ Hao Zhang ⋅ Zhengjue Wang ⋅ Bo Chen ⋅ Hongwei Liu ⋅ Jiawei Ma
In Room: ExHall D Poster Location: Poster #395 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Hazy Low-Quality Satellite Video Restoration Via Learning Optimal Joint Degradation Patterns and Continuous-Scale Super-Resolution Reconstruction
Ning Ni ⋅ Libao Zhang
In Room: ExHall D Poster Location: Poster #195 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Textured Gaussians for Enhanced 3D Scene Appearance Modeling
Brian Chao ⋅ Hung-Yu Tseng ⋅ Lorenzo Porzi ⋅ Chen Gao ⋅ Tuotuo Li ⋅ Qinbo Li ⋅ Ayush Saraf ⋅ Jia-Bin Huang ⋅ Johannes Kopf ⋅ Gordon Wetzstein ⋅ Changil Kim
In Room: ExHall D Poster Location: Poster #344 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GFlowVLM: Enhancing Multi-step Reasoning in Vision-Language Models with Generative Flow Networks
Haoqiang Kang ⋅ Enna Sachdeva ⋅ Piyush Gupta ⋅ Sangjae Bae ⋅ Kwonjoon Lee
In Room: ExHall D Poster Location: Poster #347 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics Project Page ↗
Chan Hee Song ⋅ Valts Blukis ⋅ Jonathan Tremblay ⋅ Stephen Tyree ⋅ Yu Su ⋅ Stan Birchfield
In Room: ExHall D Poster Location: Poster #146 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Segment Any-Quality Images with Generative Latent Space Enhancement
Guangqian Guo ⋅ Yong Guo ⋅ Xuehui Yu ⋅ Wenbo Li ⋅ Yaoxing Wang ⋅ Shan Gao
In Room: ExHall D Poster Location: Poster #207 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BG-Triangle: Bézier Gaussian Triangle for 3D Vectorization and Rendering Project Page ↗
Minye Wu ⋅ Haizhao Dai ⋅ Kaixin Yao ⋅ Jingyi Yu ⋅ Tinne Tuytelaars
In Room: ExHall D Poster Location: Poster #33 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Multi-subject Open-set Personalization in Video Generation Project Page ↗
Tsai-Shien Chen ⋅ Aliaksandr Siarohin ⋅ Willi Menapace ⋅ Yuwei Fang ⋅ Kwot Sin Lee ⋅ Ivan Skorokhodov ⋅ Kfir Aberman ⋅ Jun-Yan Zhu ⋅ Ming-Hsuan Yang ⋅ Sergey Tulyakov
In Room: ExHall D Poster Location: Poster #63 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TKG-DM: Training-free Chroma Key Content Generation Diffusion Model Project Page ↗
Ryugo Morita ⋅ Stanislav Frolov ⋅ Brian Bernhard Moser ⋅ Takahiro Shirakawa ⋅ Ko Watanabe ⋅ Andreas Dengel ⋅ Jinjia Zhou
In Room: ExHall D Poster Location: Poster #227 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Lift3D Policy: Lifting 2D Foundation Models for Robust 3D Robotic Manipulation
Yueru Jia ⋅ Jiaming Liu ⋅ Sixiang Chen ⋅ Chenyang Gu ⋅ Zhilve Wang ⋅ Xiaoqi Li ⋅ Longzan Luo ⋅ Pengwei Wang ⋅ Renrui Zhang ⋅ Zhongyuan Wang ⋅ Shanghang Zhang
In Room: ExHall D Poster Location: Poster #149 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
On the Generalization of Handwritten Text Recognition Models
Carlos Garrido-Munoz ⋅ Jorge Calvo-Zaragoza
In Room: ExHall D Poster Location: Poster #443 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
From Sparse to Dense: Camera Relocalization with Scene-Specific Detector from Feature Gaussian Splatting Project Page ↗
Zhiwei Huang ⋅ Hailin Yu ⋅ Yichun Shentu ⋅ Jin Yuan ⋅ Guofeng Zhang
In Room: ExHall D Poster Location: Poster #87 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CityWalker: Learning Embodied Urban Navigation from Web-Scale Videos Project Page ↗
Xinhao Liu ⋅ Jintong Li ⋅ Yicheng Jiang ⋅ Niranjan Sujay ⋅ Zhicheng Yang ⋅ Juexiao Zhang ⋅ John Abanes ⋅ Jing Zhang ⋅ Chen Feng
In Room: ExHall D Poster Location: Poster #144 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Simple yet Effective Layout Token in Large Language Models for Document Understanding
Zhaoqing Zhu ⋅ Chuwei Luo ⋅ Zirui Shao ⋅ Feiyu Gao ⋅ Hangdi Xing ⋅ Qi Zheng ⋅ Ji Zhang
In Room: ExHall D Poster Location: Poster #365 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models
Jingfeng Yao ⋅ Bin Yang ⋅ Xinggang Wang
In Room: ExHall D Poster Location: Poster #371 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OODD: Test-time Out-of-Distribution Detection with Dynamic Dictionary Project Page ↗
Yifeng Yang ⋅ Lin Zhu ⋅ Zewen Sun ⋅ Hengyu Liu ⋅ Qinying Gu ⋅ Nanyang Ye
In Room: ExHall D Poster Location: Poster #429 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BIMBA: Selective-Scan Compression for Long-Range Video Question Answering
Md Mohaiminul Islam ⋅ Tushar Nagarajan ⋅ Huiyu Wang ⋅ Gedas Bertasius ⋅ Lorenzo Torresani
In Room: ExHall D Poster Location: Poster #282 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Diff2Flow: Training Flow Matching Models via Diffusion Model Alignment
Johannes Schusterbauer ⋅ Ming Gui ⋅ Frank Fundel ⋅ Björn Ommer
In Room: ExHall D Poster Location: Poster #208 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation Project Page ↗
Yiyang Ma ⋅ Xingchao Liu ⋅ Xiaokang Chen ⋅ Wen Liu ⋅ Chengyue Wu ⋅ Zhiyu Wu ⋅ Zizheng Pan ⋅ Zhenda Xie ⋅ Haowei Zhang ⋅ Xingkai Yu ⋅ Liang Zhao ⋅ Yisong Wang ⋅ Jiaying Liu ⋅ Chong Ruan
In Room: ExHall D Poster Location: Poster #227 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Visual Prompting for One-shot Controllable Video Editing without Inversion
Zhengbo Zhang ⋅ Yuxi Zhou ⋅ DUO PENG ⋅ Joo Lim ⋅ Zhigang Tu ⋅ De Soh Soh ⋅ Lin Geng Foo
In Room: ExHall D Poster Location: Poster #231 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MegaSynth: Scaling Up 3D Scene Reconstruction with Synthesized Data
Hanwen Jiang ⋅ Zexiang Xu ⋅ Desai Xie ⋅ Chen Ziwen ⋅ Haian Jin ⋅ Fujun Luan ⋅ ZHIXIN SHU ⋅ Kai Zhang ⋅ Sai Bi ⋅ Xin Sun ⋅ Jiuxiang Gu ⋅ Qixing Huang ⋅ Georgios Pavlakos ⋅ Hao Tan
In Room: ExHall D Poster Location: Poster #57 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Prof. Robot: Differentiable Robot Rendering Without Static and Self-Collisions Project Page ↗
Quanyuan Ruan ⋅ Jiabao Lei ⋅ Wenhao Yuan ⋅ Yanglin Zhang ⋅ Dekun Lu ⋅ Guiliang Liu ⋅ Kui Jia
In Room: ExHall D Poster Location: Poster #143 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Flash-Split: 2D Reflection Removal with Flash Cues and Latent Diffusion Separation
Tianfu Wang ⋅ Mingyang Xie ⋅ Haoming Cai ⋅ Sachin Shah ⋅ Christopher Metzler
In Room: ExHall D Poster Location: Poster #23 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Attention IoU: Examining Biases in CelebA using Attention Maps Project Page ↗
Aaron Serianni ⋅ Tyler Zhu ⋅ Olga Russakovsky ⋅ Vikram V. Ramaswamy
In Room: ExHall D Poster Location: Poster #405 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Segment Any Motion in Videos
Nan Huang ⋅ Wenzhao Zheng ⋅ Chenfeng Xu ⋅ Kurt Keutzer ⋅ Shanghang Zhang ⋅ Angjoo Kanazawa ⋅ Qianqian Wang
In Room: ExHall D Poster Location: Poster #309 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HandOS: 3D Hand Reconstruction in One Stage Project Page ↗
Xingyu Chen ⋅ Zhuheng Song ⋅ Xiaoke Jiang ⋅ Yaoqing Hu ⋅ Junzhi Yu ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #142 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Task-aware Cross-modal Feature Refinement Transformer with Large Language Models for Visual Grounding
Wenbo Chen ⋅ Zhen Xu ⋅ Ruotao Xu ⋅ Si Wu ⋅ Hau San Wong
In Room: ExHall D Poster Location: Poster #358 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CGMatch: A Different Perspective of Semi-supervised Learning
Bo Cheng ⋅ Jueqing Lu ⋅ Yuan Tian ⋅ Haifeng Zhao ⋅ Yi Chang ⋅ Lan Du
In Room: ExHall D Poster Location: Poster #453 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ChatHuman: Chatting about 3D Humans with Tools Project Page ↗
Jing Lin ⋅ Yao Feng ⋅ Weiyang Liu ⋅ Michael J. Black
In Room: ExHall D Poster Location: Poster #265 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Leveraging Temporal Cues for Semi-Supervised Multi-View 3D Object Detection
Jinhyung Park ⋅ Navyata Sanghvi ⋅ Hiroki Adachi ⋅ Yoshihisa Shibata ⋅ Shawn Hunt ⋅ Shinya Tanaka ⋅ Hironobu Fujiyioshi ⋅ Kris Kitani
In Room: ExHall D Poster Location: Poster #119 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reconciling Stochastic and Deterministic Strategies for Zero-shot Image Restoration using Diffusion Model in Dual
Chong Wang ⋅ Lanqing Guo ⋅ Zixuan Fu ⋅ SIYUAN YANG ⋅ Hao Cheng ⋅ Alex C. Kot ⋅ Bihan Wen
In Room: ExHall D Poster Location: Poster #205 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Boosting Point-Supervised Temporal Action Localization through Integrating Query Reformation and Optimal Transport
Mengnan Liu ⋅ Le Wang ⋅ Sanping Zhou ⋅ Kun Xia ⋅ Xiaolong Sun ⋅ Gang Hua
In Room: ExHall D Poster Location: Poster #307 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hierarchical Flow Diffusion for Efficient Frame Interpolation
Yang Hai ⋅ Guo Wang ⋅ Tan Su ⋅ jerett ⋅ Yinlin Hu
In Room: ExHall D Poster Location: Poster #179 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval Project Page ↗
Davide Caffagni ⋅ Sara Sarto ⋅ Marcella Cornia ⋅ Lorenzo Baraldi ⋅ Rita Cucchiara
In Room: ExHall D Poster Location: Poster #373 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Camouflage Anything: Learning to Hide using Controlled Out-painting and Representation Engineering
Biplab Das ⋅ Viswanath Gopalakrishnan
In Room: ExHall D Poster Location: Poster #327 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Test-Time Fine-Tuning of Image Compression Models for Multi-Task Adaptability
Unki Park ⋅ Seongmoon Jeong ⋅ Jang Youngchan ⋅ Gyeong-Moon Park ⋅ Jong Hwan Ko
In Room: ExHall D Poster Location: Poster #409 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BASKET: A Large-Scale Video Dataset for Fine-Grained Skill Estimation
Yulu Pan ⋅ Ce Zhang ⋅ Gedas Bertasius
In Room: ExHall D Poster Location: Poster #267 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AniDoc: Animation Creation Made Easier
Yihao Meng ⋅ Hao Ouyang ⋅ Hanlin Wang ⋅ Qiuyu Wang ⋅ Wen Wang ⋅ Ka Leong Cheng ⋅ Zhiheng Liu ⋅ Yujun Shen ⋅ Huamin Qu
In Room: ExHall D Poster Location: Poster #227 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DynPose: Largely Improving the Efficiency of Human Pose Estimation by a Simple Dynamic Framework
Yalong Xu ⋅ Lin Zhao ⋅ Chen Gong ⋅ Guangyu Li ⋅ Di Wang ⋅ Nannan Wang
In Room: ExHall D Poster Location: Poster #92 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Dynamic Neural Surfaces for Elastic 4D Shape Representation and Analysis Project Page ↗
Awais Nizamani ⋅ Hamid Laga ⋅ Guanjin Wang ⋅ Farid Boussaid ⋅ Mohammed Bennamoun ⋅ Anuj Srivastava
In Room: ExHall D Poster Location: Poster #70 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Spk2SRImgNet: Super-Resolve Dynamic Scene from Spike Stream via Motion Aligned Collaborative Filtering
Yuanlin Wang ⋅ Yiyang Zhang ⋅ Ruiqin Xiong ⋅ Jing Zhao ⋅ Jian Zhang ⋅ Xiaopeng Fan ⋅ Tiejun Huang
In Room: ExHall D Poster Location: Poster #72 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ComfyBench: Benchmarking LLM-based Agents in ComfyUI for Autonomously Designing Collaborative AI Systems Project Page ↗
Xiangyuan Xue ⋅ Zeyu Lu ⋅ Di Huang ⋅ ZiDong Wang ⋅ Wanli Ouyang ⋅ Lei Bai
In Room: ExHall D Poster Location: Poster #343 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VideoGLaMM : A Large Multimodal Model for Pixel-Level Visual Grounding in Videos Project Page ↗
Shehan Munasinghe ⋅ Hanan Gani ⋅ Wenqi Zhu ⋅ Jiale Cao ⋅ Eric P. Xing ⋅ Fahad Shahbaz Khan ⋅ Salman Khan
In Room: ExHall D Poster Location: Poster #309 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
TaoAvatar: Real-Time Lifelike Full-Body Talking Avatars for Augmented Reality via 3D Gaussian Splatting Project Page ↗
Jianchuan Chen ⋅ Jingchuan Hu ⋅ Gaige Wang ⋅ Zhonghua Jiang ⋅ Tiansong Zhou ⋅ Zhiwen Chen ⋅ Chengfei Lv
In Room: ExHall D Poster Location: Poster #7 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Uni4D: Unifying Visual Foundation Models for 4D Modeling from a Single Video Project Page ↗
David Yifan Yao ⋅ Albert J. Zhai ⋅ Shenlong Wang
In Room: ExHall D Poster Location: Poster #88 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DiffLocks: Generating 3D Hair from a Single Image using Diffusion Models Project Page ↗
Radu Alexandru Rosu ⋅ Keyu Wu ⋅ Yao Feng ⋅ Youyi Zheng ⋅ Michael J. Black
In Room: ExHall D Poster Location: Poster #18 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hyperbolic Category Discovery
Yuanpei Liu ⋅ Zhenqi He ⋅ Kai Han
In Room: ExHall D Poster Location: Poster #430 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CALICO: Part-Focused Semantic Co-Segmentation with Large Vision-Language Models Project Page ↗
Kiet A. Nguyen ⋅ Adheesh Juvekar ⋅ Tianjiao Yu ⋅ Muntasir Wahed ⋅ Ismini Lourentzou
In Room: ExHall D Poster Location: Poster #420 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Cross-modal Causal Relation Alignment for Video Question Grounding
weixing chen ⋅ Yang Liu ⋅ Binglin Chen ⋅ Jiandong Su ⋅ Yongsen Zheng ⋅ Liang Lin
In Room: ExHall D Poster Location: Poster #293 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Harnessing Frequency Spectrum Insights for Image Copyright Protection Against Diffusion Models
Zhenguang Liu ⋅ Chao Shuai ⋅ Shaojing Fan ⋅ Ziping Dong ⋅ Jinwu Hu ⋅ Zhongjie Ba ⋅ Kui Ren
In Room: ExHall D Poster Location: Poster #274 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning to Detect Objects from Multi-Agent LiDAR Scans without Manual Labels
Qiming Xia ⋅ Wenkai Lin ⋅ Haoen Xiang ⋅ Xun Huang ⋅ Siheng Chen ⋅ Zhen Dong ⋅ Cheng Wang ⋅ Chenglu Wen
In Room: ExHall D Poster Location: Poster #116 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DeepLA-Net: Very Deep Local Aggregation Networks for Point Cloud Analysis Project Page ↗
Ziyin Zeng ⋅ Mingyue Dong ⋅ Jian Zhou ⋅ Huan Qiu ⋅ Zhen Dong ⋅ Man Luo ⋅ Bijun Li
In Room: ExHall D Poster Location: Poster #108 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Action Detail Matters: Refining Video Recognition with Local Action Queries
Mengmeng Wang ⋅ Zeyi Huang ⋅ Xiangjie Kong ⋅ Guojiang Shen ⋅ Guang Dai ⋅ Jingdong Wang ⋅ Yong Liu
In Room: ExHall D Poster Location: Poster #318 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
StdGEN: Semantic-Decomposed 3D Character Generation from Single Images
Yuze He ⋅ Yanning Zhou ⋅ Wang Zhao ⋅ Zhongkai Wu ⋅ Kaiwen Xiao ⋅ Yang Wei ⋅ Yong-Jin Liu ⋅ Xiao Han
In Room: ExHall D Poster Location: Poster #15 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving
Bencheng Liao ⋅ Shaoyu Chen ⋅ haoran yin ⋅ Bo Jiang ⋅ Cheng Wang ⋅ Sixu Yan ⋅ xinbang zhang ⋅ Xiangyu Li ⋅ ying zhang ⋅ Qian Zhang ⋅ Xinggang Wang
In Room: ExHall D Poster Location: Poster #134 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Maintaining Consistent Inter-Class Topology in Continual Test-Time Adaptation
Chenggong Ni ⋅ Fan Lyu ⋅ Jiayao Tan ⋅ Fuyuan Hu ⋅ Rui Yao ⋅ Tao Zhou
In Room: ExHall D Poster Location: Poster #447 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
UniVAD: A Training-free Unified Model for Few-shot Visual Anomaly Detection Project Page ↗
Zhaopeng Gu ⋅ Bingke Zhu ⋅ Guibo Zhu ⋅ Yingying Chen ⋅ Ming Tang ⋅ Jinqiao Wang
In Room: ExHall D Poster Location: Poster #435 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FFR: Frequency Feature Rectification for Weakly Supervised Semantic Segmentation
Ziqian Yang ⋅ Xinqiao Zhao ⋅ Xiaolei Wang ⋅ Quan Zhang ⋅ Jimin Xiao
In Room: ExHall D Poster Location: Poster #394 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Video-XL: Extra-Long Vision Language Model for Hour-Scale Video Understanding
Yan Shu ⋅ Zheng Liu ⋅ Peitian Zhang ⋅ Minghao Qin ⋅ Junjie Zhou ⋅ Zhengyang Liang ⋅ Tiejun Huang ⋅ Bo Zhao
In Room: ExHall D Poster Location: Poster #339 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reconstructing In-the-Wild Open-Vocabulary Human-Object Interactions
Boran Wen ⋅ Dingbang Huang ⋅ Zichen Zhang ⋅ Jiahong Zhou ⋅ Jianbin Deng ⋅ Jingyu Gong ⋅ Yulong Chen ⋅ Lizhuang Ma ⋅ Yonglu Li
In Room: ExHall D Poster Location: Poster #156 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Playing the Fool: Jailbreaking LLMs and Multimodal LLMs with Out-of-Distribution Strategy
Joonhyun Jeong ⋅ Seyun Bae ⋅ Yeonsung Jung ⋅ Jaeryong Hwang ⋅ Eunho Yang
In Room: ExHall D Poster Location: Poster #362 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Sonata: Self-Supervised Learning of Reliable Point Representations
Xiaoyang Wu ⋅ Daniel DeTone ⋅ Duncan Frost ⋅ TIANWEI SHEN ⋅ Chris Xie ⋅ Nan Yang ⋅ Jakob Engel ⋅ Richard Newcombe ⋅ Hengshuang Zhao ⋅ Julian Straub
In Room: ExHall D Poster Location: Poster #109 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
COSMIC: Clique-Oriented Semantic Multi-space Integration for Robust CLIP Test-Time Adaptation Project Page ↗
Fanding Huang ⋅ Jingyan Jiang ⋅ Qinting Jiang ⋅ Li Hebei ⋅ Faisal Nadeem Khan ⋅ Zhi Wang
In Room: ExHall D Poster Location: Poster #419 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DriveGEN: Generalized and Robust 3D Detection in Driving via Controllable Text-to-Image Diffusion Generation
Hongbin Lin ⋅ Zilu Guo ⋅ Yifan Zhang ⋅ Shuaicheng Niu ⋅ Yafeng Li ⋅ Ruimao Zhang ⋅ Shuguang Cui ⋅ Zhen Li
In Room: ExHall D Poster Location: Poster #128 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Training-free Dense-Aligned Diffusion Guidance for Modular Conditional Image Synthesis
Zixuan Wang ⋅ DUO PENG ⋅ Feng Chen ⋅ Yuwei Yang ⋅ Yinjie Lei
In Room: ExHall D Poster Location: Poster #237 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
h-Edit: Effective and Flexible Diffusion-Based Editing via Doob's h-Transform Project Page ↗
Toan Nguyen ⋅ Kien Do ⋅ Duc Kieu ⋅ Thin Nguyen
In Room: ExHall D Poster Location: Poster #222 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VideoSPatS: Video SPatiotemporal Splines for Disentangled Occlusion, Appearance and Motion Modeling and Editing Project Page ↗
Juan Luis Gonzalez Bello ⋅ Xu Yao ⋅ Alex Whelan ⋅ Kyle Olszewski ⋅ Hyeongwoo Kim ⋅ Pablo Garrido
In Room: ExHall D Poster Location: Poster #175 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Online Video Understanding: OVBench and VideoChat-Online Project Page ↗
Zhenpeng Huang ⋅ Xinhao Li ⋅ Jiaqi Li ⋅ Jing Wang ⋅ Xiangyu Zeng ⋅ Cheng Liang ⋅ Tao Wu ⋅ Xi Chen ⋅ Liang Li ⋅ Limin Wang
In Room: ExHall D Poster Location: Poster #302 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
T2ICount: Enhancing Cross-modal Understanding for Zero-Shot Counting
Yifei Qian ⋅ Zhongliang Guo ⋅ Bowen Deng ⋅ Chun Tong Lei ⋅ Shuai Zhao ⋅ Chun Pong Lau ⋅ Xiaopeng Hong ⋅ Michael Pound
In Room: ExHall D Poster Location: Poster #410 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
TADFormer: Task-Adaptive Dynamic TransFormer for Efficient Multi-Task Learning
Seungmin Baek ⋅ Soyul Lee ⋅ Hayeon Jo ⋅ Hyesong Choi ⋅ Dongbo Min
In Room: ExHall D Poster Location: Poster #402 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Unified Approach to Interpreting Self-supervised Pre-training Methods for 3D Point Clouds via Interactions
Qiang Li ⋅ Jian Ruan ⋅ Fanghao Wu ⋅ Yuchi Chen ⋅ Zhihua Wei ⋅ Wen Shen
In Room: ExHall D Poster Location: Poster #111 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Enhancing SAM with Efficient Prompting and Preference Optimization for Semi-supervised Medical Image Segmentation
Aishik Konwer ⋅ Zhijian Yang ⋅ Erhan Bas ⋅ Cao Xiao ⋅ Prateek Prasanna ⋅ Parminder Bhatia ⋅ Taha Kass-Hout
In Room: ExHall D Poster Location: Poster #456 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CamPoint: Boosting Point Cloud Segmentation with Virtual Camera
Jianhui Zhang ⋅ Luo Yizhi ⋅ Zicheng Zhang ⋅ Xuecheng Nie ⋅ Bonan Li
In Room: ExHall D Poster Location: Poster #114 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Generalizable Scene Change Detection Project Page ↗
Jae-Woo KIM ⋅ Ue-Hwan Kim
In Room: ExHall D Poster Location: Poster #328 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions Project Page ↗
Faridoun Mehri ⋅ Mahdieh Baghshah ⋅ Mohammad Taher Pilehvar
In Room: ExHall D Poster Location: Poster #397 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LightLoc: Learning Outdoor LiDAR Localization at Light Speed
Wen Li ⋅ Chen Liu ⋅ Shangshu Yu ⋅ dq Liu ⋅ Yin Zhou ⋅ Siqi Shen ⋅ Chenglu Wen ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #125 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MERGE: Multi-faceted Hierarchical Graph-based GNN for Gene Expression Prediction from Whole Slide Histopathology Images Project Page ↗
Aniruddha Ganguly ⋅ Debolina Chatterjee ⋅ Wentao Huang ⋅ Jie Zhang ⋅ Alisa Yurovsky ⋅ Travis Steele Johnson ⋅ Chao Chen
In Room: ExHall D Poster Location: Poster #475 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
D^3-Human: Dynamic Disentangled Digital Human from Monocular Video
Honghu Chen ⋅ Bo Peng ⋅ Yunfan Tao ⋅ Juyong Zhang
In Room: ExHall D Poster Location: Poster #17 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Open Ad-hoc Categorization with Contextualized Feature Learning Project Page ↗
Zilin Wang ⋅ Sangwoo Mo ⋅ Stella X. Yu ⋅ Sima Behpour ⋅ Liu Ren
In Room: ExHall D Poster Location: Poster #427 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Accurate Differential Operators for Hybrid Neural Fields Project Page ↗
Aditya Chetan ⋅ Guandao Yang ⋅ Zichen Wang ⋅ Steve Marschner ⋅ Bharath Hariharan
In Room: ExHall D Poster Location: Poster #34 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Decoupling Fine Detail and Global Geometry for Compressed Depth Map Super-Resolution
Huan Zheng ⋅ Wencheng Han ⋅ Jianbing Shen
In Room: ExHall D Poster Location: Poster #73 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Seeing What Matters: Empowering CLIP with Patch Generation-to-Selection
Gensheng Pei ⋅ Tao Chen ⋅ Yujia Wang ⋅ Xinhao Cai ⋅ Xiangbo Shu ⋅ Tianfei Zhou ⋅ Yazhou Yao
In Room: ExHall D Poster Location: Poster #366 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Classifier-guided CLIP Distillation for Unsupervised Multi-label Classification
Dongseob Kim ⋅ Hyunjung Shim
In Room: ExHall D Poster Location: Poster #430 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UMotion: Uncertainty-driven Human Motion Estimation from Inertial and Ultra-wideband Units
Huakun Liu ⋅ Hiroki Ota ⋅ Xin Wei ⋅ Yutaro Hirao ⋅ Monica Perusquia-Hernandez ⋅ Hideaki Uchiyama ⋅ Kiyoshi Kiyokawa
In Room: ExHall D Poster Location: Poster #165 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
STEREO: A Two-Stage Framework for Adversarially Robust Concept Erasing from Text-to-Image Diffusion Models
Koushik Srivatsan ⋅ Fahad Shamshad ⋅ Muzammal Naseer ⋅ Vishal M. Patel ⋅ Karthik Nandakumar
In Room: ExHall D Poster Location: Poster #263 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CAP-Net: A Unified Network for 6D Pose and Size Estimation of Categorical Articulated Parts from a Single RGB-D Image
Jingshun Huang ⋅ Haitao Lin ⋅ Tianyu Wang ⋅ Yanwei Fu ⋅ Xiangyang Xue ⋅ Yi Zhu
In Room: ExHall D Poster Location: Poster #97 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Do We Really Need Curated Malicious Data for Safety Alignment in Multi-modal Large Language Models?
Yanbo Wang ⋅ Jiyang Guan ⋅ Jian Liang ⋅ Ran He
In Room: ExHall D Poster Location: Poster #388 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Plug-and-Play PPO: An Adaptive Point Prompt Optimizer Making SAM Greater
Xueyu Liu ⋅ Rui Wang ⋅ Yexin Lai ⋅ Guangze Shi ⋅ Feixue Shao ⋅ Fang Hao ⋅ Jianan Zhang ⋅ Jia Shen ⋅ Yongfei Wu ⋅ Wen Zheng
In Room: ExHall D Poster Location: Poster #400 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Harnessing Global-Local Collaborative Adversarial Perturbation for Anti-Customization
Long Xu ⋅ Jiakai Wang ⋅ Haojie Hao ⋅ Haotong Qin ⋅ Jiejie Zhao ⋅ Xianglong Liu
In Room: ExHall D Poster Location: Poster #264 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EchoONE: Segmenting Multiple Echocardiography Planes in One Model
Jiongtong Hu ⋅ Wei Zhuo ⋅ Jun Cheng ⋅ YINGYING LIU ⋅ Wufeng Xue ⋅ Dong Ni
In Room: ExHall D Poster Location: Poster #482 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Acc3D: Accelerating Single Image to 3D Diffusion Models via Edge Consistency Guided Score Distillation
Kendong Liu ⋅ Zhiyu Zhu ⋅ Hui LIU ⋅ Junhui Hou
In Room: ExHall D Poster Location: Poster #212 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild Project Page ↗
Yumeng Liu ⋅ Xiaoxiao Long ⋅ Zemin Yang ⋅ Yuan Liu ⋅ Marc Habermann ⋅ Christian Theobalt ⋅ Yuexin Ma ⋅ Wenping Wang
In Room: ExHall D Poster Location: Poster #160 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MVSAnywhere: Zero-Shot Multi-View Stereo
Sergio Izquierdo ⋅ Mohamed Sayed ⋅ Michael Firman ⋅ Guillermo Garcia-Hernando ⋅ Daniyar Turmukhambetov ⋅ Javier Civera ⋅ Oisin Mac Aodha ⋅ Gabriel Brostow ⋅ Jamie Watson
In Room: ExHall D Poster Location: Poster #81 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception
ruotian peng ⋅ Haiying He ⋅ Yake Wei ⋅ Yandong Wen ⋅ Di Hu
In Room: ExHall D Poster Location: Poster #361 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Attribute-Missing Multi-view Graph Clustering
Bowen Zhao ⋅ Qianqian Wang ⋅ Zhengming Ding ⋅ Quanxue Gao
In Room: ExHall D Poster Location: Poster #461 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Generating 6DoF Object Manipulation Trajectories from Action Description in Egocentric Vision
Tomoya Yoshida ⋅ Shuhei Kurita ⋅ Taichi Nishimura ⋅ Shinsuke Mori
In Room: ExHall D Poster Location: Poster #151 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FruitNinja: 3D Object Interior Texture Generation with Gaussian Splatting Project Page ↗
Fangyu Wu ⋅ Yuhao Chen
In Room: ExHall D Poster Location: Poster #38 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EnergyMoGen: Compositional Human Motion Generation with Energy-Based Diffusion Model in Latent Space
Jianrong Zhang ⋅ Hehe Fan ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #171 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Stealthy Backdoor Attack in Self-Supervised Learning Vision Encoders for Large Vision Language Models
Zhaoyi Liu ⋅ Huan Zhang
In Room: ExHall D Poster Location: Poster #384 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Pose-Guided Temporal Enhancement for Robust Low-Resolution Hand Reconstruction
Kaixin Fan ⋅ Pengfei Ren ⋅ Jingyu Wang ⋅ Haifeng Sun ⋅ Qi Qi ⋅ Zirui Zhuang ⋅ Jianxin Liao
In Room: ExHall D Poster Location: Poster #149 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ReDiffDet: Rotation-equivariant Diffusion Model for Oriented Object Detection
Jiaqi Zhao ⋅ Zeyu Ding ⋅ Yong Zhou ⋅ Hancheng Zhu ⋅ Wen-Liang Du ⋅ Rui Yao
In Room: ExHall D Poster Location: Poster #325 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PosterO: Structuring Layout Trees to Enable Language Models in Generalized Content-Aware Layout Generation
HsiaoYuan Hsu ⋅ Yuxin Peng
In Room: ExHall D Poster Location: Poster #262 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UniGoal: Towards Universal Zero-shot Goal-oriented Navigation
Hang Yin ⋅ Xiuwei Xu ⋅ Linqing Zhao ⋅ Ziwei Wang ⋅ Jie Zhou ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #311 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Structure-Aware Correspondence Learning for Relative Pose Estimation Project Page ↗
Yihan Chen ⋅ Wenfei Yang ⋅ Huan Ren ⋅ Shifeng Zhang ⋅ Tianzhu Zhang ⋅ Feng Wu
In Room: ExHall D Poster Location: Poster #93 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LoRA Recycle: Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs Project Page ↗
Zixuan Hu ⋅ Yongxian Wei ⋅ Li Shen ⋅ Chun Yuan ⋅ Dacheng Tao
In Room: ExHall D Poster Location: Poster #381 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FIFA: Fine-grained Inter-frame Attention for Driver's Video Gaze Estimation
Daosong Hu ⋅ Mingyue Cui ⋅ Kai Huang
In Room: ExHall D Poster Location: Poster #284 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PyTorchGeoNodes: Enabling Differentiable Shape Programs for 3D Shape Reconstruction
Sinisa Stekovic ⋅ Arslan Artykov ⋅ Stefan Ainetter ⋅ Mattia Durso ⋅ Friedrich Fraundorfer
In Room: ExHall D Poster Location: Poster #41 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
STING-BEE: Towards Vision-Language Model for Real-World X-ray Baggage Security Inspection
Divya Velayudhan ⋅ Abdelfatah Ahmed ⋅ Mohamad Alansari ⋅ Neha Gour ⋅ Abderaouf Behouch ⋅ Taimur Hassan ⋅ Syed Talal Wasim ⋅ Nabil Maalej ⋅ Muzammal Naseer ⋅ Jürgen Gall ⋅ Mohammed Bennamoun ⋅ Ernesto Damiani ⋅ Naoufel Werghi
In Room: ExHall D Poster Location: Poster #472 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SCAP: Transductive Test-Time Adaptation via Supportive Clique-based Attribute Prompting
Chenyu Zhang ⋅ Kunlun Xu ⋅ Zichen Liu ⋅ Yuxin Peng ⋅ Jiahuan Zhou
In Room: ExHall D Poster Location: Poster #371 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Contextual AD Narration with Interleaved Multimodal Sequence
Hanlin Wang ⋅ Zhan Tong ⋅ Kecheng Zheng ⋅ Yujun Shen ⋅ Limin Wang
In Room: ExHall D Poster Location: Poster #287 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MNE-SLAM: Multi-Agent Neural SLAM for Mobile Robots
Tianchen Deng ⋅ Guole Shen ⋅ Chen Xun ⋅ Shenghai Yuan ⋅ Tongxing Jin ⋅ Hongming Shen ⋅ Yanbo Wang ⋅ Jingchuan Wang ⋅ Hesheng Wang ⋅ Danwei Wang ⋅ Weidong Chen
In Room: ExHall D Poster Location: Poster #123 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RigGS: Rigging of 3D Gaussians for Modeling Articulated Objects in Videos Project Page ↗
Yuxin Yao ⋅ Zhi Deng ⋅ Junhui Hou
In Room: ExHall D Poster Location: Poster #14 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TensoFlow: Tensorial Flow-based Sampler for Inverse Rendering Project Page ↗
Chun Gu ⋅ Xiaofei Wei ⋅ Li Zhang ⋅ Xiatian Zhu
In Room: ExHall D Poster Location: Poster #31 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FRAMES-VQA: Benchmarking Fine-Tuning Robustness across Multi-Modal Shifts in Visual Question Answering
Chengyue Huang ⋅ Brisa Maneechotesuwan ⋅ Shivang Chopra ⋅ Zsolt Kira
In Room: ExHall D Poster Location: Poster #356 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Generative Inbetweening through Frame-wise Conditions-Driven Video Generation Project Page ↗
Tianyi Zhu ⋅ Dongwei Ren ⋅ Qilong Wang ⋅ Xiaohe Wu ⋅ Wangmeng Zuo
In Room: ExHall D Poster Location: Poster #171 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Exploring Temporally-Aware Features for Point Tracking Project Page ↗
Inès Hyeonsu Kim ⋅ Seokju Cho ⋅ Gabriel Huang ⋅ Jung Yi ⋅ Joon-Young Lee ⋅ Seungryong Kim
In Room: ExHall D Poster Location: Poster #166 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GBlobs: Explicit Local Structure via Gaussian Blobs for Improved Cross-Domain LiDAR-based 3D Object Detection
Dušan Malić ⋅ Christian Fruhwirth-Reisinger ⋅ Samuel Schulter ⋅ Horst Possegger
In Room: ExHall D Poster Location: Poster #115 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Detail-Preserving Latent Diffusion for Stable Shadow Removal Project Page ↗
Jiamin Xu ⋅ Yuxin Zheng ⋅ Zelong Li ⋅ Chi Wang ⋅ Renshu Gu ⋅ Weiwei Xu ⋅ Gang Xu
In Room: ExHall D Poster Location: Poster #212 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Beyond Words: Augmenting Discriminative Richness via Diffusions in Unsupervised Prompt Learning
Hairui Ren ⋅ Fan Tang ⋅ He Zhao ⋅ Zixuan Wang ⋅ Dandan Guo ⋅ Yi Chang
In Room: ExHall D Poster Location: Poster #391 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Unlocking the Potential of Unlabeled Data in Semi-Supervised Domain Generalization Project Page ↗
Dongkwan Lee ⋅ Kyomin Hwang ⋅ Nojun Kwak
In Room: ExHall D Poster Location: Poster #426 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TokenMotion: Decoupled Motion Control via Token Disentanglement for Human-centric Video Generation
Ruineng Li ⋅ Daitao Xing ⋅ Huiming Sun ⋅ Yuanzhou Ha ⋅ Jinglin Shen ⋅ Chiuman Ho
In Room: ExHall D Poster Location: Poster #165 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CholecTrack20: A Multi-Perspective Tracking Dataset for Surgical Tools Project Page ↗
Chinedu Innocent Nwoye ⋅ Kareem elgohary ⋅ Anvita A. Srinivas ⋅ Fauzan Zaid ⋅ Joël L. Lavanchy ⋅ Nicolas Padoy
In Room: ExHall D Poster Location: Poster #342 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Zero-shot 3D Question Answering via Voxel-based Dynamic Token Compression
Hsiang-Wei Huang ⋅ Fu-Chen Chen ⋅ Wenhao Chai ⋅ Che-Chun Su ⋅ Lu Xia ⋅ Sanghun Jung ⋅ Cheng-Yen Yang ⋅ Jenq-Neng Hwang ⋅ Min Sun ⋅ Cheng-Hao Kuo
In Room: ExHall D Poster Location: Poster #345 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Visual and Semantic Prompt Collaboration for Generalized Zero-Shot Learning
Huajie Jiang ⋅ Zhengxian Li ⋅ Xiaohan Yu ⋅ Yongli Hu ⋅ Baocai Yin ⋅ Jian Yang ⋅ Yuankai Qi
In Room: ExHall D Poster Location: Poster #426 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Neural LightRig: Unlocking Accurate Object Normal and Material Estimation with Multi-Light Diffusion Project Page ↗
Zexin He ⋅ Tengfei Wang ⋅ Xin Huang ⋅ Xingang Pan ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #34 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VidMuse: A Simple Video-to-Music Generation Framework with Long-Short-Term Modeling Project Page ↗
Zeyue Tian ⋅ Zhaoyang Liu ⋅ Ruibin Yuan ⋅ Jiahao Pan ⋅ Qifeng Liu ⋅ Xu Tan ⋅ Qifeng Chen ⋅ Wei Xue ⋅ Yike Guo
In Room: ExHall D Poster Location: Poster #286 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Human-centered Interactive Learning via MLLMs for Text-to-Image Person Re-identification Project Page ↗
Yang Qin ⋅ Chao Chen ⋅ Zhihang Fu ⋅ Dezhong Peng ⋅ Xi Peng ⋅ Peng Hu
In Room: ExHall D Poster Location: Poster #357 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Conditional Balance: Improving Multi-Conditioning Trade-Offs in Image Generation Project Page ↗
Nadav Z. Cohen ⋅ Oron Nir ⋅ Ariel Shamir
In Room: ExHall D Poster Location: Poster #237 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
KeyFace: Expressive Audio-Driven Facial Animation for Long Sequences via KeyFrame Interpolation Project Page ↗
Antoni Bigata Casademunt ⋅ Michał Stypułkowski ⋅ Rodrigo Mira ⋅ Stella Bounareli ⋅ Konstantinos Vougioukas ⋅ Zoe Landgraf ⋅ Nikita Drobyshev ⋅ Maciej Zieba ⋅ Stavros Petridis ⋅ Maja Pantic
In Room: ExHall D Poster Location: Poster #3 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Mitigating Ambiguities in 3D Classification with Gaussian Splatting Project Page ↗
Ruiqi Zhang ⋅ Hao Zhu ⋅ Jingyi Zhao ⋅ Qi Zhang ⋅ Xun Cao ⋅ Zhan Ma
In Room: ExHall D Poster Location: Poster #107 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Exposure-slot: Exposure-centric Representations Learning with Slot-in-Slot Attention for Region-aware Exposure Correction Project Page ↗
Donggoo Jung ⋅ DAEHYUN KIM ⋅ Guanghui Wang ⋅ Tae Hyun Kim
In Room: ExHall D Poster Location: Poster #199 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales
Shuokai Pan ⋅ Gerti Tuzi ⋅ Sudarshan Sreeram ⋅ Dibakar Gope
In Room: ExHall D Poster Location: Poster #374 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EdgeDiff: Edge-aware Diffusion Network for Building Reconstruction from Point Clouds
Yujun Liu ⋅ Ruisheng Wang ⋅ Shangfeng Huang ⋅ GuoRong Cai
In Room: ExHall D Poster Location: Poster #114 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
A Dataset for Semantic Segmentation in the Presence of Unknowns Project Page ↗
Zakaria Laskar ⋅ Tomas Vojir ⋅ Matej Grcic ⋅ Iaroslav Melekhov ⋅ Shankar Gangisetty ⋅ Juho Kannala ⋅ Jiri Matas ⋅ Giorgos Tolias ⋅ C.V. Jawahar
In Room: ExHall D Poster Location: Poster #119 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HierarQ: Task-Aware Hierarchical Q-Former for Enhanced Video Understanding Project Page ↗
Shehreen Azad ⋅ Vibhav Vineet ⋅ Yogesh S. Rawat
In Room: ExHall D Poster Location: Poster #303 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Explainable Saliency: Articulating Reasoning with Contextual Prioritization Project Page ↗
Nuo Chen ⋅ Ming Jiang ⋅ Qi Zhao
In Room: ExHall D Poster Location: Poster #403 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DH-Set: Improving Vision-Language Alignment with Diverse and Hybrid Set-Embeddings Learning
Kun Zhang ⋅ Jingyu Li ⋅ Zhe Li ⋅ S Kevin Zhou
In Room: ExHall D Poster Location: Poster #378 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Task-Aware Clustering for Prompting Vision-Language Models
Fusheng Hao ⋅ Fengxiang He ⋅ Fuxiang Wu ⋅ Tichao Wang ⋅ Chengqun Song ⋅ Jun Cheng
In Room: ExHall D Poster Location: Poster #392 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CASP: Compression of Large Multimodal Models Based on Attention Sparsity Project Page ↗
Mohsen Gholami ⋅ Mohammad Akbari ⋅ Kevin Cannons ⋅ Yong Zhang
In Room: ExHall D Poster Location: Poster #381 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Cost-Effective Learning: A Synergy of Semi-Supervised and Active Learning
Tianxiang Yin ⋅ Ningzhong Liu ⋅ Han Sun
In Room: ExHall D Poster Location: Poster #456 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing
Pengcheng Xu ⋅ Boyuan Jiang ⋅ Xiaobin Hu ⋅ Donghao Luo ⋅ Qingdong He ⋅ Jiangning Zhang ⋅ Chengjie Wang ⋅ Yunsheng Wu ⋅ Charles Ling ⋅ Boyu Wang
In Room: ExHall D Poster Location: Poster #221 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Light Transport-aware Diffusion Posterior Sampling for Single-View Reconstruction of 3D Volumes Project Page ↗
Ludwic Leonard ⋅ Nils Thuerey ⋅ rüdiger westermann
In Room: ExHall D Poster Location: Poster #30 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DyCON: Dynamic Uncertainty-aware Consistency and Contrastive Learning for Semi-supervised Medical Image Segmentation Project Page ↗
Maregu Assefa ⋅ Muzammal Naseer ⋅ IYYAKUTTI IYAPPAN GANAPATHI ⋅ Syed Sadaf Ali ⋅ Mohamed L Seghier ⋅ Naoufel Werghi
In Room: ExHall D Poster Location: Poster #450 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
STiL: Semi-supervised Tabular-Image Learning for Comprehensive Task-Relevant Information Exploration in Multimodal Classification
Siyi Du ⋅ Xinzhe Luo ⋅ Declan ORegan ⋅ Chen Qin
In Room: ExHall D Poster Location: Poster #469 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DUNE: Distilling a Universal Encoder from Heterogeneous 2D and 3D Teachers
Mert Bülent Sarıyıldız ⋅ Philippe Weinzaepfel ⋅ Thomas Lucas ⋅ Pau de Jorge ⋅ Diane Larlus ⋅ Yannis Kalantidis
In Room: ExHall D Poster Location: Poster #376 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models
Runhui Huang ⋅ Xinpeng Ding ⋅ Chunwei Wang ⋅ Jianhua Han ⋅ Yulong Liu ⋅ Hengshuang Zhao ⋅ Hang Xu ⋅ Lu Hou ⋅ Wei Zhang ⋅ Xiaodan Liang
In Room: ExHall D Poster Location: Poster #351 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Generative Photography: Scene-Consistent Camera Control for Realistic Text-to-Image Synthesis Project Page ↗
Yu Yuan ⋅ Xijun Wang ⋅ Yichen Sheng ⋅ Prateek Chennuri ⋅ Xingguang Zhang ⋅ Stanley H. Chan
In Room: ExHall D Poster Location: Poster #244 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SeqMvRL: A Sequential Fusion Framework for Multi-view Representation Learning
Ren Wang ⋅ Haoliang Sun ⋅ Yuxiu Lin ⋅ Chuanhui Zuo ⋅ Yongshun Gong ⋅ Yilong Yin ⋅ Wenjia Meng
In Room: ExHall D Poster Location: Poster #460 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Auto Cherry-Picker: Learning from High-quality Generative Data Driven by Language
Yicheng Chen ⋅ Xiangtai Li ⋅ Yining Li ⋅ Yanhong Zeng ⋅ Jianzong Wu ⋅ Xiangyu Zhao ⋅ Kai Chen
In Room: ExHall D Poster Location: Poster #395 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
BadToken: Token-level Backdoor Attacks to Multi-modal Large Language Models
Zenghui Yuan ⋅ Jiawen Shi ⋅ Pan Zhou ⋅ Neil Zhenqiang Gong ⋅ Lichao Sun
In Room: ExHall D Poster Location: Poster #361 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
NeISF++: Neural Incident Stokes Field for Polarized Inverse Rendering of Conductors and Dielectrics
Chenhao Li ⋅ Taishi Ono ⋅ Takeshi Uemori ⋅ Sho Nitta ⋅ Hajime Mihara ⋅ Alexander Gatto ⋅ Hajime Nagahara ⋅ Yusuke Moriuchi
In Room: ExHall D Poster Location: Poster #31 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DyFo: A Training-Free Dynamic Focus Visual Search for Enhancing LMMs in Fine-Grained Visual Understanding Project Page ↗
Geng Li ⋅ Jinglin Xu ⋅ Yunzhen Zhao ⋅ Yuxin Peng
In Room: ExHall D Poster Location: Poster #356 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
From Head to Tail: Towards Balanced Representation in Large Vision-Language Models through Adaptive Data Calibration Project Page ↗
Mingyang Song ⋅ Xiaoye Qu ⋅ Jiawei Zhou ⋅ Yu Cheng
In Room: ExHall D Poster Location: Poster #387 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DEIM: DETR with Improved Matching for Fast Convergence
Shihua Huang ⋅ Zhichao Lu ⋅ Xiaodong Cun ⋅ Yongjun YU ⋅ Xiao Zhou ⋅ Xi Shen
In Room: ExHall D Poster Location: Poster #432 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BF-STVSR: B-Splines and Fourier---Best Friends for High Fidelity Spatial-Temporal Video Super-Resolution Project Page ↗
Eunjin Kim ⋅ HYEONJIN KIM ⋅ Kyong Hwan Jin ⋅ Jaejun Yoo
In Room: ExHall D Poster Location: Poster #175 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DIO: Decomposable Implicit 4D Occupancy-Flow World Model
Christopher Diehl ⋅ Quinlan Sykora ⋅ Ben Agro ⋅ Thomas Gilles ⋅ Sergio Casas ⋅ Raquel Urtasun
In Room: ExHall D Poster Location: Poster #124 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Flag Decomposition for Hierarchical Datasets Project Page ↗
Nathan Mankovich ⋅ Ignacio Santamaria ⋅ Gustau Camps-Valls ⋅ Tolga Birdal
In Room: ExHall D Poster Location: Poster #282 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
RCP-Bench: Benchmarking Robustness for Collaborative Perception Under Diverse Corruptions
Shihang Du ⋅ Sanqing Qu ⋅ Tianhang Wang ⋅ Xudong Zhang ⋅ Yunwei Zhu ⋅ Jian Mao ⋅ Fan Lu ⋅ Qiao Lin ⋅ Guang Chen
In Room: ExHall D Poster Location: Poster #122 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Olympus: A Universal Task Router for Computer Vision Tasks Project Page ↗
Yuanze Lin ⋅ Yunsheng Li ⋅ Dongdong Chen ⋅ Weijian Xu ⋅ Ronald Clark ⋅ Philip H.S. Torr
In Room: ExHall D Poster Location: Poster #343 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HERA: Hybrid Explicit Representation for Ultra-Realistic Head Avatars
Hongrui Cai ⋅ Yuting Xiao ⋅ Xuan Wang ⋅ Jiafei Li ⋅ Yudong Guo ⋅ Yanbo Fan ⋅ Shenghua Gao ⋅ Juyong Zhang
In Room: ExHall D Poster Location: Poster #9 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Circumventing Shortcuts in Audio-visual Deepfake Detection Datasets with Unsupervised Learning Project Page ↗
Stefan Smeu ⋅ Dragos-Alexandru Boldisor ⋅ Dan Oneata ⋅ Elisabeta Oneata
In Room: ExHall D Poster Location: Poster #289 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CoE: Chain-of-Explanation via Automatic Visual Concept Circuit Description and Polysemanticity Quantification
wenlong yu ⋅ Qilong Wang ⋅ Chuang Liu ⋅ Dong Li ⋅ Qinghua Hu
In Room: ExHall D Poster Location: Poster #403 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Ego4o: Egocentric Human Motion Capture and Understanding from Multi-Modal Input
Jian Wang ⋅ Rishabh Dabral ⋅ Diogo Luvizon ⋅ Zhe Cao ⋅ Lingjie Liu ⋅ Thabo Beeler ⋅ Christian Theobalt
In Room: ExHall D Poster Location: Poster #153 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FreePCA: Integrating Consistency Information across Long-short Frames in Training-free Long Video Generation via Principal Component Analysis
Jiangtong Tan ⋅ Hu Yu ⋅ Jie Huang ⋅ Jie Xiao ⋅ Feng Zhao
In Room: ExHall D Poster Location: Poster #172 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hierarchical Adaptive Filtering Network for Text Image Specular Highlight Removal
Zhi Jiang ⋅ Jingbo Hu ⋅ Ling Zhang ⋅ Gang Fu ⋅ Chunxia Xiao
In Room: ExHall D Poster Location: Poster #211 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Improving Semi-Supervised Semantic Segmentation with Sliced-Wasserstein Feature Alignment and Uniformity
Chen Yi Lu ⋅ Kasra Derakhshandeh ⋅ Somali Chaterji
In Room: ExHall D Poster Location: Poster #422 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Mind the Time: Temporally-Controlled Multi-Event Video Generation Project Page ↗
Ziyi Wu ⋅ Aliaksandr Siarohin ⋅ Willi Menapace ⋅ Ivan Skorokhodov ⋅ Yuwei Fang ⋅ Varnith Chordia ⋅ Igor Gilitschenski ⋅ Sergey Tulyakov
In Room: ExHall D Poster Location: Poster #284 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning Extremely High Density Crowds as Active Matters
Feixiang He ⋅ Jiangbei Yue ⋅ Jialin Zhu ⋅ Armin Seyfried ⋅ Dan Casas ⋅ Julien Pettré ⋅ He Wang
In Room: ExHall D Poster Location: Poster #35 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning Project Page ↗
Yuncong Yang ⋅ Han Yang ⋅ Jiachen Zhou ⋅ Peihao Chen ⋅ Hongxin Zhang ⋅ Yilun Du ⋅ Chuang Gan
In Room: ExHall D Poster Location: Poster #141 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation
Rang Meng ⋅ Xingyu Zhang ⋅ Yuming Li ⋅ Chenguang Ma
In Room: ExHall D Poster Location: Poster #4 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Navigation World Models
Amir Bar ⋅ Gaoyue Zhou ⋅ Danny Tran ⋅ Trevor Darrell ⋅ Yann LeCun
In Room: ExHall D Poster Location: Poster #396 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Video Motion Transfer with Diffusion Transformers Project Page ↗
Alexander Pondaven ⋅ Aliaksandr Siarohin ⋅ Sergey Tulyakov ⋅ Philip H.S. Torr ⋅ Fabio Pizzati
In Room: ExHall D Poster Location: Poster #176 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Unified Reconstruction of Static and Dynamic Scenes from Events
Qiyao Gao ⋅ Peiqi Duan ⋅ Hanyue Lou ⋅ Minggui Teng ⋅ Ziqi Cai ⋅ Xu Chen ⋅ Boxin Shi
In Room: ExHall D Poster Location: Poster #166 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Automatic Spectral Calibration of Hyperspectral Images: Method, Dataset and Benchmark
Zhuoran Du ⋅ Shaodi You ⋅ Cheng Cheng ⋅ Shikui Wei
In Room: ExHall D Poster Location: Poster #182 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Generative Zero-Shot Composed Image Retrieval
Lan Wang ⋅ Wei Ao ⋅ Vishnu Naresh Boddeti ⋅ Ser-Nam Lim
In Room: ExHall D Poster Location: Poster #340 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Conformal Prediction and MLLM aided Uncertainty Quantification in Scene Graph Generation
Sayak Nag ⋅ Udita Ghosh ⋅ Calvin-Khang Ta ⋅ Sarosij Bose ⋅ Jiachen Li ⋅ Amit K. Roy-Chowdhury
In Room: ExHall D Poster Location: Poster #99 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Point-to-Region Loss for Semi-Supervised Point-Based Crowd Counting
Wei Lin ⋅ Chenyang ZHAO ⋅ Antoni B. Chan
In Room: ExHall D Poster Location: Poster #307 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Parallel Sequence Modeling via Generalized Spatial Propagation Network
Hongjun Wang ⋅ Wonmin Byeon ⋅ Jiarui Xu ⋅ Jinwei Gu ⋅ Ka Chun Cheung ⋅ Jan Kautz ⋅ Xiaolong Wang ⋅ Kai Han ⋅ Sifei Liu
In Room: ExHall D Poster Location: Poster #413 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Scenario Dreamer: Vectorized Latent Diffusion for Generating Driving Simulation Environments
Luke Rowe ⋅ Roger Girgis ⋅ Anthony Gosselin ⋅ Liam Paull ⋅ Christopher Pal ⋅ Felix Heide
In Room: ExHall D Poster Location: Poster #133 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
NADER: Neural Architecture Design via Multi-Agent Collaboration Project Page ↗
Zekang Yang ⋅ Wang ZENG ⋅ Sheng Jin ⋅ Chen Qian ⋅ Ping Luo ⋅ Wentao Liu
In Room: ExHall D Poster Location: Poster #411 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Move-in-2D: 2D-Conditioned Human Motion Generation
Hsin-Ping Huang ⋅ Yang Zhou ⋅ Jui-Hsien Wang ⋅ Difan Liu ⋅ Feng Liu ⋅ Ming-Hsuan Yang ⋅ Zhan Xu
In Room: ExHall D Poster Location: Poster #162 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PoseBH: Prototypical Multi-Dataset Training Beyond Human Pose Estimation
Uyoung Jeong ⋅ Jonathan Freer ⋅ Seungryul Baek ⋅ Hyung Jin Chang ⋅ Kwang In Kim
In Room: ExHall D Poster Location: Poster #156 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Separation of Powers: On Segregating Knowledge from Observation in LLM-enabled Knowledge-based Visual Question Answering
Zhen Yang ⋅ Zhuo Tao ⋅ Qi Chen ⋅ Yuankai Qi ⋅ Liang Li ⋅ Anton van den Hengel ⋅ Qingming Huang
In Room: ExHall D Poster Location: Poster #356 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Autonomous Micromobility through Scalable Urban Simulation
Wayne Wu ⋅ Honglin He ⋅ Chaoyuan Zhang ⋅ Jack He ⋅ Seth Z. Zhao ⋅ Ran Gong ⋅ Quanyi Li ⋅ Bolei Zhou
In Room: ExHall D Poster Location: Poster #133 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FisherTune: Fisher-Guided Robust Tuning of Vision Foundation Models for Domain Generalized Segmentation
Dong Zhao ⋅ Jinlong Li ⋅ Shuang Wang ⋅ Mengyao Wu ⋅ Qi Zang ⋅ Nicu Sebe ⋅ Zhun Zhong
In Room: ExHall D Poster Location: Poster #421 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Language-Assisted Debiasing and Smoothing for Foundation Model-Based Semi-Supervised Learning
Na Zheng ⋅ Xuemeng Song ⋅ Xue Dong ⋅ Aashish Nikhil Ghosh ⋅ Liqiang Nie ⋅ Roger Zimmermann
In Room: ExHall D Poster Location: Poster #447 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Unbiased Video Scene Graph Generation via Visual and Semantic Dual Debiasing
Yanjun Li ⋅ Zhaoyang Li ⋅ Honghui Chen ⋅ li'Zhi Xu
In Room: ExHall D Poster Location: Poster #310 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Channel-wise Noise Scheduled Diffusion for Inverse Rendering in Indoor Scenes
JunYong Choi ⋅ Min-Cheol Sagong ⋅ SeokYeong Lee ⋅ Seung-Won Jung ⋅ Ig-Jae Kim ⋅ Junghyun Cho
In Room: ExHall D Poster Location: Poster #31 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Targeted Forgetting of Image Subgroups in CLIP Models
Zeliang Zhang ⋅ Gaowen Liu ⋅ Charles Fleming ⋅ Ramana Kompella ⋅ Chenliang Xu
In Room: ExHall D Poster Location: Poster #428 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Harnessing Frozen Unimodal Encoders for Flexible Multimodal Alignment Project Page ↗
Mayug Maniparambil ⋅ Raiymbek Akshulakov ⋅ YASSER ABDELAZIZ DAHOU DJILALI ⋅ Sanath Narayan ⋅ Ankit Singh ⋅ Noel O'Connor
In Room: ExHall D Poster Location: Poster #354 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Enhancing Diversity for Data-free Quantization
Kai Zhao ⋅ zhihao zhuang ⋅ Miao Zhang ⋅ Chenjuan Guo ⋅ Yang Shu ⋅ Bin Yang
In Room: ExHall D Poster Location: Poster #425 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SeqAfford: Sequential 3D Affordance Reasoning via Multimodal Large Language Model
Chunlin Yu ⋅ Hanqing Wang ⋅ Ye Shi ⋅ Haoyang Luo ⋅ Sibei Yang ⋅ Jingyi Yu ⋅ Jingya Wang
In Room: ExHall D Poster Location: Poster #142 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DSV-LFS: Unifying LLM-Driven Semantic Cues with Visual Features for Robust Few-Shot Segmentation
Amin Karimi ⋅ Charalambos Poullis
In Room: ExHall D Poster Location: Poster #423 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Revisiting Generative Replay for Class Incremental Object Detection
Shizhou Zhang ⋅ Xueqiang Lv ⋅ Yinghui Xing ⋅ Qirui Wu ⋅ Di Xu ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #432 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Bridging Viewpoint Gaps: Geometric Reasoning Boosts Semantic Correspondence
Qiyang Qian ⋅ Hansheng Chen ⋅ Masayoshi Tomizuka ⋅ Kurt Keutzer ⋅ Qianqian Wang ⋅ Chenfeng Xu
In Room: ExHall D Poster Location: Poster #90 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DPU: Dynamic Prototype Updating for Multimodal Out-of-Distribution Detection
Li Li ⋅ Huixian Gong ⋅ Hao Dong ⋅ Tiankai Yang ⋅ Zhengzhong Tu ⋅ Yue Zhao
In Room: ExHall D Poster Location: Poster #459 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Unbiased and Robust Spatio-Temporal Scene Graph Generation and Anticipation Project Page ↗
Rohith Peddi ⋅ Saurabh . ⋅ Ayush Abhay Shrivastava ⋅ Parag Singla ⋅ Vibhav Giridhar Gogate
In Room: ExHall D Poster Location: Poster #313 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Spatial Transport Optimization by Repositioning Attention Map for Training-Free Text-to-Image Synthesis
Woojung Han ⋅ Yeonkyung Lee ⋅ Chanyoung Kim ⋅ Kwanghyun Park ⋅ Seong Jae Hwang
In Room: ExHall D Poster Location: Poster #249 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Prompt2Perturb (P2P): Text-Guided Diffusion-Based Adversarial Attack on Breast Ultrasound Images Project Page ↗
Yasamin Medghalchi ⋅ Moein Heidari ⋅ Clayton Allard ⋅ Leonid Sigal ⋅ Ilker Hacihaliloglu
In Room: ExHall D Poster Location: Poster #229 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Boosting Domain Incremental Learning: Selecting the Optimal Parameters is All You Need
Qiang Wang ⋅ Xiang Song ⋅ Yuhang He ⋅ Jizhou Han ⋅ Chenhao Ding ⋅ Xinyuan Gao ⋅ Yihong Gong
In Room: ExHall D Poster Location: Poster #447 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
COAP: Memory-Efficient Training with Correlation-Aware Gradient Projection Project Page ↗
Jinqi Xiao ⋅ Shen Sang ⋅ Tiancheng Zhi ⋅ Jing Liu ⋅ Qing Yan ⋅ Linjie Luo ⋅ Bo Yuan
In Room: ExHall D Poster Location: Poster #379 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EffiDec3D: An Optimized Decoder for High-Performance and Efficient 3D Medical Image Segmentation Project Page ↗
Md Mostafijur Rahman ⋅ Radu Marculescu
In Room: ExHall D Poster Location: Poster #482 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
Zeqi Gu ⋅ Yin Cui ⋅ Max Li ⋅ Fangyin Wei ⋅ Yunhao Ge ⋅ Jinwei Gu ⋅ Ming-Yu Liu ⋅ Abe Davis ⋅ Yifan Ding
In Room: ExHall D Poster Location: Poster #261 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MobileH2R: Learning Generalizable Human to Mobile Robot Handover Exclusively from Scalable and Diverse Synthetic Data
Zifan Wang ⋅ Ziqing Chen ⋅ Junyu Chen ⋅ Jilong Wang ⋅ Yuxin Yang ⋅ Yunze Liu ⋅ Xueyi Liu ⋅ He Wang ⋅ Li Yi
In Room: ExHall D Poster Location: Poster #143 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Improving Sound Source Localization with Joint Slot Attention on Image and Audio
Inho Kim ⋅ YOUNGKIL SONG ⋅ Jicheol Park ⋅ Won Hwa Kim ⋅ Suha Kwak
In Room: ExHall D Poster Location: Poster #283 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Feature-Preserving Mesh Decimation for Normal Integration Project Page ↗
Moritz Heep ⋅ Sven Behnke ⋅ Eduard Zell
In Room: ExHall D Poster Location: Poster #32 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Is this Generated Person Existed in Real-world? Fine-grained Detecting and Calibrating Abnormal Human-body
Zeqing Wang ⋅ Qingyang Ma ⋅ Wentao Wan ⋅ Haojie Li ⋅ Keze Wang ⋅ Yonghong Tian
In Room: ExHall D Poster Location: Poster #17 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation Project Page ↗
Yuhui Zhang ⋅ Yuchang Su ⋅ Yiming Liu ⋅ Xiaohan Wang ⋅ James Burgess ⋅ Elaine Sui ⋅ Chenyu Wang ⋅ Josiah Aklilu ⋅ Alejandro Lozano ⋅ Anjiang Wei ⋅ Ludwig Schmidt ⋅ Serena Yeung
In Room: ExHall D Poster Location: Poster #327 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation Project Page ↗
Zhixuan Liang ⋅ Yao Mu ⋅ Yixiao Wang ⋅ Fei Ni ⋅ Tianxing Chen ⋅ Wenqi Shao ⋅ Wei Zhan ⋅ Masayoshi Tomizuka ⋅ Ping Luo ⋅ Mingyu Ding
In Room: ExHall D Poster Location: Poster #147 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VerbDiff: Text-Only Diffusion Models with Enhanced Interaction Awareness Project Page ↗
SeungJu Cha ⋅ Kwanyoung Lee ⋅ Ye-Chan Kim ⋅ Hyunwoo Oh ⋅ Dong-Jin Kim
In Room: ExHall D Poster Location: Poster #255 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ROLL: Robust Noisy Pseudo-label Learning for Multi-View Clustering with Noisy Correspondence
Yuan Sun ⋅ Yongxiang Li ⋅ Zhenwen Ren ⋅ Guiduo Duan ⋅ Dezhong Peng ⋅ Peng Hu
In Room: ExHall D Poster Location: Poster #439 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Memories of Forgotten Concepts Project Page ↗
Matan Rusanovsky ⋅ Shimon Malnick ⋅ Amir Jevnisek ⋅ Ohad Fried ⋅ Shai Avidan
In Room: ExHall D Poster Location: Poster #268 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PQPP: A Joint Benchmark for Text-to-Image Prompt and Query Performance Prediction
Eduard Poesina ⋅ Adriana Valentina Costache ⋅ Adrian-Gabriel Chifu ⋅ Josiane Mothe ⋅ Radu Tudor Ionescu
In Room: ExHall D Poster Location: Poster #237 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CheXwhatsApp: A Dataset for Exploring Challenges in the Diagnosis of Chest X-rays through Mobile Devices
Mariamma Antony ⋅ Rajiv Porana ⋅ Sahil M. Lathiya ⋅ Siva Teja Kakileti ⋅ Chiranjib Bhattacharyya
In Room: ExHall D Poster Location: Poster #466 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Degradation-Aware Feature Perturbation for All-in-One Image Restoration
Xiangpeng Tian ⋅ Xiangyu Liao ⋅ Xiao Liu ⋅ Meng Li ⋅ Chao Ren
In Room: ExHall D Poster Location: Poster #191 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Octopus: Alleviating Hallucination via Dynamic Contrastive Decoding
Wei Suo ⋅ Lijun Zhang ⋅ Mengyang Sun ⋅ Lin Yuanbo Wu ⋅ Peng Wang ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #359 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ShiftwiseConv: Small Convolutional Kernel with Large Kernel Effect
Dachong Li ⋅ li li ⋅ zhuangzhuang chen ⋅ Jianqiang Li
In Room: ExHall D Poster Location: Poster #405 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RealEdit: Reddit Edits As a Large-scale Empirical Dataset for Image Transformations Project Page ↗
Peter Sushko ⋅ Ayana Bharadwaj ⋅ Zhi Yang Lim ⋅ Vasily Ilin ⋅ Ben Caffee ⋅ Dongping Chen ⋅ Reza Salehi ⋅ Cheng-Yu Hsieh ⋅ Ranjay Krishna
In Room: ExHall D Poster Location: Poster #263 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MTADiffusion: Mask Text Alignment Diffusion Model for Object Inpainting
jun huang ⋅ Ting Liu ⋅ Yihang Wu ⋅ Xiaochao Qu ⋅ Luoqi Liu ⋅ Xiaolin Hu
In Room: ExHall D Poster Location: Poster #241 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Can Generative Video Models Help Pose Estimation? Project Page ↗
Ruojin Cai ⋅ Jason Y. Zhang ⋅ Philipp Henzler ⋅ Zhengqi Li ⋅ Noah Snavely ⋅ Ricardo Martin
In Room: ExHall D Poster Location: Poster #90 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DreamOmni: Unified Image Generation and Editing
Bin Xia ⋅ Yuechen Zhang ⋅ Jingyao Li ⋅ Chengyao Wang ⋅ Yitong Wang ⋅ Xinglong Wu ⋅ Bei Yu ⋅ Jiaya Jia
In Room: ExHall D Poster Location: Poster #226 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Towards Natural Language-Based Document Image Retrieval: New Dataset and Benchmark
Hao Guo ⋅ Xugong Qin ⋅ Jun Jie Ou Yang ⋅ peng zhang ⋅ Gangyan Zeng ⋅ Yubo Li ⋅ Hailun Lin
In Room: ExHall D Poster Location: Poster #343 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PARC: A Quantitative Framework Uncovering the Symmetries within Vision Language Models
Jenny Schmalfuss ⋅ Nadine Chang ⋅ Vibashan VS ⋅ Maying Shen ⋅ Andrés Bruhn ⋅ Jose M. Alvarez
In Room: ExHall D Poster Location: Poster #386 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DAGSM: Disentangled Avatar Generation with GS-enhanced Mesh
Jingyu Zhuang ⋅ Di Kang ⋅ Linchao Bao ⋅ Liang Lin ⋅ Guanbin Li
In Room: ExHall D Poster Location: Poster #12 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
InsightEdit: Towards Better Instruction Following for Image Editing
Yingjing Xu ⋅ Jie Kong ⋅ Jiazhi Wang ⋅ Xiao Pan ⋅ Bo Lin ⋅ Qiang Liu
In Room: ExHall D Poster Location: Poster #242 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Open-Canopy: Towards Very High Resolution Forest Monitoring
Fajwel Fogel ⋅ Yohann PERRON ⋅ Nikola Besic ⋅ Laurent Saint-André ⋅ Agnès Pellissier-Tanon ⋅ Thomas Boudras ⋅ Martin Schwartz ⋅ Ibrahim Fayad ⋅ Alexandre d'Aspremont ⋅ Loic Landrieu ⋅ Philippe Ciais
In Room: ExHall D Poster Location: Poster #114 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
The Language of Motion: Unifying Verbal and Non-verbal Language of 3D Human Motion Project Page ↗
Changan Chen ⋅ Juze Zhang ⋅ Shrinidhi Kowshika Lakshmikanth ⋅ Yusu Fang ⋅ Ruizhi Shao ⋅ Gordon Wetzstein ⋅ Li Fei-Fei ⋅ Ehsan Adeli
In Room: ExHall D Poster Location: Poster #73 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SINR: Sparsity Driven Compressed Implicit Neural Representations
Dhananjaya Jayasundara ⋅ Sudarshan Rajagopalan ⋅ Yasiru Ranasinghe ⋅ Trac Tran ⋅ Vishal M. Patel
In Room: ExHall D Poster Location: Poster #277 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Chat2SVG: Vector Graphics Generation with Large Language Models and Image Diffusion Models
Ronghuan Wu ⋅ Wanchao Su ⋅ Jing Liao
In Room: ExHall D Poster Location: Poster #254 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Spiking Transformer: Introducing Accurate Addition-Only Spiking Self-Attention for Transformer
Yufei Guo ⋅ Xiaode Liu ⋅ Yuanpei Chen ⋅ Weihang Peng ⋅ Yuhan Zhang ⋅ Zhe Ma
In Room: ExHall D Poster Location: Poster #322 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
S2D-LFE: Sparse-to-Dense Light Field Event Generation
Yutong Liu ⋅ Wenming Weng ⋅ Yueyi Zhang ⋅ Zhiwei Xiong
In Room: ExHall D Poster Location: Poster #53 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Beyond Generation: A Diffusion-based Low-level Feature Extractor for Detecting AI-generated Images
Nan Zhong ⋅ Haoyu Chen ⋅ Yiran Xu ⋅ Zhenxing Qian ⋅ Xinpeng Zhang
In Room: ExHall D Poster Location: Poster #275 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Stable and Storage-efficient Dataset Distillation: Matching Convexified Trajectory Project Page ↗
Wenliang Zhong ⋅ Haoyu Tang ⋅ Qinghai Zheng ⋅ Mingzhu Xu ⋅ Yupeng Hu ⋅ Weili Guan
In Room: ExHall D Poster Location: Poster #434 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FiRe: Fixed-points of Restoration Priors for Solving Inverse Problems
Matthieu Terris ⋅ Ulugbek Kamilov ⋅ Thomas Moreau
In Room: ExHall D Poster Location: Poster #203 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes Project Page ↗
Ruijie Lu ⋅ Yixin Chen ⋅ Junfeng Ni ⋅ Baoxiong Jia ⋅ Yu Liu ⋅ Diwen Wan ⋅ Gang Zeng ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #60 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dynamic Stereotype Theory Induced Micro-expression Recognition with Oriented Deformation
Bohao Zhang ⋅ Xuejiao Wang ⋅ Changbo Wang ⋅ Gaoqi He
In Room: ExHall D Poster Location: Poster #5 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Charm: The Missing Piece in ViT Fine-Tuning for Image Aesthetic Assessment Project Page ↗
Fatemeh Behrad ⋅ Tinne Tuytelaars ⋅ Johan Wagemans
In Room: ExHall D Poster Location: Poster #234 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Protecting Your Video Content: Disrupting Automated Video-based LLM Annotations
Haitong Liu ⋅ Kuofeng Gao ⋅ Yang Bai ⋅ Jinmin Li ⋅ Jinxiao Shan ⋅ Tao Dai ⋅ Shu-Tao Xia
In Room: ExHall D Poster Location: Poster #290 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SCSegamba: Lightweight Structure-Aware Vision Mamba for Crack Segmentation in Structures
Hui Liu ⋅ Chen Jia ⋅ Fan Shi ⋅ Xu Cheng ⋅ Shengyong Chen
In Room: ExHall D Poster Location: Poster #311 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MMRL: Multi-Modal Representation Learning for Vision-Language Models Project Page ↗
Yuncheng Guo ⋅ Xiaodong Gu
In Room: ExHall D Poster Location: Poster #380 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Parallelized Autoregressive Visual Generation Project Page ↗
Yuqing Wang ⋅ Shuhuai Ren ⋅ Zhijie Lin ⋅ Yujin Han ⋅ Haoyuan Guo ⋅ Zhenheng Yang ⋅ Difan Zou ⋅ Jiashi Feng ⋅ Xihui Liu
In Room: ExHall D Poster Location: Poster #220 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PanDA: Towards Panoramic Depth Anything with Unlabeled Panoramas and Mobius Spatial Augmentation
Zidong Cao ⋅ Jinjing Zhu ⋅ Weiming Zhang ⋅ Hao Ai ⋅ Haotian Bai ⋅ Hengshuang Zhao ⋅ Lin Wang
In Room: ExHall D Poster Location: Poster #76 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
JiSAM: Alleviate Labeling Burden and Corner Case Problems in Autonomous Driving via Minimal Real-World Data
Runjian Chen ⋅ Wenqi Shao ⋅ Bo Zhang ⋅ Shaoshuai Shi ⋅ Li Jiang ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #136 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion Project Page ↗
Chunyang Cheng ⋅ Tianyang Xu ⋅ Zhenhua Feng ⋅ Xiaojun Wu ⋅ Zhangyong Tang ⋅ Hui Li ⋅ Zhang Zeyang ⋅ Sara Atito ⋅ Muhammad Awais ⋅ Josef Kittler
In Room: ExHall D Poster Location: Poster #184 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
Pu Cao ⋅ Feng Zhou ⋅ Lu Yang ⋅ TianruiHuang ⋅ Qing Song
In Room: ExHall D Poster Location: Poster #244 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MedUnifier: Unifying Vision-and-Language Pre-training on Medical Data with Vision Generation Task using Discrete Visual Representations
Ziyang Zhang ⋅ Yang Yu ⋅ Yucheng Chen ⋅ Xulei Yang ⋅ Si Yong Yeo
In Room: ExHall D Poster Location: Poster #345 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RandAR: Decoder-only Autoregressive Visual Generation in Random Orders
Ziqi Pang ⋅ Tianyuan Zhang ⋅ Fujun Luan ⋅ Yunze Man ⋅ Hao Tan ⋅ Kai Zhang ⋅ William Freeman ⋅ Yu-Xiong Wang
In Room: ExHall D Poster Location: Poster #222 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AnySat: One Earth Observation Model for Many Resolutions, Scales, and Modalities
Guillaume Astruc ⋅ Nicolas Gonthier ⋅ Clement Mallet ⋅ Loic Landrieu
In Room: ExHall D Poster Location: Poster #355 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MV-SSM: Multi-View State Space Modeling for 3D Human Pose Estimation Project Page ↗
Aviral Chharia ⋅ Wenbo Gou ⋅ Haoye Dong
In Room: ExHall D Poster Location: Poster #91 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
JTD-UAV: MLLM-Enhanced Joint Tracking and Description Framework for Anti-UAV Systems
Yifan Wang ⋅ Jian Zhao ⋅ Zhaoxin Fan ⋅ Xin Zhang ⋅ Xuecheng Wu ⋅ Yudian Zhang ⋅ Lei Jin ⋅ Xinyue Li ⋅ Gang Wang ⋅ Mengxi Jia ⋅ Ping Hu ⋅ Zheng Zhu ⋅ Xuelong Li
In Room: ExHall D Poster Location: Poster #137 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
NVComposer: Boosting Generative Novel View Synthesis with Multiple Sparse and Unposed Images Project Page ↗
Lingen Li ⋅ Zhaoyang Zhang ⋅ Yaowei Li ⋅ Jiale Xu ⋅ Wenbo Hu ⋅ Xiaoyu Li ⋅ Weihao Cheng ⋅ Jinwei Gu ⋅ Tianfan Xue ⋅ Ying Shan
In Room: ExHall D Poster Location: Poster #57 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Stop Learning it all to Mitigate Visual Hallucination, Focus on the Hallucination Target.
Dokyoon Yoon ⋅ Youngsook Song ⋅ Woomyoung Park
In Room: ExHall D Poster Location: Poster #385 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Bridging the Vision-Brain Gap with an Uncertainty-Aware Blur Prior Project Page ↗
Haitao Wu ⋅ Qing Li ⋅ Changqing Zhang ⋅ Zhen He ⋅ Xiaomin Ying
In Room: ExHall D Poster Location: Poster #196 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VLMs-Guided Representation Distillation for Efficient Vision-Based Reinforcement Learning
Haoran Xu ⋅ Peixi Peng ⋅ Guang Tan ⋅ Yiqian Chang ⋅ Luntong Li ⋅ Yonghong Tian
In Room: ExHall D Poster Location: Poster #323 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Scalable Video-to-Dataset Generation for Cross-Platform Mobile Agents Project Page ↗
Yunseok Jang ⋅ Yeda Song ⋅ Sungryull Sohn ⋅ Lajanugen Logeswaran ⋅ Tiange Luo ⋅ Dong-Ki Kim ⋅ GyungHoon Bae ⋅ Honglak Lee
In Room: ExHall D Poster Location: Poster #308 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multi-Modal Aerial-Ground Cross-View Place Recognition with Neural ODEs
Sijie Wang ⋅ Rui She ⋅ Qiyu Kang ⋅ Siqi Li ⋅ Disheng Li ⋅ Tianyu Geng ⋅ Shangshu Yu ⋅ Wee Peng Tay
In Room: ExHall D Poster Location: Poster #103 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LeanGaussian: Breaking Pixel or Point Cloud Correspondence in Modeling 3D Gaussians
Jiamin WU ⋅ Kenkun Liu ⋅ Han Gao ⋅ Xiaoke Jiang ⋅ Yuan Yao ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #46 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DKC: Differentiated Knowledge Consolidation for Cloth-Hybrid Lifelong Person Re-identification
Zhenyu Cui ⋅ Jiahuan Zhou ⋅ Yuxin Peng
In Room: ExHall D Poster Location: Poster #324 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
See Further When Clear: Curriculum Consistency Model
Yunpeng Liu ⋅ Boxiao Liu ⋅ Yi Zhang ⋅ Xingzhong Hou ⋅ Guanglu Song ⋅ Yu Liu ⋅ Haihang You
In Room: ExHall D Poster Location: Poster #219 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CaMuViD: Calibration-Free Multi-View Detection Project Page ↗
Amir Etefaghi Daryani ⋅ M. Usman Maqbool Bhutta ⋅ Byron Hernandez ⋅ Henry Medeiros
In Room: ExHall D Poster Location: Poster #98 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input Project Page ↗
Zhen Lv ⋅ Yangqi Long ⋅ Congzhentao Huang ⋅ Cao Li ⋅ Chengfei Lv ⋅ Hao Ren ⋅ Dian Zheng
In Room: ExHall D Poster Location: Poster #60 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
From Sparse Signal to Smooth Motion: Real-Time Motion Generation with Rolling Prediction Models Project Page ↗
German Barquero ⋅ Nadine Bertsch ⋅ Manojkumar Marramreddy ⋅ Carlos Chacón ⋅ Filippo Arcadu ⋅ Ferran Rigual ⋅ Nicky Sijia He ⋅ Cristina Palmero ⋅ Sergio Escalera ⋅ Yuting Ye ⋅ Robin Kips
In Room: ExHall D Poster Location: Poster #156 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Improving Adversarial Transferability on Vision Transformers via Forward Propagation Refinement Project Page ↗
Yuchen Ren ⋅ Zhengyu Zhao ⋅ Chenhao Lin ⋅ Bo Yang ⋅ Lu Zhou ⋅ Zhe Liu ⋅ Chao Shen
In Room: ExHall D Poster Location: Poster #385 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers Project Page ↗
Sherwin Bahmani ⋅ Ivan Skorokhodov ⋅ Guocheng Qian ⋅ Aliaksandr Siarohin ⋅ Willi Menapace ⋅ Andrea Tagliasacchi ⋅ David B. Lindell ⋅ Sergey Tulyakov
In Room: ExHall D Poster Location: Poster #173 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Adv-CPG: A Customized Portrait Generation Framework with Facial Adversarial Attacks
Junying Wang ⋅ Hongyuan Zhang ⋅ Yuan Yuan
In Room: ExHall D Poster Location: Poster #259 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Shadow Generation Using Diffusion Model with Geometry Prior
Haonan Zhao ⋅ Qingyang Liu ⋅ Xinhao Tao ⋅ Li Niu ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #213 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Extrapolating and Decoupling Image-to-Video Generation Models: Motion Modeling is Easier Than You Think
Zhenyi Lu ⋅ Xiaoye Qu ⋅ Zhenyi Lu ⋅ Wei Wei ⋅ Sichen Liu ⋅ Yu Cheng
In Room: ExHall D Poster Location: Poster #177 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Visual Agentic AI for Spatial Reasoning with a Dynamic API Project Page ↗
Damiano Marsili ⋅ Rohun Agrawal ⋅ Yisong Yue ⋅ Georgia Gkioxari
In Room: ExHall D Poster Location: Poster #347 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Modeling Multiple Normal Action Representations for Error Detection in Procedural Tasks
Wei-Jin Huang ⋅ Yuan-Ming Li ⋅ Zhi-Wei Xia ⋅ Yu-Ming Tang ⋅ Kun-Yu Lin ⋅ Jian-Fang Hu ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #155 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Rethinking Temporal Fusion with a Unified Gradient Descent View for 3D Semantic Occupancy Prediction
Dubing Chen ⋅ Huan Zheng ⋅ Jin Fang ⋅ Xingping Dong ⋅ Xianfei Li ⋅ Wenlong Liao ⋅ Tao He ⋅ Pai Peng ⋅ Jianbing Shen
In Room: ExHall D Poster Location: Poster #125 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SemAlign3D: Semantic Correspondence between RGB-Images through Aligning 3D Object-Class Representations
Krispin Wandel ⋅ Hesheng Wang
In Room: ExHall D Poster Location: Poster #90 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RUBIK: A Structured Benchmark for Image Matching across Geometric Challenges
Thibaut Loiseau ⋅ Guillaume Bourmaud
In Room: ExHall D Poster Location: Poster #88 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Star with Bilinear Mapping
Zelin Peng ⋅ Yu Huang ⋅ Zhengqin Xu ⋅ feilong tang ⋅ Ming Hu ⋅ Xiaokang Yang ⋅ Wei Shen
In Room: ExHall D Poster Location: Poster #406 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Efficient Personalization of Quantized Diffusion Model without Backpropagation Project Page ↗
Hoigi Seo ⋅ Wongi Jeong ⋅ Kyungryeol Lee ⋅ Se Young Chun
In Room: ExHall D Poster Location: Poster #225 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
M3GYM: A Large-Scale Multimodal Multi-view Multi-person Pose Dataset for Fitness Activity Understanding in Real-world Settings
Qingzheng Xu ⋅ Ru Cao ⋅ Xin Shen ⋅ Heming Du ⋅ Sen Wang ⋅ Xin Yu
In Room: ExHall D Poster Location: Poster #157 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Vid2Sim: Realistic and Interactive Simulation from Video for Urban Navigation Project Page ↗
Ziyang Xie ⋅ Zhizheng Liu ⋅ Zhenghao Peng ⋅ Wayne Wu ⋅ Bolei Zhou
In Room: ExHall D Poster Location: Poster #132 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
A Unified Latent Schrödinger Bridge Diffusion Model for Unsupervised Anomaly Detection and Localization Project Page ↗
Shilhora Akshay ⋅ Niveditha Lakshmi Narasimhan ⋅ Jacob George ⋅ Vineeth Balasubramanian
In Room: ExHall D Poster Location: Poster #429 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Unveiling the Ignorance of MLLMs: Seeing Clearly, Answering Incorrectly
Yexin Liu ⋅ Zhengyang Liang ⋅ Yueze Wang ⋅ Xianfeng Wu ⋅ feilong tang ⋅ Muyang He ⋅ Jian Li ⋅ Zheng Liu ⋅ Harry Yang ⋅ Ser-Nam Lim ⋅ Bo Zhao
In Room: ExHall D Poster Location: Poster #355 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Beyond Image Classification: A Video Benchmark and Dual-Branch Hybrid Discrimination Framework for Compositional Zero-Shot Learning
Dongyao Jiang ⋅ Haodong Jing ⋅ Yongqiang Ma ⋅ Nanning Zheng
In Room: ExHall D Poster Location: Poster #427 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dual Focus-Attention Transformer for Robust Point Cloud Registration
Kexue Fu ⋅ Ming'zhi Yuan ⋅ Changwei Wang ⋅ Weiguang Pang ⋅ Jing Chi ⋅ Manning Wang ⋅ Longxiang Gao
In Room: ExHall D Poster Location: Poster #108 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Forming Auxiliary High-confident Instance-level Loss to Promote Learning from Label Proportions
Tianhao Ma ⋅ Han Chen ⋅ Juncheng Hu ⋅ Yungang Zhu ⋅ Ximing Li
In Room: ExHall D Poster Location: Poster #455 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SMTPD: A New Benchmark for Temporal Prediction of Social Media Popularity
Yijie Xu ⋅ Bolun Zheng ⋅ Wei Zhu ⋅ Hangjia Pan ⋅ Yuchen Yao ⋅ Ning Xu ⋅ An-An Liu ⋅ Quan Zhang ⋅ Chenggang Yan
In Room: ExHall D Poster Location: Poster #292 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model
Changchang Sun ⋅ Gaowen Liu ⋅ Charles Fleming ⋅ Yan Yan
In Room: ExHall D Poster Location: Poster #282 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Neuro-Symbolic Evaluation of Text-to-Video Models using Formal Verification Project Page ↗
S P Sharan ⋅ Minkyu Choi ⋅ Sahil Shah ⋅ Harsh Goel ⋅ Mohammad Omama ⋅ Sandeep P. Chinchali
In Room: ExHall D Poster Location: Poster #289 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Spherical Manifold Guided Diffusion Model for Panoramic Image Generation
Xiancheng Sun ⋅ Mai Xu ⋅ Shengxi Li ⋅ Senmao Ma ⋅ Xin Deng ⋅ Lai Jiang ⋅ Shen gang
In Room: ExHall D Poster Location: Poster #36 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning on Model Weights using Tree Experts
Eliahu Horwitz ⋅ Bar Cavia ⋅ Jonathan Kahana ⋅ Yedid Hoshen
In Room: ExHall D Poster Location: Poster #444 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Rethinking Query-based Transformer for Continual Image Segmentation
Yuchen Zhu ⋅ Cheng Shi ⋅ Dingyou Wang ⋅ Jiajin Tang ⋅ Zhengxuan Wei ⋅ Yu Wu ⋅ Guanbin Li ⋅ Sibei Yang
In Room: ExHall D Poster Location: Poster #424 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Image Reconstruction from Readout-Multiplexed Single-Photon Detector Arrays
Shashwath Bharadwaj ⋅ Ruangrawee Kitichotkul ⋅ Akshay Agarwal ⋅ Vivek K Goyal
In Room: ExHall D Poster Location: Poster #71 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Smart Point-and-Shoot Photography
Jiawan Li ⋅ Fei Zhou ⋅ Zhipeng Zhong ⋅ Jiongzhi Lin ⋅ Guoping Qiu
In Room: ExHall D Poster Location: Poster #198 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SlideChat: A Large Vision-Language Assistant for Whole-Slide Pathology Image Understanding
Ying Chen ⋅ Guoan Wang ⋅ Yuanfeng Ji ⋅ Yanjun Li ⋅ Jin Ye ⋅ Tianbin Li ⋅ Ming Hu ⋅ Rongshan Yu ⋅ Yu Qiao ⋅ Junjun He
In Room: ExHall D Poster Location: Poster #475 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Transformer-Based Aligned Generation with Self-Coherence Guidance
Shulei Wang ⋅ Wang Lin ⋅ Hai Huang ⋅ Hanting Wang ⋅ Sihang Cai ⋅ WenKang Han ⋅ Tao Jin ⋅ Jingyuan Chen ⋅ Jiacheng Sun ⋅ Jieming Zhu ⋅ Zhou Zhao
In Room: ExHall D Poster Location: Poster #256 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Accurate Scene Text Recognition with Efficient Model Scaling and Cloze Self-Distillation
Andrea Maracani ⋅ Savas Ozkan ⋅ Sijun Cho ⋅ Hyo-Won Kim ⋅ Eunchung Noh ⋅ Jeongwon Min ⋅ Cho Jung Min ⋅ Dookun Park ⋅ Mete Ozay
In Room: ExHall D Poster Location: Poster #369 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
On the Consistency of Video Large Language Models in Temporal Comprehension Project Page ↗
Minjoon Jung ⋅ Junbin Xiao ⋅ Byoung-Tak Zhang ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #293 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation
Jiaming Zhou ⋅ Teli Ma ⋅ Kun-Yu Lin ⋅ Zifan Wang ⋅ Ronghe Qiu ⋅ Junwei Liang
In Room: ExHall D Poster Location: Poster #142 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
One-Minute Video Generation with Test-Time Training
Jiarui Xu ⋅ Shihao Han ⋅ Karan Dalal ⋅ Daniel Koceja ⋅ Yue Zhao ⋅ Ka Chun Cheung ⋅ Yejin Choi ⋅ Jan Kautz ⋅ Yu Sun ⋅ Xiaolong Wang
In Room: ExHall D Poster Location: Poster #181 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Text-guided Sparse Voxel Pruning for Efficient 3D Visual Grounding Project Page ↗
Wenxuan Guo ⋅ Xiuwei Xu ⋅ Ziwei Wang ⋅ Jianjiang Feng ⋅ Jie Zhou ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #333 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Common3D: Self-Supervised Learning of 3D Morphable Models for Common Objects in Neural Feature Space Project Page ↗
Leonhard Sommer ⋅ Olaf Dünkel ⋅ Christian Theobalt ⋅ Adam Kortylewski
In Room: ExHall D Poster Location: Poster #104 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LinGen: Towards High-Resolution Minute-Length Text-to-Video Generation with Linear Computational Complexity Project Page ↗
Hongjie Wang ⋅ Chih-Yao Ma ⋅ Yen-Cheng Liu ⋅ Ji Hou ⋅ Tao Xu ⋅ Jialiang Wang ⋅ Felix Juefei-Xu ⋅ Yaqiao Luo ⋅ Peizhao Zhang ⋅ Tingbo Hou ⋅ Peter Vajda ⋅ Niraj Jha ⋅ Xiaoliang Dai
In Room: ExHall D Poster Location: Poster #231 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EditSplat: Multi-View Fusion and Attention-Guided Optimization for View-Consistent 3D Scene Editing with 3D Gaussian Splatting Project Page ↗
Dong In Lee ⋅ Hyeongcheol Park ⋅ Jiyoung Seo ⋅ Eunbyung Park ⋅ Hyunje Park ⋅ Ha Dam Baek ⋅ Shin sangheon ⋅ sangmin kim ⋅ Sangpil Kim
In Room: ExHall D Poster Location: Poster #46 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SpatialCLIP: Learning 3D-aware Image Representations from Spatially Discriminative Language
zehan wang ⋅ Sashuai zhou ⋅ Shaoxuan He ⋅ Haifeng Huang ⋅ Lihe Yang ⋅ Ziang Zhang ⋅ Xize Cheng ⋅ Shengpeng Ji ⋅ Tao Jin ⋅ Hengshuang Zhao ⋅ Zhou Zhao
In Room: ExHall D Poster Location: Poster #336 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mono2Stereo: A Benchmark and Empirical Study for Stereo Conversion
Songsong Yu ⋅ Yuxin Chen ⋅ Zhongang Qi ⋅ Zeke Xie ⋅ Yifan Wang ⋅ Lijun Wang ⋅ Ying Shan ⋅ Huchuan Lu
In Room: ExHall D Poster Location: Poster #76 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Open-Vocabulary Audio-Visual Event Localization
Jinxing Zhou ⋅ Dan Guo ⋅ Ruohao Guo ⋅ Yuxin Mao ⋅ Jingjing Hu ⋅ Yiran Zhong ⋅ Xiaojun Chang ⋅ Meng Wang
In Room: ExHall D Poster Location: Poster #286 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
One-shot 3D Object Canonicalization based on Geometric and Semantic Consistency Project Page ↗
Li Jin ⋅ Yujie Wang ⋅ Wenzheng Chen ⋅ Qiyu Dai ⋅ Qingzhe Gao ⋅ Xueying Qin ⋅ Baoquan Chen
In Room: ExHall D Poster Location: Poster #98 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Inst3D-LMM: Instance-Aware 3D Scene Understanding with Multi-modal Instruction Tuning
Hanxun Yu ⋅ Wentong Li ⋅ Song Wang ⋅ Junbo Chen ⋅ Jianke Zhu
In Room: ExHall D Poster Location: Poster #335 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HIIF: Hierarchical Encoding based Implicit Image Function for Continuous Super-resolution
Yuxuan Jiang ⋅ Ho Man Kwan ⋅ jasmine peng ⋅ Ge Gao ⋅ Fan Zhang ⋅ Xiaoqing Zhu ⋅ Joel Sole ⋅ David Bull
In Room: ExHall D Poster Location: Poster #200 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Motion Prompting: Controlling Video Generation with Motion Trajectories Project Page ↗
Daniel Geng ⋅ Charles Herrmann ⋅ Junhwa Hur ⋅ Forrester Cole ⋅ Serena Zhang ⋅ Tobias Pfaff ⋅ Tatiana Lopez-Guevara ⋅ Yusuf Aytar ⋅ Michael Rubinstein ⋅ Chen Sun ⋅ Oliver Wang ⋅ Andrew Owens ⋅ Deqing Sun
In Room: ExHall D Poster Location: Poster #173 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VERA: Explainable Video Anomaly Detection via Verbalized Learning of Vision-Language Models Project Page ↗
Muchao Ye ⋅ Weiyang Liu ⋅ Pan He
In Room: ExHall D Poster Location: Poster #316 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ProHOC: Probabilistic Hierarchical Out-of-Distribution Classification via Multi-Depth Networks Project Page ↗
Erik Wallin ⋅ Fredrik Kahl ⋅ Lars Hammarstrand
In Room: ExHall D Poster Location: Poster #457 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CCIN: Compositional Conflict Identification and Neutralization for Composed Image Retrieval
Likai Tian ⋅ Jian Zhao ⋅ Zechao Hu ⋅ Zhengwei Yang ⋅ Hao Li ⋅ Lei Jin ⋅ Zheng Wang ⋅ Xuelong Li
In Room: ExHall D Poster Location: Poster #362 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP Project Page ↗
Songlong Xing ⋅ Zhengyu Zhao ⋅ Nicu Sebe
In Room: ExHall D Poster Location: Poster #433 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
OverLoCK: An Overview-first-Look-Closely-next ConvNet with Context-Mixing Dynamic Kernels Project Page ↗
Meng Lou ⋅ Yizhou Yu
In Room: ExHall D Poster Location: Poster #395 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SLVR: Super-Light Visual Reconstruction via Blueprint Controllable Convolutions and Exploring Feature Diversity Representation
Ning Ni ⋅ Libao Zhang
In Room: ExHall D Poster Location: Poster #22 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Vision-Language Embodiment for Monocular Depth Estimation
Jinchang Zhang ⋅ Guoyu Lu
In Room: ExHall D Poster Location: Poster #318 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Layered Image Vectorization via Semantic Simplification
Zhenyu Wang ⋅ Jianxi Huang ⋅ Zhida Sun ⋅ Yuanhao Gong ⋅ Daniel Cohen-Or ⋅ Min Lu
In Room: ExHall D Poster Location: Poster #226 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning Occlusion-Robust Vision Transformers for Real-Time UAV Tracking Project Page ↗
You Wu ⋅ Xucheng Wang ⋅ Xiangyang Yang ⋅ Mengyuan Liu ⋅ Dan Zeng ⋅ Hengzhou Ye ⋅ Shuiwang Li
In Room: ExHall D Poster Location: Poster #123 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Enhancing Vision-Language Compositional Understanding with Multimodal Synthetic Data
Haoxin Li ⋅ Boyang Li
In Room: ExHall D Poster Location: Poster #365 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UltraFusion: Ultra High Dynamic Imaging using Exposure Fusion
Zixuan Chen ⋅ Yujin Wang ⋅ Xin Cai ⋅ Zhiyuan You ⋅ Zhe-Ming Lu ⋅ Fan Zhang ⋅ Shi Guo ⋅ Tianfan Xue
In Room: ExHall D Poster Location: Poster #25 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Automated Proof of Polynomial Inequalities via Reinforcement Learning
Banglong Liu ⋅ Niuniu Qi ⋅ Xia Zeng ⋅ Lydia Dehbi ⋅ Zhengfeng Yang
In Room: ExHall D Poster Location: Poster #467 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Frequency Dynamic Convolution for Dense Image Prediction
Linwei Chen ⋅ Lin Gu ⋅ Liang Li ⋅ Chenggang Yan ⋅ Ying Fu
In Room: ExHall D Poster Location: Poster #386 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
IDEA: Inverted Text with Cooperative Deformable Aggregation for Multi-modal Object Re-Identification
Yuhao Wang ⋅ Yongfeng Lv ⋅ Pingping Zhang ⋅ Huchuan Lu
In Room: ExHall D Poster Location: Poster #341 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SAM-I2V: Upgrading SAM to Support Promptable Video Segmentation with Less than 0.2% Training Cost Project Page ↗
Haiyang Mei ⋅ Pengyu Zhang ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #310 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GroupMamba: Efficient Group-Based Visual State Space Model
Abdelrahman Shaker ⋅ Syed Talal Wasim ⋅ Salman Khan ⋅ Jürgen Gall ⋅ Fahad Shahbaz Khan
In Room: ExHall D Poster Location: Poster #407 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
How Do I Do That? Synthesizing 3D Hand Motion and Contacts for Everyday Interactions
Aditya Prakash ⋅ Benjamin E Lundell ⋅ Dmitry Andreychuk ⋅ David Forsyth ⋅ Saurabh Gupta ⋅ Harpreet S. Sawhney
In Room: ExHall D Poster Location: Poster #158 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Escaping Plato's Cave: Towards the Alignment of 3D and Text Latent Spaces
Souhail Hadgi ⋅ Luca Moschella ⋅ Andrea Santilli ⋅ Diego Gomez ⋅ Qixing Huang ⋅ Emanuele Rodolà ⋅ Simone Melzi ⋅ Maks Ovsjanikov
In Room: ExHall D Poster Location: Poster #383 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Consistency Posterior Sampling for Diverse Image Synthesis Project Page ↗
Vishal Purohit ⋅ Matthew Repasky ⋅ Jianfeng Lu ⋅ Qiang Qiu ⋅ Yao Xie ⋅ Xiuyuan Cheng
In Room: ExHall D Poster Location: Poster #206 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
IMFine: 3D Inpainting via Geometry-guided Multi-view Refinement Project Page ↗
Zhihao Shi ⋅ Dong Huo ⋅ Yuhongze Zhou ⋅ Yan Min ⋅ Juwei Lu ⋅ Xinxin Zuo
In Room: ExHall D Poster Location: Poster #51 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ActiveGAMER: Active GAussian Mapping through Efficient Rendering Project Page ↗
Liyan Chen ⋅ Huangying Zhan ⋅ Kevin Chen ⋅ Xiangyu Xu ⋅ Qingan Yan ⋅ Changjiang Cai ⋅ Yi Xu
In Room: ExHall D Poster Location: Poster #62 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DeepCompress-ViT: Rethinking Model Compression to Enhance Efficiency of Vision Transformers at the Edge Project Page ↗
Sabbir Ahmed ⋅ Abdullah Al Arafat ⋅ Deniz Najafi ⋅ Akhlak Mahmood ⋅ Mamshad Nayeem Rizve ⋅ Mohaiminul Al Nahian ⋅ RANYANG ZHOU ⋅ Shaahin Angizi ⋅ Adnan Rakin Rakin
In Room: ExHall D Poster Location: Poster #382 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EvOcc: Accurate Semantic Occupancy for Automated Driving Using Evidence Theory
Jonas Kälble ⋅ Sascha Wirges ⋅ Maxim Tatarchenko ⋅ Eddy Ilg
In Room: ExHall D Poster Location: Poster #125 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Positive2Negative: Breaking the Information-Lossy Barrier in Self-Supervised Single Image Denoising
Tong Li ⋅ Lizhi Wang ⋅ Zhiyuan Xu ⋅ Lin Zhu ⋅ Wanxuan Lu ⋅ Hua Huang
In Room: ExHall D Poster Location: Poster #202 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PGC: Physics-Based Gaussian Cloth from a Single Pose Project Page ↗
Michelle Guo ⋅ Matt Jen-Yuan Chiang ⋅ Igor Santesteban ⋅ Nikolaos Sarafianos ⋅ Hsiaoyu Chen ⋅ Oshri Halimi ⋅ Aljaž Božič ⋅ Shunsuke Saito ⋅ Jiajun Wu ⋅ Karen Liu ⋅ Tuur Stuyck ⋅ Egor Larionov
In Room: ExHall D Poster Location: Poster #16 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Joint Vision-Language Social Bias Removal for CLIP
Haoyu Zhang ⋅ Yangyang Guo ⋅ Mohan Kankanhalli
In Room: ExHall D Poster Location: Poster #389 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation
Shangjin Zhai ⋅ Zhichao Ye ⋅ Jialin Liu ⋅ Weijian Xie ⋅ Jiaqi Hu ⋅ Zhen Peng ⋅ Hua Xue ⋅ Danpeng Chen ⋅ Xiaomeng Wang ⋅ Lei Yang ⋅ Nan Wang ⋅ Haomin Liu ⋅ Guofeng Zhang
In Room: ExHall D Poster Location: Poster #65 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MV-DUSt3R+: Single-Stage Scene Reconstruction from Sparse Views In 2 Seconds
Zhenggang Tang ⋅ Yuchen Fan ⋅ Dilin Wang ⋅ Hongyu Xu ⋅ Rakesh Ranjan ⋅ Alexander G. Schwing ⋅ Zhicheng Yan
In Room: ExHall D Poster Location: Poster #57 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Explicit Depth-Aware Blurry Video Frame Interpolation Guided by Differential Curves
yan zaoming ⋅ pengcheng lei ⋅ Tingting Wang ⋅ Faming Fang ⋅ Junkang Zhang ⋅ Yaomin Huang ⋅ Haichuan Song
In Room: ExHall D Poster Location: Poster #170 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OFER: Occluded Face Expression Reconstruction Project Page ↗
Pratheba Selvaraju ⋅ Victoria Abrevaya ⋅ Timo Bolkart ⋅ Rick Akkerman ⋅ Tianyu Ding ⋅ Faezeh Amjadi ⋅ Ilya Zharkov
In Room: ExHall D Poster Location: Poster #80 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation Project Page ↗
Dekai Zhu ⋅ Yan Di ⋅ Stefan Gavranovic ⋅ Slobodan Ilic
In Room: ExHall D Poster Location: Poster #111 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MonSter: Marry Monodepth to Stereo Unleashes Power
JunDa Cheng ⋅ Longliang Liu ⋅ Gangwei Xu ⋅ Xianqi Wang ⋅ Zhaoxing Zhang ⋅ Yong Deng ⋅ Jinliang Zang ⋅ Yurui Chen ⋅ zhipeng cai ⋅ Xin Yang
In Room: ExHall D Poster Location: Poster #82 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Toward Real-world BEV Perception: Depth Uncertainty Estimation via Gaussian Splatting Project Page ↗
Shu-Wei Lu ⋅ Yi-Hsuan Tsai ⋅ Yi-Ting Chen
In Room: ExHall D Poster Location: Poster #125 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Efficient Fine-Tuning and Concept Suppression for Pruned Diffusion Models
Reza Shirkavand ⋅ Peiran Yu ⋅ Shangqian Gao ⋅ Gowthami Somepalli ⋅ Tom Goldstein ⋅ Heng Huang
In Room: ExHall D Poster Location: Poster #271 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
WildGS-SLAM: Monocular Gaussian Splatting SLAM in Dynamic Environments Project Page ↗
Jianhao Zheng ⋅ Zihan Zhu ⋅ Valentin Bieri ⋅ Marc Pollefeys ⋅ Songyou Peng ⋅ Iro Armeni
In Room: ExHall D Poster Location: Poster #76 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Tale of Two Classes: Adapting Supervised Contrastive Learning to Binary Imbalanced Datasets
David Mildenberger ⋅ Paul Hager ⋅ Daniel Rueckert ⋅ Martin J. Menten
In Room: ExHall D Poster Location: Poster #470 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DEAL: Data-Efficient Adversarial Learning for High-Quality Infrared Imaging
Zhu Liu ⋅ Zijun Wang ⋅ Jinyuan Liu ⋅ Fanqi Meng ⋅ Long Ma ⋅ Risheng Liu
In Room: ExHall D Poster Location: Poster #194 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RePerformer: Immersive Human-centric Volumetric Videos from Playback to Photoreal Reperformance Project Page ↗
Yuheng Jiang ⋅ Zhehao Shen ⋅ Chengcheng Guo ⋅ Yu Hong ⋅ Zhuo Su ⋅ Yingliang Zhang ⋅ Marc Habermann ⋅ Lan Xu
In Room: ExHall D Poster Location: Poster #66 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CheXWorld: Exploring Image World Modeling for Radiograph Representation Learning
Yang Yue ⋅ Yulin Wang ⋅ Chenxin Tao ⋅ Pan Liu ⋅ Shiji Song ⋅ Gao Huang
In Room: ExHall D Poster Location: Poster #473 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Re-thinking Temporal Search for Long-Form Video Understanding Project Page ↗
Jinhui Ye ⋅ Zihan Wang ⋅ Haosen Sun ⋅ Keshigeyan Chandrasegaran ⋅ Zane Durante ⋅ Cristobal Eyzaguirre ⋅ Yonatan Bisk ⋅ Juan Carlos Niebles ⋅ Ehsan Adeli ⋅ Li Fei-Fei ⋅ Jiajun Wu ⋅ Manling Li
In Room: ExHall D Poster Location: Poster #306 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HyperSeg: Hybrid Segmentation Assistant with Fine-grained Visual Perceiver
Cong Wei ⋅ Haoxian Tan ⋅ Yujie Zhong ⋅ Yong Liu ⋅ Jie Hu ⋅ Dengjie Li ⋅ Zheng Zhao ⋅ Yujiu Yang
In Room: ExHall D Poster Location: Poster #341 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Diffusion-based Event Generation for High-Quality Image Deblurring
Xinan Xie ⋅ Qing Zhang ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #190 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Video Summarization with Large Language Models Project Page ↗
Min Jung Lee ⋅ Dayoung Gong ⋅ Minsu Cho
In Room: ExHall D Poster Location: Poster #304 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Sketchtopia: A Dataset and Foundational Agents for Benchmarking Asynchronous Multimodal Communication with Iconic Feedback
Mohd Hozaifa Khan ⋅ Ravi Kiran Sarvadevabhatla
In Room: ExHall D Poster Location: Poster #226 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Seeing Speech and Sound: Distinguishing and Locating Audio Sources in Visual Scenes
Hyeonggon Ryu ⋅ Seongyu Kim ⋅ Joon Chung ⋅ Arda Senocak
In Room: ExHall D Poster Location: Poster #276 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Consistency-aware Self-Training for Iterative-based Stereo Matching
Jingyi Zhou ⋅ Peng Ye ⋅ Haoyu Zhang ⋅ Jiakang Yuan ⋅ Rao Qiang ⋅ Liu YangChenXu ⋅ Wu Cailin ⋅ Feng Xu ⋅ Tao Chen
In Room: ExHall D Poster Location: Poster #77 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Balanced Rate-Distortion Optimization in Learned Image Compression
Yichi Zhang ⋅ Zhihao Duan ⋅ Yuning Huang ⋅ Fengqing Zhu
In Room: ExHall D Poster Location: Poster #213 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Bridge the Gap: From Weak to Full Supervision for Temporal Action Localization with PseudoFormer
Ziyi Liu ⋅ Yangcen Liu
In Room: ExHall D Poster Location: Poster #319 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HomoGen: Enhanced Video Inpainting via Homography Propagation and Diffusion
Ding Ding ⋅ Yueming Pan ⋅ Ruoyu Feng ⋅ Qi Dai ⋅ Kai Qiu ⋅ Jianmin Bao ⋅ Chong Luo ⋅ Zhenzhong Chen
In Room: ExHall D Poster Location: Poster #180 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Generalized Few-shot 3D Point Cloud Segmentation with Vision-Language Model Project Page ↗
Zhaochong An ⋅ Guolei Sun ⋅ Yun Liu ⋅ Runjia Li ⋅ Junlin Han ⋅ Ender Konukoglu ⋅ Serge Belongie
In Room: ExHall D Poster Location: Poster #113 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Online Task-Free Continual Learning via Dynamic Expansionable Memory Distribution
Fei Ye ⋅ Adrian Bors
In Room: ExHall D Poster Location: Poster #448 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Seeing is Not Believing: Adversarial Natural Object Optimization for Hard-Label 3D Scene Attacks
Daizong Liu ⋅ Wei Hu
In Room: ExHall D Poster Location: Poster #120 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Once-Tuning-Multiple-Variants: Tuning Once and Expanded as Multiple Vision-Language Model Variants
Chong Yu ⋅ Tao Chen ⋅ Zhongxue Gan
In Room: ExHall D Poster Location: Poster #389 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Rethinking Epistemic and Aleatoric Uncertainty for Active Open-Set Annotation: An Energy-Based Approach Project Page ↗
Chen-Chen Zong ⋅ Sheng-Jun Huang
In Room: ExHall D Poster Location: Poster #455 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Devil is in the Detail: Towards Injecting Fine Details of Image Prompt in Image Generation via Conflict-free Guidance and Stratified Attention
Kyungmin Jo ⋅ Jooyeol Yun ⋅ Jaegul Choo
In Room: ExHall D Poster Location: Poster #244 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Noise Modeling in One Hour: Minimizing Preparation Efforts for Self-supervised Low-Light RAW Image Denoising
Feiran Li ⋅ Haiyang Jiang ⋅ Daisuke Iso
In Room: ExHall D Poster Location: Poster #24 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SfM-Free 3D Gaussian Splatting via Hierarchical Training
Bo Ji ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #57 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Heterogeneous Skeleton-Based Action Representation Learning
Xiaoyan Ma ⋅ jidong kuang ⋅ Hongsong Wang ⋅ Jie Gui
In Room: ExHall D Poster Location: Poster #320 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Point Cloud Upsampling Using Conditional Diffusion Module with Adaptive Noise Suppression
Boqian Zhang ⋅ shen yang ⋅ Hao Chen ⋅ Chao Yang ⋅ Jing Jia ⋅ Guang Jiang
In Room: ExHall D Poster Location: Poster #112 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Beyond Clean Training Data: A Versatile and Model-Agnostic Framework for Out-of-Distribution Detection with Contaminated Training Data
Yuchuan Li ⋅ Jae-Mo Kang ⋅ Il-Min Kim
In Room: ExHall D Poster Location: Poster #458 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Cubify Anything: Scaling Indoor 3D Object Detection
Justin Lazarow ⋅ David Griffiths ⋅ Gefen Kohavi ⋅ Francisco Crespo ⋅ Afshin Dehghan
In Room: ExHall D Poster Location: Poster #112 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CTRL-D: Controllable Dynamic 3D Scene Editing with Personalized 2D Diffusion Project Page ↗
Kai He ⋅ Chin-Hsuan Wu ⋅ Igor Gilitschenski
In Room: ExHall D Poster Location: Poster #45 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Scale Efficient Training for Large Datasets Project Page ↗
Qing Zhou ⋅ Junyu Gao ⋅ Qi Wang
In Room: ExHall D Poster Location: Poster #443 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Recurrent Feature Mining and Keypoint Mixup Padding for Category-Agnostic Pose Estimation
Junjie Chen ⋅ Weilong Chen ⋅ Yifan Zuo ⋅ Yuming Fang
In Room: ExHall D Poster Location: Poster #94 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Minimizing Labeled, Maximizing Unlabeled: An Image-Driven Approach for Video Instance Segmentation
Fangyun Wei ⋅ Jinjing Zhao ⋅ Kun Yan ⋅ Chang Xu
In Room: ExHall D Poster Location: Poster #334 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Do Visual Imaginations Improve Vision-and-Language Navigation Agents? Project Page ↗
Akhil Perincherry ⋅ Jacob Krantz ⋅ Stefan Lee
In Room: ExHall D Poster Location: Poster #350 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MoSca: Dynamic Gaussian Fusion from Casual Videos via 4D Motion Scaffolds
Jiahui Lei ⋅ Yijia Weng ⋅ Adam W Harley ⋅ Leonidas Guibas ⋅ Kostas Daniilidis
In Room: ExHall D Poster Location: Poster #70 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MUST: The First Dataset and Unified Framework for Multispectral UAV Single Object Tracking Project Page ↗
Haolin Qin ⋅ Tingfa Xu ⋅ Tianhao Li ⋅ Zhenxiang Chen ⋅ Tao Feng ⋅ Jianan Li
In Room: ExHall D Poster Location: Poster #101 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
IncEventGS: Pose-Free Gaussian Splatting from a Single Event Camera
Jian Huang ⋅ Chengrui Dong ⋅ Xuanhua Chen ⋅ Peidong Liu
In Room: ExHall D Poster Location: Poster #75 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hybrid Global-Local Representation with Augmented Spatial Guidance for Zero-Shot Referring Image Segmentation
Ting Liu ⋅ Siyuan Li
In Room: ExHall D Poster Location: Poster #333 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MAP: Unleashing Hybrid Mamba-Transformer Vision Backbone's Potential with Masked Autoregressive Pretraining
Yunze Liu ⋅ Li Yi
In Room: ExHall D Poster Location: Poster #410 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Relation3D : Enhancing Relation Modeling for Point Cloud Instance Segmentation Project Page ↗
Edward LOO ⋅ Jiacheng Deng
In Room: ExHall D Poster Location: Poster #337 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Style Quantization for Data-Efficient GAN Training
Jian Wang ⋅ Xin Lan ⋅ Ji-Zhe Zhou ⋅ Yuxin Tian ⋅ Jiancheng Lv
In Room: ExHall D Poster Location: Poster #223 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FASTer: Focal token Acquiring-and-Scaling Transformer for Long-term 3D Objection Detection
Chenxu Dang ⋅ Pei An ⋅ Xinmin Zhang ⋅ ZaiPeng Duan ⋅ Xuzhong Hu ⋅ Jie Ma
In Room: ExHall D Poster Location: Poster #116 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction
ZaiPeng Duan ⋅ Xuzhong Hu ⋅ Pei An ⋅ Junfeng Ding ⋅ Jie Zhan ⋅ Chenxu Dang ⋅ Yunbiao Xu ⋅ Jie Ma
In Room: ExHall D Poster Location: Poster #132 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Cheb-GR: Rethinking K-nearest Neighbor Search in Re-ranking for Person Re-identification
Jinxi Yang ⋅ He Li ⋅ Bo Du ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #330 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FIction: 4D Future Interaction Prediction from Video
Kumar Ashutosh ⋅ Georgios Pavlakos ⋅ Kristen Grauman
In Room: ExHall D Poster Location: Poster #173 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Boost Your Human Image Generation Model via Direct Preference Optimization
Sanghyeon Na ⋅ Yonggyu Kim ⋅ Hyunjoon Lee
In Room: ExHall D Poster Location: Poster #238 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Type-R: Automatically Retouching Typos for Text-to-Image Generation Project Page ↗
Wataru Shimoda ⋅ Naoto Inoue ⋅ Daichi Haraguchi ⋅ Hayato Mitani ⋅ Seiichi Uchida ⋅ Kota Yamaguchi
In Room: ExHall D Poster Location: Poster #248 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HoGS: Unified Near and Far Object Reconstruction via Homogeneous Gaussian Splatting
Xinpeng Liu ⋅ Zeyi Huang ⋅ Fumio Okura ⋅ Yasuyuki Matsushita
In Room: ExHall D Poster Location: Poster #54 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Multi-Label Prototype Visual Spatial Search for Weakly Supervised Semantic Segmentation
Songsong Duan ⋅ Xi Yang ⋅ Nannan Wang
In Room: ExHall D Poster Location: Poster #392 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model Project Page ↗
Mingtao Guo ⋅ Guanyu Xing ⋅ Yanli Liu
In Room: ExHall D Poster Location: Poster #6 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
Wenyi Hong ⋅ Yean Cheng ⋅ Zhuoyi Yang ⋅ Weihan Wang ⋅ Lefan Wang ⋅ Xiaotao Gu ⋅ Shiyu Huang ⋅ Yuxiao Dong ⋅ Jie Tang
In Room: ExHall D Poster Location: Poster #294 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Image Referenced Sketch Colorization Based on Animation Creation Workflow
Dingkun Yan ⋅ Xinrui Wang ⋅ Zhuoru Li ⋅ Suguru Saito ⋅ Yusuke Iwasawa ⋅ Yutaka Matsuo ⋅ Jiaxian Guo
In Room: ExHall D Poster Location: Poster #223 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
The Change You Want To Detect: Semantic Change Detection In Earth Observation With Hybrid Data Generationf
Yanis Benidir ⋅ Nicolas Gonthier ⋅ Clement Mallet
In Room: ExHall D Poster Location: Poster #191 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RoboSense: Large-scale Dataset and Benchmark for Egocentric Robot Perception and Navigation in Crowded and Unstructured Environments Project Page ↗
Haisheng Su ⋅ Feixiang Song ⋅ CONG MA ⋅ Wei Wu ⋅ Junchi Yan
In Room: ExHall D Poster Location: Poster #123 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TimeTracker: Event-based Continuous Point Tracking for Video Frame Interpolation with Non-linear Motion
Haoyue Liu ⋅ Jinghan Xu ⋅ Yi Chang ⋅ Hanyu Zhou ⋅ Haozhi Zhao ⋅ Lin Wang ⋅ Luxin Yan
In Room: ExHall D Poster Location: Poster #176 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OccMamba: Semantic Occupancy Prediction with State Space Models Project Page ↗
Heng Li ⋅ Yuenan Hou ⋅ Xiaohan Xing ⋅ Yuexin Ma ⋅ Xiao Sun ⋅ Yanyong Zhang
In Room: ExHall D Poster Location: Poster #126 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion Project Page ↗
Hao Wen ⋅ Zehuan Huang ⋅ Yaohui Wang ⋅ Xinyuan Chen ⋅ Lu Sheng
In Room: ExHall D Poster Location: Poster #55 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Forensics-Bench: A Comprehensive Forgery Detection Benchmark Suite for Large Vision Language Models Project Page ↗
Jin Wang ⋅ Chenghui Lv ⋅ Xian Li ⋅ Shichao Dong ⋅ Huadong Li ⋅ kelu Yao ⋅ Chao Li ⋅ Wenqi Shao ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #388 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models
Yassir Bendou ⋅ Amine Ouasfi ⋅ Vincent Gripon ⋅ Adnane Boukhayma
In Room: ExHall D Poster Location: Poster #387 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
One-Way Ticket: Time-Independent Unified Encoder for Distilling Text-to-Image Diffusion Models Project Page ↗
Senmao Li ⋅ Lei Wang ⋅ Kai Wang ⋅ Tao Liu ⋅ Jiehang Xie ⋅ Joost van de Weijer ⋅ Fahad Shahbaz Khan ⋅ Shiqi Yang ⋅ Yaxing Wang ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #240 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Fast and Accurate Gigapixel Pathological Image Classification with Hierarchical Distillation Multi-Instance Learning
Jiuyang Dong ⋅ Junjun Jiang ⋅ Kui Jiang ⋅ Jiahan Li ⋅ Yongbing Zhang
In Room: ExHall D Poster Location: Poster #447 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM
Yizhou Huang ⋅ Yihua Cheng ⋅ Kezhi Wang
In Room: ExHall D Poster Location: Poster #136 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DiC: Rethinking Conv3x3 Designs in Diffusion Models
Yuchuan Tian ⋅ Jing Han ⋅ Chengcheng Wang ⋅ Yuchen Liang ⋅ Chao Xu ⋅ Hanting Chen
In Room: ExHall D Poster Location: Poster #220 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
InteractionMap: Improving Online Vectorized HDMap Construction with Interaction Project Page ↗
Kuang Wu ⋅ Chuan Yang ⋅ Zhanbin Li
In Room: ExHall D Poster Location: Poster #130 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
S2Gaussian: Sparse-View Super-Resolution 3D Gaussian Splatting Project Page ↗
Yecong Wan ⋅ Mingwen Shao ⋅ Yuanshuo Cheng ⋅ Wangmeng Zuo
In Room: ExHall D Poster Location: Poster #51 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
Chen Liu ⋅ Peike Li ⋅ Liying Yang ⋅ Dadong Wang ⋅ Lincheng Li ⋅ Xin Yu
In Room: ExHall D Poster Location: Poster #262 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
OmniStyle: Filtering High Quality Style Transfer Data at Scale
Ye Wang ⋅ Ruiqi Liu ⋅ Jiang Lin ⋅ Fei Liu ⋅ Zili Yi ⋅ Yilin Wang ⋅ Rui Ma
In Room: ExHall D Poster Location: Poster #237 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Improved Text-Aligned Codebook Learning: Multi-Hierarchical Codebook-Text Alignment with Long Text
Guotao liang ⋅ Baoquan Zhang ⋅ Zhiyuan Wen ⋅ Junteng Zhao ⋅ Yunming Ye ⋅ Guangming Ye ⋅ Yao He
In Room: ExHall D Poster Location: Poster #371 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
StyleMaster: Stylize Your Video with Artistic Generation and Translation
Zixuan Ye ⋅ Huijuan Huang ⋅ Xintao Wang ⋅ Pengfei Wan ⋅ Di ZHANG ⋅ Wenhan Luo
In Room: ExHall D Poster Location: Poster #236 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MMVU: Measuring Expert-Level Multi-Discipline Video Understanding
Yilun Zhao ⋅ Lujing Xie ⋅ Haowei Zhang ⋅ Guo Gan ⋅ Weiyuan Chen ⋅ Yitao Long ⋅ Tongyan Hu ⋅ Zhijian Xu ⋅ Chengye Wang ⋅ Chuhan Li ⋅ Ziyao Shangguan ⋅ Yixin Liu ⋅ Zhenwen Liang ⋅ Zhiyuan Hu ⋅ Chen Zhao ⋅ Arman Cohan
In Room: ExHall D Poster Location: Poster #296 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Overcoming Shortcut Problem in VLM for Robust Out-of-Distribution Detection Project Page ↗
Zhuo Xu ⋅ Xiang Xiang ⋅ Yifan Liang
In Room: ExHall D Poster Location: Poster #455 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Divide and Conquer: Heterogeneous Noise Integration for Diffusion-based Adversarial Purification
Gaozheng Pei ⋅ Shaojie Lyu ⋅ Gong Chen ⋅ Ke Ma ⋅ Qianqian Xu ⋅ Yingfei Sun ⋅ Qingming Huang
In Room: ExHall D Poster Location: Poster #298 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PCDreamer: Point Cloud Completion Through Multi-view Diffusion Priors Project Page ↗
Guangshun Wei ⋅ Yuan Feng ⋅ Long Ma ⋅ Chen Wang ⋅ Yuanfeng Zhou ⋅ Changjian Li
In Room: ExHall D Poster Location: Poster #104 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
One-Step Event-Driven High-Speed Autofocus Project Page ↗
Yuhan Bao ⋅ Shaohua Gao ⋅ Wenyong Li ⋅ Kaiwei Wang
In Room: ExHall D Poster Location: Poster #75 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FIMA-Q: Post-Training Quantization for Vision Transformers by Fisher Information Matrix Approximation Project Page ↗
Zhuguanyu Wu ⋅ Shihe Wang ⋅ Jiayi Zhang ⋅ Jiaxin Chen ⋅ Yunhong Wang
In Room: ExHall D Poster Location: Poster #405 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers Project Page ↗
Zhuguanyu Wu ⋅ Jiayi Zhang ⋅ Jiaxin Chen ⋅ Jinyang Guo ⋅ Di Huang ⋅ Yunhong Wang
In Room: ExHall D Poster Location: Poster #411 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Foley-Flow: Coordinated Video-to-Audio Generation with Masked Audio-Visual Alignment and Dynamic Conditional Flows
Shentong Mo ⋅ Yibing Song
In Room: ExHall D Poster Location: Poster #261 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Effective Cloud Removal for Remote Sensing Images by an Improved Mean-Reverting Denoising Model with Elucidated Design Space Project Page ↗
Yi Liu ⋅ Wengen Li ⋅ Jihong Guan ⋅ Shuigeng Zhou ⋅ Yichao Zhang
In Room: ExHall D Poster Location: Poster #195 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
HVI: A New Color Space for Low-light Image Enhancement Project Page ↗
Qingsen Yan ⋅ Yixu Feng ⋅ Cheng Zhang ⋅ Guansong Pang ⋅ Kangbiao Shi ⋅ Peng Wu ⋅ Wei Dong ⋅ Jinqiu Sun ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #22 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ECVC: Exploiting Non-Local Correlations in Multiple Frames for Contextual Video Compression
Wei Jiang ⋅ Junru Li ⋅ Kai Zhang ⋅ Li zhang
In Room: ExHall D Poster Location: Poster #188 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning Dynamic Collaborative Network for Semi-supervised 3D Vessel Segmentation Project Page ↗
Jiao Xu ⋅ Xin Chen ⋅ Lihe Zhang
In Room: ExHall D Poster Location: Poster #483 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Weakly Supervised Contrastive Adversarial Training for Learning Robust Features from Semi-supervised Data
Lilin Zhang ⋅ Chengpei Wu ⋅ Ning Yang
In Room: ExHall D Poster Location: Poster #448 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
Shengjun Zhang ⋅ Jinzhao Li ⋅ Xin Fei ⋅ Hao Liu ⋅ Yueqi Duan
In Room: ExHall D Poster Location: Poster #62 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models Project Page ↗
Junzhe Chen ⋅ Tianshu Zhang ⋅ Shiyu Huang ⋅ Yuwei Niu ⋅ Linfeng Zhang ⋅ Lijie Wen ⋅ Xuming Hu
In Room: ExHall D Poster Location: Poster #386 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UMFN: Unified Multi-Domain Face Normalization for Joint Cross-domain Prototype Learning and Heterogeneous Face Recognition
Meng Pang ⋅ Wenjun Zhang ⋅ Nanrun Zhou ⋅ Shengbo Chen ⋅ Hong Rao
In Room: ExHall D Poster Location: Poster #301 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Graph-Embedded Structure-Aware Perceptual Hashing for Neural Network Protection and Piracy Detection
Ruiheng Liu ⋅ Haozhe Chen ⋅ Boyao Zhao ⋅ Kejiang Chen ⋅ Weiming Zhang
In Room: ExHall D Poster Location: Poster #416 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
BHViT: Binarized Hybrid Vision Transformer
Tian Gao ⋅ Yu Zhang ⋅ Zhiyuan Zhang ⋅ Huajun Liu ⋅ Kaijie Yin ⋅ Cheng-Zhong Xu ⋅ Hui Kong
In Room: ExHall D Poster Location: Poster #323 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GaussianFormer-2: Probabilistic Gaussian Superposition for Efficient 3D Occupancy Prediction
Yuanhui Huang ⋅ Amonnut Thammatadatrakoon ⋅ Wenzhao Zheng ⋅ Yunpeng Zhang ⋅ Dalong Du ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #126 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Improving Accuracy and Calibration via Differentiated Deep Mutual Learning
Han Liu ⋅ Peng Cui ⋅ Bingning Wang ⋅ Weipeng Chen ⋅ Yupeng Zhang ⋅ Jun Zhu ⋅ Xiaolin Hu
In Room: ExHall D Poster Location: Poster #459 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
BooW-VTON: Boosting In-the-Wild Virtual Try-On via Mask-Free Pseudo Data Training
Xuanpu Zhang ⋅ Dan Song ⋅ pengxin zhan ⋅ Tianyu Chang ⋅ Jianhao Zeng ⋅ Qing-Guo Chen ⋅ Weihua Luo ⋅ An-An Liu
In Room: ExHall D Poster Location: Poster #20 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
UniScene: Unified Occupancy-centric Driving Scene Generation
Bohan Li ⋅ Jiazhe Guo ⋅ Hongsi Liu ⋅ Yingshuang Zou ⋅ Yikang Ding ⋅ Xiwu Chen ⋅ Hu ZHU ⋅ Feiyang Tan ⋅ Chi Zhang ⋅ Tiancai Wang ⋅ Shuchang Zhou ⋅ Li Zhang ⋅ Xiaojuan Qi ⋅ Hao Zhao ⋅ Mu Yang ⋅ Wenjun Zeng ⋅ Xin Jin
In Room: ExHall D Poster Location: Poster #128 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Digital Twin Catalog: A Large-Scale Photorealistic 3D Object Digital Twin Dataset Project Page ↗
Zhao Dong ⋅ Ka chen ⋅ Zhaoyang Lv ⋅ Hong-Xing Yu ⋅ Yunzhi Zhang ⋅ Cheng Zhang ⋅ Yufeng Zhu ⋅ Stephen Tian ⋅ Zhengqin Li ⋅ Geordie Moffatt ⋅ Sean Christofferson ⋅ James Fort ⋅ Xiaqing Pan ⋅ Mingfei Yan ⋅ Jiajun Wu ⋅ Carl Ren ⋅ Richard Newcombe
In Room: ExHall D Poster Location: Poster #55 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Visual Persona: Foundation Model for Full-Body Human Customization
Jisu Nam ⋅ Soowon Son ⋅ Zhan Xu ⋅ Jing Shi ⋅ Difan Liu ⋅ Feng Liu ⋅ Seungryong Kim ⋅ Yang Zhou
In Room: ExHall D Poster Location: Poster #272 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation
Dingcheng Zhen ⋅ Shunshun Yin ⋅ Shiyang Qin ⋅ Hou Yi ⋅ Ziwei Zhang ⋅ Siyuan Liu ⋅ Gan Qi ⋅ Ming Tao
In Room: ExHall D Poster Location: Poster #3 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Multi-Sensor Object Anomaly Detection: Unifying Appearance, Geometry, and Internal Properties
wenqiao Li ⋅ BoZhong Zheng ⋅ Xiaohao Xu ⋅ Jinye Gan ⋅ Fading Lu ⋅ Xiang Li ⋅ Na Ni ⋅ Zheng Tian ⋅ Xiaonan Huang ⋅ Shenghua Gao ⋅ Yingna Wu
In Room: ExHall D Poster Location: Poster #439 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Blood Flow Speed Estimation with Optical Coherence Tomography Angiography Images Project Page ↗
Wensheng Cheng ⋅ Zhenghong Li ⋅ Jiaxiang Ren ⋅ Hyomin Jeong ⋅ Congwu Du ⋅ Yingtian Pan ⋅ Haibin Ling
In Room: ExHall D Poster Location: Poster #485 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SP3D: Boosting Sparsely-Supervised 3D Object Detection via Accurate Cross-Modal Semantic Prompts
Shijia Zhao ⋅ Qiming Xia ⋅ Xusheng Guo ⋅ Pufan Zou ⋅ Maoji Zheng ⋅ Hai Wu ⋅ Chenglu Wen ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #308 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
NeighborRetr: Balancing Hub Centrality in Cross-Modal Retrieval Project Page ↗
Zengrong Lin ⋅ Zheng Wang ⋅ Tianwen Qian ⋅ Pan Mu ⋅ Sixian Chan ⋅ Cong Bai
In Room: ExHall D Poster Location: Poster #371 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs
Ziheng Ouyang ⋅ Zhen Li ⋅ Qibin Hou
In Room: ExHall D Poster Location: Poster #228 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator
Fan Yang ⋅ Ru Zhen ⋅ Jianing Wang ⋅ Yanhao Zhang ⋅ Haoxiang Chen ⋅ Haonan Lu ⋅ Sicheng Zhao ⋅ Guiguang Ding
In Room: ExHall D Poster Location: Poster #351 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CO-SPY: Combining Semantic and Pixel Features to Detect Synthetic Images by AI
Siyuan Cheng ⋅ Lingjuan Lyu ⋅ Zhenting Wang ⋅ Xiangyu Zhang ⋅ Vikash Sehwag
In Room: ExHall D Poster Location: Poster #268 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MaskGaussian: Adaptive 3D Gaussian Representation from Probabilistic Masks
Yifei Liu ⋅ Zhihang Zhong ⋅ Yifan Zhan ⋅ Sheng Xu ⋅ Xiao Sun
In Room: ExHall D Poster Location: Poster #48 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CarPlanner: Consistent Auto-regressive Trajectory Planning for Large-Scale Reinforcement Learning in Autonomous Driving
Dongkun Zhang ⋅ Jiaming Liang ⋅ Ke Guo ⋅ Sha Lu ⋅ Qi Wang ⋅ Rong Xiong ⋅ Zhenwei Miao ⋅ Yue Wang
In Room: ExHall D Poster Location: Poster #136 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
StreetCrafter: Street View Synthesis with Controllable Video Diffusion Models
Yunzhi Yan ⋅ Zhen Xu ⋅ Haotong Lin ⋅ Haian Jin ⋅ Haoyu Guo ⋅ Yida Wang ⋅ Kun Zhan ⋅ XianPeng Lang ⋅ Hujun Bao ⋅ Xiaowei Zhou ⋅ Sida Peng
In Room: ExHall D Poster Location: Poster #61 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FreeTimeGS: Free Gaussian Primitives at Anytime Anywhere for Dynamic Scene Reconstruction
Yifan Wang ⋅ Peishan Yang ⋅ Zhen Xu ⋅ Jiaming Sun ⋅ Zhanhua Zhang ⋅ chen yong ⋅ Hujun Bao ⋅ Sida Peng ⋅ Xiaowei Zhou
In Room: ExHall D Poster Location: Poster #66 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DashGaussian: Optimizing 3D Gaussian Splatting in 200 Seconds
Youyu Chen ⋅ Junjun Jiang ⋅ Kui Jiang ⋅ Xiao Tang ⋅ Zhihao Li ⋅ Xianming Liu ⋅ Yinyu Nie
In Room: ExHall D Poster Location: Poster #47 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Classic Video Denoising in a Machine Learning World: Robust, Fast, and Controllable
Xin Jin ⋅ Simon Niklaus ⋅ Zhoutong Zhang ⋅ Zhihao Xia ⋅ Chun-Le Guo ⋅ Yuting Yang ⋅ Jiawen Chen ⋅ Chongyi Li
In Room: ExHall D Poster Location: Poster #180 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
Ailin Deng ⋅ Tri Cao ⋅ Zhirui Chen ⋅ Bryan Hooi
In Room: ExHall D Poster Location: Poster #352 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Steepest Descent Density Control for Compact 3D Gaussian Splatting Project Page ↗
Peihao Wang ⋅ Yuehao Wang ⋅ Dilin Wang ⋅ Sreyas Mohan ⋅ Zhiwen Fan ⋅ Lemeng Wu ⋅ Ruisi Cai ⋅ Yu-Ying Yeh ⋅ Zhangyang Wang ⋅ Qiang Liu ⋅ Rakesh Ranjan
In Room: ExHall D Poster Location: Poster #48 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Unboxed: Geometrically and Temporally Consistent Video Outpainting
Zhongrui Yu ⋅ Martina Megaro-Boldini ⋅ Robert Sumner ⋅ Abdelaziz Djelouah
In Room: ExHall D Poster Location: Poster #186 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
From Poses to Identity: Training-Free Person Re-Identification via Feature Centralization Project Page ↗
Chao Yuan ⋅ Guiwei Zhang ⋅ Changxiao Ma ⋅ Tianyi Zhang ⋅ Guanglin Niu
In Room: ExHall D Poster Location: Poster #323 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Tightening Robustness Verification of MaxPool-based Neural Networks via Minimizing the Over-Approximation Zone
Yuan Xiao ⋅ Yuchen Chen ⋅ Shiqing Ma ⋅ Chunrong Fang ⋅ Tongtong Bai ⋅ Mingzheng Gu ⋅ Yuxin Cheng ⋅ Yanwei Chen ⋅ Zhenyu Chen
In Room: ExHall D Poster Location: Poster #465 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Human Motion Instruction Tuning
Lei Li ⋅ Sen Jia ⋅ Jianhao Wang ⋅ Zhongyu Jiang ⋅ Feng Zhou ⋅ Ju Dai ⋅ Tianfang Zhang ⋅ Zongkai Wu ⋅ Jenq-Neng Hwang
In Room: ExHall D Poster Location: Poster #170 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MMAR: Towards Lossless Multi-Modal Auto-Regressive Probabilistic Modeling
Jian Yang ⋅ Dacheng Yin ⋅ Yizhou Zhou ⋅ Fengyun Rao ⋅ Wei Zhai ⋅ Yang Cao ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #249 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Boost the Inference with Co-training: A Depth-guided Mutual Learning Framework for Semi-supervised Medical Polyp Segmentation
Yuxin Li ⋅ Zihao Zhu ⋅ Yuxiang Zhang ⋅ Yifan Chen ⋅ Zhibin Yu
In Room: ExHall D Poster Location: Poster #478 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Convex Relaxation for Robust Vanishing Point Estimation in Manhattan World Project Page ↗
Bangyan Liao ⋅ Zhenjun Zhao ⋅ Haoang Li ⋅ Yi Zhou ⋅ Yingping Zeng ⋅ Hao Li ⋅ Peidong Liu
In Room: ExHall D Poster Location: Poster #102 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Deep Fair Multi-View Clustering with Attention KAN
HaiMing Xu ⋅ Qianqian Wang ⋅ Boyue Wang ⋅ Quanxue Gao
In Room: ExHall D Poster Location: Poster #468 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Distinguish Then Exploit: Source-free Open Set Domain Adaptation via Weight Barcode Estimation and Sparse Label Assignment
Weiming Liu ⋅ Jun Dan ⋅ Fan Wang ⋅ Xinting Liao ⋅ Junhao Dong ⋅ Hua Yu ⋅ Shunjie Dong ⋅ Lianyong Qi
In Room: ExHall D Poster Location: Poster #455 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MatAnyone: Stable Video Matting with Consistent Memory Propagation
Peiqing Yang ⋅ Shangchen Zhou ⋅ Jixin Zhao ⋅ Qingyi Tao ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #185 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AG-VPReID: A Challenging Large-Scale Benchmark for Aerial-Ground Video-based Person Re-Identification Project Page ↗
Huy Nguyen ⋅ Kien Nguyen Thanh ⋅ Akila Pemasiri ⋅ Feng Liu ⋅ Sridha Sridharan ⋅ Clinton Fookes
In Room: ExHall D Poster Location: Poster #100 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Anomize: Better Open Vocabulary Video Anomaly Detection
Fei Li ⋅ Wenxuan Liu ⋅ Jingjing Chen ⋅ Ruixu Zhang ⋅ Yuran Wang ⋅ Xian Zhong ⋅ Zheng Wang
In Room: ExHall D Poster Location: Poster #292 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SyncSDE: A Probabilistic Framework for Diffusion Synchronization Project Page ↗
Hyunjun Lee ⋅ Hyunsoo Lee ⋅ Sookwan Han
In Room: ExHall D Poster Location: Poster #163 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DVHGNN: Multi-Scale Dilated Vision HGNN for Efficient Vision Recognition
Caoshuo Li ⋅ Tanzhe Li ⋅ Xiaobin Hu ⋅ Donghao Luo ⋅ Taisong Jin
In Room: ExHall D Poster Location: Poster #415 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
Mingcheng Li ⋅ Xiaolu Hou ⋅ Ziyang Liu ⋅ Dingkang Yang ⋅ Ziyun Qian ⋅ Jiawei Chen ⋅ Jinjie Wei ⋅ Yue Jiang ⋅ Qingyao Xu ⋅ Lihua Zhang
In Room: ExHall D Poster Location: Poster #249 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Diffusion Bridge: Leveraging Diffusion Model to Reduce the Modality Gap Between Text and Vision for Zero-Shot Image Captioning
Jeongryong Lee ⋅ Yejee Shin ⋅ Geonhui Son ⋅ Dosik Hwang
In Room: ExHall D Poster Location: Poster #369 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Data Distributional Properties As Inductive Bias for Systematic Generalization Project Page ↗
Felipe del Rio ⋅ Alain Raymond ⋅ Daniel Florea ⋅ Rodrigo Toro Icarte ⋅ Julio Hurtado ⋅ Cristian Buc Calderon ⋅ Alvaro Soto
In Room: ExHall D Poster Location: Poster #435 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
Haicheng Wang ⋅ Chen Ju ⋅ Weixiong Lin ⋅ Mengting Chen ⋅ Shuai Xiao ⋅ Yixuan Huang ⋅ Chang Liu ⋅ mingshuai Yao ⋅ Jinsong Lan ⋅ Ying Chen ⋅ Qingwen Liu ⋅ Yanfeng Wang
In Room: ExHall D Poster Location: Poster #349 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Rethinking Noisy Video-Text Retrieval via Relation-aware Alignment
Huakai Lai ⋅ Guoxin Xiong ⋅ Huayu Mai ⋅ Xiang Liu ⋅ Tianzhu Zhang
In Room: ExHall D Poster Location: Poster #368 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Generalized Gaussian Entropy Model for Point Cloud Attribute Compression with Dynamic Likelihood Intervals
Changhao Peng
In Room: ExHall D Poster Location: Poster #109 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics
Xi Chen ⋅ Zhifei Zhang ⋅ He Zhang ⋅ Yuqian Zhou ⋅ Soo Ye Kim ⋅ Qing Liu ⋅ Yijun Li ⋅ Jianming Zhang ⋅ Nanxuan Zhao ⋅ Yilin Wang ⋅ Hui Ding ⋅ Zhe Lin ⋅ Hengshuang Zhao
In Room: ExHall D Poster Location: Poster #176 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dynamic Derivation and Elimination: Audio Visual Segmentation with Enhanced Audio Semantics
Chen Liu ⋅ Liying Yang ⋅ Peike Li ⋅ Dadong Wang ⋅ Lincheng Li ⋅ Xin Yu
In Room: ExHall D Poster Location: Poster #284 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MonoDGP: Monocular 3D Object Detection with Decoupled-Query and Geometry-Error Priors Project Page ↗
Fanqi Pu ⋅ Yifan Wang ⋅ Jiru Deng ⋅ Wenming Yang
In Room: ExHall D Poster Location: Poster #109 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
InterAct: Advancing Large-Scale Versatile 3D Human-Object Interaction Generation Project Page ↗
Sirui Xu ⋅ Dongting Li ⋅ Yucheng Zhang ⋅ Xiyan Xu ⋅ Qi Long ⋅ Ziyin Wang ⋅ Yunzhi Lu ⋅ Shuchang Dong ⋅ Hezi Jiang ⋅ Akshat Gupta ⋅ Yu-Xiong Wang ⋅ Liangyan Gui
In Room: ExHall D Poster Location: Poster #162 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Q-PART: Quasi-Periodic Adaptive Regression with Test-time Training for Pediatric Left Ventricular Ejection Fraction Regression
Jie Liu ⋅ Tiexin Qin ⋅ Hui Liu ⋅ Yilei Shi ⋅ Lichao Mou ⋅ Xiao Xiang Zhu ⋅ Shiqi Wang ⋅ Haoliang Li
In Room: ExHall D Poster Location: Poster #470 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis Project Page ↗
Jiaqi Liu ⋅ Jichao Zhang ⋅ Paolo Rota ⋅ Nicu Sebe
In Room: ExHall D Poster Location: Poster #15 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EnvPoser: Environment-aware Realistic Human Motion Estimation from Sparse Observations with Uncertainty Modeling
Songpengcheng Xia ⋅ Yu Zhang ⋅ Zhuo Su ⋅ Xiaozheng Zheng ⋅ Zheng Lv ⋅ Guidong Wang ⋅ Yongjie Zhang ⋅ Qi Wu ⋅ Lei Chu ⋅ Ling Pei
In Room: ExHall D Poster Location: Poster #155 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
One-for-More: Continual Diffusion Model for Anomaly Detection Project Page ↗
Xiaofan Li ⋅ Xin Tan ⋅ Zhuo Chen ⋅ Zhizhong Zhang ⋅ Ruixin Zhang ⋅ Rizen Guo ⋅ Guannan Jiang ⋅ Yulong Chen ⋅ Yanyun Qu ⋅ Lizhuang Ma ⋅ Yuan Xie
In Room: ExHall D Poster Location: Poster #440 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
Weijia Wu ⋅ Mingyu Liu ⋅ Zeyu Zhu ⋅ Haoen Feng ⋅ Xi Xia ⋅ Wen Wang ⋅ Kevin Qinghong Lin ⋅ Chunhua Shen ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #271 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
Vittorio Pippi ⋅ Fabio Quattrini ⋅ Silvia Cascianelli ⋅ Alessio Tonioni ⋅ Rita Cucchiara
In Room: ExHall D Poster Location: Poster #243 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
Wei Deng ⋅ Mengshi Qi ⋅ Huadong Ma
In Room: ExHall D Poster Location: Poster #345 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
Yaqi Zhao ⋅ Yuanyang Yin ⋅ Lin Li ⋅ Mingan Lin ⋅ Victor Shea-Jay Huang ⋅ Siwei Chen ⋅ Weipeng Chen ⋅ Baoqun Yin ⋅ Zenan Zhou ⋅ Wentao Zhang
In Room: ExHall D Poster Location: Poster #374 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Volumetric Surfaces: Representing Fuzzy Geometries with Layered Meshes
Stefano Esposito ⋅ Anpei Chen ⋅ Christian Reiser ⋅ Samuel Rota Bulò ⋅ Lorenzo Porzi ⋅ Katja Schwarz ⋅ Christian Richardt ⋅ Michael Zollhoefer ⋅ Peter Kontschieder ⋅ Andreas Geiger
In Room: ExHall D Poster Location: Poster #31 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HumanMM: Global Human Motion Recovery from Multi-shot Videos Project Page ↗
Yuhong Zhang ⋅ Guanlin Wu ⋅ Ling-Hao Chen ⋅ Zhuokai Zhao ⋅ Jing Lin ⋅ Xiaoke Jiang ⋅ Jiamin WU ⋅ Zhuoheng Li ⋅ Hao Frank Yang ⋅ Haoqian Wang ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #167 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MINIMA: Modality Invariant Image Matching Project Page ↗
Jiangwei Ren ⋅ Xingyu Jiang ⋅ Zizhuo Li ⋅ Dingkang Liang ⋅ Xin Zhou ⋅ Xiang Bai
In Room: ExHall D Poster Location: Poster #190 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
IAAO: Interactive Affordance Learning for Articulated Objects in 3D Environments
Can Zhang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #143 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Gaussian Eigen Models for Human Heads Project Page ↗
Wojciech Zielonka ⋅ Timo Bolkart ⋅ Thabo Beeler ⋅ Justus Thies
In Room: ExHall D Poster Location: Poster #7 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Scaling Properties of Diffusion Models For Perceptual Tasks
Rahul Ravishankar ⋅ Zeeshan Patel ⋅ Jathushan Rajasegaran ⋅ Jitendra Malik
In Room: ExHall D Poster Location: Poster #219 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MetaShadow: Object-Centered Shadow Detection, Removal, and Synthesis
Tianyu Wang ⋅ Jianming Zhang ⋅ Haitian Zheng ⋅ Zhihong Ding ⋅ Scott Cohen ⋅ Zhe Lin ⋅ Wei Xiong ⋅ Chi-Wing Fu ⋅ Luis Figueroa ⋅ Soo Ye Kim
In Room: ExHall D Poster Location: Poster #199 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Model with Spatio-Temporal Visual Representation
Yichen Xie ⋅ Runsheng Xu ⋅ Tong He ⋅ Jyh-Jing Hwang ⋅ Katie Z Luo ⋅ Jingwei Ji ⋅ Hubert Lin ⋅ Letian Chen ⋅ Yiren Lu ⋅ Zhaoqi Leng ⋅ Dragomir Anguelov ⋅ Mingxing Tan
In Room: ExHall D Poster Location: Poster #136 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FLARE: Feed-forward Geometry, Appearance and Camera Estimation from Uncalibrated Sparse Views
Shangzhan Zhang ⋅ Jianyuan Wang ⋅ Yinghao Xu ⋅ Nan Xue ⋅ Christian Rupprecht ⋅ Xiaowei Zhou ⋅ Yujun Shen ⋅ Gordon Wetzstein
In Room: ExHall D Poster Location: Poster #84 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ESC: Erasing Space Concept for Knowledge Deletion
Tae-Young Lee ⋅ Sundong Park ⋅ Minwoo Jeon ⋅ Hyoseok Hwang ⋅ Gyeong-Moon Park
In Room: ExHall D Poster Location: Poster #463 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model Project Page ↗
Yingying Fan ⋅ Quanwei Yang ⋅ Kaisiyuan Wang ⋅ Hang Zhou ⋅ Yingying Li ⋅ Haocheng Feng ⋅ Errui Ding ⋅ Yu Wu ⋅ Jingdong Wang
In Room: ExHall D Poster Location: Poster #167 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SATA: Spatial Autocorrelation Token Analysis for Enhancing the Robustness of Vision Transformers Project Page ↗
Nikaan Nikzad ⋅ YI LIAO ⋅ Yongsheng Gao ⋅ Jun Zhou
In Room: ExHall D Poster Location: Poster #415 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Spiking Transformer with Spatial-Temporal Attention Project Page ↗
Donghyun Lee ⋅ Yuhang Li ⋅ Youngeun Kim ⋅ Shiting Xiao ⋅ Priyadarshini Panda
In Room: ExHall D Poster Location: Poster #315 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Perceptual Video Compression with Neural Wrapping
Muhammad Umar Karim Khan ⋅ Aaron Chadha ⋅ Mohammad Ashraful Anam ⋅ Yiannis Andreopoulos
In Room: ExHall D Poster Location: Poster #185 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DKDM: Data-Free Knowledge Distillation for Diffusion Models with Any Architecture
Qianlong Xiang ⋅ Miao Zhang ⋅ Yuzhang Shang ⋅ Jianlong Wu ⋅ Yan Yan ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #267 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Reversible Decoupling Network for Single Image Reflection Removal Project Page ↗
Hao Zhao ⋅ Mingjia Li ⋅ Qiming Hu ⋅ Xiaojie Guo
In Room: ExHall D Poster Location: Poster #23 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model Project Page ↗
Zongjian Li ⋅ Bin Lin ⋅ Yang Ye ⋅ Liuhan Chen ⋅ Xinhua Cheng ⋅ Shenghai Yuan ⋅ Li Yuan
In Room: ExHall D Poster Location: Poster #188 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Localized Concept Erasure for Text-to-Image Diffusion Models Using Training-Free Gated Low-Rank Adaptation
Byung Hyun Lee ⋅ Sungjin Lim ⋅ Se Young Chun
In Room: ExHall D Poster Location: Poster #269 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
zefeng zhang ⋅ Hengzhu Tang ⋅ Jiawei Sheng ⋅ Zhenyu Zhang ⋅ YiMing Ren ⋅ Zhenyang Li ⋅ Dawei Yin ⋅ Duohe Ma ⋅ Tingwen Liu
In Room: ExHall D Poster Location: Poster #386 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
Shaofei Huang ⋅ Rui Ling ⋅ Tianrui Hui ⋅ Hongyu Li ⋅ Xu Zhou ⋅ Shifeng Zhang ⋅ Si Liu ⋅ Richang Hong ⋅ Meng Wang
In Room: ExHall D Poster Location: Poster #285 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MAC-Ego3D: Multi-Agent Gaussian Consensus for Real-Time Collaborative Ego-Motion and Photorealistic 3D Reconstruction
Xiaohao Xu ⋅ Feng Xue ⋅ Shibo Zhao ⋅ Yike Pan ⋅ Sebastian Scherer ⋅ Xiaonan Huang
In Room: ExHall D Poster Location: Poster #64 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Rethinking Decoder Design: Improving Biomarker Segmentation Using Depth-to-Space Restoration and Residual Linear Attention Project Page ↗
Saad Wazir ⋅ Daeyoung Kim
In Room: ExHall D Poster Location: Poster #451 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SphereUFormer: A U-Shaped Transformer for Spherical 360 Perception
Yaniv Benny ⋅ Lior Wolf
In Room: ExHall D Poster Location: Poster #72 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Advancing Generalizable Tumor Segmentation with Anomaly-Aware Open-Vocabulary Attention Maps and Frozen Foundation Diffusion Models Project Page ↗
Yankai Jiang ⋅ Peng Zhang ⋅ Donglin Yang ⋅ Yuan Tian ⋅ Hai Lin ⋅ Xiaosong Wang
In Room: ExHall D Poster Location: Poster #474 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Incorporating Dense Knowledge Alignment into Unified Multimodal Representation Models
Yuhao Cui ⋅ Xinxing Zu ⋅ Wenhua Zhang ⋅ Zhongzhou Zhao ⋅ Jinyang Gao
In Room: ExHall D Poster Location: Poster #344 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
The Devil is in Low-Level Features for Cross-Domain Few-Shot Segmentation
Yuhan Liu ⋅ Yixiong Zou ⋅ Yuhua Li ⋅ Ruixuan Li
In Room: ExHall D Poster Location: Poster #426 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
STEP: Enhancing Video-LLMs’ Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
Haiyi Qiu ⋅ Minghe Gao ⋅ Long Qian ⋅ Kaihang Pan ⋅ Qifan Yu ⋅ Juncheng Li ⋅ Wenjie Wang ⋅ Siliang Tang ⋅ Yueting Zhuang ⋅ Tat-seng Chua
In Room: ExHall D Poster Location: Poster #298 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LoRA Subtraction for Drift-Resistant Space in Exemplar-Free Continual Learning
Xuan Liu ⋅ Xiaobin Chang
In Room: ExHall D Poster Location: Poster #446 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MATCHA: Towards Matching Anything
Fei Xue ⋅ Sven Elflein ⋅ Laura Leal-Taixe ⋅ Qunjie Zhou
In Room: ExHall D Poster Location: Poster #89 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Unleashing In-context Learning of Autoregressive Models for Few-shot Image Manipulation Project Page ↗
Bolin Lai ⋅ Felix Juefei-Xu ⋅ Miao Liu ⋅ Xiaoliang Dai ⋅ Nikhil Mehta ⋅ Chenguang Zhu ⋅ Zeyi Huang ⋅ James Rehg ⋅ Sangmin Lee ⋅ Ning Zhang ⋅ Tong Xiao
In Room: ExHall D Poster Location: Poster #243 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FaceBench: A Multi-View Multi-Level Facial Attribute VQA Dataset for Benchmarking Face Perception MLLMs
Xiaoqin Wang ⋅ Xusen Ma ⋅ Xianxu Hou ⋅ Meidan Ding ⋅ Yudong Li ⋅ Junliang Chen ⋅ Wenting Chen ⋅ Xiaoyang Peng ⋅ Linlin Shen
In Room: ExHall D Poster Location: Poster #361 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Physics-Informed Blur Learning Framework for Imaging Systems
liqun.chen ⋅ Yuxuan Li ⋅ Jun Dai ⋅ Jinwei Gu ⋅ Tianfan Xue
In Room: ExHall D Poster Location: Poster #24 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Tartan IMU: A Light Foundation Model for Inertial Positioning in Robotics Project Page ↗
Shibo Zhao ⋅ Sifan Zhou ⋅ Raphael Blanchard ⋅ Yuheng Qiu ⋅ Wenshan Wang ⋅ Sebastian Scherer
In Room: ExHall D Poster Location: Poster #139 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Event Ellipsometer: Event-based Mueller-Matrix Video Imaging
Ryota Maeda ⋅ Yunseong Moon ⋅ Seung-Hwan Baek
In Room: ExHall D Poster Location: Poster #72 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MANTA: A Large-Scale Multi-View and Visual-Text Anomaly Detection Dataset for Tiny Objects
Lei Fan ⋅ Dongdong Fan ⋅ Zhiguang Hu ⋅ Yiwen Ding ⋅ Donglin Di ⋅ Kai Yi ⋅ Maurice Pagnucco ⋅ Yang Song
In Room: ExHall D Poster Location: Poster #428 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions
He Zhu ⋅ Quyu Kong ⋅ Kechun Xu ⋅ Xunlong Xia ⋅ Bing Deng ⋅ Jieping Ye ⋅ Rong Xiong ⋅ Yue Wang
In Room: ExHall D Poster Location: Poster #148 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DocLayLLM: An Efficient Multi-modal Extension of Large Language Models for Text-rich Document Understanding
Wenhui Liao ⋅ Jiapeng Wang ⋅ Hongliang Li ⋅ Chengyu Wang ⋅ Jun Huang ⋅ Lianwen Jin
In Room: ExHall D Poster Location: Poster #368 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Gradient-Guided Annealing for Domain Generalization Project Page ↗
Aristotelis Ballas ⋅ Christos Diou
In Room: ExHall D Poster Location: Poster #452 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Continuous Locomotive Crowd Behavior Generation Project Page ↗
Inhwan Bae ⋅ Junoh Lee ⋅ Hae-Gon Jeon
In Room: ExHall D Poster Location: Poster #130 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EDEN: Enhanced Diffusion for High-quality Large-motion Video Frame Interpolation Project Page ↗
Zihao Zhang ⋅ Haoran Chen ⋅ Haoyu Zhao ⋅ Guansong Lu ⋅ Yanwei Fu ⋅ Hang Xu ⋅ Zuxuan Wu
In Room: ExHall D Poster Location: Poster #182 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UNIC-Adapter: Unified Image-instruction Adapter with Multi-modal Transformer for Image Generation
Lunhao Duan ⋅ Shanshan Zhao ⋅ Wenjun Yan ⋅ Yinglun Li ⋅ Qing-Guo Chen ⋅ Zhao Xu ⋅ Weihua Luo ⋅ Kaifu Zhang ⋅ Mingming Gong ⋅ Gui-Song Xia
In Room: ExHall D Poster Location: Poster #248 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LongVALE: Vision-Audio-Language-Event Benchmark Towards Time-Aware Omni-Modal Perception of Long Videos Project Page ↗
Tiantian Geng ⋅ Jinrui Zhang ⋅ Qingni Wang ⋅ Teng Wang ⋅ Jinming Duan ⋅ Feng Zheng
In Room: ExHall D Poster Location: Poster #302 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
IDOL: Instant Photorealistic 3D Human Creation from a Single Image Project Page ↗
Yiyu Zhuang ⋅ Jiaxi Lv ⋅ Hao Wen ⋅ Qing Shuai ⋅ Ailing Zeng ⋅ Hao Zhu ⋅ Shifeng Chen ⋅ Yujiu Yang ⋅ Xun Cao ⋅ Wei Liu
In Room: ExHall D Poster Location: Poster #10 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Decouple Distortion from Perception: Region Adaptive Diffusion for Extreme-low Bitrate Perception Image Compression
Jinchang Xu ⋅ Shaokang Wang ⋅ Jintao Chen ⋅ Zhe Li ⋅ Peidong Jia ⋅ Fei Zhao ⋅ Guoqing Xiang ⋅ Zhijian Hao ⋅ Shanghang Zhang ⋅ Xiaodong Xie
In Room: ExHall D Poster Location: Poster #214 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Adversarial Diffusion Compression for Real-World Image Super-Resolution
Bin Chen ⋅ Gehui Li ⋅ Rongyuan Wu ⋅ Xindong Zhang ⋅ Jie Chen ⋅ Jian Zhang ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #195 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BARD-GS: Blur-Aware Reconstruction of Dynamic Scenes via Gaussian Splatting Project Page ↗
Yiren Lu ⋅ Yunlai Zhou ⋅ Disheng Liu ⋅ tuo liang ⋅ Yu Yin
In Room: ExHall D Poster Location: Poster #66 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Effortless Active Labeling for Long-Term Test-Time Adaptation
Guowei Wang ⋅ Changxing Ding
In Room: ExHall D Poster Location: Poster #439 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Universal AI-Generated Image Detection by Variational Information Bottleneck Network
Haifeng Zhang ⋅ Qinghui He ⋅ Xiuli Bi ⋅ Weisheng Li ⋅ Bo Liu ⋅ Bin Xiao
In Room: ExHall D Poster Location: Poster #269 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AlphaPre: Amplitude-Phase Disentanglement Model for Precipitation Nowcasting
Kenghong Lin ⋅ Baoquan Zhang ⋅ Demin Yu ⋅ Wenzhi Feng ⋅ Shidong Chen ⋅ Feifan Gao ⋅ Xutao Li ⋅ Yunming Ye
In Room: ExHall D Poster Location: Poster #194 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SLADE: Shielding against Dual Exploits in Large Vision-Language Models
Md Zarif Hossain ⋅ AHMED IMTEAJ
In Room: ExHall D Poster Location: Poster #308 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AI-Face: A Million-Scale Demographically Annotated AI-Generated Face Dataset and Fairness Benchmark Project Page ↗
Li Lin ⋅ Santosh Santosh ⋅ Mingyang Wu ⋅ Xin Wang ⋅ Shu Hu
In Room: ExHall D Poster Location: Poster #318 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Keep the Balance: A Parameter-Efficient Symmetrical Framework for RGB+X Semantic Segmentation
Jiaxin Cai ⋅ Jingze Su ⋅ Qi Li ⋅ Wenjie Yang ⋅ Shu Wang ⋅ Tiesong Zhao ⋅ Shengfeng He ⋅ Wenxi Liu
In Room: ExHall D Poster Location: Poster #410 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
TopoCellGen: Generating Histopathology Cell Topology with a Diffusion Model Project Page ↗
Meilong Xu ⋅ Saumya Gupta ⋅ Xiaoling Hu ⋅ Chen Li ⋅ Shahira Abousamra ⋅ Dimitris Samaras ⋅ Prateek Prasanna ⋅ Chao Chen
In Room: ExHall D Poster Location: Poster #458 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LLM-driven Multimodal and Multi-Identity Listening Head Generation
Peiwen Lai ⋅ Weizhi Zhong ⋅ Yipeng Qin ⋅ Xiaohang Ren ⋅ Baoyuan Wang ⋅ Guanbin Li
In Room: ExHall D Poster Location: Poster #1 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GOAL: Global-local Object Alignment Learning Project Page ↗
Hyungyu Choi ⋅ Young Kyun Jang ⋅ Chanho Eom
In Room: ExHall D Poster Location: Poster #372 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PBR-NeRF: Inverse Rendering with Physics-Based Neural Fields Project Page ↗
Sean Wu ⋅ Shamik Basu ⋅ Tim Broedermann ⋅ Luc Van Gool ⋅ Christos Sakaridis
In Room: ExHall D Poster Location: Poster #31 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation
Yuanbo Yang ⋅ Jiahao Shao ⋅ Xinyang Li ⋅ Yujun Shen ⋅ Andreas Geiger ⋅ Yiyi Liao
In Room: ExHall D Poster Location: Poster #258 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
No Pains, More Gains: Recycling Sub-Salient Patches for Efficient High-Resolution Image Recognition
Rong Qin ⋅ Xin Liu ⋅ Xingyu Liu ⋅ Jiaxuan Liu ⋅ Jinglei Shi ⋅ Liang Lin ⋅ Jufeng Yang
In Room: ExHall D Poster Location: Poster #413 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Incomplete Multi-modal Brain Tumor Segmentation via Learnable Sorting State Space Model
Zheyu Zhang ⋅ Yayuan Lu ⋅ Feipeng Ma ⋅ Yueyi Zhang ⋅ Huanjing Yue ⋅ Xiaoyan Sun
In Room: ExHall D Poster Location: Poster #475 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FreeUV: Ground-Truth-Free Realistic Facial UV Texture Recovery via Cross-Assembly Inference Strategy Project Page ↗
Xingchao Yang ⋅ Takafumi Taketomi ⋅ Yuki Endo ⋅ Yoshihiro Kanamori
In Room: ExHall D Poster Location: Poster #15 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HarmonySet: A Comprehensive Dataset for Understanding Video-Music Semantic Alignment and Temporal Synchronization Project Page ↗
Zitang Zhou ⋅ Ke Mei ⋅ Yu Lu ⋅ Tianyi Wang ⋅ Fengyun Rao
In Room: ExHall D Poster Location: Poster #286 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression Project Page ↗
Zichong Meng ⋅ Yiming Xie ⋅ Xiaogang Peng ⋅ Zeyu Han ⋅ Huaizu Jiang
In Room: ExHall D Poster Location: Poster #161 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking
Xuanyu Zhang ⋅ Zecheng Tang ⋅ Zhipei Xu ⋅ Runyi Li ⋅ Youmin Xu ⋅ Bin Chen ⋅ Feng Gao ⋅ Jian Zhang
In Room: ExHall D Poster Location: Poster #272 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ClearSight: Visual Signal Enhancement for Object Hallucination Mitigation in Multimodal Large Language Models
Hao Yin ⋅ Guangzong Si ⋅ Zilei Wang
In Room: ExHall D Poster Location: Poster #381 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Stretching Each Dollar: Diffusion Training from Scratch on a Micro-Budget Project Page ↗
Vikash Sehwag ⋅ Xianghao Kong ⋅ Jingtao Li ⋅ Michael Spranger ⋅ Lingjuan Lyu
In Room: ExHall D Poster Location: Poster #232 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Guiding Human-Object Interactions with Rich Geometry and Relations
Mengqing Xue ⋅ Yifei Liu ⋅ Ling Guo ⋅ Shaoli Huang ⋅ Changxing Ding
In Room: ExHall D Poster Location: Poster #157 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
TacoDepth: Towards Efficient Radar-Camera Depth Estimation with One-stage Fusion
Yiran Wang ⋅ Jiaqi Li ⋅ Chaoyi Hong ⋅ Ruibo Li ⋅ Liusheng Sun ⋅ Xiao Song ⋅ Zhe Wang ⋅ Zhiguo Cao ⋅ Guosheng Lin
In Room: ExHall D Poster Location: Poster #110 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Physical Plausibility-aware Trajectory Prediction via Locomotion Embodiment Project Page ↗
Hiromu Taketsugu ⋅ Takeru Oba ⋅ Takahiro Maeda ⋅ Shohei Nobuhara ⋅ Norimichi Ukita
In Room: ExHall D Poster Location: Poster #160 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CADDreamer: CAD Object Generation from Single-view Images
Yuan Li ⋅ Cheng Lin ⋅ Yuan Liu ⋅ Xiaoxiao Long ⋅ Chenxu Zhang ⋅ Ningna Wang ⋅ Xin Li ⋅ Wenping Wang ⋅ Xiaohu Guo
In Room: ExHall D Poster Location: Poster #38 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Vision-Language Model IP Protection via Prompt-based Learning Project Page ↗
Lianyu Wang ⋅ Meng Wang ⋅ Huazhu Fu ⋅ Daoqiang Zhang
In Room: ExHall D Poster Location: Poster #393 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Where's the Liability in the Generative Era? Recovery-based Black-Box Detection of AI-Generated Content
Haoyue Bai ⋅ Yiyou Sun ⋅ Wei Cheng ⋅ Haifeng Chen
In Room: ExHall D Poster Location: Poster #253 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiTASK: Multi-Task Fine-Tuning with Diffeomorphic Transformations Project Page ↗
Krishna Sri Ipsit Mantri ⋅ Carola-Bibiane Schönlieb ⋅ Bruno Ribeiro ⋅ Chaim Baskin ⋅ Moshe Eliasof
In Room: ExHall D Poster Location: Poster #399 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OW-OVD: Unified Open World and Open Vocabulary Object Detection
Xing Xi ⋅ Yangyang Huang ⋅ Ronghua Luo ⋅ Yu Qiu
In Room: ExHall D Poster Location: Poster #421 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
Dongxu Wei ⋅ Zhiqi Li ⋅ Peidong Liu
In Room: ExHall D Poster Location: Poster #121 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Improving Diffusion Inverse Problem Solving with Decoupled Noise Annealing
Bingliang Zhang ⋅ Wenda Chu ⋅ Julius Berner ⋅ Chenlin Meng ⋅ Anima Anandkumar ⋅ Yang Song
In Room: ExHall D Poster Location: Poster #200 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AvatarArtist: Open-Domain 4D Avatarization
Hongyu Liu ⋅ Xuan Wang ⋅ Ziyu Wan ⋅ Yue Ma ⋅ Jingye Chen ⋅ Yanbo Fan ⋅ Yujun Shen ⋅ Yibing Song ⋅ Qifeng Chen
In Room: ExHall D Poster Location: Poster #10 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
Zhendong Wang ⋅ Jianmin Bao ⋅ Shuyang Gu ⋅ Dong Chen ⋅ Wengang Zhou ⋅ Houqiang Li
In Room: ExHall D Poster Location: Poster #239 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Using Powerful Prior Knowledge of Diffusion Model in Deep Unfolding Networks for Image Compressive Sensing Project Page ↗
Chen Liao ⋅ Yan Shen ⋅ Dan Li ⋅ Zhongli Wang
In Room: ExHall D Poster Location: Poster #209 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content
Qiuheng Wang ⋅ Yukai Shi ⋅ Jiarong Ou ⋅ Rui Chen ⋅ Ke Lin ⋅ Jiahao Wang ⋅ Boyuan Jiang ⋅ Haotian Yang ⋅ Mingwu Zheng ⋅ Xin Tao ⋅ Fei Yang ⋅ Pengfei Wan ⋅ Di ZHANG
In Room: ExHall D Poster Location: Poster #292 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models
Matt Deitke ⋅ Christopher Clark ⋅ Sangho Lee ⋅ Rohun Tripathi ⋅ Yue Yang ⋅ Jae Sung Park ⋅ Reza Salehi ⋅ Niklas Muennighoff ⋅ Kyle Lo ⋅ Luca Soldaini ⋅ Jiasen Lu ⋅ Taira Anderson ⋅ Erin Bransom ⋅ Kiana Ehsani ⋅ Huong Ngo ⋅ Yen-Sung Chen ⋅ Ajay Patel ⋅ Mark Yatskar ⋅ Chris Callison-Burch ⋅ Andrew Head ⋅ Rose Hendrix ⋅ Favyen Bastani ⋅ Eli VanderBilt ⋅ Nathan Lambert ⋅ Yvonne Chou ⋅ Arnavi Chheda-Kothary ⋅ Jenna Sparks ⋅ Sam Skjonsberg ⋅ Michael Schmitz ⋅ Aaron Sarnat ⋅ Byron Bischoff ⋅ Pete Walsh ⋅ Christopher Newell ⋅ Piper Wolters ⋅ Tanmay Gupta ⋅ Kuo-Hao Zeng ⋅ Jon Borchardt ⋅ Dirk Groeneveld ⋅ Crystal Nam ⋅ Sophie Lebrecht ⋅ Caitlin Wittlif ⋅ Carissa Schoenick ⋅ Oscar Michel ⋅ Ranjay Krishna ⋅ Luca Weihs ⋅ Noah A. Smith ⋅ Hannaneh Hajishirzi ⋅ Ross Girshick ⋅ Ali Farhadi ⋅ Aniruddha Kembhavi
In Room: ExHall D Poster Location: Poster #370 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DriveGPT4-V2: Harnessing Large Language Model Capabilities for Enhanced Closed-Loop Autonomous Driving
Zhenhua Xu ⋅ Yan Bai ⋅ Yujia Zhang ⋅ Zhuoling Li ⋅ Fei Xia ⋅ Kwan-Yee K. Wong ⋅ Jianqiang Wang ⋅ Hengshuang Zhao
In Room: ExHall D Poster Location: Poster #138 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
High-Fidelity Lightweight Mesh Reconstruction from Point Clouds Project Page ↗
Chen Zhang ⋅ Wentao Wang ⋅ Ximeng Li ⋅ Xinyao Liao ⋅ Wanjuan Su ⋅ Wenbing Tao
In Room: ExHall D Poster Location: Poster #105 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ORIDa: Object-centric Real-world Image Composition Dataset
Jinwoo Kim ⋅ Sangmin Han ⋅ Jinho Jeong ⋅ Jiwoo Choi ⋅ Dongyoung Kim ⋅ Seon Joo Kim
In Room: ExHall D Poster Location: Poster #276 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OSDFace: One-Step Diffusion Model for Face Restoration Project Page ↗
Jingkai Wang ⋅ Jue Gong ⋅ Lin Zhang ⋅ Zheng Chen ⋅ Xing Liu ⋅ Hong Gu ⋅ Yutong Liu ⋅ Yulun Zhang ⋅ Xiaokang Yang
In Room: ExHall D Poster Location: Poster #189 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Task Singular Vectors: Reducing Task Interference in Model Merging
Antonio Andrea Gargiulo ⋅ Donato Crisostomi ⋅ Maria Sofia Bucarelli ⋅ Simone Scardapane ⋅ Fabrizio Silvestri ⋅ Emanuele Rodolà
In Room: ExHall D Poster Location: Poster #278 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Dragin3D: Image Editing by Dragging in 3D Space
Weiran Guang ⋅ Xiaoguang Gu ⋅ Mengqi Huang ⋅ Zhendong Mao
In Room: ExHall D Poster Location: Poster #43 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation
Kaiyue Sun ⋅ Kaiyi Huang ⋅ Xian Liu ⋅ Yue Wu ⋅ Zihan Xu ⋅ Zhenguo Li ⋅ Xihui Liu
In Room: ExHall D Poster Location: Poster #290 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Self-Evolving Visual Concept Library using Vision-Language Critics Project Page ↗
Atharva Sehgal ⋅ Patrick Yuan ⋅ Ziniu Hu ⋅ Yisong Yue ⋅ Jennifer J. Sun ⋅ Swarat Chaudhuri
In Room: ExHall D Poster Location: Poster #236 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
TFCustom: Customized Image Generation with Time-Aware Frequency Feature Guidance
Mushui Liu ⋅ Dong She ⋅ Qihan Huang ⋅ Jiacheng Ying ⋅ Wanggui He ⋅ Jingxuan Pang ⋅ Yuanlei Hou ⋅ Siming Fu
In Room: ExHall D Poster Location: Poster #244 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SketchFusion: Learning Universal Sketch Features through Fusing Foundation Models Project Page ↗
Subhadeep Koley ⋅ Tapas Kumar Dutta ⋅ Aneeshan Sain ⋅ Pinaki Nath Chowdhury ⋅ Ayan Kumar Bhunia ⋅ Yi-Zhe Song
In Room: ExHall D Poster Location: Poster #229 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Invisible Backdoor Attack against Self-supervised Learning Project Page ↗
Hanrong Zhang ⋅ Zhenting Wang ⋅ Boheng Li ⋅ Fulin Lin ⋅ Tingxu Han ⋅ Mingyu Jin ⋅ Chenlu Zhan ⋅ Mengnan Du ⋅ Hongwei Wang ⋅ Shiqing Ma
In Room: ExHall D Poster Location: Poster #455 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
BWFormer: Building Wireframe Reconstruction from Airborne LiDAR Point Cloud with Transformer
Yuzhou Liu ⋅ Lingjie Zhu ⋅ Hanqiao Ye ⋅ Shangfeng Huang ⋅ Xiang Gao ⋅ Xianwei Zheng ⋅ Shuhan Shen
In Room: ExHall D Poster Location: Poster #111 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models Project Page ↗
Jinjin Zhang ⋅ qiuyu Huang ⋅ Junjie Liu ⋅ Xiefan Guo ⋅ Di Huang
In Room: ExHall D Poster Location: Poster #230 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AffordDP: Generalizable Diffusion Policy with Transferable Affordance
Shijie Wu ⋅ Yihang Zhu ⋅ Yunao Huang ⋅ Kaizhen Zhu ⋅ Jiayuan Gu ⋅ Jingyi Yu ⋅ Ye Shi ⋅ Jingya Wang
In Room: ExHall D Poster Location: Poster #153 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation Project Page ↗
Hermann Kumbong ⋅ Xian Liu ⋅ Tsung-Yi Lin ⋅ Ming-Yu Liu ⋅ Xihui Liu ⋅ Ziwei Liu ⋅ Daniel Y Fu ⋅ Christopher Re ⋅ David W. Romero
In Room: ExHall D Poster Location: Poster #227 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
Shihao Wang ⋅ Zhiding Yu ⋅ Xiaohui Jiang ⋅ Shiyi Lan ⋅ Min Shi ⋅ Nadine Chang ⋅ Jan Kautz ⋅ Ying Li ⋅ Jose M. Alvarez
In Room: ExHall D Poster Location: Poster #132 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MeGA: Hybrid Mesh-Gaussian Head Avatar for High-Fidelity Rendering and Head Editing
Cong Wang ⋅ Di Kang ⋅ Heyi Sun ⋅ SHENHAN QIAN ⋅ Zixuan Wang ⋅ Linchao Bao ⋅ Song-Hai Zhang
In Room: ExHall D Poster Location: Poster #7 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Image Generation Diversity Issues and How to Tame Them Project Page ↗
Mischa Dombrowski ⋅ Weitong Zhang ⋅ Hadrien Reynaud ⋅ Sarah Cechnicka ⋅ Bernhard Kainz
In Room: ExHall D Poster Location: Poster #274 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Annotation Ambiguity Aware Semi-Supervised Medical Image Segmentation
Suruchi Kumari ⋅ Pravendra Singh
In Room: ExHall D Poster Location: Poster #479 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CAP4D: Creating Animatable 4D Portrait Avatars with Morphable Multi-View Diffusion Models Project Page ↗
Felix Taubner ⋅ Ruihang Zhang ⋅ Mathieu Tuli ⋅ David B. Lindell
In Room: ExHall D Poster Location: Poster #9 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Comprehensive Information Bottleneck for Unveiling Universal Attribution to Interpret Vision Transformers
Jung-Ho Hong ⋅ Ho-Joong Kim ⋅ Kyu-Sung Jeon ⋅ Seong-Whan Lee
In Room: ExHall D Poster Location: Poster #394 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OpticalNet: An Optical Imaging Dataset and Benchmark Beyond the Diffraction Limit
Benquan Wang ⋅ Ruyi An ⋅ Jin-Kyu So ⋅ Sergei Kurdiumov ⋅ Eng Aik Chan ⋅ Giorgio Adamo ⋅ Yuhan Peng ⋅ Yewen Li ⋅ Bo An
In Room: ExHall D Poster Location: Poster #23 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dataset Distillation with Neural Characteristic Function: A Minmax Perspective
Shaobo Wang ⋅ Yicun Yang ⋅ Zhiyuan Liu ⋅ Chenghao Sun ⋅ Xuming Hu ⋅ Conghui He ⋅ Linfeng Zhang
In Room: ExHall D Poster Location: Poster #433 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Free-viewpoint Human Animation with Pose-correlated Reference Selection Project Page ↗
Fa-Ting Hong ⋅ Zhan Xu ⋅ Haiyang Liu ⋅ Qinjie Lin ⋅ Luchuan Song ⋅ ZHIXIN SHU ⋅ Yang Zhou ⋅ Duygu Ceylan ⋅ Dan Xu
In Room: ExHall D Poster Location: Poster #5 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CORE4D: A 4D Human-Object-Human Interaction Dataset for Collaborative Object REarrangement
Yun Liu ⋅ Chengwen Zhang ⋅ Ruofan Xing ⋅ Bingda Tang ⋅ Bowen Yang ⋅ Li Yi
In Room: ExHall D Poster Location: Poster #149 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PillarHist: A Quantization-aware Pillar Feature Encoder based on Height-aware Histogram
Sifan Zhou ⋅ Zhihang Yuan ⋅ Dawei Yang ⋅ Ziyu Zhao ⋅ Jian Qian ⋅ Xing Hu
In Room: ExHall D Poster Location: Poster #113 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
POp-GS: Next Best View in 3D-Gaussian Splatting with P-Optimality
Joey Wilson ⋅ Marcelino M. de Almeida ⋅ Sachit Mahajan ⋅ Martin Labrie ⋅ Maani Ghaffari ⋅ Omid Ghasemalizadeh ⋅ Min Sun ⋅ Cheng-Hao Kuo ⋅ Arnab Sen
In Room: ExHall D Poster Location: Poster #331 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
StyleStudio: Text-Driven Style Transfer with Selective Control of Style Elements Project Page ↗
Mingkun Lei ⋅ Xue Song ⋅ Beier Zhu ⋅ Hao Wang ⋅ Chi Zhang
In Room: ExHall D Poster Location: Poster #228 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning Project Page ↗
Bozhou Zhang ⋅ Nan Song ⋅ Xin Jin ⋅ Li Zhang
In Room: ExHall D Poster Location: Poster #142 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
EIDT-V: Exploiting Intersections in Diffusion Trajectories for Model-Agnostic, Zero-Shot, Training-Free Text-to-Video Generation
Diljeet Jagpal ⋅ Xi Chen ⋅ Vinay P. Namboodiri
In Room: ExHall D Poster Location: Poster #231 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Temporal Score Analysis for Understanding and Correcting Diffusion Artifacts Project Page ↗
Yu Cao ⋅ Zengqun Zhao ⋅ Ioannis Patras ⋅ Shaogang Gong
In Room: ExHall D Poster Location: Poster #224 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Cross-View Completion Models are Zero-shot Correspondence Estimators
Honggyu An ⋅ Jin Hyeon Kim ⋅ Seonghoon Park ⋅ Sunghwan Hong ⋅ Jaewoo Jung ⋅ Jisang Han ⋅ Seungryong Kim
In Room: ExHall D Poster Location: Poster #87 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-party Collaborative Attention Control for Image Customization
Han Yang ⋅ Chuanguang Yang ⋅ Qiuli Wang ⋅ Zhulin An ⋅ Weilun Feng ⋅ Libo Huang ⋅ Yongjun Xu
In Room: ExHall D Poster Location: Poster #246 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Reproducible Vision-Language Models Meet Concepts Out of Pre-Training Project Page ↗
Ziliang Chen ⋅ Xin Huang ⋅ Xiaoxuan Fan ⋅ Keze Wang ⋅ Yuyu Zhou ⋅ Quanlong Guan ⋅ Liang Lin
In Room: ExHall D Poster Location: Poster #388 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation Project Page ↗
Guy Yariv ⋅ Yuval Kirstain ⋅ Amit Zohar ⋅ Shelly Sheynin ⋅ Yaniv Taigman ⋅ Yossi Adi ⋅ Sagie Benaim ⋅ Adam Polyak
In Room: ExHall D Poster Location: Poster #228 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AIM-Fair: Advancing Algorithmic Fairness via Selectively Fine-Tuning Biased Models with Contextual Synthetic Data Project Page ↗
Zengqun Zhao ⋅ Ziquan Liu ⋅ Yu Cao ⋅ Shaogang Gong ⋅ Ioannis Patras
In Room: ExHall D Poster Location: Poster #246 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ReWind: Understanding Long Videos with Instructed Learnable Memory
Anxhelo Diko ⋅ Tinghuai Wang ⋅ Wassim Swaileh ⋅ Shiyan Sun ⋅ Ioannis Patras
In Room: ExHall D Poster Location: Poster #295 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Segment Anything, Even Occluded
Wei-En Tai ⋅ Yu-Lin Shih ⋅ Cheng Sun ⋅ Yu-Chiang Frank Wang ⋅ Hwann-Tzong Chen
In Room: ExHall D Poster Location: Poster #309 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Advancing Multiple Instance Learning with Continual Learning for Whole Slide Imaging
Xianrui Li ⋅ Yufei Cui ⋅ Jun Li ⋅ Antoni B. Chan
In Room: ExHall D Poster Location: Poster #475 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ABBSPO: Adaptive Bounding Box Scaling and Symmetric Prior based Orientation Prediction for Detecting Aerial Image Objects
Woojin Lee ⋅ Hyugjae Chang ⋅ Jaeho Moon ⋅ Jaehyup Lee ⋅ Munchurl Kim
In Room: ExHall D Poster Location: Poster #332 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Decoupled Distillation to Erase: A General Unlearning Method for Any Class-centric Tasks
Yu Zhou ⋅ Dian Zheng ⋅ Qijie Mo ⋅ Ren-Jie Lu ⋅ Kun-Yu Lin ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #433 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
TAET: Two-Stage Adversarial Equalization Training on Long-Tailed Distributions Project Page ↗
Wang Yu-Hang ⋅ Junkang Guo ⋅ Aolei Liu ⋅ Kaihao Wang ⋅ Zaitong Wu ⋅ Zhenyu Liu ⋅ Wenfei Yin ⋅ Jian Liu
In Room: ExHall D Poster Location: Poster #462 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Do Your Best and Get Enough Rest for Continual Learning Project Page ↗
Hankyul Kang ⋅ Gregor Seifer ⋅ Donghyun Lee ⋅ Jongbin Ryu
In Room: ExHall D Poster Location: Poster #448 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Mamba as a Bridge: Where Vision Foundation Models Meet Vision Language Models for Domain-Generalized Semantic Segmentation Project Page ↗
Xin Zhang ⋅ Robby T. Tan
In Room: ExHall D Poster Location: Poster #370 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Vision-Guided Action: Enhancing 3D Human Motion Prediction with Gaze-informed Affordance in 3D Scenes Project Page ↗
Ting Yu ⋅ Yi Lin ⋅ Jun Yu ⋅ Zhenyu Lou ⋅ Qiongjie Cui
In Room: ExHall D Poster Location: Poster #161 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ChainHOI: Joint-based Kinematic Chain Modeling for Human-Object Interaction Generation
Ling-An Zeng ⋅ Guohong Huang ⋅ Yi-Lin Wei ⋅ Shengbo Gu ⋅ Yu-Ming Tang ⋅ Jingke Meng ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #163 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CLOC: Contrastive Learning for Ordinal Classification with Multi-Margin N-pair Loss Project Page ↗
Dileepa Pitawela ⋅ Gustavo Carneiro ⋅ Hsiang-Ting Chen
In Room: ExHall D Poster Location: Poster #468 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Universal Actions for Enhanced Embodied Foundation Models Project Page ↗
Jinliang Zheng ⋅ Jianxiong Li ⋅ Dongxiu Liu ⋅ Yinan Zheng ⋅ Zhihao Wang ⋅ Zhonghong Ou ⋅ Yu Liu ⋅ Jingjing Liu ⋅ Ya-Qin Zhang ⋅ Xianyuan Zhan
In Room: ExHall D Poster Location: Poster #138 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ObjectMover: Generative Object Movement with Video Prior Project Page ↗
Xin Yu ⋅ Tianyu Wang ⋅ Soo Ye Kim ⋅ Paul Guerrero ⋅ Xi Chen ⋅ Qing Liu ⋅ Zhe Lin ⋅ Xiaojuan Qi
In Room: ExHall D Poster Location: Poster #179 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LoTUS: Large-Scale Machine Unlearning with a Taste of Uncertainty Project Page ↗
Christoforos N. Spartalis ⋅ Theodoros Semertzidis ⋅ Efstratios Gavves ⋅ Petros Daras
In Room: ExHall D Poster Location: Poster #445 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DiffFNO: Diffusion Fourier Neural Operator Project Page ↗
Xiaoyi Liu ⋅ Hao Tang
In Room: ExHall D Poster Location: Poster #195 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SEC-Prompt:SEmantic Complementary Prompting for Few-Shot Class-Incremental Learning
Ye Liu ⋅ Meng Yang
In Room: ExHall D Poster Location: Poster #440 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LiMoE: Mixture of LiDAR Representation Learners from Automotive Scenes Project Page ↗
Xiang Xu ⋅ Lingdong Kong ⋅ hui shuai ⋅ Liang Pan ⋅ Ziwei Liu ⋅ Qingshan Liu
In Room: ExHall D Poster Location: Poster #116 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
WAVE: Weight Templates for Adaptive Initialization of Variable-sized Models
Fu Feng ⋅ Yucheng Xie ⋅ Jing Wang ⋅ Xin Geng
In Room: ExHall D Poster Location: Poster #445 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PI-HMR: Towards Robust In-bed Temporal Human Shape Reconstruction with Contact Pressure Sensing
Ziyu Wu ⋅ Yufan Xiong ⋅ Mengting Niu ⋅ Fangting Xie ⋅ Quan Wan ⋅ Qijun Ying ⋅ Boyan Liu ⋅ Xiaohui Cai
In Room: ExHall D Poster Location: Poster #150 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CXPMRG-Bench: Pre-training and Benchmarking for X-ray Medical Report Generation on CheXpert Plus Dataset Project Page ↗
Xiao Wang ⋅ Fuling Wang ⋅ Yuehang Li ⋅ Qingchuan Ma ⋅ Shiao Wang ⋅ Bo Jiang ⋅ Jin Tang
In Room: ExHall D Poster Location: Poster #474 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Mind the Trojan Horse: Image Prompt Adapter Enabling Scalable and Deceptive Jailbreaking Project Page ↗
Junxi Chen ⋅ Junhao Dong ⋅ Xiaohua Xie
In Room: ExHall D Poster Location: Poster #265 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Lost in Translation, Found in Context: Sign Language Translation with Contextual Cues
Youngjoon Jang ⋅ Haran Raajesh ⋅ Liliane Momeni ⋅ Gul Varol ⋅ Andrew Zisserman
In Room: ExHall D Poster Location: Poster #322 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CraftsMan3D: High-fidelity Mesh Generation with 3D Native Diffusion and Interactive Geometry Refiner
Weiyu Li ⋅ Jiarui Liu ⋅ Hongyu Yan ⋅ Rui Chen ⋅ Yixun Liang ⋅ Xuelin Chen ⋅ Ping Tan ⋅ Xiaoxiao Long
In Room: ExHall D Poster Location: Poster #40 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Synchronized Video-to-Audio Generation via Mel Quantization-Continuum Decomposition
Juncheng Wang ⋅ Chao Xu ⋅ Cheng Yu ⋅ Lei Shang ⋅ Zhe Hu ⋅ Shujun Wang ⋅ Liefeng Bo
In Room: ExHall D Poster Location: Poster #282 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Semantic-guided Cross-Modal Prompt Learning for Skeleton-based Zero-shot Action Recognition
Anqi Zhu ⋅ Jingmin Zhu ⋅ James Bailey ⋅ Mingming Gong ⋅ Qiuhong Ke
In Room: ExHall D Poster Location: Poster #308 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting
Chengyou Jia ⋅ Changliang Xia ⋅ Zhuohang Dang ⋅ Weijia Wu ⋅ Hangwei Qian ⋅ Minnan Luo
In Room: ExHall D Poster Location: Poster #251 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dora: Sampling and Benchmarking for 3D Shape Variational Auto-Encoders Project Page ↗
Rui Chen ⋅ Jianfeng Zhang ⋅ Yixun Liang ⋅ Guan Luo ⋅ Weiyu Li ⋅ Jiarui Liu ⋅ Xiu Li ⋅ Xiaoxiao Long ⋅ Jiashi Feng ⋅ Ping Tan
In Room: ExHall D Poster Location: Poster #38 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VEU-Bench: Towards Comprehensive Understanding of Video Editing
Bozheng Li ⋅ Yongliang Wu ⋅ YI LU ⋅ Jiashuo Yu ⋅ Licheng Tang ⋅ Jiawang Cao ⋅ Wenqing Zhu ⋅ Yuyang Sun ⋅ Jay Wu ⋅ Wenbo Zhu
In Room: ExHall D Poster Location: Poster #289 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PatchVSR: Breaking Video Diffusion Resolution Limits with Patch-wise Video Super-Resolution
Shian Du ⋅ Menghan Xia ⋅ Chang Liu ⋅ Xintao Wang ⋅ Jing Wang ⋅ Pengfei Wan ⋅ Di ZHANG ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #190 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FluxSpace: Disentangled Semantic Editing in Rectified Flow Models Project Page ↗
Yusuf Dalva ⋅ Kavana Venkatesh ⋅ Pinar Yanardag
In Room: ExHall D Poster Location: Poster #232 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Free360: Layered Gaussian Splatting for Unbounded 360-Degree View Synthesis from Extremely Sparse and Unposed Views
Chong Bao ⋅ Xiyu Zhang ⋅ Zehao Yu ⋅ Jiale Shi ⋅ Guofeng Zhang ⋅ Songyou Peng ⋅ Zhaopeng Cui
In Room: ExHall D Poster Location: Poster #51 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Touch2Shape: Touch-Conditioned 3D Diffusion for Shape Exploration and Reconstruction
Yuanbo Wang ⋅ Zhaoxuan Zhang ⋅ Jiajin Qiu ⋅ Dilong Sun ⋅ Zhengyu Meng ⋅ Xiaopeng Wei ⋅ Xin Yang
In Room: ExHall D Poster Location: Poster #20 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ProAPO: Progressively Automatic Prompt Optimization for Visual Classification Project Page ↗
Xiangyan Qu ⋅ Gaopeng Gou ⋅ Jiamin Zhuang ⋅ Jing Yu ⋅ Kun Song ⋅ Qihao Wang ⋅ Yili Li ⋅ Gang Xiong
In Room: ExHall D Poster Location: Poster #392 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ShapeWords: Guiding Text-to-Image Synthesis with 3D Shape-Aware Prompts Project Page ↗
Dmitrii M Petrov ⋅ Pradyumn Goyal ⋅ Divyansh Shivashok ⋅ Yuanming Tao ⋅ Melinos Averkiou ⋅ Evangelos Kalogerakis
In Room: ExHall D Poster Location: Poster #253 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Black Swan: Abductive and Defeasible Video Reasoning in Unpredictable Events
Aditya Chinchure ⋅ Sahithya Ravi ⋅ Raymond Ng ⋅ Vered Shwartz ⋅ Boyang Li ⋅ Leonid Sigal
In Room: ExHall D Poster Location: Poster #304 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
TANGO: Training-free Embodied AI Agents for Open-world Tasks
Filippo Ziliotto ⋅ Tommaso Campari ⋅ Luciano Serafini ⋅ Lamberto Ballan
In Room: ExHall D Poster Location: Poster #342 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation Project Page ↗
Yuan Gan ⋅ Jiaxu Miao ⋅ Yunze Wang ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #266 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Filter Images First, Generate Instructions Later: Pre-Instruction Data Selection for Visual Instruction Tuning
Bardia Safaei ⋅ Faizan Siddiqui ⋅ Jiacong Xu ⋅ Vishal M. Patel ⋅ Shao-Yuan Lo
In Room: ExHall D Poster Location: Poster #344 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness Project Page ↗
Yiming Zhong ⋅ Qi Jiang ⋅ Jingyi Yu ⋅ Yuexin Ma
In Room: ExHall D Poster Location: Poster #145 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Vision-Language Gradient Descent-driven All-in-One Deep Unfolding Networks
Haijin Zeng ⋅ Xiangming Wang ⋅ Yongyong Chen ⋅ Jingyong Su ⋅ Jie Liu
In Room: ExHall D Poster Location: Poster #206 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer
Jiajun Deng ⋅ Tianyu He ⋅ Li Jiang ⋅ Tianyu Wang ⋅ Feras Dayoub ⋅ Ian Reid
In Room: ExHall D Poster Location: Poster #343 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VL2Lite: Task-Specific Knowledge Distillation from Large Vision-Language Models to Lightweight Networks
Jinseong Jang ⋅ Chunfei Ma ⋅ Byeongwon Lee
In Room: ExHall D Poster Location: Poster #375 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VidHalluc: Evaluating Temporal Hallucinations in Multimodal Large Language Models for Video Understanding
Chaoyu Li ⋅ Eun Woo Im ⋅ Pooyan Fazli
In Room: ExHall D Poster Location: Poster #294 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
From Laboratory to Real World: A New Benchmark Towards Privacy-Preserved Visible-Infrared Person Re-Identification Project Page ↗
Yan Jiang ⋅ Hao Yu ⋅ Xu Cheng ⋅ Haoyu Chen ⋅ Zhaodong Sun ⋅ Guoying Zhao
In Room: ExHall D Poster Location: Poster #330 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward
Haonan Han ⋅ Xiangzuo Wu ⋅ Huan Liao ⋅ Zunnan Xu ⋅ Zhongyuan Hu ⋅ Ronghui Li ⋅ Yachao Zhang ⋅ Xiu Li
In Room: ExHall D Poster Location: Poster #160 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
4Deform: Neural Surface Deformation for Robust Shape Interpolation Project Page ↗
Lu Sang ⋅ Zehranaz Canfes ⋅ Dongliang Cao ⋅ Riccardo Marin ⋅ Florian Bernard ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #111 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TSAM: Temporal SAM Augmented with Multimodal Prompts for Referring Audio-Visual Segmentation
Abduljalil Radman ⋅ Jorma Laaksonen
In Room: ExHall D Poster Location: Poster #280 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Dense Match Summarization for Faster Two-view Estimation
Jonathan Astermark ⋅ Anders Heyden ⋅ Viktor Larsson
In Room: ExHall D Poster Location: Poster #86 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MultiGO: Towards Multi-level Geometry Learning for Monocular 3D Textured Human Reconstruction
Gangjian Zhang ⋅ Nanjie Yao ⋅ Shunsi Zhang ⋅ hanfeng Zhao ⋅ Guoliang Pang ⋅ Jian Shu ⋅ Hao Wang
In Room: ExHall D Poster Location: Poster #16 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Align-A-Video: Deterministic Reward Tuning of Image Diffusion Models for Consistent Video Editing
Shengzhi Wang ⋅ Yingkang Zhong ⋅ Jiangchuan Mu ⋅ Kai WU ⋅ Mingliang Xiong ⋅ Wen Fang ⋅ Mingqing Liu ⋅ Hao Deng ⋅ Bin He ⋅ Gang Li ⋅ Qingwen Liu
In Room: ExHall D Poster Location: Poster #179 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Interpreting Object-level Foundation Models via Visual Precision Search Project Page ↗
Ruoyu Chen ⋅ Siyuan Liang ⋅ Jingzhi Li ⋅ Shiming Liu ⋅ Maosen Li ⋅ Zhen Huang ⋅ Hua Zhang ⋅ Xiaochun Cao
In Room: ExHall D Poster Location: Poster #372 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Selective Re-learning Mechanism for Hyperspectral Fusion Imaging
Yuanye Liu ⋅ jinyang liu ⋅ Renwei Dian ⋅ Shutao Li
In Room: ExHall D Poster Location: Poster #198 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Autoregressive Sequential Pretraining for Visual Tracking
Shiyi Liang ⋅ Yifan Bai ⋅ Yihong Gong ⋅ Xing Wei
In Room: ExHall D Poster Location: Poster #181 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Fish-Vista: A Multi-Purpose Dataset for Understanding & Identification of Traits from Images
Kazi Sajeed Mehrab ⋅ M. Maruf ⋅ Arka Daw ⋅ Abhilash Neog ⋅ Harish Babu Manogaran ⋅ Mridul Khurana ⋅ Zhenyang Feng ⋅ Bahadir Altintas ⋅ Yasin Bakis ⋅ Elizabeth Campolongo ⋅ Matthew Thompson ⋅ Xiaojun Wang ⋅ Hilmar Lapp ⋅ Tanya Berger-Wolf ⋅ Paula Mabee ⋅ Henry Bart ⋅ Wei-Lun Chao ⋅ Wasla Dahdul ⋅ Anuj Karpatne
In Room: ExHall D Poster Location: Poster #311 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Number it: Temporal Grounding Videos like Flipping Manga
Yongliang Wu ⋅ Xinting Hu ⋅ Yuyang Sun ⋅ Yizhou Zhou ⋅ Wenbo Zhu ⋅ Fengyun Rao ⋅ Bernt Schiele ⋅ Xu Yang
In Room: ExHall D Poster Location: Poster #297 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SyncVP: Joint Diffusion for Synchronous Multi-Modal Video Prediction Project Page ↗
Enrico Pallotta ⋅ Sina Mokhtarzadeh Azar ⋅ Shuai Li ⋅ Olga Zatsarynna ⋅ Jürgen Gall
In Room: ExHall D Poster Location: Poster #300 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HUSH: Holistic Panoramic 3D Scene Understanding using Spherical Harmonics Project Page ↗
Jongsung Lee ⋅ HARIN PARK ⋅ Byeong-Uk Lee ⋅ Kyungdon Joo
In Room: ExHall D Poster Location: Poster #73 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SkillMimic: Learning Basketball Interaction Skills from Demonstrations
Yinhuai Wang ⋅ Qihan Zhao ⋅ Runyi Yu ⋅ Hok Wai Tsui ⋅ Ailing Zeng ⋅ Jing Lin ⋅ Zhengyi Luo ⋅ Jiwen Yu ⋅ Xiu Li ⋅ Qifeng Chen ⋅ Jian Zhang ⋅ Lei Zhang ⋅ Ping Tan
In Room: ExHall D Poster Location: Poster #166 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
STPro: Spatial and Temporal Progressive Learning for Weakly Supervised Spatio-Temporal Grounding Project Page ↗
Aaryan Garg ⋅ Akash Kumar ⋅ Yogesh S. Rawat
In Room: ExHall D Poster Location: Poster #307 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SALOVA: Segment-Augmented Long Video Assistant for Targeted Retrieval and Routing in Long-Form Video Analysis Project Page ↗
Junho Kim ⋅ Hyunjun Kim ⋅ Hosu Lee ⋅ Yong Man Ro
In Room: ExHall D Poster Location: Poster #304 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RGBAvatar: Reduced Gaussian Blendshapes for Online Modeling of Head Avatars Project Page ↗
Linzhou Li ⋅ Yumeng Li ⋅ Yanlin Weng ⋅ Youyi Zheng ⋅ Kun Zhou
In Room: ExHall D Poster Location: Poster #9 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
Ming Li ⋅ Jike Zhong ⋅ Tianle Chen ⋅ Yuxiang Lai ⋅ Konstantinos Psounis
In Room: ExHall D Poster Location: Poster #256 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Text-Driven Fashion Image Editing with Compositional Concept Learning and Counterfactual Abduction
Shanshan Huang ⋅ Haoxuan Li ⋅ Chunyuan Zheng ⋅ Mingyuan Ge ⋅ WeiGao ⋅ Lei Wang ⋅ Li Liu
In Room: ExHall D Poster Location: Poster #244 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Good, Cheap, and Fast: Overfitted Image Compression with Wasserstein Distortion Project Page ↗
Jona Ballé ⋅ Luca Versari ⋅ Emilien Dupont ⋅ Hyunjik Kim ⋅ Matthias Bauer
In Room: ExHall D Poster Location: Poster #210 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AuraFusion360: Augmented Unseen Region Alignment for Reference-based 360° Unbounded Scene Inpainting Project Page ↗
Chung-Ho Wu ⋅ Yang-Jung Chen ⋅ Ying-Huan Chen ⋅ Jie-Ying Lee ⋅ Bo-Hsu Ke ⋅ Chun-Wei Tuan Mu ⋅ Yichuan Huang ⋅ Chin-Yang Lin ⋅ Min-Hung Chen ⋅ Yen-Yu Lin ⋅ Yu-Lun Liu
In Room: ExHall D Poster Location: Poster #50 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis
Enric Corona ⋅ Andrei Zanfir ⋅ Eduard Gabriel Bazavan ⋅ NIKOS KOLOTOUROS ⋅ Thiemo Alldieck ⋅ Cristian Sminchisescu
In Room: ExHall D Poster Location: Poster #4 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SoMA: Singular Value Decomposed Minor Components Adaptation for Domain Generalizable Representation Learning
Seokju Yun ⋅ Seunghye Chae ⋅ Dongheon Lee ⋅ Youngmin Ro
In Room: ExHall D Poster Location: Poster #436 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DynaMoDe-NeRF: Motion-aware Deblurring Neural Radiance Field for Dynamic Scenes
Ashish Kumar ⋅ A. N. Rajagopalan
In Room: ExHall D Poster Location: Poster #64 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Composing Parts for Expressive Object Generation
Harsh Rangwani ⋅ Aishwarya Agarwal ⋅ Kuldeep Kulkarni ⋅ R. Venkatesh Babu ⋅ Srikrishna Karanam
In Room: ExHall D Poster Location: Poster #244 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Adapting Text-to-Image Generation with Feature Difference Instruction for Generic Image Restoration
Chao Wang ⋅ Hehe Fan ⋅ Huichen Yang ⋅ Sarvnaz Karimi ⋅ Lina Yao ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #237 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Tokenize Image Patches: Global Context Fusion for Effective Haze Removal in Large Images Project Page ↗
Jiuchen Chen ⋅ Xinyu Yan ⋅ Qizhi Xu ⋅ Kaiqi Li
In Room: ExHall D Poster Location: Poster #197 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image Project Page ↗
Xingyu Liu ⋅ Gu Wang ⋅ Ruida Zhang ⋅ Chenyangguang Zhang ⋅ Federico Tombari ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #93 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Tuning the Frequencies: Robust Training for Sinusoidal Neural Networks
Tiago Novello ⋅ Diana Aldana Moreno ⋅ André Araujo ⋅ Luiz Velho
In Room: ExHall D Poster Location: Poster #278 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Real-time Free-view Human Rendering from Sparse-view RGB Videos using Double Unprojected Textures Project Page ↗
Guoxing Sun ⋅ Rishabh Dabral ⋅ Heming Zhu ⋅ Pascal Fua ⋅ Christian Theobalt ⋅ Marc Habermann
In Room: ExHall D Poster Location: Poster #37 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Uncertainty Meets Diversity: A Comprehensive Active Learning Framework for Indoor 3D Object Detection
Jiangyi Wang ⋅ Na Zhao
In Room: ExHall D Poster Location: Poster #431 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CASAGPT: Cuboid Arrangement and Scene Assembly for Interior Design
Weitao Feng ⋅ Hang Zhou ⋅ Jing Liao ⋅ Li Cheng ⋅ Wenbo Zhou
In Room: ExHall D Poster Location: Poster #289 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Identity-Clothing Similarity Modeling for Unsupervised Clothing Change Person Re-Identification
Zhiqi Pang ⋅ Junjie Wang ⋅ Lingling Zhao ⋅ Chunyu Wang
In Room: ExHall D Poster Location: Poster #329 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GIVEPose: Gradual Intra-class Variation Elimination for RGB-based Category-Level Object Pose Estimation
Ziqin Huang ⋅ Gu Wang ⋅ Chenyangguang Zhang ⋅ Ruida Zhang ⋅ Xiu Li ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #96 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
3D Prior Is All You Need: Cross-Task Few-shot 2D Gaze Estimation
Yihua Cheng ⋅ Hengfei Wang ⋅ Zhongqun Zhang ⋅ Yang Yue ⋅ Boeun Kim ⋅ Feng Lu ⋅ Hyung Jin Chang
In Room: ExHall D Poster Location: Poster #275 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts Project Page ↗
Feng Liang ⋅ Haoyu Ma ⋅ Zecheng He ⋅ Tingbo Hou ⋅ Ji Hou ⋅ Kunpeng Li ⋅ Xiaoliang Dai ⋅ Felix Juefei-Xu ⋅ Samaneh Azadi ⋅ Animesh Sinha ⋅ Peizhao Zhang ⋅ Peter Vajda ⋅ Diana Marculescu
In Room: ExHall D Poster Location: Poster #238 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MoEdit: On Learning Quantity Perception for Multi-object Image Editing
Yanfeng Li ⋅ Ka-Hou Chan ⋅ Yue Sun ⋅ Chan-Tong Lam ⋅ Tong Tong ⋅ Zitong YU ⋅ Keren Fu ⋅ Xiaohong Liu ⋅ Tao Tan
In Room: ExHall D Poster Location: Poster #241 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Seeing More with Less: Human-like Representations in Vision Models
Andrey Gizdov ⋅ Shimon Ullman ⋅ Daniel Harari
In Room: ExHall D Poster Location: Poster #407 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FALCON: Fairness Learning via Contrastive Attention Approach to Continual Semantic Scene Understanding Project Page ↗
Thanh-Dat Truong ⋅ Utsav Prabhu ⋅ Bhiksha Raj ⋅ Jackson Cothren ⋅ Khoa Luu
In Room: ExHall D Poster Location: Poster #423 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Modeling Thousands of Human Annotators for Generalizable Text-to-Image Person Re-identification
Jiayu Jiang ⋅ Changxing Ding ⋅ Wentao Tan ⋅ Junhong Wang ⋅ JIN Tao ⋅ Xiangmin Xu
In Room: ExHall D Poster Location: Poster #367 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces
Jihan Yang ⋅ Shusheng Yang ⋅ Anjali W. Gupta ⋅ Rilyn Han ⋅ Li Fei-Fei ⋅ Saining Xie
In Room: ExHall D Poster Location: Poster #287 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Nested Diffusion Models Using Hierarchical Latent Priors
Xiao Zhang ⋅ Ruoxi Jiang ⋅ Rebecca Willett ⋅ Michael Maire
In Room: ExHall D Poster Location: Poster #224 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Tra-MoE: Learning Trajectory Prediction Model from Multiple Domains for Adaptive Policy Conditioning
Jiange Yang ⋅ Haoyi Zhu ⋅ Yating Wang ⋅ Gangshan Wu ⋅ Tong He ⋅ Limin Wang
In Room: ExHall D Poster Location: Poster #152 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Localizing Events in Videos with Multimodal Queries Project Page ↗
Gengyuan Zhang ⋅ Mang Ling Ada Fok ⋅ Jialu Ma ⋅ Yan Xia ⋅ Philip H.S. Torr ⋅ Daniel Cremers ⋅ Volker Tresp ⋅ Jindong Gu
In Room: ExHall D Poster Location: Poster #303 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DoF-Gaussian: Controllable Depth-of-Field for 3D Gaussian Splatting
Liao Shen ⋅ Tianqi Liu ⋅ Huiqiang Sun ⋅ Jiaqi Li ⋅ Zhiguo Cao ⋅ Wei Li ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #26 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MEAT: Multiview Diffusion Model for Human Generation on Megapixels with Mesh Attention
Yuhan Wang ⋅ Fangzhou Hong ⋅ Shuai Yang ⋅ Liming Jiang ⋅ Wayne Wu ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #61 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
F-LMM: Grounding Frozen Large Multimodal Models Project Page ↗
Size Wu ⋅ Sheng Jin ⋅ Wenwei Zhang ⋅ Lumin Xu ⋅ Wentao Liu ⋅ Wei Li ⋅ Chen Change Loy
In Room: ExHall D Poster Location: Poster #352 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EdgeTAM: On-Device Track Anything Model
Chong Zhou ⋅ Chenchen Zhu ⋅ Yunyang Xiong ⋅ Saksham Suri ⋅ Fanyi Xiao ⋅ Lemeng Wu ⋅ Raghuraman Krishnamoorthi ⋅ Bo Dai ⋅ Chen Change Loy ⋅ Vikas Chandra ⋅ Bilge Soran
In Room: ExHall D Poster Location: Poster #304 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CleanDIFT: Diffusion Features without Noise Project Page ↗
Nick Stracke ⋅ Stefan Andreas Baumann ⋅ Kolja Bauer ⋅ Frank Fundel ⋅ Björn Ommer
In Room: ExHall D Poster Location: Poster #218 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Uncertainty-Instructed Structure Injection for Generalizable HD Map Construction
Xiaolu Liu ⋅ Ruizi Yang ⋅ Song Wang ⋅ Wentong Li ⋅ Junbo Chen ⋅ Jianke Zhu
In Room: ExHall D Poster Location: Poster #125 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Don't Shake the Wheel: Momentum-Aware Planning in End-to-End Autonomous Driving Project Page ↗
Ziying Song ⋅ Caiyan Jia ⋅ Lin Liu ⋅ Hongyu Pan ⋅ Yongchang Zhang ⋅ Junming Wang ⋅ Xingyu Zhang ⋅ Shaoqing Xu ⋅ Lei Yang ⋅ Yadan Luo
In Room: ExHall D Poster Location: Poster #131 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UniRestore: Unified Perceptual and Task-Oriented Image Restoration Model Using Diffusion Prior
I-Hsiang (Aaron) Chen ⋅ Wei-Ting Chen ⋅ Yu-Wei Liu ⋅ Yuan-Chun Chiang ⋅ Sy-Yen Kuo ⋅ Ming-Hsuan Yang
In Room: ExHall D Poster Location: Poster #206 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Complexity Experts are Task-Discriminative Learners for Any Image Restoration
Eduard Zamfir ⋅ Zongwei Wu ⋅ Nancy Mehta ⋅ Yuedong Tan ⋅ Danda Paudel ⋅ Yulun Zhang ⋅ Radu Timofte
In Room: ExHall D Poster Location: Poster #201 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Generative Omnimatte: Learning to Decompose Video into Layers Project Page ↗
Yao-Chih Lee ⋅ Erika Lu ⋅ Sarah Rumbley ⋅ Michal Geyer ⋅ Jia-Bin Huang ⋅ Tali Dekel ⋅ Forrester Cole
In Room: ExHall D Poster Location: Poster #178 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks Project Page ↗
Dongshuo Yin ⋅ Leiyi Hu ⋅ Bin Li ⋅ Youqun Zhang ⋅ Xue Yang
In Room: ExHall D Poster Location: Poster #407 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Precise Event Spotting in Sports Videos: Solving Long-Range Dependency and Class Imbalance
Sanchayan Santra ⋅ Vishal Chudasama ⋅ Pankaj Wasnik ⋅ Vineeth Balasubramanian
In Room: ExHall D Poster Location: Poster #287 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
KAC: Kolmogorov-Arnold Classifier for Continual Learning
Yusong Hu ⋅ Zichen Liang ⋅ Fei Yang ⋅ Qibin Hou ⋅ Xialei Liu ⋅ Ming-Ming Cheng
In Room: ExHall D Poster Location: Poster #445 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Steady Progress Beats Stagnation: Mutual Aid of Foundation and Conventional Models in Mixed Domain Semi-Supervised Medical Image Segmentation
Qinghe Ma ⋅ Jian Zhang ⋅ Zekun Li ⋅ Lei Qi ⋅ Qian Yu ⋅ Yinghuan Shi
In Room: ExHall D Poster Location: Poster #479 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ATP: Adaptive Threshold Pruning for Efficient Data Encoding in Quantum Neural Networks
Mohamed Afane ⋅ Gabrielle Ebbrecht ⋅ Ying Wang ⋅ Juntao Chen ⋅ Junaid Farooq
In Room: ExHall D Poster Location: Poster #440 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
dFLMoE: Decentralized Federated Learning via Mixture of Experts for Medical Data Analysis
Luyuan Xie ⋅ Tianyu Luan ⋅ Wenyuan Cai ⋅ Guochen Yan ⋅ Zhaoyu Chen ⋅ Nan Xi ⋅ Yuejian Fang ⋅ Qingni Shen ⋅ Zhonghai Wu ⋅ Junsong Yuan
In Room: ExHall D Poster Location: Poster #460 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AFL: A Single-Round Analytic Approach for Federated Learning with Pre-trained Models
Run He ⋅ Kai Tong ⋅ Di Fang ⋅ Han Sun ⋅ Ziqian Zeng ⋅ Haoran Li ⋅ Tianyi Chen ⋅ Huiping Zhuang
In Room: ExHall D Poster Location: Poster #461 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MIMO: A Medical Vision Language Model with Visual Referring Multimodal Input and Pixel Grounding Multimodal Output Project Page ↗
Yanyuan Chen ⋅ Dexuan Xu ⋅ Yu Huang ⋅ Songkun Zhan ⋅ Hanpin Wang ⋅ Dongxue Chen ⋅ Xueping Wang ⋅ Meikang Qiu ⋅ Hang Li
In Room: ExHall D Poster Location: Poster #354 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
XLRS-Bench: Could Your Multimodal LLMs Understand Extremely Large Ultra-High-Resolution Remote Sensing Imagery? Project Page ↗
Fengxiang Wang ⋅ hongzhen wang ⋅ Zonghao Guo ⋅ Di Wang ⋅ Yulin Wang ⋅ Mingshuo Chen ⋅ Qiang Ma ⋅ Long Lan ⋅ Wenjing Yang ⋅ Jing Zhang ⋅ Zhiyuan Liu ⋅ Maosong Sun
In Room: ExHall D Poster Location: Poster #351 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Let's Chorus: Partner-aware Hybrid Song-Driven 3D Head Animation
Xiumei Xie ⋅ Zikai Huang ⋅ Wenhao Xu ⋅ Peng Xiao ⋅ Xuemiao Xu ⋅ Huaidong Zhang
In Room: ExHall D Poster Location: Poster #2 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SPARS3R: Semantic Prior Alignment and Regularization for Sparse 3D Reconstruction
Yutao Tang ⋅ Yuxiang Guo ⋅ Deming Li ⋅ Cheng Peng
In Room: ExHall D Poster Location: Poster #64 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation Project Page ↗
Hanzhi Chen ⋅ Boyang Sun ⋅ Anran Zhang ⋅ Marc Pollefeys ⋅ Stefan Leutenegger
In Room: ExHall D Poster Location: Poster #143 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FilmComposer: LLM-Driven Music Production for Silent Film Clips
Zhifeng Xie ⋅ Qile He ⋅ Youjia Zhu ⋅ Qiwei He ⋅ Mengtian Li
In Room: ExHall D Poster Location: Poster #274 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning Person-Specific Animatable Face Models from In-the-Wild Images via a Shared Base Model
Yuxiang Mao ⋅ Zhenfeng Fan ⋅ Zhijie Zhang ⋅ Zhiheng Zhang ⋅ Shihong Xia
In Room: ExHall D Poster Location: Poster #15 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation Project Page ↗
Yabiao Wang ⋅ Shuo Wang ⋅ Jiangning Zhang ⋅ Ke Fan ⋅ Jiafu Wu ⋅ Xuezhucun Xue ⋅ Yong Liu
In Room: ExHall D Poster Location: Poster #173 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Factored-NeuS: Reconstructing Surfaces, Illumination, and Materials of Possibly Glossy Objects
Yue Fan ⋅ Ningjing Fan ⋅ Ivan Skorokhodov ⋅ Oleg Voynov ⋅ Savva Ignatyev ⋅ Evgeny Burnaev ⋅ Peter Wonka ⋅ Yiqun Wang
In Room: ExHall D Poster Location: Poster #26 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos
Sagnik Majumder ⋅ Tushar Nagarajan ⋅ Ziad Al-Halah ⋅ Reina Pradhan ⋅ Kristen Grauman
In Room: ExHall D Poster Location: Poster #275 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hybrid Reciprocal Transformer with Triplet Feature Alignment for Scene Graph Generation
Jiawei Fu ⋅ ZHANG Tiantian ⋅ Kai Chen ⋅ Qi Dou
In Room: ExHall D Poster Location: Poster #343 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TransPixeler: Advancing Text-to-Video Generation with Transparency
Luozhou Wang ⋅ Yijun Li ⋅ ZhiFei Chen ⋅ Jui-Hsien Wang ⋅ Zhifei Zhang ⋅ He Zhang ⋅ Zhe Lin ⋅ Ying-Cong Chen
In Room: ExHall D Poster Location: Poster #232 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Adaptive Keyframe Sampling for Long Video Understanding Project Page ↗
Xi Tang ⋅ Jihao Qiu ⋅ Lingxi Xie ⋅ Yunjie Tian ⋅ Jianbin Jiao ⋅ Qixiang Ye
In Room: ExHall D Poster Location: Poster #284 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Person De-reidentification: A Variation-guided Identity Shift Modeling
Yi-Xing Peng ⋅ Yu-Ming Tang ⋅ Kun-Yu Lin ⋅ Qize Yang ⋅ Jingke Meng ⋅ Xihan Wei ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #304 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FreeSim: Toward Free-viewpoint Camera Simulation in Driving Scenes
Lue Fan ⋅ Hao ZHANG ⋅ Qitai Wang ⋅ Hongsheng Li ⋅ Zhaoxiang Zhang
In Room: ExHall D Poster Location: Poster #131 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Gradient Inversion Attacks on Parameter-Efficient Fine-Tuning
Hasin Us Sami ⋅ Swapneel Sen ⋅ Amit K. Roy-Chowdhury ⋅ Srikanth Krishnamurthy ⋅ Basak Guler
In Room: ExHall D Poster Location: Poster #462 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DiGIT: Multi-Dilated Gated Encoder and Central-Adjacent Region Integrated Decoder for Temporal Action Detection Transformer
Ho-Joong Kim ⋅ Yearang Lee ⋅ Jung-Ho Hong ⋅ Seong-Whan Lee
In Room: ExHall D Poster Location: Poster #312 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Making Old Film Great Again: Degradation-aware State Space Model for Old Film Restoration
Yudong Mao ⋅ Hao Luo ⋅ Zhiwei Zhong ⋅ Peilin CHEN ⋅ Zhijiang Zhang ⋅ Shiqi Wang
In Room: ExHall D Poster Location: Poster #178 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
Runtao Liu ⋅ Haoyu Wu ⋅ Zheng Ziqiang ⋅ Chen Wei ⋅ Yingqing He ⋅ Renjie Pi ⋅ Qifeng Chen
In Room: ExHall D Poster Location: Poster #252 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Iterative Predictor-Critic Code Decoding for Real-World Image Dehazing Project Page ↗
Jiayi Fu ⋅ Siyu Liu ⋅ Zikun Liu ⋅ Chun-Le Guo ⋅ Hyunhee Park ⋅ Rui-Qi Wu ⋅ Guoqing Wang ⋅ Chongyi Li
In Room: ExHall D Poster Location: Poster #196 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FlashGS: Efficient 3D Gaussian Splatting for Large-scale and High-resolution Rendering
Guofeng Feng ⋅ Siyan Chen ⋅ Rong Fu ⋅ Zimu Liao ⋅ Yi Wang ⋅ Tao Liu ⋅ Boni Hu ⋅ Linning Xu ⋅ PeiZhilin ⋅ Hengjie Li ⋅ Xiuhong Li ⋅ Ninghui Sun ⋅ Xingcheng Zhang ⋅ Bo Dai
In Room: ExHall D Poster Location: Poster #47 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MMTL-UniAD: A Unified Framework for Multimodal and Multi-Task Learning in Assistive Driving Perception
Wenzhuo Liu ⋅ Wenshuo Wang ⋅ Yicheng Qiao ⋅ Qiannan Guo ⋅ Jiayin Zhu ⋅ Pengfei Li ⋅ Zilong Chen ⋅ Huiming Yang ⋅ Zhiwei Li ⋅ Lening Wang ⋅ Tiao Tan ⋅ Huaping Liu
In Room: ExHall D Poster Location: Poster #143 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Realistic Test-Time Adaptation of Vision-Language Models Project Page ↗
Maxime Zanella ⋅ Clément Fuchs ⋅ Christophe De Vleeschouwer ⋅ Ismail Ben Ayed
In Room: ExHall D Poster Location: Poster #388 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SelfSplat: Pose-Free and 3D Prior-Free Generalizable 3D Gaussian Splatting Project Page ↗
Gyeongjin Kang ⋅ Jisang Yoo ⋅ Jihyeon Park ⋅ Seungtae Nam ⋅ Hyeonsoo Im ⋅ Shin sangheon ⋅ Sangpil Kim ⋅ Eunbyung Park
In Room: ExHall D Poster Location: Poster #92 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Enhancing Virtual Try-On with Synthetic Pairs and Error-Aware Noise Scheduling
Nannan Li ⋅ Kevin Shih ⋅ Bryan A. Plummer
In Room: ExHall D Poster Location: Poster #18 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RDD: Robust Feature Detector and Descriptor using Deformable Transformer
Gonglin Chen ⋅ Tianwen Fu ⋅ Haiwei Chen ⋅ Wenbin Teng ⋅ Hanyuan Xiao ⋅ Yajie Zhao
In Room: ExHall D Poster Location: Poster #97 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GRAPHGPT-O: Synergistic Multimodal Comprehension and Generation on Graphs
Yi Fang ⋅ Bowen Jin ⋅ Jiacheng Shen ⋅ Sirui Ding ⋅ Qiaoyu Tan ⋅ Jiawei Han
In Room: ExHall D Poster Location: Poster #349 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Erasing Undesirable Influence in Diffusion Models
Jing Wu ⋅ Trung Le ⋅ Munawar Hayat ⋅ Mehrtash Harandi
In Room: ExHall D Poster Location: Poster #200 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LT3SD: Latent Trees for 3D Scene Diffusion Project Page ↗
Quan Meng ⋅ Lei Li ⋅ Matthias Nießner ⋅ Angela Dai
In Room: ExHall D Poster Location: Poster #45 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Exact: Exploring Space-Time Perceptive Clues for Weakly Supervised Satellite Image Time Series Semantic Segmentation Project Page ↗
Hao Zhu ⋅ Yan Zhu ⋅ Jiayu Xiao ⋅ Tianxiang Xiao ⋅ Yike Ma ⋅ Yucheng Zhang ⋅ Feng Dai
In Room: ExHall D Poster Location: Poster #324 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Stacking Brick by Brick: Aligned Feature Isolation for Incremental Face Forgery Detection
Jikang Cheng ⋅ Zhiyuan Yan ⋅ Ying Zhang ⋅ Li Hao ⋅ Jiaxin Ai ⋅ Qin Zou ⋅ Chen Li ⋅ Zhongyuan Wang
In Room: ExHall D Poster Location: Poster #313 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Closest Neighbors are Harmful for Lightweight Masked Auto-encoders
Jian Meng ⋅ Ahmed Hasssan ⋅ Li Yang ⋅ Deliang Fan ⋅ Jinwoo Shin ⋅ Jae-sun Seo
In Room: ExHall D Poster Location: Poster #400 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EnvGS: Modeling View-Dependent Appearance with Environment Gaussian
Tao Xie ⋅ Xi Chen ⋅ Zhen Xu ⋅ Yiman Xie ⋅ Yudong Jin ⋅ Yujun Shen ⋅ Sida Peng ⋅ Hujun Bao ⋅ Xiaowei Zhou
In Room: ExHall D Poster Location: Poster #28 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP Project Page ↗
Mohamad Hassan N C ⋅ Divyam Gupta ⋅ Mainak Singha ⋅ SAI BHARGAV RONGALI ⋅ Ankit Jha ⋅ Muhammad Haris Khan ⋅ Biplab Banerjee
In Room: ExHall D Poster Location: Poster #451 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Samba: A Unified Mamba-based Framework for General Salient Object Detection
Jiahao He ⋅ Keren Fu ⋅ Xiaohong Liu ⋅ Qijun Zhao
In Room: ExHall D Poster Location: Poster #408 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PAVE: Patching and Adapting Video Large Language Models Project Page ↗
Zhuoming Liu ⋅ Yiquan Li ⋅ Khoi D Nguyen ⋅ Yiwu Zhong ⋅ Yin Li
In Room: ExHall D Poster Location: Poster #300 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LesionLocator: Zero-Shot Universal Tumor Segmentation and Tracking in 3D Whole-Body Imaging Project Page ↗
Maximilian Rokuss ⋅ Yannick Kirchhoff ⋅ Seval Akbal ⋅ Balint Kovacs ⋅ Saikat Roy ⋅ Constantin Ulrich ⋅ Tassilo Wald ⋅ Lukas T. Rotkopf ⋅ Heinz-Peter Schlemmer ⋅ Klaus Maier-Hein
In Room: ExHall D Poster Location: Poster #452 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Generative Map Priors for Collaborative BEV Semantic Segmentation
Jiahui Fu ⋅ Yue Gong ⋅ Luting Wang ⋅ Shifeng Zhang ⋅ Xu Zhou ⋅ Si Liu
In Room: ExHall D Poster Location: Poster #123 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
3D-AVS: LiDAR-based 3D Auto-Vocabulary Segmentation
Weijie Wei ⋅ Osman Ülger ⋅ Fatemeh Karimi Nejadasl ⋅ Theo Gevers ⋅ Martin R. Oswald
In Room: ExHall D Poster Location: Poster #339 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Generative Image Layer Decomposition with Visual Effects
Jinrui Yang ⋅ Qing Liu ⋅ Yijun Li ⋅ Soo Ye Kim ⋅ Daniil Pakhomov ⋅ Mengwei Ren ⋅ Jianming Zhang ⋅ Zhe Lin ⋅ Cihang Xie ⋅ Yuyin Zhou
In Room: ExHall D Poster Location: Poster #217 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AR-Diffusion: Asynchronous Video Generation with Auto-Regressive Diffusion
Mingzhen Sun ⋅ Weining Wang ⋅ Li ⋅ Jiawei Liu ⋅ Jiahui Sun ⋅ Wanquan Feng ⋅ Shanshan Lao ⋅ SiYu Zhou ⋅ Qian HE ⋅ Jing Liu
In Room: ExHall D Poster Location: Poster #191 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ManiVideo: Generating Hand-Object Manipulation Video with Dexterous and Generalizable Grasping
Youxin Pang ⋅ Ruizhi Shao ⋅ Jiajun Zhang ⋅ Hanzhang Tu ⋅ Yun Liu ⋅ Boyao Zhou ⋅ Hongwen Zhang ⋅ Yebin Liu
In Room: ExHall D Poster Location: Poster #150 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FlexUOD: The Answer to Real-world Unsupervised Image Outlier Detection
Zhonghang Liu ⋅ Kun Zhou ⋅ Changshuo Wang ⋅ Daniel Lin ⋅ Jiangbo Lu
In Room: ExHall D Poster Location: Poster #434 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves Project Page ↗
Shihan Wu ⋅ Ji Zhang ⋅ Pengpeng Zeng ⋅ Lianli Gao ⋅ Jingkuan Song ⋅ Heng Tao Shen
In Room: ExHall D Poster Location: Poster #390 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DOF-GS: Adjustable Depth-of-Field 3D Gaussian Splatting for Post-Capture Refocusing, Defocus Rendering and Blur Removal
Yujie Wang ⋅ Praneeth Chakravarthula ⋅ Baoquan Chen
In Room: ExHall D Poster Location: Poster #24 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
The Photographer's Eye: Teaching Multimodal Large Language Models to See, and Critique Like Photographers
Daiqing Qi ⋅ Handong Zhao ⋅ Jing Shi ⋅ Simon Jenni ⋅ Yifei Fan ⋅ Franck Dernoncourt ⋅ Scott Cohen ⋅ Sheng Li
In Room: ExHall D Poster Location: Poster #361 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Synergizing Motion and Appearance: Multi-Scale Compensatory Codebooks for Talking Head Video Generation
Shuling Zhao ⋅ Fa-Ting Hong ⋅ Xiaoshui Huang ⋅ Dan Xu
In Room: ExHall D Poster Location: Poster #3 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Coherent 3D Portrait Video Reconstruction via Triplane Fusion
Shengze Wang ⋅ Xueting Li ⋅ Chao Liu ⋅ Matthew Chan ⋅ Michael Stengel ⋅ Henry Fuchs ⋅ Shalini De Mello ⋅ Koki Nagano
In Room: ExHall D Poster Location: Poster #6 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BLADE: Single-view Body Mesh Estimation through Accurate Depth Estimation
Shengze Wang ⋅ Jiefeng Li ⋅ Tianye Li ⋅ Ye Yuan ⋅ Henry Fuchs ⋅ Koki Nagano ⋅ Shalini De Mello ⋅ Michael Stengel
In Room: ExHall D Poster Location: Poster #90 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GraphI2P: Image-to-Point Cloud Registration with Exploring Pattern of Correspondence via Graph Learning
Lin Bie ⋅ Shouan Pan ⋅ Siqi Li ⋅ Yining Zhao ⋅ Yue Gao
In Room: ExHall D Poster Location: Poster #106 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FedCS: Coreset Selection for Federated Learning
Chenhe Hao ⋅ Weiying Xie ⋅ Daixun Li ⋅ Haonan Qin ⋅ Hangyu Ye ⋅ Leyuan Fang ⋅ Yunsong Li
In Room: ExHall D Poster Location: Poster #458 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
Haoyang Li ⋅ Liang Wang ⋅ Chao Wang ⋅ Jing Jiang ⋅ Yan Peng ⋅ Guodong Long
In Room: ExHall D Poster Location: Poster #438 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Dual-Granularity Semantic Guided Sparse Routing Diffusion Model for General Pansharpening
Yinghui Xing ⋅ Qu Li Tao ⋅ Shizhou Zhang ⋅ Di Xu ⋅ YingkunYang ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #192 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Robust Multi-Object 4D Generation for In-the-wild Videos
Wen-Hsuan Chu ⋅ Lei Ke ⋅ Jianmeng Liu ⋅ Mingxiao Huo ⋅ Pavel Tokmakov ⋅ Katerina Fragkiadaki
In Room: ExHall D Poster Location: Poster #97 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MUSt3R: Multi-view Network for Stereo 3D Reconstruction
Yohann Cabon ⋅ Lucas Stoffl ⋅ Leonid Antsfeld ⋅ Gabriela Csurka ⋅ Boris Chidlovskii ⋅ Jerome Revaud ⋅ Vincent Leroy
In Room: ExHall D Poster Location: Poster #82 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SOAP: Vision-Centric 3D Semantic Scene Completion with Scene-Adaptive Decoder and Occluded Region-Aware View Projection
Hyo-Jun Lee ⋅ Yeong Jun Koh ⋅ Hanul Kim ⋅ Hyunseop Kim ⋅ Yonguk Lee ⋅ Jinu Lee
In Room: ExHall D Poster Location: Poster #127 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Taxonomy-Aware Evaluation of Vision-Language Models
Vésteinn Snæbjarnarson ⋅ Kevin Du ⋅ Niklas Stoehr ⋅ Serge Belongie ⋅ Ryan Cotterell ⋅ Nico Lang ⋅ Stella Frank
In Room: ExHall D Poster Location: Poster #357 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Yo’Chameleon: Personalized Vision and Language Generation Project Page ↗
Thao Nguyen ⋅ Krishna Kumar Singh ⋅ Jing Shi ⋅ Trung Bui ⋅ Yong Jae Lee ⋅ Yuheng Li
In Room: ExHall D Poster Location: Poster #362 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SMILE: Infusing Spatial and Motion Semantics in Masked Video Learning Project Page ↗
Fida Mohammad Thoker ⋅ Letian Jiang ⋅ Chen Zhao ⋅ Bernard Ghanem
In Room: ExHall D Poster Location: Poster #293 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Video Language Model Pretraining with Spatio-temporal Masking
Yue Wu ⋅ Zhaobo Qi ⋅ Junshu Sun ⋅ Yaowei Wang ⋅ Qingming Huang ⋅ Shuhui Wang
In Room: ExHall D Poster Location: Poster #304 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
Sanghwan Kim ⋅ Rui Xiao ⋅ Iuliana Georgescu ⋅ Stephan Alaniz ⋅ Zeynep Akata
In Room: ExHall D Poster Location: Poster #387 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Lifting Motion to the 3D World via 2D Diffusion
Jiaman Li ⋅ Karen Liu ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #164 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
Xin Wang ⋅ Kai Chen ⋅ Jiaming Zhang ⋅ Jingjing Chen ⋅ Xingjun Ma
In Room: ExHall D Poster Location: Poster #391 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Your ViT is Secretly an Image Segmentation Model Project Page ↗
Tommie Kerssies ⋅ Niccolò Cavagnero ⋅ Alexander Hermans ⋅ Narges Norouzi ⋅ Giuseppe Averta ⋅ Bastian Leibe ⋅ Gijs Dubbelman ⋅ Daan de Geus
In Room: ExHall D Poster Location: Poster #407 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Any-Resolution AI-Generated Image Detection by Spectral Learning Project Page ↗
Dimitrios Karageorgiou ⋅ Symeon Papadopoulos ⋅ Ioannis Kompatsiaris ⋅ Efstratios Gavves
In Room: ExHall D Poster Location: Poster #279 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
An Image-like Diffusion Method for Human-Object Interaction Detection
Xiaofei Hui ⋅ Haoxuan Qu ⋅ Hossein Rahmani ⋅ Jun Liu
In Room: ExHall D Poster Location: Poster #321 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MammAlps: A Multi-view Video Behavior Monitoring Dataset of Wild Mammals in the Swiss Alps
Valentin Gabeff ⋅ Haozhe Qi ⋅ Brendan Flaherty ⋅ Gencer Sumbul ⋅ Alexander Mathis ⋅ Devis Tuia
In Room: ExHall D Poster Location: Poster #306 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Diffusion-based Realistic Listening Head Generation via Hybrid Motion Modeling
Yinuo Wang ⋅ Yanbo Fan ⋅ Xuan Wang ⋅ Yu Guo ⋅ Fei Wang
In Room: ExHall D Poster Location: Poster #3 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PIDLoc: Cross-View Pose Optimization Network Inspired by PID Controllers
Wooju Lee ⋅ Juhye Park ⋅ Dasol Hong ⋅ Changki Sung ⋅ Youngwoo Seo ⋅ DongWan Kang ⋅ Hyun Myung
In Room: ExHall D Poster Location: Poster #89 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SAT-HMR: Real-Time Multi-Person 3D Mesh Estimation via Scale-Adaptive Tokens Project Page ↗
Chi Su ⋅ Xiaoxuan Ma ⋅ Jiajun Su ⋅ Yizhou Wang
In Room: ExHall D Poster Location: Poster #93 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens
Kaihang Pan ⋅ Wang Lin ⋅ Zhongqi Yue ⋅ Tenglong Ao ⋅ Liyu Jia ⋅ Wei Zhao ⋅ Juncheng Li ⋅ Siliang Tang ⋅ Hanwang Zhang
In Room: ExHall D Poster Location: Poster #334 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
Tongda Xu ⋅ Jiahao Li ⋅ Bin Li ⋅ Yan Wang ⋅ Ya-Qin Zhang ⋅ Yan Lu
In Room: ExHall D Poster Location: Poster #217 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Wonderland: Navigating 3D Scenes from a Single Image
Hanwen Liang ⋅ Junli Cao ⋅ Vidit Goel ⋅ Guocheng Qian ⋅ Sergei Korolev ⋅ Demetri Terzopoulos ⋅ Konstantinos N. Plataniotis ⋅ Sergey Tulyakov ⋅ Jian Ren
In Room: ExHall D Poster Location: Poster #59 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Learning from Streaming Video with Orthogonal Gradients
Tengda Han ⋅ Dilara Gokay ⋅ Joseph Heyward ⋅ Chuhan Zhang ⋅ Daniel Zoran ⋅ Viorica Patraucean ⋅ Joao Carreira ⋅ Dima Damen ⋅ Andrew Zisserman
In Room: ExHall D Poster Location: Poster #286 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SuperLightNet: Lightweight Parameter Aggregation Network for Multimodal Brain Tumor Segmentation
Feng Yu ⋅ Jiacheng Cao ⋅ Li Liu ⋅ Minghua Jiang
In Room: ExHall D Poster Location: Poster #481 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
Huaxin Zhang ⋅ Xiaohao Xu ⋅ Xiang Wang ⋅ Jialong Zuo ⋅ Xiaonan Huang ⋅ Changxin Gao ⋅ Shanjun Zhang ⋅ Li Yu ⋅ Nong Sang
In Room: ExHall D Poster Location: Poster #305 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Anyattack: Towards Large-scale Self-supervised Adversarial Attacks on Vision-language Models
Jiaming Zhang ⋅ Junhong Ye ⋅ Xingjun Ma ⋅ Yige Li ⋅ Yunfan Yang ⋅ Yunhao Chen ⋅ Jitao Sang ⋅ Dit-Yan Yeung
In Room: ExHall D Poster Location: Poster #390 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GENIUS: A Generative Framework for Universal Multimodal Search Project Page ↗
Sungyeon Kim ⋅ Xinliang Zhu ⋅ Xiaofan Lin ⋅ Muhammet Bastan ⋅ Douglas Gray ⋅ Suha Kwak
In Room: ExHall D Poster Location: Poster #367 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Classifier-to-Bias: Toward Unsupervised Automatic Bias Detection for Visual Classifiers
Quentin Guimard ⋅ Moreno D'Incà ⋅ Massimiliano Mancini ⋅ Elisa Ricci
In Room: ExHall D Poster Location: Poster #431 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MOS-Attack: A Scalable Multi-objective Adversarial Attack Framework
Ping Guo ⋅ Cheng Gong ⋅ Fei Liu ⋅ Xi Lin ⋅ Zhichao Lu ⋅ Qingfu Zhang ⋅ Zhenkun Wang
In Room: ExHall D Poster Location: Poster #466 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Motion Modes: What Could Happen Next?
Karran Pandey ⋅ Yannick Hold-Geoffroy ⋅ Matheus Gadelha ⋅ Niloy J. Mitra ⋅ Karan Singh ⋅ Paul Guerrero
In Room: ExHall D Poster Location: Poster #175 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation
Ziheng Zhang ⋅ Jianyang Gu ⋅ Arpita Chowdhury ⋅ Zheda Mai ⋅ David Carlyn ⋅ Tanya Berger-Wolf ⋅ Yu Su ⋅ Wei-Lun Chao
In Room: ExHall D Poster Location: Poster #404 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Black-Box Forgery Attacks on Semantic Watermarks for Diffusion Models
Andreas Müller ⋅ Denis Lukovnikov ⋅ Jonas Thietke ⋅ Asja Fischer ⋅ Erwin Quiring
In Room: ExHall D Poster Location: Poster #256 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VidSeg: Training-free Video Semantic Segmentation based on Diffusion Models
Qian Wang ⋅ Abdelrahman Eldesokey ⋅ Mohit Mendiratta ⋅ Fangneng Zhan ⋅ Adam Kortylewski ⋅ Christian Theobalt ⋅ Peter Wonka
In Room: ExHall D Poster Location: Poster #183 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RELOCATE: A Simple Training-Free Baseline for Visual Query Localization Using Region-Based Representations
Savya Khosla ⋅ Sethuraman T V ⋅ Alexander G. Schwing ⋅ Derek Hoiem
In Room: ExHall D Poster Location: Poster #336 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HOTFormerLoc: Hierarchical Octree Transformer for Versatile Lidar Place Recognition Across Ground and Aerial Views Project Page ↗
Ethan Griffiths ⋅ Maryam Haghighat ⋅ Simon Denman ⋅ Clinton Fookes ⋅ Milad Ramezani
In Room: ExHall D Poster Location: Poster #122 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UniK3D: Universal Camera Monocular 3D Estimation Project Page ↗
Luigi Piccinelli ⋅ Christos Sakaridis ⋅ Mattia Segu ⋅ Yung-Hsu Yang ⋅ Siyuan Li ⋅ Wim Abbeloos ⋅ Luc Van Gool
In Room: ExHall D Poster Location: Poster #80 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ConMo: Controllable Motion Disentanglement and Recomposition for Zero-Shot Motion Transfer
Jiayi Gao ⋅ Zijin Yin ⋅ Changcheng Hua ⋅ Yuxin Peng ⋅ Kongming Liang ⋅ Zhanyu Ma ⋅ Jun Guo ⋅ Yang Liu
In Room: ExHall D Poster Location: Poster #175 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models Project Page ↗
Chi-Pin Huang ⋅ Yen-Siang Wu ⋅ Hung-Kai Chung ⋅ Kai-Po Chang ⋅ Fu-En Yang ⋅ Yu-Chiang Frank Wang
In Room: ExHall D Poster Location: Poster #172 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EBS-EKF: Accurate and High Frequency Event-based Star Tracking Project Page ↗
Albert Reed ⋅ Connor Hashemi ⋅ Dennis Melamed ⋅ Nitesh Menon ⋅ Keigo Hirakawa ⋅ Scott McCloskey
In Room: ExHall D Poster Location: Poster #108 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GliaNet: Adaptive Neural Network Structure Learning with Glia-Driven
Mengqiao Han ⋅ Liyuan Pan ⋅ Xiabi Liu
In Room: ExHall D Poster Location: Poster #401 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
APT: Adaptive Personalized Training for Diffusion Models with Limited Data
JungWoo Chae ⋅ Jiyoon Kim ⋅ Jaewoong Choi ⋅ Kyungyul Kim ⋅ Sangheum Hwang
In Room: ExHall D Poster Location: Poster #234 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Symmetry Strikes Back: From Single-Image Symmetry Detection to 3D Generation Project Page ↗
Xiang Li ⋅ Zixuan Huang ⋅ Anh Thai ⋅ James Rehg
In Room: ExHall D Poster Location: Poster #54 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Frequency-Biased Synergistic Design for Image Compression and Compensation
Jiaming Liu ⋅ Qi Zheng ⋅ Zihao Liu ⋅ Yilian Zhong ⋅ Peiye Liu ⋅ Tao Liu ⋅ Shusong Xu ⋅ Yanheng Lu ⋅ Sicheng Li ⋅ Dimin Niu ⋅ Yibo Fan
In Room: ExHall D Poster Location: Poster #207 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering
Yifan Gao ⋅ Zihang Lin ⋅ Chuanbin Liu ⋅ Min Zhou ⋅ Tiezheng Ge ⋅ Bo Zheng ⋅ Hongtao Xie
In Room: ExHall D Poster Location: Poster #259 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Sparse Voxels Rasterization: Real-time High-fidelity Radiance Field Rendering Project Page ↗
Cheng Sun ⋅ Jaesung Choe ⋅ Charles Loop ⋅ Wei-Chiu Ma ⋅ Yu-Chiang Frank Wang
In Room: ExHall D Poster Location: Poster #32 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Rethinking Personalized Aesthetics Assessment: Employing Physique Aesthetics Assessment as An Exemplification
Haobin Zhong ⋅ Shuai He ⋅ Anlong Ming ⋅ Huadong Ma
In Room: ExHall D Poster Location: Poster #265 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
You See it, You Got it: Learning 3D Creation on Pose-Free Videos at Scale
Baorui Ma ⋅ Huachen Gao ⋅ Haoge Deng ⋅ Zhengxiong Luo ⋅ Tiejun Huang ⋅ Lulu Tang ⋅ Xinlong Wang
In Room: ExHall D Poster Location: Poster #172 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Locality-Aware Zero-Shot Human-Object Interaction Detection Project Page ↗
Sanghyun Kim ⋅ Deunsol Jung ⋅ Minsu Cho
In Room: ExHall D Poster Location: Poster #418 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PEACE: Empowering Geologic Map Holistic Understanding with MLLMs Project Page ↗
Yangyu Huang ⋅ Tianyi Gao ⋅ Haoran Xu ⋅ Qihao Zhao ⋅ Yang Song ⋅ Zhipeng Gui ⋅ Tengchao Lv ⋅ Hao Chen ⋅ Lei Cui ⋅ Scarlett Li ⋅ Furu Wei
In Room: ExHall D Poster Location: Poster #355 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion Project Page ↗
Xiyue Guo ⋅ Jiarui Hu ⋅ Junjie Hu ⋅ Hujun Bao ⋅ Guofeng Zhang
In Room: ExHall D Poster Location: Poster #124 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MARVEL-40M+: Multi-Level Visual Elaboration for High-Fidelity Text-to-3D Content Creation Project Page ↗
Sankalp Sinha ⋅ Mohammad Sadil Khan ⋅ Muhammad Usama ⋅ Shino Sam ⋅ Didier Stricker ⋅ Sk Aziz Ali ⋅ Muhammad Zeshan Afzal
In Room: ExHall D Poster Location: Poster #261 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Random Conditioning with Distillation for Data-Efficient Diffusion Model Compression
Dohyun Kim ⋅ Sehwan Park ⋅ GeonHee Han ⋅ Seung Wook Kim ⋅ Paul Hongsuck Seo
In Room: ExHall D Poster Location: Poster #270 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Hierarchical Gaussian Mixture Model Splatting for Efficient and Part Controllable 3D Generation
Qitong Yang ⋅ Mingtao Feng ⋅ Zijie Wu ⋅ Weisheng Dong ⋅ Fangfang Wu ⋅ Yaonan Wang ⋅ Ajmal Mian
In Room: ExHall D Poster Location: Poster #43 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting
Runsong Zhu ⋅ Shi Qiu ⋅ ZHENGZHE LIU ⋅ Ka-Hei Hui ⋅ Qianyi Wu ⋅ Pheng-Ann Heng ⋅ Chi-Wing Fu
In Room: ExHall D Poster Location: Poster #332 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Quad-Pixel Image Defocus Deblurring: A New Benchmark and Model
Hang Chen ⋅ Yin Xie ⋅ Xiaoxiu Peng ⋅ Lihu Sun ⋅ Wenkai Su ⋅ Xiaodong Yang ⋅ Chengming Liu
In Room: ExHall D Poster Location: Poster #25 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DocVLM: Make Your VLM an Efficient Reader
Mor Shpigel Nacson ⋅ Aviad Aberdam ⋅ Roy Ganz ⋅ Elad Ben Avraham ⋅ Alona Golts ⋅ Yair Kittenplon ⋅ Shai Mazor ⋅ Ron Litman
In Room: ExHall D Poster Location: #486 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Revisiting Source-Free Domain Adaptation: Insights into Representativeness, Generalization, and Variety
Ronghang Zhu ⋅ Mengxuan Hu ⋅ Weiming Zhuang ⋅ Lingjuan Lyu ⋅ Xiang Yu ⋅ Sheng Li
In Room: ExHall D Poster Location: Poster #445 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Improving Gaussian Splatting with Localized Points Management
Haosen Yang ⋅ Chenhao Zhang ⋅ Wenqing Wang ⋅ Marco Volino ⋅ Adrian Hilton ⋅ Li Zhang ⋅ Xiatian Zhu
In Room: ExHall D Poster Location: Poster #61 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GEAL: Generalizable 3D Affordance Learning with Cross-Modal Consistency Project Page ↗
Dongyue Lu ⋅ Lingdong Kong ⋅ Tianxin Huang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #141 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Language Guided Concept Bottleneck Models for Interpretable Continual Learning Project Page ↗
Lu Yu ⋅ HaoYu Han ⋅ Zhe Tao ⋅ Hantao Yao ⋅ Changsheng Xu
In Room: ExHall D Poster Location: Poster #414 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Domain Adaptive Diabetic Retinopathy Grading with Model Absence and Flowing Data
Wenxin Su ⋅ Song Tang ⋅ Xiaofeng Liu ⋅ Xiaojing Yi ⋅ Mao Ye ⋅ Chunxiao Zu ⋅ Jiahao Li ⋅ Xiatian Zhu
In Room: ExHall D Poster Location: Poster #207 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Temporal Separation with Entropy Regularization for Knowledge Distillation in Spiking Neural Networks
Kairong Yu ⋅ Chengting Yu ⋅ Tianqing Zhang ⋅ Xiaochen Zhao ⋅ Shu Yang ⋅ Hongwei Wang ⋅ Qiang Zhang ⋅ Qi Xu
In Room: ExHall D Poster Location: Poster #328 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LoRASculpt: Sculpting LoRA for Harmonizing General and Specialized Knowledge in Multimodal Large Language Models
Jian Liang ⋅ Wenke Huang ⋅ Guancheng Wan ⋅ Qu Yang ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #329 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SCFlow2: Plug-and-Play Object Pose Refiner with Shape-Constraint Scene Flow
Qingyuan Wang ⋅ Rui Song ⋅ Jiaojiao Li ⋅ Kerui Cheng ⋅ David Ferstl ⋅ Yinlin Hu
In Room: ExHall D Poster Location: Poster #95 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
D^3CTTA: Domain-Dependent Decorrelation for Continual Test-Time Adaption of 3D LiDAR Segmentation
Jichun Zhao ⋅ Haiyong Jiang ⋅ Haoxuan Song ⋅ Jun Xiao ⋅ Dong Gong
In Room: ExHall D Poster Location: Poster #118 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Flowing from Words to Pixels: A Noise-Free Framework for Cross-Modality Evolution Project Page ↗
Qihao Liu ⋅ Xi Yin ⋅ Alan L. Yuille ⋅ Andrew Brown ⋅ Mannat Singh
In Room: ExHall D Poster Location: Poster #249 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FlipSketch: Flipping Static Drawings to Text-Guided Sketch Animations Project Page ↗
Hmrishav Bandyopadhyay ⋅ Yi-Zhe Song
In Room: ExHall D Poster Location: Poster #212 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Interpretable Generative Models through Post-hoc Concept Bottlenecks Project Page ↗
Akshay R. Kulkarni ⋅ Ge Yan ⋅ Chung-En Sun ⋅ Tuomas Oikarinen ⋅ Tsui-Wei Weng
In Room: ExHall D Poster Location: Poster #266 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SketchAgent: Language-Driven Sequential Sketch Generation
Yael Vinker ⋅ Tamar Rott Shaham ⋅ Kristine Zheng ⋅ Alex Zhao ⋅ Judith Fan ⋅ Antonio Torralba
In Room: ExHall D Poster Location: Poster #220 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DRAWER: Digital Reconstruction and Articulation With Environment Realism
Hongchi Xia ⋅ Entong Su ⋅ Marius Memmel ⋅ Arhan Jain ⋅ Raymond Yu ⋅ Numfor Mbiziwo-Tiapo ⋅ Ali Farhadi ⋅ Abhishek Gupta ⋅ Shenlong Wang ⋅ Wei-Chiu Ma
In Room: ExHall D Poster Location: Poster #68 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GoLF-NRT: Integrating Global Context and Local Geometry for Few-Shot View Synthesis
You Wang ⋅ Li Fang ⋅ Hao Zhu ⋅ Fei Hu ⋅ Long Ye ⋅ Zhan Ma
In Room: ExHall D Poster Location: Poster #29 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UCOD-DPL: Unsupervised Camouflaged Object Detection via Dynamic Pseudo-label Learning
Weiqi Yan ⋅ Lvhai Chen ⋅ Huaijia Kou ⋅ Shengchuan Zhang ⋅ Yan Zhang ⋅ Liujuan Cao
In Room: ExHall D Poster Location: Poster #404 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Geometry in Style: 3D Stylization via Surface Normal Deformation Project Page ↗
Nam Anh Dinh ⋅ Itai Lang ⋅ Hyunwoo Kim ⋅ Oded Stein ⋅ Rana Hanocka
In Room: ExHall D Poster Location: Poster #219 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Multi-modal Vision Pre-training for Medical Image Analysis Project Page ↗
Shaohao Rui ⋅ Lingzhi Chen ⋅ Zhenyu Tang ⋅ Lilong Wang ⋅ Mianxin Liu ⋅ Shaoting Zhang ⋅ Xiaosong Wang
In Room: ExHall D Poster Location: Poster #478 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SegMAN: Omni-scale Context Modeling with State Space Models and Local Attention for Semantic Segmentation Project Page ↗
Yunxiang Fu ⋅ Meng Lou ⋅ Yizhou Yu
In Room: ExHall D Poster Location: Poster #313 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
Shufan Li ⋅ Konstantinos Kallidromitis ⋅ Akash Gokul ⋅ Zichun Liao ⋅ Yusuke Kato ⋅ Kazuki Kozuka ⋅ Aditya Grover
In Room: ExHall D Poster Location: Poster #241 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Multiple Object Tracking as ID Prediction Project Page ↗
Ruopeng Gao ⋅ Ji Qi ⋅ Limin Wang
In Room: ExHall D Poster Location: Poster #163 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SLAM3R: Real-Time Dense Scene Reconstruction from Monocular RGB Videos Project Page ↗
Yuzheng Liu ⋅ Siyan Dong ⋅ Shuzhe Wang ⋅ Yingda Yin ⋅ Yanchao Yang ⋅ Qingnan Fan ⋅ Baoquan Chen
In Room: ExHall D Poster Location: Poster #78 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FAM Diffusion: Frequency and Attention Modulation for High-Resolution Image Generation with Stable Diffusion
Haosen Yang ⋅ Adrian Bulat ⋅ Isma Hadji ⋅ Hai X. Pham ⋅ Xiatian Zhu ⋅ Georgios Tzimiropoulos ⋅ Brais Martinez
In Room: ExHall D Poster Location: Poster #219 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Hash3D: Training-free Acceleration for 3D Generation Project Page ↗
Xingyi Yang ⋅ Songhua Liu ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #41 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SemGeoMo: Dynamic Contextual Human Motion Generation with Semantic and Geometric Guidance
Peishan Cong ⋅ Ziyi Wang ⋅ Yuexin Ma ⋅ Xiangyu Yue
In Room: ExHall D Poster Location: Poster #168 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Generative Photomontage Project Page ↗
Sean J. Liu ⋅ Nupur Kumari ⋅ Ariel Shamir ⋅ Jun-Yan Zhu
In Room: ExHall D Poster Location: Poster #245 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multi-view Reconstruction via SfM-guided Monocular Depth Estimation
Haoyu Guo ⋅ He Zhu ⋅ Sida Peng ⋅ Haotong Lin ⋅ Yunzhi Yan ⋅ Tao Xie ⋅ Wenguan Wang ⋅ Xiaowei Zhou ⋅ Hujun Bao
In Room: ExHall D Poster Location: Poster #80 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Unified Image-Dense Annotation Generation Model for Underwater Scenes
Hongkai Lin ⋅ Dingkang Liang ⋅ Zhenghao Qi ⋅ Xiang Bai
In Room: ExHall D Poster Location: Poster #74 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Learning Hazing to Dehazing: Towards Realistic Haze Generation for Real-World Image Dehazing
Ruiyi Wang ⋅ Yushuo Zheng ⋅ Zicheng Zhang ⋅ Chunyi Li ⋅ Shuaicheng Liu ⋅ Guangtao Zhai ⋅ Xiaohong Liu
In Room: ExHall D Poster Location: Poster #193 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HuMoCon: Concept Discovery for Human Motion Understanding Project Page ↗
Qihang Fang ⋅ Chengcheng Tang ⋅ Bugra Tekin ⋅ Shugao Ma ⋅ Yanchao Yang
In Room: ExHall D Poster Location: Poster #174 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Curriculum Direct Preference Optimization for Diffusion and Consistency Models
Florinel Croitoru ⋅ Vlad Hondru ⋅ Radu Tudor Ionescu ⋅ Nicu Sebe ⋅ Mubarak Shah
In Room: ExHall D Poster Location: Poster #255 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OpenMIBOOD: Open Medical Imaging Benchmarks for Out-Of-Distribution Detection Project Page ↗
Max Gutbrod ⋅ David Rauber ⋅ Danilo Weber Nunes ⋅ Christoph Palm
In Room: ExHall D Poster Location: Poster #465 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Detecting Open World Objects via Partial Attribute Assignment Project Page ↗
Muli Yang ⋅ Gabriel James Goenawan ⋅ Huaiyuan Qin ⋅ Kai Han ⋅ Xi Peng ⋅ Yanhua Yang ⋅ Hongyuan Zhu
In Room: ExHall D Poster Location: Poster #430 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FactCheXcker: Mitigating Measurement Hallucinations in Chest X-ray Report Generation Models
Alice Heiman ⋅ Xiaoman Zhang ⋅ Emma Chen ⋅ Sung Eun Kim ⋅ Pranav Rajpurkar
In Room: ExHall D Poster Location: Poster #444 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Personalized Preference Fine-tuning of Diffusion Models
Meihua Dang ⋅ Anikait Singh ⋅ Linqi Zhou ⋅ Stefano Ermon ⋅ Jiaming Song
In Room: ExHall D Poster Location: Poster #253 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
Yiheng Li ⋅ RuiBing Hou ⋅ Hong Chang ⋅ Shiguang Shan ⋅ Xilin Chen
In Room: ExHall D Poster Location: Poster #156 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
POMP: Physics-constrainable Motion Generative Model through Phase Manifolds
Bin Ji ⋅ Ye Pan ⋅ zhimeng Liu ⋅ Shuai Tan ⋅ Xiaogang Jin ⋅ Xiaokang Yang
In Room: ExHall D Poster Location: Poster #155 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
NN-Former: Rethinking Graph Structure in Neural Architecture Representation
Ruihan Xu ⋅ Haokui Zhang ⋅ Yaowei Wang ⋅ Wei Zeng ⋅ Shiliang Zhang
In Room: ExHall D Poster Location: Poster #441 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ReSpec: Relevance and Specificity Grounded Online Filtering for Learning on Video-Text Data Streams
Chris Dongjoo Kim ⋅ Jihwan Moon ⋅ Sangwoo Moon ⋅ Heeseung Yun ⋅ Sihaeng Lee ⋅ Aniruddha Kembhavi ⋅ Soonyoung Lee ⋅ Gunhee Kim ⋅ Sangho Lee ⋅ Christopher Clark
In Room: ExHall D Poster Location: Poster #277 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reloc3r: Large-Scale Training of Relative Camera Pose Regression for Generalizable, Fast, and Accurate Visual Localization Project Page ↗
Siyan Dong ⋅ Shuzhe Wang ⋅ Shaohui Liu ⋅ Lulu Cai ⋅ Qingnan Fan ⋅ Juho Kannala ⋅ Yanchao Yang
In Room: ExHall D Poster Location: Poster #87 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
R-SCoRe: Revisiting Scene Coordinate Regression for Robust Large-Scale Visual Localization
Xudong Jiang ⋅ Fangjinhua Wang ⋅ Silvano Galliani ⋅ Christoph Vogel ⋅ Marc Pollefeys
In Room: ExHall D Poster Location: Poster #85 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DynRefer: Delving into Region-level Multimodal Tasks via Dynamic Resolution Project Page ↗
Yuzhong Zhao ⋅ Feng Liu ⋅ Yue Liu ⋅ Mingxiang Liao ⋅ Chen GONG ⋅ Qixiang Ye ⋅ Fang Wan
In Room: ExHall D Poster Location: Poster #355 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OmniSplat: Taming Feed-Forward 3D Gaussian Splatting for Omnidirectional Images with Editable Capabilities
Suyoung Lee ⋅ JAEYOUNG CHUNG ⋅ Kihoon Kim ⋅ Jaeyoo Huh ⋅ Gunhee Lee ⋅ Minsoo Lee ⋅ Kyoung Mu Lee
In Room: ExHall D Poster Location: Poster #49 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VideoWorld: Exploring Knowledge Learning from Unlabeled Videos
Zhongwei Ren ⋅ Yunchao Wei ⋅ Xun Guo ⋅ Yao Zhao ⋅ Bingyi Kang ⋅ Jiashi Feng ⋅ Xiaojie Jin
In Room: ExHall D Poster Location: Poster #276 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
FSHNet: Fully Sparse Hybrid Network for 3D Object Detection
Shuai Liu ⋅ Mingyue Cui ⋅ Boyang Li ⋅ Quanmin Liang ⋅ Tinghe Hong ⋅ Kai Huang ⋅ yunxiao shan ⋅ Kai Huang
In Room: ExHall D Poster Location: Poster #338 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
3D-SLNR: A Super Lightweight Neural Representation for Large-scale 3D Mapping
Chenhui Shi ⋅ Fulin Tang ⋅ Ning An ⋅ Yihong Wu
In Room: ExHall D Poster Location: Poster #103 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
STINR: Deciphering Spatial Transcriptomics via Implicit Neural Representation
Yisi Luo ⋅ Xile Zhao ⋅ Kai Ye ⋅ Deyu Meng
In Room: ExHall D Poster Location: Poster #470 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Remote Photoplethysmography in Real-World and Extreme Lighting Scenarios
Hang Shao ⋅ lei luo ⋅ Jianjun Qian ⋅ Mengkai Yan ⋅ Shuo Chen ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #19 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Universal Domain Adaptation for Semantic Segmentation
Seun-An Choe ⋅ Keon Hee Park ⋅ Jinwoo Choi ⋅ Gyeong-Moon Park
In Room: ExHall D Poster Location: Poster #425 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Distraction is All You Need for Multimodal Large Language Model Jailbreaking
Zuopeng Yang ⋅ Jiluan Fan ⋅ Anli Yan ⋅ Erdun Gao ⋅ Xin Lin ⋅ Tao Li ⋅ Kanghua Mo ⋅ Changyu Dong
In Room: ExHall D Poster Location: Poster #390 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DivPrune: Diversity-based Visual Token Pruning for Large Multimodal Models Project Page ↗
Saeed Ranjbar Alvar ⋅ Gursimran Singh ⋅ Mohammad Akbari ⋅ Yong Zhang
In Room: ExHall D Poster Location: Poster #383 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
PatchDPO: Patch-level DPO for Finetuning-free Personalized Image Generation
Qihan Huang ⋅ Weilong Dai ⋅ Jinlong Liu ⋅ Wanggui He ⋅ Hao Jiang ⋅ Mingli Song ⋅ Jie Song
In Room: ExHall D Poster Location: Poster #245 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning to Normalize on the SPD Manifold under Bures-Wasserstein Geometry
Rui Wang ⋅ Shaocheng Jin ⋅ Ziheng Chen ⋅ Xiaoqing Luo ⋅ Xiaojun Wu
In Room: ExHall D Poster Location: Poster #279 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SAMWISE: Infusing Wisdom in SAM2 for Text-Driven Video Segmentation Project Page ↗
Claudia Cuttano ⋅ Gabriele Trivigno ⋅ Gabriele Rosi ⋅ Carlo Masone ⋅ Giuseppe Averta
In Room: ExHall D Poster Location: Poster #308 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GeoAvatar: Geometrically-Consistent Multi-Person Avatar Reconstruction from Sparse Multi-View Videos
Soohyun Lee ⋅ SeoYeon Kim ⋅ HeeKyung Lee ⋅ Won-Sik Cheong ⋅ Joo Ho Lee
In Room: ExHall D Poster Location: Poster #9 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Robust-MVTON: Learning Cross-Pose Feature Alignment and Fusion for Robust Multi-View Virtual Try-On
Nannan Zhang ⋅ Yijiang Li ⋅ Dong Du ⋅ Zheng Chong ⋅ Zhengwentai Sun ⋅ Jianhao Zeng ⋅ Yusheng Dai ⋅ Zhenyu Xie ⋅ Hairui Zhu ⋅ Xiaoguang Han
In Room: ExHall D Poster Location: Poster #16 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FreeGave: 3D Physics Learning from Dynamic Videos by Gaussian Velocity
Jinxi Li ⋅ Ziyang Song ⋅ Siyuan Zhou ⋅ Bo Yang
In Room: ExHall D Poster Location: Poster #170 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Zero-Shot Monocular Scene Flow Estimation in the Wild
Yiqing Liang ⋅ Abhishek Badki ⋅ Hang Su ⋅ James Tompkin ⋅ Orazio Gallo
In Room: ExHall D Poster Location: Poster #165 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MG-MotionLLM: A Unified Framework for Motion Comprehension and Generation across Multiple Granularities
Bizhu Wu ⋅ Jinheng Xie ⋅ Keming Shen ⋅ Zhe Kong ⋅ Jianfeng Ren ⋅ Ruibin Bai ⋅ Rong Qu ⋅ Linlin Shen
In Room: ExHall D Poster Location: Poster #160 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Retaining Knowledge and Enhancing Long-Text Representations in CLIP through Dual-Teacher Distillation
Yuheng Feng ⋅ Changsong Wen ⋅ Zelin Peng ⋅ Li jiaye ⋅ Siyu Zhu
In Room: ExHall D Poster Location: Poster #369 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Optical-Flow Guided Prompt Optimization for Coherent Video Generation Project Page ↗
Hyelin Nam ⋅ Jaemin Kim ⋅ Dohun Lee ⋅ Jong Chul Ye
In Room: ExHall D Poster Location: Poster #236 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MOS: Modeling Object-Scene Associations in Generalized Category Discovery Project Page ↗
Zhengyuan Peng ⋅ Jinpeng Ma ⋅ Zhimin Sun ⋅ Ran Yi ⋅ Haichuan Song ⋅ Xin Tan ⋅ Lizhuang Ma
In Room: ExHall D Poster Location: Poster #428 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Anchor-Aware Similarity Cohesion in Target Frames Enables Predicting Temporal Moment Boundaries in 2D
Jiawei Tan ⋅ Hongxing Wang ⋅ Junwu Weng ⋅ Jiaxin Li ⋅ Zhilong Ou ⋅ Kang Dang
In Room: ExHall D Poster Location: Poster #302 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Test-time Augmentation Improves Efficiency in Conformal Prediction
Divya M Shanmugam ⋅ Helen Lu ⋅ Swami Sankaranarayanan ⋅ John Guttag
In Room: ExHall D Poster Location: Poster #458 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Breaking the Low-Rank Dilemma of Linear Attention Project Page ↗
Qihang Fan ⋅ Huaibo Huang ⋅ Ran He
In Room: ExHall D Poster Location: Poster #404 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection
Enshen Zhou ⋅ Qi Su ⋅ Cheng Chi ⋅ Zhizheng Zhang ⋅ Zhongyuan Wang ⋅ Tiejun Huang ⋅ Lu Sheng ⋅ He Wang
In Room: ExHall D Poster Location: Poster #148 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning Project Page ↗
Jinpeng Wang ⋅ Tianci Luo ⋅ Yaohua Zha ⋅ Yan Feng ⋅ Ruisheng Luo ⋅ Bin Chen ⋅ Tao Dai ⋅ Long Chen ⋅ Yaowei Wang ⋅ Shu-Tao Xia
In Room: ExHall D Poster Location: Poster #393 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Rethinking Reconstruction and Denoising in the Dark: New Perspective, General Architecture and Beyond
Long Ma ⋅ Tengyu Ma ⋅ Ziye Li ⋅ Yuetong Wang ⋅ Jinyuan Liu ⋅ Chengpei Xu ⋅ Risheng Liu
In Room: ExHall D Poster Location: Poster #203 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Unity in Diversity: Video Editing via Gradient-Latent Purification
Junyu Gao ⋅ Kunlin Yang ⋅ Xuan Yao ⋅ Yufan Hu
In Room: ExHall D Poster Location: Poster #224 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection
Songhao Han ⋅ Wei Huang ⋅ Hairong Shi ⋅ Le Zhuo ⋅ Xiu Su ⋅ Shifeng Zhang ⋅ Xu Zhou ⋅ Xiaojuan Qi ⋅ Yue Liao ⋅ Si Liu
In Room: ExHall D Poster Location: Poster #266 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
INFP: Audio-Driven Interactive Head Generation in Dyadic Conversations
Yongming Zhu ⋅ Longhao Zhang ⋅ Zhengkun Rong ⋅ Tianshu Hu ⋅ Shuang Liang ⋅ Zhipengge
In Room: ExHall D Poster Location: Poster #2 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Cross-Modal Distillation for 2D/3D Multi-Object Discovery from 2D Motion
Saad Lahlali ⋅ Sandra Kara ⋅ Hejer AMMAR ⋅ Florian Chabot ⋅ Nicolas Granger ⋅ Hervé Le Borgne ⋅ Quoc Cuong PHAM
In Room: ExHall D Poster Location: Poster #334 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Deterministic Certification of Graph Neural Networks against Graph Poisoning Attacks with Arbitrary Perturbations
Jiate Li ⋅ Meng Pang ⋅ Yun Dong ⋅ Binghui Wang
In Room: ExHall D Poster Location: Poster #464 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation Project Page ↗
Liao Qu ⋅ Huichao Zhang ⋅ Yiheng Liu ⋅ Xu Wang ⋅ Yi Jiang ⋅ Yiming Gao ⋅ Hu Ye ⋅ Daniel Kang Du ⋅ Zehuan Yuan ⋅ Xinglong Wu
In Room: ExHall D Poster Location: Poster #228 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Improving Personalized Search with Regularized Low-Rank Parameter Updates
Fiona Ryan ⋅ Josef Sivic ⋅ Fabian Caba Heilbron ⋅ Judy Hoffman ⋅ James Rehg ⋅ Bryan Russell
In Room: ExHall D Poster Location: Poster #376 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
A Focused Human Body Model for Accurate Anthropometric Measurements Extraction
Shuhang Chen ⋅ Xianliang Huang ⋅ Zhizhou Zhong ⋅ Jihong Guan ⋅ Shuigeng Zhou
In Room: ExHall D Poster Location: Poster #152 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device Project Page ↗
Yushu Wu ⋅ Zhixing Zhang ⋅ Yanyu Li ⋅ Yanwu Xu ⋅ Anil Kag ⋅ Yang Sui ⋅ Huseyin Coskun ⋅ Ke Ma ⋅ Aleksei Lebedev ⋅ Ju Hu ⋅ Dimitris N. Metaxas ⋅ Yanzhi Wang ⋅ Sergey Tulyakov ⋅ Jian Ren
In Room: ExHall D Poster Location: Poster #221 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Adapting Dense Matching for Homography Estimation with Grid-based Acceleration
Kaining Zhang ⋅ Yuxin Deng ⋅ Jiayi Ma ⋅ Paolo Favaro
In Room: ExHall D Poster Location: Poster #84 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HyperLoRA: Parameter-Efficient Adaptive Generation for Portrait Synthesis Project Page ↗
Mengtian Li ⋅ Jinshu Chen ⋅ Wanquan Feng ⋅ Bingchuan Li ⋅ Fei Dai ⋅ Songtao Zhao ⋅ Qian HE
In Room: ExHall D Poster Location: Poster #235 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DropGaussian: Structural Regularization for Sparse-view Gaussian Splatting Project Page ↗
Hyunwoo Park ⋅ Gun Ryu ⋅ Wonjun Kim
In Room: ExHall D Poster Location: Poster #52 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EchoMatch: Partial-to-Partial Shape Matching via Correspondence Reflection Project Page ↗
Yizheng Xie ⋅ Viktoria Ehm ⋅ Paul Roetzer ⋅ Nafie El Amrani ⋅ Maolin Gao ⋅ Florian Bernard ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #98 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CoSDH: Communication-Efficient Collaborative Perception via Supply-Demand Awareness and Intermediate-Late Hybridization
Junhao Xu ⋅ Yanan Zhang ⋅ Zhi Cai ⋅ Di Huang
In Room: ExHall D Poster Location: Poster #140 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Order-Robust Class Incremental Learning: Graph-Driven Dynamic Similarity Grouping
Guannan Lai ⋅ Yujie Li ⋅ Xiangkun Wang ⋅ Junbo Zhang ⋅ Tianrui Li ⋅ Xin Yang
In Room: ExHall D Poster Location: Poster #452 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Hierarchical Knowledge Prompt Tuning for Multi-task Test-Time Adaptation
Qiang Zhang ⋅ Mengsheng Zhao ⋅ Jiawei Liu ⋅ Fanrui Zhang ⋅ Yongchao Xu ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #419 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Regularization-Guided Equivariant Approach for Image Restoration
Yulu Bai ⋅ Jiahong Fu ⋅ Qi Xie ⋅ Deyu Meng
In Room: ExHall D Poster Location: Poster #201 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DejaVid: Encoder-Agnostic Learned Temporal Matching for Video Classification
Darryl Ho ⋅ Samuel Madden
In Room: ExHall D Poster Location: Poster #287 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DPSeg: Dual-Prompt Cost Volume Learning for Open-Vocabulary Semantic Segmentation
Ziyu Zhao ⋅ Xiaoguang Li ⋅ Lingjia Shi ⋅ Nasrin Imanpour ⋅ Song Wang
In Room: ExHall D Poster Location: Poster #411 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
One Diffusion to Generate Them All Project Page ↗
Duong H. Le ⋅ Tuan Pham ⋅ Sangho Lee ⋅ Christopher Clark ⋅ Aniruddha Kembhavi ⋅ Stephan Mandt ⋅ Ranjay Krishna ⋅ Jiasen Lu
In Room: ExHall D Poster Location: Poster #240 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Bias for Action: Video Implicit Neural Representations with Bias Modulation Project Page ↗
Alper Kayabasi ⋅ Anil Kumar Vadathya ⋅ Guha Balakrishnan ⋅ Vishwanath Saragadam
In Room: ExHall D Poster Location: Poster #174 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Let's Verify and Reinforce Image Generation Step by Step Project Page ↗
Renrui Zhang ⋅ Chengzhuo Tong ⋅ Zhizheng Zhao ⋅ Ziyu Guo ⋅ Haoquan Zhang ⋅ Manyuan Zhang ⋅ Jiaming Liu ⋅ Peng Gao ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #238 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
All-Optical Nonlinear Diffractive Deep Network for Ultrafast Image Denoising
Xiaoling Zhou ⋅ Zhemg Lee ⋅ Wei Ye ⋅ Rui Xie ⋅ Wenbo Zhang ⋅ Guanju Peng ⋅ Zongze Li ⋅ Shikun Zhang
In Room: ExHall D Poster Location: Poster #196 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CoSER: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
Bonan Li ⋅ Zicheng Zhang ⋅ Xingyi Yang ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #260 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HybridMQA: Exploring Geometry-Texture Interactions for Colored Mesh Quality Assessment Project Page ↗
Armin Shafiee Sarvestani ⋅ Sheyang Tang ⋅ Zhou Wang
In Room: ExHall D Poster Location: Poster #35 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Self-Learning Hyperspectral and Multispectral Image Fusion via Adaptive Residual Guided Subspace Diffusion Model
Jian Zhu ⋅ He Wang ⋅ Yang Xu ⋅ Zebin Wu ⋅ Zhihui Wei
In Room: ExHall D Poster Location: Poster #196 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SIR-DIFF: Sparse Image Sets Restoration with Multi-View Diffusion Model
Yucheng Mao ⋅ Boyang Wang ⋅ Nilesh Kulkarni ⋅ Jeong Joon Park
In Room: ExHall D Poster Location: Poster #54 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
StickMotion: Generating 3D Human Motions by Drawing a Stickman
Tao Wang ⋅ Zhihua Wu ⋅ Qiaozhi He ⋅ Jiaming Chu ⋅ Ling Qian ⋅ Yu Cheng ⋅ Junliang Xing ⋅ Jian Zhao ⋅ Lei Jin
In Room: ExHall D Poster Location: Poster #164 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Enduring, Efficient and Robust Trajectory Prediction Attack in Autonomous Driving via Optimization-Driven Multi-Frame Perturbation Framework
Yi Yu ⋅ Weizhen Han ⋅ Libing Wu ⋅ Bingyi Liu ⋅ Enshu Wang ⋅ Zhuangzhuang Zhang
In Room: ExHall D Poster Location: Poster #135 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GLASS: Guided Latent Slot Diffusion for Object-Centric Learning
Krishnakant Singh ⋅ Simone Schaub-Meyer ⋅ Stefan Roth
In Room: ExHall D Poster Location: Poster #239 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Multimodal Autoregressive Pre-training of Large Vision Encoders
Enrico Fini ⋅ Mustafa Shukor ⋅ Xiujun Li ⋅ Philipp Dufter ⋅ Michal Klein ⋅ David Haldimann ⋅ Sai Aitharaju ⋅ Victor Guilherme Turrisi da Costa ⋅ Louis Béthune ⋅ Zhe Gan ⋅ Alexander Toshev ⋅ Marcin Eichner ⋅ Moin Nabi ⋅ Yinfei Yang ⋅ Joshua Susskind ⋅ Alaaeldin El-Nouby
In Room: ExHall D Poster Location: Poster #407 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UNEM: UNrolled Generalized EM for Transductive Few-Shot Learning
Long Zhou ⋅ Fereshteh Shakeri ⋅ Aymen Sadraoui ⋅ Mounir Kaaniche ⋅ Jean-Christophe Pesquet ⋅ Ismail Ben Ayed
In Room: ExHall D Poster Location: Poster #409 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SASep: Saliency-Aware Structured Separation of Geometry and Feature for Open Set Learning on Point Clouds
Jinfeng Xu ⋅ Xianzhi Li ⋅ Yuan Tang ⋅ Xu Han ⋅ Qiao Yu ⋅ yixue Hao ⋅ Long Hu ⋅ Min Chen
In Room: ExHall D Poster Location: Poster #109 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Link to the Past: Temporal Propagation for Fast 3D Human Reconstruction from Monocular Video
Marchellus Matthew ⋅ Nadhira Noor ⋅ In Kyu Park
In Room: ExHall D Poster Location: Poster #72 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SVG-IR: Spatially-Varying Gaussian Splatting for Inverse Rendering
Hanxiao Sun ⋅ Yupeng Gao ⋅ Jin Xie ⋅ Jian Yang ⋅ Beibei Wang
In Room: ExHall D Poster Location: Poster #28 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Beyond Single-Modal Boundary: Cross-Modal Anomaly Detection through Visual Prototype and Harmonization
Kai Mao ⋅ Ping Wei ⋅ Yiyang Lian ⋅ Yangyang Wang ⋅ Nanning Zheng
In Room: ExHall D Poster Location: Poster #437 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VDocRAG: Retrieval-Augmented Generation over Visually-Rich Documents Project Page ↗
Ryota Tanaka ⋅ Taichi Iki ⋅ Taku Hasegawa ⋅ Kyosuke Nishida ⋅ Kuniko Saito ⋅ Jun Suzuki
In Room: ExHall D Poster Location: Poster #363 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Pose Priors from Language Models
Sanjay Subramanian ⋅ Evonne Ng ⋅ Lea Müller ⋅ Dan Klein ⋅ Shiry Ginosar ⋅ Trevor Darrell
In Room: ExHall D Poster Location: Poster #169 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Generative Densification: Learning to Densify Gaussians for High-Fidelity Generalizable 3D Reconstruction
Seungtae Nam ⋅ Xiangyu Sun ⋅ Gyeongjin Kang ⋅ Younggeun Lee ⋅ Seungjun Oh ⋅ Eunbyung Park
In Room: ExHall D Poster Location: Poster #50 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HyperGS: Hyperspectral 3D Gaussian Splatting
Christopher Thirgood ⋅ Oscar Mendez ⋅ Erin Chao Ling ⋅ Jonathan Storey ⋅ Simon Hadfield
In Room: ExHall D Poster Location: Poster #50 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Exploring Intrinsic Normal Prototypes within a Single Image for Universal Anomaly Detection Project Page ↗
Wei Luo ⋅ Yunkang Cao ⋅ Haiming Yao ⋅ Xiaotian Zhang ⋅ Jianan Lou ⋅ Yuqi Cheng ⋅ Weiming Shen ⋅ Wenyong Yu
In Room: ExHall D Poster Location: Poster #438 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Augmenting Perceptual Super-Resolution via Image Quality Predictors
Fengjia Zhang ⋅ Samrudhdhi Rangrej ⋅ Tristan T Aumentado-Armstrong ⋅ Afsaneh Fazly ⋅ Alex Levinshtein
In Room: ExHall D Poster Location: Poster #202 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TurboFill: Adapting Few-step Text-to-image Model for Fast Image Inpainting Project Page ↗
Liangbin Xie ⋅ Daniil Pakhomov ⋅ Zhonghao Wang ⋅ Zongze Wu ⋅ Ziyan Chen ⋅ Yuqian Zhou ⋅ Haitian Zheng ⋅ Zhifei Zhang ⋅ Zhe Lin ⋅ Jiantao Zhou ⋅ Chao Dong
In Room: ExHall D Poster Location: Poster #214 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Stochastic Human Motion Prediction with Memory of Action Transition and Action Characteristic Project Page ↗
Jianwei Tang ⋅ Hong Yang ⋅ Tengyue Chen ⋅ Jian-Fang Hu
In Room: ExHall D Poster Location: Poster #159 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Perception Tokens Enhance Visual Reasoning in Multimodal Language Models
Mahtab Bigverdi ⋅ Zelun Luo ⋅ Cheng-Yu Hsieh ⋅ Ethan Shen ⋅ Dongping Chen ⋅ Linda Shapiro ⋅ Ranjay Krishna
In Room: ExHall D Poster Location: Poster #349 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning
David Junhao Zhang ⋅ Roni Paiss ⋅ Shiran Zada ⋅ Nikhil Karnad ⋅ David E. Jacobs ⋅ Yael Pritch ⋅ Inbar Mosseri ⋅ Mike Zheng Shou ⋅ Neal Wadhwa ⋅ Nataniel Ruiz
In Room: ExHall D Poster Location: Poster #177 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Are Images Indistinguishable to Humans Also Indistinguishable to Classifiers?
Zebin You ⋅ Xinyu Zhang ⋅ Hanzhong Guo ⋅ Jingdong Wang ⋅ Chongxuan Li
In Room: ExHall D Poster Location: Poster #250 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
X-Dyna: Expressive Dynamic Human Image Animation Project Page ↗
Di Chang ⋅ Hongyi Xu ⋅ You Xie ⋅ Yipeng Gao ⋅ Zhengfei Kuang ⋅ Shengqu Cai ⋅ Chenxu Zhang ⋅ Guoxian Song ⋅ Chao Wang ⋅ Yichun Shi ⋅ Zeyuan Chen ⋅ Shijie Zhou ⋅ Linjie Luo ⋅ Gordon Wetzstein ⋅ Mohammad Soleymani
In Room: ExHall D Poster Location: Poster #5 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Understanding Multi-layered Transmission Matrices
Marina Alterman ⋅ Anat Levin
In Room: ExHall D Poster Location: Poster #201 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking
Weikang Bian ⋅ Zhaoyang Huang ⋅ Xiaoyu Shi ⋅ Yijin Li ⋅ Fu-Yun Wang ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #63 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hierarchical Features Matter: A Deep Exploration of Progressive Parameterization Method for Dataset Distillation
Xinhao Zhong ⋅ Hao Fang ⋅ Bin Chen ⋅ Xulin Gu ⋅ Meikang Qiu ⋅ Shuhan Qi ⋅ Shu-Tao Xia
In Room: ExHall D Poster Location: Poster #413 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AnyMoLe: Any Character Motion In-betweening Leveraging Video Diffusion Models Project Page ↗
Kwan Yun ⋅ Seokhyeon Hong ⋅ Chaelin Kim ⋅ Junyong Noh
In Room: ExHall D Poster Location: Poster #159 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Towards Optimizing Large-Scale Multi-Graph Matching in Bioimaging
Max Kahl ⋅ Sebastian Stricker ⋅ Lisa Hutschenreiter ⋅ Florian Bernard ⋅ Carsten Rother ⋅ Bogdan Savchynskyy
In Room: ExHall D Poster Location: Poster #89 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SinGS: Animatable Single-Image Human Gaussian Splats with Kinematic Priors Project Page ↗
Yufan Wu ⋅ Xuanhong Chen ⋅ Wen Li ⋅ Shunran Jia ⋅ Hualiang Wei ⋅ Kairui Feng ⋅ Jialiang CHEN ⋅ Yuhan Li ⋅ Ang He ⋅ Weimin Zhang ⋅ Bingbing Ni ⋅ Wenjun Zhang
In Room: ExHall D Poster Location: Poster #12 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing Project Page ↗
Seokhyeon Hong ⋅ Chaelin Kim ⋅ Serin Yoon ⋅ Junghyun Nam ⋅ Sihun Cha ⋅ Junyong Noh
In Room: ExHall D Poster Location: Poster #172 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Seq2Time: Sequential Knowledge Transfer for Video LLM Temporal Grounding
Andong Deng ⋅ Zhongpai Gao ⋅ Anwesa Choudhuri ⋅ Benjamin Planche ⋅ Meng Zheng ⋅ Bin Wang ⋅ Terrence Chen ⋅ Chen Chen ⋅ Ziyan Wu
In Room: ExHall D Poster Location: Poster #298 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Effective and Sparse Adversarial Attack on Spiking Neural Networks via Breaking Invisible Surrogate Gradients Project Page ↗
Li Lun ⋅ Kunyu Feng ⋅ Qinglong Ni ⋅ Ling Liang ⋅ Yuan Wang ⋅ Ying Li ⋅ dunshan yu ⋅ Xiaoxin CUI
In Room: ExHall D Poster Location: Poster #321 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Understanding and Quantifying Uncertainty for Text-to-Image Generation
Gianni Franchi ⋅ Nacim Belkhir ⋅ Dat NGUYEN ⋅ Guoxuan Xia ⋅ Andrea Pilzer
In Room: ExHall D Poster Location: Poster #257 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CoCoGaussian: Leveraging Circle of Confusion for Gaussian Splatting from Defocused Images
Jungho Lee ⋅ Suhwan Cho ⋅ Taeoh Kim ⋅ Ho-Deok Jang ⋅ Minhyeok Lee ⋅ Geonho Cha ⋅ Dongyoon Wee ⋅ Dogyoon Lee ⋅ Sangyoun Lee
In Room: ExHall D Poster Location: Poster #24 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PS-Diffusion: Photorealistic Subject-Driven Image Editing with Disentangled Control and Attention
Weicheng Wang ⋅ Guoli Jia ⋅ Zhongqi Zhang ⋅ Liang Lin ⋅ Jufeng Yang
In Room: ExHall D Poster Location: Poster #239 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
Shuyang Hao ⋅ Bryan Hooi ⋅ Jun Liu ⋅ Kai-Wei Chang ⋅ Zi Huang ⋅ Yujun Cai
In Room: ExHall D Poster Location: Poster #389 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding Project Page ↗
Hongyu Li ⋅ Jinyu Chen ⋅ Ziyu Wei ⋅ Shaofei Huang ⋅ Tianrui Hui ⋅ Jialin Gao ⋅ Xiaoming Wei ⋅ Si Liu
In Room: ExHall D Poster Location: Poster #307 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models Project Page ↗
Ozgur Kara ⋅ Krishna Kumar Singh ⋅ Feng Liu ⋅ Duygu Ceylan ⋅ James Rehg ⋅ Tobias Hinz
In Room: ExHall D Poster Location: Poster #213 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Context-Aware Multimodal Pretraining Project Page ↗
Karsten Roth ⋅ Zeynep Akata ⋅ Dima Damen ⋅ Ivana Balazevic ⋅ Olivier J Henaff
In Room: ExHall D Poster Location: Poster #391 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Sound Bridge: Associating Egocentric and Exocentric Videos via Audio Cues
Sihong Huang ⋅ Jiaxin Wu ⋅ Xiaoyong Wei ⋅ Yi Cai ⋅ Dongmei Jiang ⋅ Yaowei Wang
In Room: ExHall D Poster Location: Poster #265 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
Fan-Yun Sun ⋅ Weiyu Liu ⋅ Siyi Gu ⋅ Dylan Lim ⋅ Goutam Bhat ⋅ Federico Tombari ⋅ Manling Li ⋅ Nick Haber ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #317 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ODA-GAN: Orthogonal Decoupling Alignment GAN Assisted by Weakly-supervised Learning for Virtual Immunohistochemistry Staining
Tong Wang ⋅ Mingkang Wang ⋅ Zhongze Wang ⋅ Hongkai Wang ⋅ Qi Xu ⋅ Fengyu Cong ⋅ Hongming Xu
In Room: ExHall D Poster Location: Poster #469 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Faster Parameter-Efficient Tuning with Token Redundancy Reduction Project Page ↗
Kwonyoung Kim ⋅ Jungin Park ⋅ Jin Kim ⋅ Hyeongjun Kwon ⋅ Kwanghoon Sohn
In Room: ExHall D Poster Location: Poster #387 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
Trong-Thuan Nguyen ⋅ Pha Nguyen ⋅ Jackson Cothren ⋅ Alper Yilmaz ⋅ Khoa Luu
In Room: ExHall D Poster Location: Poster #287 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BlockDance: Reuse Structurally Similar Spatio-Temporal Features to Accelerate Diffusion Transformers
Hui Zhang ⋅ Tingwei Gao ⋅ Jie Shao ⋅ Zuxuan Wu
In Room: ExHall D Poster Location: Poster #214 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Panorama Generation From NFoV Image Done Right
Dian Zheng ⋅ Cheng Zhang ⋅ Xiao-Ming Wu ⋅ Cao Li ⋅ Chengfei Lv ⋅ Jian-Fang Hu ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #53 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Mamba-Adaptor: State Space Model Adaptor for Visual Recognition
Fei Xie ⋅ Jiahao Nie ⋅ Yujin Tang ⋅ Wenkang Zhang ⋅ Hongshen Zhao
In Room: ExHall D Poster Location: Poster #412 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Robust Message Embedding via Attention Flow-Based Steganography Project Page ↗
Huayuan Ye ⋅ Shenzhuo Zhang ⋅ Shiqi Jiang ⋅ Jing Liao ⋅ Shuhang Gu ⋅ Dejun Zheng ⋅ Changbo Wang ⋅ Chenhui Li
In Room: ExHall D Poster Location: Poster #209 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Task-driven Image Fusion with Learnable Fusion Loss
Haowen Bai ⋅ Jiangshe Zhang ⋅ Zixiang Zhao ⋅ Yichen Wu ⋅ Lilun Deng ⋅ Yukun Cui ⋅ Tao Feng ⋅ Shuang Xu
In Room: ExHall D Poster Location: Poster #200 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Compositional Targeted Multi-Label Universal Perturbations
Hassan Mahmood ⋅ Ehsan Elhamifar
In Room: ExHall D Poster Location: Poster #454 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PatchGuard: Adversarially Robust Anomaly Detection and Localization through Vision Transformers and Pseudo Anomalies
Mojtaba Nafez ⋅ Amirhossein Koochakian ⋅ Arad Maleki ⋅ Jafar Habibi ⋅ Mohammad Rohban
In Room: ExHall D Poster Location: Poster #436 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Distilling Monocular Foundation Model for Fine-grained Depth Completion
Yingping Liang ⋅ Yutao Hu ⋅ Wenqi Shao ⋅ Ying Fu
In Room: ExHall D Poster Location: Poster #115 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Diffusion Renderer: Neural Inverse and Forward Rendering with Video Diffusion Models Project Page ↗
Ruofan Liang ⋅ Žan Gojčič ⋅ Huan Ling ⋅ Jacob Munkberg ⋅ Jon Hasselgren ⋅ Chih-Hao Lin ⋅ Jun Gao ⋅ Alexander Keller ⋅ Nandita Vijaykumar ⋅ Sanja Fidler ⋅ Zian Wang
In Room: ExHall D Poster Location: Poster #29 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant Project Page ↗
Yikun Liu ⋅ Yajie Zhang ⋅ jiayin cai ⋅ Xiaolong Jiang ⋅ Yao Hu ⋅ Jiangchao Yao ⋅ Yanfeng Wang ⋅ Weidi Xie
In Room: ExHall D Poster Location: Poster #366 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FSFM: A Generalizable Face Security Foundation Model via Self-Supervised Facial Representation Learning Project Page ↗
Gaojian Wang ⋅ Feng Lin ⋅ Tong Wu ⋅ Zhenguang Liu ⋅ Zhongjie Ba ⋅ Kui Ren
In Room: ExHall D Poster Location: Poster #319 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Zero-1-to-A: Zero-Shot One Image to Animatable Head Avatars Using Video Diffusion Project Page ↗
Zhenglin Zhou ⋅ Fan Ma ⋅ Hehe Fan ⋅ Tat-seng Chua
In Room: ExHall D Poster Location: Poster #8 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
On-Device Self-Supervised Learning of Low-Latency Monocular Depth from Only Events Project Page ↗
Jesse Hagenaars ⋅ Yilun Wu ⋅ Federico Paredes Valles ⋅ Stein Stroobants ⋅ Guido De Croon
In Room: ExHall D Poster Location: Poster #124 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LogoSP: Local-global Grouping of Superpoints for Unsupervised Semantic Segmentation of 3D Point Clouds
Zihui Zhang ⋅ Weisheng Dai ⋅ Hongtao Wen ⋅ Bo Yang
In Room: ExHall D Poster Location: Poster #112 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
One is Plenty: A Polymorphic Feature Interpreter for Immutable Heterogeneous Collaborative Perception
Yuchen Xia ⋅ Quan Yuan ⋅ Guiyang Luo ⋅ Xiaoyuan Fu ⋅ Yang Li ⋅ Xuanhan Zhu ⋅ Tianyou Luo ⋅ Siheng Chen ⋅ Jinglin Li
In Room: ExHall D Poster Location: Poster #133 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Dynamic Updates for Language Adaptation in Visual-Language Tracking
Xiaohai Li ⋅ Bineng Zhong ⋅ Qihua Liang ⋅ Zhiyi Mo ⋅ Jian Nong ⋅ Shuxiang Song
In Room: ExHall D Poster Location: Poster #321 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CustAny: Customizing Anything from A Single Example
Lingjie Kong ⋅ Kai WU ⋅ Chengming Xu ⋅ Xiaobin Hu ⋅ Wenhui Han ⋅ Jinlong Peng ⋅ Donghao Luo ⋅ Mengtian Li ⋅ Jiangning Zhang ⋅ Chengjie Wang ⋅ Yanwei Fu
In Room: ExHall D Poster Location: Poster #246 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation
Wei Chen ⋅ Lin Li ⋅ Yongqi Yang ⋅ Bin Wen ⋅ Fan Yang ⋅ Tingting Gao ⋅ Yu Wu ⋅ Long Chen
In Room: ExHall D Poster Location: Poster #258 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision
Ruicheng Wang ⋅ Sicheng Xu ⋅ Cassie Lee Dai ⋅ Jianfeng XIANG ⋅ Yu Deng ⋅ Xin Tong ⋅ Jiaolong Yang
In Room: ExHall D Poster Location: Poster #113 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ScaleLSD: Scalable Deep Line Segment Detection Streamlined Project Page ↗
Zeran Ke ⋅ Bin Tan ⋅ Xianwei Zheng ⋅ Yujun Shen ⋅ Tianfu Wu ⋅ Nan Xue
In Room: ExHall D Poster Location: Poster #89 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning with Noisy Triplet Correspondence for Composed Image Retrieval Project Page ↗
Shuxian Li ⋅ Changhao He ⋅ XitingLiu ⋅ Joey Tianyi Zhou ⋅ Xi Peng ⋅ Peng Hu
In Room: ExHall D Poster Location: Poster #364 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FlashSloth : Lightning Multimodal Large Language Models via Embedded Visual Compression Project Page ↗
Bo Tong ⋅ Bokai Lai ⋅ Yiyi Zhou ⋅ Luo ⋅ Yunhang Shen ⋅ Ke Li ⋅ Xiaoshuai Sun ⋅ Rongrong Ji
In Room: ExHall D Poster Location: Poster #375 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DiET-GS: Diffusion Prior and Event Stream-Assisted Motion Deblurring 3D Gaussian Splatting Project Page ↗
Seungjun Lee ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #65 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DualPM: Dual Posed-Canonical Point Maps for 3D Shape and Pose Reconstruction Project Page ↗
Ben Kaye ⋅ Tomas Jakab ⋅ Shangzhe Wu ⋅ Christian Rupprecht ⋅ Andrea Vedaldi
In Room: ExHall D Poster Location: Poster #100 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DnLUT: Ultra-Efficient Color Image Denoising via Channel-Aware Lookup Tables
Sidi Yang ⋅ Binxiao Huang ⋅ Yulun Zhang ⋅ Dahai Yu ⋅ Yujiu Yang ⋅ Ngai Wong
In Room: ExHall D Poster Location: Poster #211 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
EVolSplat: Efficient Volume-based Gaussian Splatting for Urban View Synthesis
Sheng Miao ⋅ Jiaxin Huang ⋅ Dongfeng Bai ⋅ Xu Yan ⋅ Hongyu Zhou ⋅ Yue Wang ⋅ Bingbing Liu ⋅ Andreas Geiger ⋅ Yiyi Liao
In Room: ExHall D Poster Location: Poster #60 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Incomplete Multi-View Multi-label Learning via Disentangled Representation and Label Semantic Embedding
Xu Yan ⋅ Jun Yin ⋅ Jie Wen
In Room: ExHall D Poster Location: Poster #438 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EquiPose: Exploiting Permutation Equivariance for Relative Camera Pose Estimation
Yuzhen Liu ⋅ Qiulei Dong
In Room: ExHall D Poster Location: Poster #89 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AutoURDF: Unsupervised Robot Modeling from Point Cloud Frames Using Cluster Registration Project Page ↗
Jiong Lin ⋅ Lechen Zhang ⋅ Kwansoo Lee ⋅ Jialong Ning ⋅ Judah A Goldfeder ⋅ Hod Lipson
In Room: ExHall D Poster Location: Poster #140 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Building Vision Models upon Heat Conduction
Zhaozhi Wang ⋅ Yue Liu ⋅ Yunjie Tian ⋅ Yunfan Liu ⋅ Yaowei Wang ⋅ Qixiang Ye
In Room: ExHall D Poster Location: Poster #413 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ZeroGrasp: Zero-Shot Shape Reconstruction Enabled Robotic Grasping Project Page ↗
Shun Iwase ⋅ Muhammad Zubair Irshad ⋅ Katherine Liu ⋅ Vitor Guizilini ⋅ Robert Lee ⋅ Takuya Ikeda ⋅ Ayako Amma ⋅ Koichi Nishiwaki ⋅ Kris Kitani ⋅ Rares Andrei Ambrus ⋅ Sergey Zakharov
In Room: ExHall D Poster Location: Poster #154 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Repurposing Pre-trained Video Diffusion Models for Event-based Video Interpolation Project Page ↗
Jingxi Chen ⋅ Brandon Y. Feng ⋅ Haoming Cai ⋅ Tianfu Wang ⋅ Levi Burner ⋅ Dehao Yuan ⋅ Cornelia Fermuller ⋅ Christopher Metzler ⋅ Yiannis Aloimonos
In Room: ExHall D Poster Location: Poster #172 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Progress-Aware Video Frame Captioning Project Page ↗
Zihui Xue ⋅ Joungbin An ⋅ Xitong Yang ⋅ Kristen Grauman
In Room: ExHall D Poster Location: Poster #285 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic Manipulation
Jingyi Tian ⋅ Le Wang ⋅ Sanping Zhou ⋅ Sen Wang ⋅ lijiayi ⋅ Haowen Sun ⋅ Wei Tang
In Room: ExHall D Poster Location: Poster #144 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
WiLoR: End-to-end 3D Hand Localization and Reconstruction in-the-wild Project Page ↗
Rolandos Alexandros Potamias ⋅ Jinglei Zhang ⋅ Jiankang Deng ⋅ Stefanos Zafeiriou
In Room: ExHall D Poster Location: Poster #153 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos Project Page ↗
Ziyang Wang ⋅ Shoubin Yu ⋅ Elias Stengel-Eskin ⋅ Jaehong Yoon ⋅ Feng Cheng ⋅ Gedas Bertasius ⋅ Mohit Bansal
In Room: ExHall D Poster Location: Poster #297 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-modal Contrastive Learning with Negative Sampling Calibration for Phenotypic Drug Discovery
Jiahua Rao ⋅ Hanjing Lin ⋅ Leyu Chen ⋅ Jiancong Xie ⋅ Shuangjia Zheng ⋅ Yuedong Yang
In Room: ExHall D Poster Location: Poster #441 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
R-TPT: Improving Adversarial Robustness of Vision-Language Models through Test-Time Prompt Tuning
Lijun Sheng ⋅ Jian Liang ⋅ Zilei Wang ⋅ Ran He
In Room: ExHall D Poster Location: Poster #364 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SplatFlow: Multi-View Rectified Flow Model for 3D Gaussian Splatting Synthesis
Hyojun Go ⋅ byeongjun park ⋅ Jiho Jang ⋅ Jin-Young Kim ⋅ Soonwoo Kwon ⋅ Changick Kim
In Room: ExHall D Poster Location: Poster #45 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Fancy123: One Image to High-Quality 3D Mesh Generation via Plug-and-Play Deformation
Qiao Yu ⋅ Xianzhi Li ⋅ Yuan Tang ⋅ Xu Han ⋅ Long Hu ⋅ yixue Hao ⋅ Min Chen
In Room: ExHall D Poster Location: Poster #40 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Dense Dispersed Structured Light for Hyperspectral 3D Imaging of Dynamic Scenes
Suhyun Shin ⋅ Seungwoo Yoon ⋅ Ryota Maeda ⋅ Seung-Hwan Baek
In Room: ExHall D Poster Location: Poster #72 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Language-Guided Audio-Visual Learning for Long-Term Sports Assessment
Huangbiao Xu ⋅ Xiao Ke ⋅ Huanqi Wu ⋅ Rui Xu ⋅ Yuezhou Li ⋅ Wenzhong Guo
In Room: ExHall D Poster Location: Poster #282 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PlanarSplatting: Accurate Planar Surface Reconstruction in 3 Minutes
Bin Tan ⋅ Rui Yu ⋅ Yujun Shen ⋅ Nan Xue
In Room: ExHall D Poster Location: Poster #95 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GBC-Splat: Generalizable Gaussian-Based Clothed Human Digitalization under Sparse RGB Cameras
Hanzhang Tu ⋅ Zhanfeng Liao ⋅ Boyao Zhou ⋅ Shunyuan Zheng ⋅ Xilong Zhou ⋅ Liuxin ZHANG ⋅ QianYing Wang ⋅ Yebin Liu
In Room: ExHall D Poster Location: Poster #18 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SoundVista: Novel-View Ambient Sound Synthesis via Visual-Acoustic Binding Project Page ↗
Mingfei Chen ⋅ Israel D. Gebru ⋅ Ishwarya Ananthabhotla ⋅ Christian Richardt ⋅ Dejan Markovic ⋅ Steven Krenn ⋅ Todd Keebler ⋅ Jacob Sandakly ⋅ Alexander Richard ⋅ Eli Shlizerman
In Room: ExHall D Poster Location: Poster #283 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Omni-ID: Holistic Identity Representation Designed for Generative Tasks Project Page ↗
Guocheng Qian ⋅ Kuan-Chieh Wang ⋅ Or Patashnik ⋅ Negin Heravi ⋅ Daniil Ostashev ⋅ Sergey Tulyakov ⋅ Daniel Cohen-Or ⋅ Kfir Aberman
In Room: ExHall D Poster Location: Poster #326 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
IM-Portrait: Learning 3D-aware Video Diffusion for Photorealistic Talking Heads from Monocular VideosC
Yuan Li ⋅ Ziqian Bai ⋅ Feitong Tan ⋅ Zhaopeng Cui ⋅ Sean Fanello ⋅ Yinda Zhang
In Room: ExHall D Poster Location: Poster #6 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MM-OR: A Large Multimodal Operating Room Dataset for Semantic Understanding of High-Intensity Surgical Environments Project Page ↗
Ege Özsoy ⋅ Chantal Pellegrini ⋅ Tobias Czempiel ⋅ Felix Tristram ⋅ Kun yuan ⋅ David Bani-Harouni ⋅ Ulrich Eck ⋅ Benjamin Busam ⋅ Matthias Keicher ⋅ Nassir Navab
In Room: ExHall D Poster Location: Poster #341 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MIRE: Matched Implicit Neural Representations
Dhananjaya Jayasundara ⋅ Heng Zhao ⋅ Demetrio Labate ⋅ Vishal M. Patel
In Room: ExHall D Poster Location: Poster #278 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AeSPa : Attention-guided Self-supervised Parallel Imaging for MRI Reconstruction
Jinho Joo ⋅ Hyeseong Kim ⋅ Hyeyeon Won ⋅ Deukhee Lee ⋅ Taejoon Eo ⋅ Dosik Hwang
In Room: ExHall D Poster Location: Poster #483 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Visual Consensus Prompting for Co-Salient Object Detection
Jie Wang ⋅ Nana Yu ⋅ Zihao Zhang ⋅ Yahong Han
In Room: ExHall D Poster Location: Poster #402 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MagicArticulate: Make Your 3D Models Articulation-Ready Project Page ↗
Chaoyue Song ⋅ Jianfeng Zhang ⋅ Xiu Li ⋅ Fan Yang ⋅ Yiwen Chen ⋅ Zhongcong Xu ⋅ Jun Hao Liew ⋅ Xiaoyang Guo ⋅ Fayao Liu ⋅ Jiashi Feng ⋅ Guosheng Lin
In Room: ExHall D Poster Location: Poster #13 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Boltzmann Attention Sampling for Image Analysis with Small Objects Project Page ↗
Theodore Zhao ⋅ Sid Kiblawi ⋅ Mu Wei ⋅ Ho Hin Lee ⋅ J. Samuel Preston ⋅ Naoto Usuyama ⋅ Hoifung Poon
In Room: ExHall D Poster Location: Poster #472 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Generalized Recorrupted-to-Recorrupted: Self-Supervised Learning Beyond Gaussian Noise Project Page ↗
Brayan Monroy ⋅ Jorge Bacca ⋅ Julián Tachella
In Room: ExHall D Poster Location: Poster #190 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dynamic Motion Blending for Versatile Motion Editing
Nan Jiang ⋅ Hongjie Li ⋅ Ziye Yuan ⋅ Zimo He ⋅ Yixin Chen ⋅ Tengyu Liu ⋅ Yixin Zhu ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #159 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Open Set Label Shift with Test Time Out-of-Distribution Reference
Changkun Ye ⋅ Russell Tsuchida ⋅ Lars Petersson ⋅ Nick Barnes
In Room: ExHall D Poster Location: Poster #428 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Floating No More: Object-Ground Reconstruction from a Single Image
Yunze Man ⋅ Yichen Sheng ⋅ Jianming Zhang ⋅ Liangyan Gui ⋅ Yu-Xiong Wang
In Room: ExHall D Poster Location: Poster #94 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CrossOver: 3D Scene Cross-Modal Alignment Project Page ↗
Sayan Deb Sarkar ⋅ Ondrej Miksik ⋅ Marc Pollefeys ⋅ Daniel Barath ⋅ Iro Armeni
In Room: ExHall D Poster Location: Poster #346 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SKE-Layout: Spatial Knowledge Enhanced Layout Generation with LLMs
Junsheng Wang ⋅ Nieqing Cao ⋅ Yan Ding ⋅ Mengying Xie ⋅ Fuqiang Gu ⋅ Chao Chen
In Room: ExHall D Poster Location: Poster #344 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Pattern Analogies: Learning to Perform Programmatic Image Edits by Analogy
Aditya Ganeshan ⋅ Thibault Groueix ⋅ Paul Guerrero ⋅ Radomir Mech ⋅ Matthew Fisher ⋅ Daniel Ritchie
In Room: ExHall D Poster Location: Poster #243 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
4D-Fly: Fast 4D Reconstruction from a Single Monocular Video
Diankun Wu ⋅ Fangfu Liu ⋅ Yi-Hsin Hung ⋅ Yue Qian ⋅ Xiaohang Zhan ⋅ Yueqi Duan
In Room: ExHall D Poster Location: Poster #79 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
STAR-Edge: Structure-aware Local Spherical Curve Representation for Thin-walled Edge Extraction from Unstructured Point Clouds Project Page ↗
Zikuan Li ⋅ Honghua Chen ⋅ Yuecheng Wang ⋅ Sibo Wu ⋅ Mingqiang Wei ⋅ Jun Wang
In Room: ExHall D Poster Location: Poster #105 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Complementary Advantages: Exploiting Cross-Field Frequency Correlation for NIR-Assisted Image Denoising
Yuchen Wang ⋅ Hongyuan Wang ⋅ Lizhi Wang ⋅ Xin Wang ⋅ Lin Zhu ⋅ Wanxuan Lu ⋅ Hua Huang
In Room: ExHall D Poster Location: Poster #194 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Boosting the Dual-Stream Architecture in Ultra-High Resolution Segmentation with Resolution-Biased Uncertainty Estimation
Rong Qin ⋅ Xingyu Liu ⋅ Jinglei Shi ⋅ Liang Lin ⋅ Jufeng Yang
In Room: ExHall D Poster Location: Poster #473 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DiffLO: Semantic-Aware LiDAR Odometry with Diffusion-Based Refinement
huang yongshu ⋅ Chen Liu ⋅ Minghang Zhu ⋅ Sheng Ao ⋅ Chenglu Wen ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #118 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
pFedMxF: Personalized Federated Class-Incremental Learning with Mixture of Frequency Aggregation
Yifei Zhang ⋅ Hao Zhu ⋅ Alysa Ziying Tan ⋅ Dianzhi Yu ⋅ Longtao Huang ⋅ Han Yu
In Room: ExHall D Poster Location: Poster #430 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Style-Editor: Text-driven Object-centric Style Editing Project Page ↗
Jihun Park ⋅ Jongmin Gim ⋅ Kyoungmin Lee ⋅ Seunghun Lee ⋅ Sunghoon Im
In Room: ExHall D Poster Location: Poster #237 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Transfer Your Perspective: Controllable 3D Generation from Any Viewpoint in a Driving Scene
Tai-Yu Daniel Pan ⋅ Sooyoung Jeon ⋅ Mengdi Fan ⋅ Jinsu Yoo ⋅ Zhenyang Feng ⋅ Mark Campbell ⋅ Kilian Q Weinberger ⋅ Bharath Hariharan ⋅ Wei-Lun Chao
In Room: ExHall D Poster Location: Poster #133 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Efficient Transfer Learning for Video-language Foundation Models
Haoxing Chen ⋅ Zizheng Huang ⋅ Yan Hong ⋅ YANSHUO WANG ⋅ Zhongcai Lyu ⋅ Zhuoer Xu ⋅ Jun Lan ⋅ Zhangxuan Gu
In Room: ExHall D Poster Location: Poster #285 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Radio Frequency Ray Tracing with Neural Object Representation for Enhanced RF Modeling Project Page ↗
Xingyu Chen ⋅ Zihao Feng ⋅ Kun Qian ⋅ Xinyu Zhang
In Room: ExHall D Poster Location: Poster #28 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DiscoVLA: Discrepancy Reduction in Vision, Language, and Alignment for Parameter-Efficient Video-Text Retrieval Project Page ↗
Leqi Shen ⋅ Guoqiang Gong ⋅ Tianxiang Hao ⋅ Tao He ⋅ Yifeng Zhang ⋅ Pengzhang Liu ⋅ Sicheng Zhao ⋅ Jungong Han ⋅ Guiguang Ding
In Room: ExHall D Poster Location: Poster #372 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ANNEXE: Unified Analyzing, Answering, and Pixel Grounding for Egocentric Interaction
YUEJIAO SU ⋅ Yi Wang ⋅ Qiongyang Hu ⋅ Chuang Yang ⋅ Lap-Pui Chau
In Room: ExHall D Poster Location: Poster #350 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MET3R: Measuring Multi-View Consistency in Generated Images
Mohammad Asim ⋅ Christopher Wewer ⋅ Thomas Wimmer ⋅ Bernt Schiele ⋅ Jan Lenssen
In Room: ExHall D Poster Location: Poster #56 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Segmenting Maxillofacial Structures in CBCT Volumes
Federico Bolelli ⋅ Kevin Marchesini ⋅ Niels van Nistelrooij ⋅ Luca Lumetti ⋅ Vittorio Pipoli ⋅ Elisa Ficarra ⋅ Shankeeth Vinayahalingam ⋅ Costantino Grana
In Room: ExHall D Poster Location: Poster #485 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
3D Dental Model Segmentation with Geometrical Boundary Preserving
Shufan Xi ⋅ Zexian Liu ⋅ Junlin Chang ⋅ Hongyu Wu ⋅ Xiaogang Wang ⋅ Aimin Hao
In Room: ExHall D Poster Location: Poster #486 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Neuro-3D: Towards 3D Visual Decoding from EEG Signals
Zhanqiang Guo ⋅ Jiamin Wu ⋅ Yonghao Song ⋅ Jiahui Bu ⋅ Weijian Mai ⋅ Qihao Zheng ⋅ Wanli Ouyang ⋅ Chunfeng Song
In Room: ExHall D Poster Location: Poster #273 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VISTA3D: A Unified Segmentation Foundation Model For 3D Medical Imaging
Yufan He ⋅ Pengfei Guo ⋅ Yucheng Tang ⋅ Andriy Myronenko ⋅ Vishwesh Nath ⋅ Ziyue Xu ⋅ Dong Yang ⋅ Can Zhao ⋅ Benjamin D. Simon ⋅ Mason Belue ⋅ Stephanie Anne Harmon ⋅ Baris Turkbey ⋅ Daguang Xu ⋅ Wenqi Li
In Room: ExHall D Poster Location: Poster #481 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
The Art of Deception: Color Visual Illusions and Diffusion Models
Alexandra Gomez-Villa ⋅ Kai Wang ⋅ C.Alejandro Parraga ⋅ Bartłomiej Twardowski ⋅ Jesus Malo ⋅ Javier Vazquez-Corral ⋅ Joost van de Weijer
In Room: ExHall D Poster Location: Poster #273 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GaussianUDF: Inferring Unsigned Distance Functions through 3D Gaussian Splatting
Shujuan Li ⋅ Yu-Shen Liu ⋅ Zhizhong Han
In Room: ExHall D Poster Location: Poster #92 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data
Zhiyuan Ma ⋅ Xinyue Liang ⋅ Rongyuan Wu ⋅ Xiangyu Zhu ⋅ Zhen Lei ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #37 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Derivative-Free Diffusion Manifold-Constrained Gradient for Unified XAI
Won Jun Kim ⋅ Hyungjin Chung ⋅ Jaemin Kim ⋅ Sangmin Lee ⋅ Byeongsu Sim ⋅ Jong Chul Ye
In Room: ExHall D Poster Location: Poster #266 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ZoomLDM: Latent Diffusion Model for Multi-scale Image Generation Project Page ↗
Srikar Yellapragada ⋅ Alexandros Graikos ⋅ Kostas Triaridis ⋅ Prateek Prasanna ⋅ Rajarsi Gupta ⋅ Joel Saltz ⋅ Dimitris Samaras
In Room: ExHall D Poster Location: Poster #229 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Do Computer Vision Foundation Models Learn the Low-level Characteristics of the Human Visual System? Project Page ↗
Yancheng Cai ⋅ Fei Yin ⋅ Dounia Hammou ⋅ Rafal Mantiuk
In Room: ExHall D Poster Location: Poster #404 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards RAW Object Detection in Diverse Conditions
Zhong-Yu Li ⋅ Xin Jin ⋅ Bo-Yuan Sun ⋅ Chun-Le Guo ⋅ Ming-Ming Cheng
In Room: ExHall D Poster Location: Poster #333 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DeDe: Detecting Backdoor Samples for SSL Encoders via Decoders Project Page ↗
Sizai Hou ⋅ Songze Li ⋅ Duanyi Yao
In Room: ExHall D Poster Location: Poster #463 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FLAME: Frozen Large Language Models Enable Data-Efficient Language-Image Pre-training Project Page ↗
Anjia Cao ⋅ Xing Wei ⋅ Zhiheng Ma
In Room: ExHall D Poster Location: Poster #373 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BiLoRA: Almost-Orthogonal Parameter Spaces for Continual Learning
Hao Zhu ⋅ Yifei Zhang ⋅ Junhao Dong ⋅ Piotr Koniusz
In Room: ExHall D Poster Location: Poster #437 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DeCafNet: Delegate and Conquer for Efficient Temporal Grounding in Long Videos Project Page ↗
Zijia Lu ⋅ ASM Iftekhar ⋅ Gaurav Mittal ⋅ Tianjian Meng ⋅ Xiawei Wang ⋅ Cheng Zhao ⋅ Rohith Kukkala ⋅ Ehsan Elhamifar ⋅ Mei Chen
In Room: ExHall D Poster Location: Poster #291 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Efficient ANN-Guided Distillation: Aligning Rate-based Features of Spiking Neural Networks through Hybrid Block-wise Replacement
Shu Yang ⋅ Chengting Yu ⋅ Lei Liu ⋅ Hanzhi Ma ⋅ Aili Wang ⋅ Erping Li
In Room: ExHall D Poster Location: Poster #443 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Subspace Constraint and Contribution Estimation for Heterogeneous Federated Learning
Xiangtao Zhang ⋅ Sheng Li ⋅ Ao Li ⋅ Yipeng Liu ⋅ Fan Zhang ⋅ Ce Zhu ⋅ Le Zhang
In Room: ExHall D Poster Location: Poster #459 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SmartEraser: Remove Anything from Images using Masked-Region Guidance
Longtao Jiang ⋅ Zhendong Wang ⋅ Jianmin Bao ⋅ Wengang Zhou ⋅ Dongdong Chen ⋅ Lei Shi ⋅ Dong Chen ⋅ Houqiang Li
In Room: ExHall D Poster Location: Poster #327 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Sample- and Parameter-Efficient Auto-Regressive Image Models
Elad Amrani ⋅ Leonid Karlinsky ⋅ Alex M. Bronstein
In Room: ExHall D Poster Location: Poster #380 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LOCORE: Image Re-ranking with Long-Context Sequence Modeling
Zilin Xiao ⋅ Pavel Suma ⋅ Ayush Sachdeva ⋅ Hao-Jen Wang ⋅ Giorgos Kordopatis-Zilos ⋅ Giorgos Tolias ⋅ Vicente Ordonez
In Room: ExHall D Poster Location: Poster #401 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
NeRFPrior: Learning Neural Radiance Field as a Prior for Indoor Scene Reconstruction
Wenyuan Zhang ⋅ Emily Yue-ting Jia ⋅ Junsheng Zhou ⋅ Baorui Ma ⋅ Kanle Shi ⋅ Yu-Shen Liu ⋅ Zhizhong Han
In Room: ExHall D Poster Location: Poster #63 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Emphasizing Discriminative Features for Dataset Distillation in Complex Scenarios
Kai Wang ⋅ Zekai Li ⋅ Zhi-Qi Cheng ⋅ Samir Khaki ⋅ Ahmad Sajedi ⋅ Ramakrishna Vedantam ⋅ Konstantinos N. Plataniotis ⋅ Alexander G. Hauptmann ⋅ Yang You
In Room: ExHall D Poster Location: Poster #412 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AerialMegaDepth: Learning Aerial-Ground Reconstruction and View Synthesis Project Page ↗
Khiem Vuong ⋅ Anurag Ghosh ⋅ Deva Ramanan ⋅ Srinivasa G. Narasimhan ⋅ Shubham Tulsiani
In Room: ExHall D Poster Location: Poster #59 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Training-free Anomaly Detection with Vision and Language Foundation Models Project Page ↗
Jinjin Zhang ⋅ Guodong Wang ⋅ yizhou jin ⋅ Di Huang
In Room: ExHall D Poster Location: Poster #436 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LiVOS: Light Video Object Segmentation with Gated Linear Matching
Qin Liu ⋅ Jianfeng Wang ⋅ Zhengyuan Yang ⋅ Linjie Li ⋅ Kevin Lin ⋅ Marc Niethammer ⋅ Lijuan Wang
In Room: ExHall D Poster Location: Poster #315 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dynamic Content Prediction with Motion-aware Priors for Blind Face Video Restoration
Lianxin Xie ⋅ csbingbing zheng ⋅ Si Wu ⋅ Hau San Wong
In Room: ExHall D Poster Location: Poster #192 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Visual Representation Learning through Causal Intervention for Controllable Image Editing
Shanshan Huang ⋅ Haoxuan Li ⋅ Chunyuan Zheng ⋅ Lei Wang ⋅ Guorui Liao ⋅ Zhili Gong ⋅ Huayi Yang ⋅ Li Liu
In Room: ExHall D Poster Location: Poster #232 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Exploring the Deep Fusion of Large Language Models and Diffusion Transformers for Text-to-Image Synthesis
Bingda Tang ⋅ Sayak Paul ⋅ Boyang Zheng ⋅ Saining Xie
In Room: ExHall D Poster Location: Poster #231 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Deformable Radial Kernel Splatting
Yihua Huang ⋅ Mingxian Lin ⋅ Yangtian Sun ⋅ Ziyi Yang ⋅ Xiaoyang Lyu ⋅ Yan-Pei Cao ⋅ Xiaojuan Qi
In Room: ExHall D Poster Location: Poster #44 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Bayesian Prompt Flow Learning for Zero-Shot Anomaly Detection Project Page ↗
Zhen Qu ⋅ Xian Tao ⋅ Xinyi Gong ⋅ ShiChen Qu ⋅ Qiyu Chen ⋅ Zhengtao Zhang ⋅ Xingang Wang ⋅ Guiguang Ding
In Room: ExHall D Poster Location: Poster #407 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
Shin'ya Yamaguchi ⋅ Dewei Feng ⋅ Sekitoshi Kanai ⋅ Kazuki Adachi ⋅ Daiki Chijiwa
In Room: ExHall D Poster Location: Poster #390 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Efficient Event-Based Object Detection: A Hybrid Neural Network with Spatial and Temporal Attention Project Page ↗
Soikat Hasan Ahmed ⋅ Jan Finkbeiner ⋅ Emre Neftci
In Room: ExHall D Poster Location: Poster #317 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SynthLight: Portrait Relighting with Diffusion Model by Learning to Re-render Synthetic Faces
Sumit Chaturvedi ⋅ Mengwei Ren ⋅ Yannick Hold-Geoffroy ⋅ Jingyuan Liu ⋅ Julie Dorsey ⋅ ZHIXIN SHU
In Room: ExHall D Poster Location: Poster #19 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HalLoc: Token-level Localization of Hallucinations for Vision Language Models
Eunkyu Park ⋅ Minyeong Kim ⋅ Gunhee Kim
In Room: ExHall D Poster Location: Poster #358 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis Project Page ↗
Yuming Gu ⋅ Phong Tran ⋅ Yujian Zheng ⋅ Hongyi Xu ⋅ Heyuan Li ⋅ Adilbek Karmanov ⋅ Hao Li
In Room: ExHall D Poster Location: Poster #6 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Plug-and-Play Versatile Compressed Video Enhancement
Huimin Zeng ⋅ Jiacheng Li ⋅ Zhiwei Xiong
In Room: ExHall D Poster Location: Poster #187 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting
Dongliang Luo ⋅ Hanshen Zhu ⋅ Ziyang Zhang ⋅ Dingkang Liang ⋅ Xudong Xie ⋅ Yuliang Liu ⋅ Xiang Bai
In Room: ExHall D Poster Location: Poster #377 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
From Slow Bidirectional to Fast Autoregressive Video Diffusion Models Project Page ↗
Tianwei Yin ⋅ Qiang Zhang ⋅ Richard Zhang ⋅ William Freeman ⋅ Fredo Durand ⋅ Eli Shechtman ⋅ Xun Huang
In Room: ExHall D Poster Location: Poster #181 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PassionSR: Post-Training Quantization with Adaptive Scale in One-Step Diffusion based Image Super-Resolution
Zhu Li Bo ⋅ Jianze Li ⋅ Haotong Qin ⋅ Wenbo Li ⋅ Yulun Zhang ⋅ Yong Guo ⋅ Xiaokang Yang
In Room: ExHall D Poster Location: Poster #203 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RainyGS: Efficient Rain Synthesis with Physically-Based Gaussian Splatting Project Page ↗
Qiyu Dai ⋅ Xingyu Ni ⋅ Qianfan Shen ⋅ Mengyu Chu ⋅ Wenzheng Chen ⋅ Baoquan Chen
In Room: ExHall D Poster Location: Poster #29 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis Project Page ↗
Boming Miao ⋅ Chunxiao Li ⋅ Xiaoxiao Wang ⋅ Andi Zhang ⋅ Rui Sun ⋅ Zizhe Wang ⋅ Yao Zhu
In Room: ExHall D Poster Location: Poster #241 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MonoInstance: Enhancing Monocular Priors via Multi-view Instance Alignment for Neural Rendering and Reconstruction
Wenyuan Zhang ⋅ Yixiao Yang ⋅ Han Huang ⋅ Liang Han ⋅ Kanle Shi ⋅ Yu-Shen Liu ⋅ Zhizhong Han
In Room: ExHall D Poster Location: Poster #56 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Three-view Focal Length Recovery From Homographies
Yaqing Ding ⋅ Viktor Kocur ⋅ Zuzana Berger Haladova ⋅ Qianliang Wu ⋅ Shen Cai ⋅ Jian Yang ⋅ Zuzana Kukelova
In Room: ExHall D Poster Location: Poster #82 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models Project Page ↗
Haoran Hao ⋅ Jiaming Han ⋅ Changsheng Li ⋅ Yu-Feng Li ⋅ Xiangyu Yue
In Room: ExHall D Poster Location: Poster #371 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FADA: Fast Diffusion Avatar Synthesis with Mixed-Supervised Multi-CFG Distillation
Tianyun Zhong ⋅ Chao Liang ⋅ Jianwen Jiang ⋅ Gaojie Lin ⋅ Jiaqi Yang ⋅ Zhou Zhao
In Room: ExHall D Poster Location: Poster #281 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MeshArt: Generating Articulated Meshes with Structure-Guided Transformers
Daoyi Gao ⋅ Mohd Yawar Nihal Siddiqui ⋅ Lei Li ⋅ Angela Dai
In Room: ExHall D Poster Location: Poster #42 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Non-Natural Image Understanding with Advancing Frequency-based Vision Encoders
Wang Lin ⋅ Qingsong Wang ⋅ Yueying Feng ⋅ Shulei Wang ⋅ Tao Jin ⋅ Zhou Zhao ⋅ Fei Wu ⋅ Chang Yao ⋅ Jingyuan Chen
In Room: ExHall D Poster Location: Poster #346 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SplatFlow: Self-Supervised Dynamic Gaussian Splatting in Neural Motion Flow Field for Autonomous Driving
Su Sun ⋅ Cheng Zhao ⋅ Zhuoyang Sun ⋅ Yingjie Chen ⋅ Mei Chen
In Room: ExHall D Poster Location: Poster #127 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AesthetiQ: Enhancing Graphic Layout Design via Aesthetic-Aware Preference Alignment of Multi-modal Large Language Models Project Page ↗
Sohan Patnaik ⋅ Rishabh Jain ⋅ Balaji Krishnamurthy ⋅ Mausoom Sarkar
In Room: ExHall D Poster Location: Poster #255 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Enhanced then Progressive Fusion with View Graph for Multi-View Clustering
Zhibin Dong ⋅ Meng Liu ⋅ Siwei Wang ⋅ KE LIANG ⋅ Yi Zhang ⋅ Suyuan Liu ⋅ Jiaqi Jin ⋅ Xinwang Liu ⋅ En Zhu
In Room: ExHall D Poster Location: Poster #466 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity
Hang Hua ⋅ Qing Liu ⋅ Lingzhi Zhang ⋅ Jing Shi ⋅ Soo Ye Kim ⋅ Zhifei Zhang ⋅ Yilin Wang ⋅ Jianming Zhang ⋅ Zhe Lin ⋅ Jiebo Luo
In Room: ExHall D Poster Location: Poster #357 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Adaptive Non-Uniform Timestep Sampling for Accelerating Diffusion Model Training Project Page ↗
Myunsoo Kim ⋅ Donghyeon Ki ⋅ Seong-Woong Shim ⋅ Byung-Jun Lee
In Room: ExHall D Poster Location: Poster #225 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Navigating the Unseen: Zero-shot Scene Graph Generation via Capsule-Based Equivariant Features
Wenhuan Huang ⋅ Yi JI ⋅ guiqian zhu ⋅ Ying Li ⋅ chunping Liu
In Room: ExHall D Poster Location: Poster #315 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea
Qifan Yu ⋅ Wei Chow ⋅ Zhongqi Yue ⋅ Kaihang Pan ⋅ Yang Wu ⋅ Xiaoyang Wan ⋅ Juncheng Li ⋅ Siliang Tang ⋅ Hanwang Zhang ⋅ Yueting Zhuang
In Room: ExHall D Poster Location: Poster #214 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Compass Control: Multi Object Orientation Control for Text-to-Image Generation
Rishubh Parihar ⋅ Vaibhav Agrawal ⋅ Sachidanand VS ⋅ R. Venkatesh Babu
In Room: ExHall D Poster Location: Poster #252 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Correcting Deviations from Normality: A Reformulated Diffusion Model for Multi-Class Unsupervised Anomaly Detection
Farzad Beizaee ⋅ Gregory A. Lodygensky ⋅ Christian Desrosiers ⋅ Jose Dolz
In Room: ExHall D Poster Location: Poster #314 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Continuous 3D Perception Model with Persistent State Project Page ↗
Qianqian Wang ⋅ Yifei Zhang ⋅ Aleksander Holynski ⋅ Alexei A. Efros ⋅ Angjoo Kanazawa
In Room: ExHall D Poster Location: Poster #77 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Unleashing the Potential of Consistency Learning for Detecting and Grounding Multi-Modal Media Manipulation
Yiheng Li ⋅ Yang Yang ⋅ Zichang Tan ⋅ Huan Liu ⋅ Weihua Chen ⋅ Xu Zhou ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #369 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DNF: Unconditional 4D Generation with Dictionary-based Neural Fields
Xinyi Zhang ⋅ Naiqi Li ⋅ Angela Dai
In Room: ExHall D Poster Location: Poster #12 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Gazing at Rewards: Eye Movements as a Lens into Human and AI Decision-Making in Hybrid Visual Foraging
Bo Wang ⋅ Dingwei Tan ⋅ Yen-Ling Kuo ⋅ Zhaowei Sun ⋅ Jeremy M Wolfe ⋅ Tat-Jen Cham ⋅ Mengmi Zhang
In Room: ExHall D Poster Location: Poster #398 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ARM: Appearance Reconstruction Model for Relightable 3D Generation
Xiang Feng ⋅ Chang Yu ⋅ Zoubin Bi ⋅ Yintong Shang ⋅ Feng Gao ⋅ Hongzhi Wu ⋅ Kun Zhou ⋅ Chenfanfu Jiang ⋅ Yin Yang
In Room: ExHall D Poster Location: Poster #36 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Ground-V: Teaching VLMs to Ground Complex Instructions in Pixels
Yongshuo Zong ⋅ Qin ZHANG ⋅ DONGSHENG An ⋅ Zhihua Li ⋅ Xiang Xu ⋅ Linghan Xu ⋅ Zhuowen Tu ⋅ Yifan Xing ⋅ Onkar Dabeer
In Room: ExHall D Poster Location: Poster #345 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Structure-from-Motion with a Non-Parametric Camera Model
Yihan Wang ⋅ Linfei Pan ⋅ Marc Pollefeys ⋅ Viktor Larsson
In Room: ExHall D Poster Location: Poster #81 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EventPSR: Surface Normal and Reflectance Estimation from Photometric Stereo Using an Event Camera
Bohan Yu ⋅ Jin Han ⋅ Boxin Shi ⋅ Imari Sato
In Room: ExHall D Poster Location: Poster #73 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LAL: Enhancing 3D Human Motion Prediction with Latency-aware Auxiliary Learning
Xiaoning Sun ⋅ Dong Wei ⋅ Huaijiang Sun ⋅ Shengxiang Hu
In Room: ExHall D Poster Location: Poster #167 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RefPose: Leveraging Reference Geometric Correspondences for Accurate 6D Pose Estimation of Unseen Objects
Jaeguk Kim ⋅ Jaewoo Park ⋅ Keuntek Lee ⋅ Nam Ik Cho
In Room: ExHall D Poster Location: Poster #102 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Shape My Moves: Text-Driven Shape-Aware Synthesis of Human Motions
Ting-Hsuan Liao ⋅ Yi Zhou ⋅ Yu Shen ⋅ Chun-Hao P. Huang ⋅ Saayan Mitra ⋅ Jia-Bin Huang ⋅ Uttaran Bhattacharya
In Room: ExHall D Poster Location: Poster #162 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Generating 3D-Consistent Videos from Unposed Internet Photos
Gene Chou ⋅ Kai Zhang ⋅ Sai Bi ⋅ Hao Tan ⋅ Zexiang Xu ⋅ Fujun Luan ⋅ Bharath Hariharan ⋅ Noah Snavely
In Room: ExHall D Poster Location: Poster #168 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GRAE-3DMOT: Geometry Relation-Aware Encoder for Online 3D Multi-Object Tracking
Hyunseop Kim ⋅ Hyo-Jun Lee ⋅ Yonguk Lee ⋅ Jinu Lee ⋅ Hanul Kim ⋅ Yeong Jun Koh
In Room: ExHall D Poster Location: Poster #101 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Automatic Joint Structured Pruning and Quantization for Efficient Neural Network Training and Compression Project Page ↗
Xiaoyi Qu ⋅ David Aponte ⋅ Colby Banbury ⋅ Daniel Robinson ⋅ Tianyu Ding ⋅ Kazuhito Koishida ⋅ Ilya Zharkov ⋅ Tianyi Chen
In Room: ExHall D Poster Location: Poster #439 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LIRM: Large Inverse Rendering Model for Progressive Reconstruction of Shape, Materials and View-dependent Radiance Fields Project Page ↗
Zhengqin Li ⋅ Dilin Wang ⋅ Ka chen ⋅ Zhaoyang Lv ⋅ Thu Nguyen-Phuoc ⋅ Milim Lee ⋅ Jia-Bin Huang ⋅ Lei Xiao ⋅ Yufeng Zhu ⋅ Carl Marshall ⋅ Carl Ren ⋅ Richard Newcombe ⋅ Zhao Dong
In Room: ExHall D Poster Location: Poster #32 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Latent Space Super-Resolution for Higher-Resolution Image Generation with Diffusion Models Project Page ↗
Jinho Jeong ⋅ Sangmin Han ⋅ Jinwoo Kim ⋅ Seon Joo Kim
In Room: ExHall D Poster Location: Poster #206 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DualTalk: Dual-Speaker Interaction for 3D Talking Head Conversations Project Page ↗
Ziqiao Peng ⋅ Yanbo Fan ⋅ Haoyu Wu ⋅ Xuan Wang ⋅ Hongyan Liu ⋅ Jun He ⋅ Zhaoxin Fan
In Room: ExHall D Poster Location: Poster #1 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MAR-3D: Progressive Masked Auto-regressor for High-Resolution 3D Generation Project Page ↗
Jinnan Chen ⋅ Lingting Zhu ⋅ Zeyu HU ⋅ Shengju Qian ⋅ Yugang Chen ⋅ Xin Wang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #41 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dynamic Group Normalization: Spatio-Temporal Adaptation to Evolving Data Statistics
Yair Smadar ⋅ Assaf Hoogi
In Room: ExHall D Poster Location: Poster #385 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Gen3DEval: Using vLLMs for Automatic Evaluation of Generated 3D Objects
Shalini Maiti ⋅ Lourdes Agapito ⋅ Filippos Kokkinos
In Room: ExHall D Poster Location: Poster #265 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ACL: Activating Capability of Linear Attention for Image Restoration
Yubin Gu ⋅ Yuan Meng ⋅ Jiayi Ji ⋅ Xiaoshuai Sun
In Room: ExHall D Poster Location: Poster #201 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GenDeg: Diffusion-based Degradation Synthesis for Generalizable All-In-One Image Restoration
Sudarshan Rajagopalan ⋅ Nithin Gopalakrishnan Nair ⋅ Jay Paranjape ⋅ Vishal M. Patel
In Room: ExHall D Poster Location: Poster #189 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Phoenix: A Motion-based Self-Reflection Framework for Fine-grained Robotic Action Correction
Wenke Xia ⋅ Ruoxuan Feng ⋅ Dong Wang ⋅ Di Hu
In Room: ExHall D Poster Location: Poster #154 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
The Power of Context: How Multimodality Improves Image Super-Resolution Project Page ↗
Kangfu Mei ⋅ Vishal M. Patel ⋅ Mojtaba Sahraee-Ardakan ⋅ Hossein Talebi ⋅ Peyman Milanfar ⋅ Mauricio Delbracio
In Room: ExHall D Poster Location: Poster #198 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MARBLE: Material Recomposition and Blending in CLIP-Space Project Page ↗
Ta-Ying Cheng ⋅ Prafull Sharma ⋅ Mark Boss ⋅ Varun Jampani
In Room: ExHall D Poster Location: Poster #230 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EventFly: Event Camera Perception from Ground to the Sky Project Page ↗
Lingdong Kong ⋅ Dongyue Lu ⋅ Xiang Xu ⋅ Lai Xing Ng ⋅ Wei Tsang Ooi ⋅ Benoit Cottereau
In Room: ExHall D Poster Location: Poster #122 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Detect Any Mirrors: Boosting Learning Reliability on Large-Scale Unlabeled Data with an Iterative Data Engine
Zhaohu Xing ⋅ Lihao Liu ⋅ Yijun Yang ⋅ Hongqiu Wang ⋅ Tian Ye ⋅ Sixiang Chen ⋅ Wenxue Li ⋅ Guang Liu ⋅ Lei Zhu
In Room: ExHall D Poster Location: Poster #423 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CH3Depth: Efficient and Flexible Depth Foundation Model with Flow Matching Project Page ↗
Jiaqi Li ⋅ Yiran Wang ⋅ Jinghong Zheng ⋅ Junrui Zhang ⋅ Liao Shen ⋅ Tianqi Liu ⋅ Zhiguo Cao
In Room: ExHall D Poster Location: Poster #178 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ASIGN: An Anatomy-aware Spatial Imputation Graphic Network for 3D Spatial Transcriptomics Project Page ↗
Junchao Zhu ⋅ Ruining Deng ⋅ Tianyuan Yao ⋅ Juming Xiong ⋅ Chongyu Qu ⋅ Junlin Guo ⋅ Siqi Lu ⋅ Mengmeng Yin ⋅ Yu Wang ⋅ Shilin Zhao ⋅ Haichun Yang ⋅ Yuankai Huo
In Room: ExHall D Poster Location: Poster #448 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Efficient Visual State Space Model for Image Deblurring
Lingshun Kong ⋅ Jiangxin Dong ⋅ Jinhui Tang ⋅ Ming-Hsuan Yang ⋅ Jinshan Pan
In Room: ExHall D Poster Location: Poster #197 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
4D LangSplat: 4D Language Gaussian Splatting via Multimodal Large Language Models
Wanhua Li ⋅ Renping Zhou ⋅ Jiawei Zhou ⋅ Yingwei Song ⋅ Johannes Herter ⋅ Minghan Qin ⋅ Gao Huang ⋅ Hanspeter Pfister
In Room: ExHall D Poster Location: Poster #91 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking
Xinqi Liu ⋅ Li Zhou ⋅ Zikun Zhou ⋅ Jianqiu Chen ⋅ Zhenyu He
In Room: ExHall D Poster Location: Poster #321 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhancing 3D Gaze Estimation in the Wild using Weak Supervision with Gaze Following Labels Project Page ↗
Pierre Vuillecard ⋅ Jean-marc Odobez
In Room: ExHall D Poster Location: Poster #273 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MotionMap: Representing Multimodality in Human Pose Forecasting
Reyhaneh Hosseininejad ⋅ Megh Shukla ⋅ Saeed Saadatnejad ⋅ Mathieu Salzmann ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #154 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning-enabled Polynomial Lyapunov Function Synthesis via High-Accuracy Counterexample-Guided Framework
Hanrui Zhao ⋅ Niuniu Qi ⋅ Mengxin Ren ⋅ Banglong Liu ⋅ Shuming Shi ⋅ Zhengfeng Yang
In Room: ExHall D Poster Location: Poster #467 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GaussianSpa: An “Optimizing-Sparsifying” Simplification Framework for Compact and High-Quality 3D Gaussian Splatting Project Page ↗
Yangming Zhang ⋅ Wenqi Jia ⋅ Wei Niu ⋅ Miao Yin
In Room: ExHall D Poster Location: Poster #49 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Sparse2DGS: Geometry-Prioritized Gaussian Splatting for Surface Reconstruction from Sparse Views
Jiang Wu ⋅ Rui Li ⋅ Yu Zhu ⋅ Rong Guo ⋅ Jinqiu Sun ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #62 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ASHiTA: Automatic Scene-grounded HIerarchical Task Analysis
Yun Chang ⋅ Leonor Fermoselle ⋅ Duy Ta ⋅ Bernadette Bucher ⋅ Luca Carlone ⋅ Jiuguang Wang
In Room: ExHall D Poster Location: Poster #316 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Patient-Level Anatomy Meets Scanning-Level Physics: Personalized Federated Low-Dose CT Denoising Empowered by Large Language Model
Ziyuan Yang ⋅ Yingyu Chen ⋅ Zhiwen Wang ⋅ Hongming Shan ⋅ Yang Chen ⋅ Yi Zhang
In Room: ExHall D Poster Location: Poster #477 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Exploiting Deblurring Networks for Radiance Fields Project Page ↗
Haeyun Choi ⋅ Heemin Yang ⋅ Janghyeok Han ⋅ Sunghyun Cho
In Room: ExHall D Poster Location: Poster #54 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rethinking Lanes and Points in Complex Scenarios for Monocular 3D Lane Detection
Yifan Chang ⋅ Junjie Huang ⋅ Xiaofeng Wang ⋅ Yun Ye ⋅ Zhujin LIANG ⋅ Yi Shan ⋅ Dalong Du ⋅ Xingang Wang
In Room: ExHall D Poster Location: Poster #137 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
Zixuan Huang ⋅ Mark Boss ⋅ Aaryaman Vasishta ⋅ James Rehg ⋅ Varun Jampani
In Room: ExHall D Poster Location: Poster #99 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Discovering Fine-Grained Visual-Concept Relations by Disentangled Optimal Transport Concept Bottleneck Models
Yan Xie ⋅ Zequn Zeng ⋅ Hao Zhang ⋅ Yucheng Ding ⋅ Yi Wang ⋅ Zhengjue Wang ⋅ Bo Chen ⋅ Hongwei Liu
In Room: ExHall D Poster Location: Poster #388 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Focus-N-Fix: Region-Aware Fine-Tuning for Text-to-Image Generation
Xiaoying Xing ⋅ Avinab Saha ⋅ Junfeng He ⋅ Susan Hao ⋅ Paul Vicol ⋅ Moonkyung Ryu ⋅ Gang Li ⋅ Sahil Singla ⋅ Sarah Young ⋅ Yinxiao Li ⋅ Feng Yang ⋅ Deepak Ramachandran
In Room: ExHall D Poster Location: Poster #259 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PSA-SSL: Pose and Size-aware Self-Supervised Learning on LiDAR Point Clouds
Barza Nisar ⋅ Steven L. Waslander
In Room: ExHall D Poster Location: Poster #124 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Bringing CLIP to the Clinic: Dynamic Soft Labels and Negation-Aware Learning for Medical Analysis
Hanbin Ko ⋅ Chang Min Park
In Room: ExHall D Poster Location: Poster #467 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Label Shift Meets Online Learning: Ensuring Consistent Adaptation with Universal Dynamic Regret
Yucong Dai ⋅ Shilin Gu ⋅ Ruidong Fan ⋅ Chao Xu ⋅ Chenping Hou
In Room: ExHall D Poster Location: Poster #454 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Semantic Knowledge Complementarity based Decoupling Framework for Semi-supervised Class-imbalanced Medical Image Segmentation Project Page ↗
Zheng Zhang ⋅ Guanchun Yin ⋅ Bo Zhang ⋅ Wu Liu ⋅ Xiuzhuang Zhou ⋅ Wendong Wang
In Room: ExHall D Poster Location: Poster #471 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ModeSeq: Taming Sparse Multimodal Motion Prediction with Sequential Mode Modeling
Zikang Zhou ⋅ Hengjian Zhou ⋅ Haibo Hu ⋅ Zihao WEN ⋅ Jianping Wang ⋅ Yung-Hui Li ⋅ Yu-Kai Huang
In Room: ExHall D Poster Location: Poster #135 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Quaffure: Real-Time Quasi-Static Neural Hair Simulation
Tuur Stuyck ⋅ Gene Wei-Chin Lin ⋅ Egor Larionov ⋅ Hsiaoyu Chen ⋅ Aljaž Božič ⋅ Nikolaos Sarafianos ⋅ Doug Roble
In Room: ExHall D Poster Location: Poster #7 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
From Alexnet to Transformers: Measuring the Non-linearity of Deep Neural Networks with Affine Optimal Transport Project Page ↗
Quentin Bouniot ⋅ Ievgen Redko ⋅ Anton Mallasto ⋅ Charlotte Laclau ⋅ Oliver Struckmeier ⋅ Karol Arndt ⋅ Markus Heinonen ⋅ Ville Kyrki ⋅ Samuel Kaski
In Room: ExHall D Poster Location: Poster #402 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DepthSplat: Connecting Gaussian Splatting and Depth Project Page ↗
Haofei Xu ⋅ Songyou Peng ⋅ Fangjinhua Wang ⋅ Hermann Blum ⋅ Daniel Barath ⋅ Andreas Geiger ⋅ Marc Pollefeys
In Room: ExHall D Poster Location: Poster #58 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FedBiP: Heterogeneous One-Shot Federated Learning with Personalized Latent Diffusion Models
Haokun Chen ⋅ Hang Li ⋅ Yao Zhang ⋅ Jinhe Bi ⋅ Gengyuan Zhang ⋅ Yueqi Zhang ⋅ Philip H.S. Torr ⋅ Jindong Gu ⋅ Denis Krompaß ⋅ Volker Tresp
In Room: ExHall D Poster Location: Poster #411 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Evolving High-Quality Rendering and Reconstruction in a Unified Framework with Contribution-Adaptive Regularization
You Shen ⋅ Zhipeng Zhang ⋅ Xinyang Li ⋅ Yansong Qu ⋅ Yu Lin ⋅ Shengchuan Zhang ⋅ Liujuan Cao
In Room: ExHall D Poster Location: Poster #48 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Language-Guided Salient Object Ranking
Fang Liu ⋅ Yuhao Liu ⋅ Ke Xu ⋅ Shuquan Ye ⋅ Gerhard Hancke ⋅ Rynson W.H. Lau
In Room: ExHall D Poster Location: Poster #350 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
D^2iT: Dynamic Diffusion Transformer for Accurate Image Generation
Weinan Jia ⋅ Mengqi Huang ⋅ Nan Chen ⋅ Lei Zhang ⋅ Zhendong Mao
In Room: ExHall D Poster Location: Poster #211 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Inference-Scale Complexity in ANN-SNN Conversion for High-Performance and Low-Power Applications
Tong Bu ⋅ Maohua Li ⋅ Zhaofei Yu
In Room: ExHall D Poster Location: Poster #321 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
NoiseCtrl: A Sampling-Algorithm-Agnostic Conditional Generation Method for Diffusion Models
Longquan Dai ⋅ He Wang ⋅ Jinhui Tang
In Room: ExHall D Poster Location: Poster #218 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Segment This Thing: Foveated Tokenization for Efficient Point-Prompted Segmentation Project Page ↗
Tanner Schmidt ⋅ Richard Newcombe
In Room: ExHall D Poster Location: Poster #313 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TCFG: Tangential Damping Classifier-free Guidance
Mingi Kwon ⋅ Shin seong Kim ⋅ Jaeseok Jeong ⋅ Yi-Ting Hsiao ⋅ Youngjung Uh
In Room: ExHall D Poster Location: Poster #235 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AutoPresent: Designing Structured Visuals from Scratch
Jiaxin Ge ⋅ Zora Zhiruo Wang ⋅ Xuhui Zhou ⋅ Yi-Hao Peng ⋅ Sanjay Subramanian ⋅ Qinyue Tan ⋅ Maarten Sap ⋅ Alane Suhr ⋅ Daniel Fried ⋅ Graham Neubig ⋅ Trevor Darrell
In Room: ExHall D Poster Location: Poster #262 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PVC: Progressive Visual Token Compression for Unified Image and Video Processing in Large Vision-Language Models Project Page ↗
Chenyu Yang ⋅ Xuan Dong ⋅ Xizhou Zhu ⋅ Weijie Su ⋅ Jiahao Wang ⋅ Hao Tian ⋅ Zhe Chen ⋅ Wenhai Wang ⋅ Lewei Lu ⋅ Jifeng Dai
In Room: ExHall D Poster Location: Poster #373 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
KMD: Koopman Multi-modality Decomposition for Generalized Brain Tumor Segmentation under Incomplete Modalities
Tianyi Liu ⋅ Haochuan Jiang ⋅ Kaizhu Huang
In Room: ExHall D Poster Location: Poster #480 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LongDiff: Training-Free Long Video Generation in One Go
Zhuoling Li ⋅ Hossein Rahmani ⋅ Qiuhong Ke ⋅ Jun Liu
In Room: ExHall D Poster Location: Poster #189 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation
Yuyang Peng ⋅ Shishi Xiao ⋅ Keming Wu ⋅ Qisheng Liao ⋅ Bohan CHEN ⋅ Kevin Lin ⋅ Danqing Huang ⋅ Ji Li ⋅ Yuhui Yuan
In Room: ExHall D Poster Location: Poster #247 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LSNet: See Large, Focus Small Project Page ↗
Ao Wang ⋅ Hui Chen ⋅ Zijia Lin ⋅ Jungong Han ⋅ Guiguang Ding
In Room: ExHall D Poster Location: Poster #414 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DORNet: A Degradation Oriented and Regularized Network for Blind Depth Super-Resolution
Zhengxue Wang ⋅ Zhiqiang Yan ⋅ Jinshan Pan ⋅ Guangwei Gao ⋅ Kai Zhang ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #46 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Unsupervised Continual Domain Shift Learning with Multi-Prototype Modeling
Haopeng Sun ⋅ Yingwei Zhang ⋅ Lumin Xu ⋅ Sheng Jin ⋅ Ping Luo ⋅ Chen Qian ⋅ Wentao Liu ⋅ Yiqiang Chen
In Room: ExHall D Poster Location: Poster #453 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Using Diffusion Priors for Video Amodal Segmentation Project Page ↗
Kaihua Chen ⋅ Deva Ramanan ⋅ Tarasha Khurana
In Room: ExHall D Poster Location: Poster #174 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Augmented Deep Contexts for Spatially Embedded Video Coding Project Page ↗
Yifan Bian ⋅ Chuanbo Tang ⋅ Li Li ⋅ Dong Liu
In Room: ExHall D Poster Location: Poster #181 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Source-Free Machine Unlearning
Sk Miraj Ahmed ⋅ Umit Basaran ⋅ Dripta S. Raychaudhuri ⋅ Arindam Dutta ⋅ Rohit Kundu ⋅ Fahim Faisal Niloy ⋅ Basak Guler ⋅ Amit K. Roy-Chowdhury
In Room: ExHall D Poster Location: Poster #457 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Fractal Calibration for Long-tailed Object Detection Project Page ↗
Konstantinos Alexandridis ⋅ Ismail Elezi ⋅ Jiankang Deng ⋅ Anh Nguyen ⋅ Shan Luo
In Room: ExHall D Poster Location: Poster #430 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Adaptive Unimodal Regulation for Balanced Multimodal Information Acquisition
Chengxiang Huang ⋅ Yake Wei ⋅ Zequn Yang ⋅ Di Hu
In Room: ExHall D Poster Location: Poster #463 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Noise Calibration and Spatial-Frequency Interactive Network for STEM Image Enhancement Project Page ↗
Hesong Li ⋅ Ziqi Wu ⋅ Ruiwen Shao ⋅ Tao Zhang ⋅ Ying Fu
In Room: ExHall D Poster Location: Poster #23 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning to Highlight Audio by Watching Movies Project Page ↗
Chao Huang ⋅ Ruohan Gao ⋅ J. M. F. Tsang ⋅ Jan Kurcius ⋅ Cagdas Bilen ⋅ Chenliang Xu ⋅ Anurag Kumar ⋅ Sanjeel Parekh
In Room: ExHall D Poster Location: Poster #278 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos Project Page ↗
Prithviraj Banerjee ⋅ Sindi Shkodrani ⋅ Pierre Moulon ⋅ Shreyas Hampali ⋅ Shangchen Han ⋅ Fan Zhang ⋅ Linguang Zhang ⋅ Jade Fountain ⋅ Edward Miller ⋅ Selen Basol ⋅ Richard Newcombe ⋅ Robert Wang ⋅ Jakob Engel ⋅ Tomas Hodan
In Room: ExHall D Poster Location: Poster #163 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Video-3D LLM: Learning Position-Aware Video Representation for 3D Scene Understanding
Duo Zheng ⋅ Shijia Huang ⋅ Liwei Wang
In Room: ExHall D Poster Location: Poster #347 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhancing Video-LLM Reasoning via Agent-of-Thoughts Distillation
Yudi Shi ⋅ Shangzhe Di ⋅ Qirui Chen ⋅ Weidi Xie
In Room: ExHall D Poster Location: Poster #300 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FedSPA: Generalizable Federated Graph Learning under Homophily Heterogeneity
Zihan Tan ⋅ Guancheng Wan ⋅ Wenke Huang ⋅ Guibin Zhang ⋅ He Li ⋅ Carl Yang ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #461 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PRaDA: Projective Radial Distortion Averaging
Daniil Sinitsyn ⋅ Linus Härenstam-Nielsen ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #81 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation Project Page ↗
Jiantao Lin ⋅ Xin Yang ⋅ Meixi Chen ⋅ Xu Yingjie ⋅ Dongyu Yan ⋅ Leyi Wu ⋅ Xinli Xu ⋅ Lie XU ⋅ Shunsi Zhang ⋅ Ying-Cong Chen
In Room: ExHall D Poster Location: Poster #41 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Feature Information Driven Position Gaussian Distribution Estimation for Tiny Object Detection
Jinghao Bian ⋅ Mingtao Feng ⋅ Weisheng Dong ⋅ Fangfang Wu ⋅ Jianqiao Luo ⋅ Yaonan Wang ⋅ Guangming Shi
In Room: ExHall D Poster Location: Poster #405 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SURGEON: Memory-Adaptive Fully Test-Time Adaptation via Dynamic Activation Sparsity Project Page ↗
Ke Ma ⋅ Jiaqi Tang ⋅ Bin Guo ⋅ Fan Dang ⋅ Sicong Liu ⋅ Zhui Zhu ⋅ Lei Wu ⋅ Cheng Fang ⋅ Ying-Cong Chen ⋅ Zhiwen Yu ⋅ Yunhao Liu
In Room: ExHall D Poster Location: Poster #418 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Homogeneous Dynamics Space for Heterogeneous Humans
Xinpeng Liu ⋅ Junxuan Liang ⋅ Chenshuo Zhang ⋅ Zixuan Cai ⋅ Cewu Lu ⋅ Yonglu Li
In Room: ExHall D Poster Location: Poster #154 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GazeGene: Large-scale Synthetic Gaze Dataset with 3D Eyeball Annotations
Yiwei Bao ⋅ Zhiming Wang ⋅ Feng Lu
In Room: ExHall D Poster Location: Poster #283 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ImViD: Immersive Volumetric Videos for Enhanced VR Engagement Project Page ↗
Zhengxian Yang ⋅ Shi Pan ⋅ Shengqi Wang ⋅ Haoxiang Wang ⋅ Li Lin ⋅ Guanjun Li ⋅ Zhengqi Wen ⋅ Borong Lin ⋅ Jianhua Tao ⋅ Tao Yu
In Room: ExHall D Poster Location: Poster #69 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Real-IAD D³: A Real-World 2D/Pseudo-3D/3D Dataset for Industrial Anomaly Detection
wenbing zhu ⋅ Lidong Wang ⋅ Ziqing Zhou ⋅ Chengjie Wang ⋅ Yurui Pan ⋅ Ruoyi.Zhang ⋅ Zhuhao Chen ⋅ Linjie Cheng ⋅ Bin-Bin Gao ⋅ Jiangning Zhang ⋅ Zhenye Gan ⋅ Yuxie Wang ⋅ Yulong Chen ⋅ Bruce Qian ⋅ Mingmin Chi ⋅ Bo Peng ⋅ Lizhuang Ma
In Room: ExHall D Poster Location: Poster #437 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Attribute-formed Class-specific Concept Space: Endowing Language Bottleneck Model with Better Interpretability and Scalability
Jianyang Zhang ⋅ Qianli Luo ⋅ Guowu Yang ⋅ Wenjing Yang ⋅ Weide Liu ⋅ Guosheng Lin ⋅ Fengmao Lv
In Room: ExHall D Poster Location: Poster #397 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Erase Diffusion: Empowering Object Removal Through Calibrating Diffusion Pathways
Yi Liu ⋅ Hao Zhou ⋅ Benlei Cui ⋅ Wenxiang Shang ⋅ Ran Lin
In Room: ExHall D Poster Location: Poster #212 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MultiVENT 2.0: A Massive Multilingual Benchmark for Event-Centric Video Retrieval
Reno Kriz ⋅ Kate Sanders ⋅ David Etter ⋅ Kenton Murray ⋅ Cameron Carpenter ⋅ Hannah Recknor ⋅ Jimena Guallar-Blasco ⋅ Alexander Martin ⋅ Eugene Yang ⋅ Benjamin Van Durme
In Room: ExHall D Poster Location: Poster #299 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
BiomedCoOp: Learning to Prompt for Biomedical Vision-Language Models Project Page ↗
Taha Koleilat ⋅ Hojat Asgariandehkordi ⋅ Hassan Rivaz ⋅ Yiming Xiao
In Room: ExHall D Poster Location: Poster #394 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Shape and Texture: What Influences Reliable Optical Flow Estimation?
Libo Long ⋅ Xiao Hu ⋅ Jochen Lang
In Room: ExHall D Poster Location: Poster #164 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VideoHandles: Editing 3D Object Compositions in Videos Using Video Generative Priors
Juil Koo ⋅ Paul Guerrero ⋅ Chun-Hao P. Huang ⋅ Duygu Ceylan ⋅ Minhyuk Sung
In Room: ExHall D Poster Location: Poster #180 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Resilient Sensor Fusion Under Adverse Sensor Failures via Multi-Modal Expert Fusion Project Page ↗
Konyul Park ⋅ Yecheol Kim ⋅ Daehun Kim ⋅ Jun Won Choi
In Room: ExHall D Poster Location: Poster #129 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Satellite Observations Guided Diffusion Model for Accurate Meteorological States at Arbitrary Resolution
Siwei Tu ⋅ Ben Fei ⋅ Weidong Yang ⋅ Fenghua Ling ⋅ Hao Chen ⋅ Zili Liu ⋅ Kun Chen ⋅ Hang Fan ⋅ Wanli Ouyang ⋅ Lei Bai
In Room: ExHall D Poster Location: Poster #181 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Event-Equalized Dense Video Captioning
Kangyi Wu ⋅ Pengna Li ⋅ Jingwen Fu ⋅ Yizhe Li ⋅ Yang Wu ⋅ Yuhan Liu ⋅ Jinjun Wang ⋅ Sanping Zhou
In Room: ExHall D Poster Location: Poster #291 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multirate Neural Image Compression with Adaptive Lattice Vector Quantization
Hao Xu ⋅ Xiaolin Wu ⋅ Xi Zhang
In Room: ExHall D Poster Location: Poster #216 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VidTwin: Video VAE with Decoupled Structure and Dynamics Project Page ↗
Yuchi Wang ⋅ Junliang Guo ⋅ Xinyi Xie ⋅ Tianyu He ⋅ Xu Sun ⋅ Jiang Bian
In Room: ExHall D Poster Location: Poster #177 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reconstructing People, Places, and Cameras
Lea Müller ⋅ Hongsuk Choi ⋅ Anthony Zhang ⋅ Brent Yi ⋅ Jitendra Malik ⋅ Angjoo Kanazawa
In Room: ExHall D Poster Location: Poster #86 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Evaluating Model Perception of Color Illusions in Photorealistic Scenes
Lingjun Mao ⋅ Zineng Tang ⋅ Alane Suhr
In Room: ExHall D Poster Location: Poster #233 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Preserve or Modify? Context-Aware Evaluation for Balancing Preservation and Modification in Text-Guided Image Editing Project Page ↗
Yoonjeon Kim ⋅ Soohyun Ryu ⋅ Yeonsung Jung ⋅ Hyunkoo Lee ⋅ Joowon Kim ⋅ June Yong Yang ⋅ Jaeryong Hwang ⋅ Eunho Yang
In Room: ExHall D Poster Location: Poster #231 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ProReflow: Progressive Reflow with Decomposed Velocity
Lei Ke ⋅ Haohang Xu ⋅ Xuefei Ning ⋅ Yu Li ⋅ Jiajun Li ⋅ Haoling Li ⋅ Yuxuan Lin ⋅ Dongsheng Jiang ⋅ Yujiu Yang ⋅ Linfeng Zhang
In Room: ExHall D Poster Location: Poster #177 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Object-aware Sound Source Localization via Audio-Visual Scene Understanding
Sung Jin Um ⋅ Dongjin Kim ⋅ Sangmin Lee ⋅ Jung Uk Kim
In Room: ExHall D Poster Location: Poster #284 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
PCM : Picard Consistency Model for Fast Parallel Sampling of Diffusion Models
Junhyuk So ⋅ Jiwoong Shin ⋅ Chaeyeon Jang ⋅ Eunhyeok Park
In Room: ExHall D Poster Location: Poster #216 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Precise Scaling Laws for Video Diffusion Transformers
Yuanyang Yin ⋅ Yaqi Zhao ⋅ Mingwu Zheng ⋅ Ke Lin ⋅ Jiarong Ou ⋅ Rui Chen ⋅ Victor Shea-Jay Huang ⋅ Jiahao Wang ⋅ Xin Tao ⋅ Pengfei Wan ⋅ Di ZHANG ⋅ Baoqun Yin ⋅ Wentao Zhang ⋅ Kun Gai
In Room: ExHall D Poster Location: Poster #224 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VideoGEM: Training-free Action Grounding in Videos
Felix Vogel ⋅ Walid Bousselham ⋅ Anna Kukleva ⋅ Nina Shvetsova ⋅ Hilde Kuehne
In Room: ExHall D Poster Location: Poster #306 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
InPO: Inversion Preference Optimization with Reparametrized DDIM for Efficient Diffusion Model Alignment Project Page ↗
Yunhong Lu ⋅ Qichao Wang ⋅ Hengyuan Cao ⋅ Xierui Wang ⋅ Xiaoyin Xu ⋅ Min Zhang
In Room: ExHall D Poster Location: Poster #235 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SceneFactor: Factored Latent 3D Diffusion for Controllable 3D Scene Generation
Aleksei Bokhovkin ⋅ Quan Meng ⋅ Shubham Tulsiani ⋅ Angela Dai
In Room: ExHall D Poster Location: Poster #43 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
StreamingT2V: Consistent, Dynamic, and Extendable Long Video Generation from Text
Roberto Henschel ⋅ Levon Khachatryan ⋅ Hayk Poghosyan ⋅ Daniil Hayrapetyan ⋅ Vahram Tadevosyan ⋅ Zhangyang Wang ⋅ Shant Navasardyan ⋅ Humphrey Shi
In Room: ExHall D Poster Location: Poster #230 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DefMamba: Deformable Visual State Space Model
Leiye Liu ⋅ Miao Zhang ⋅ Jihao Yin ⋅ Tingwei Liu ⋅ Wei Ji ⋅ Yongri Piao ⋅ Huchuan Lu
In Room: ExHall D Poster Location: Poster #331 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Color Alignment in Diffusion Project Page ↗
Ka Chun SHUM ⋅ Binh-Son Hua ⋅ Thanh Nguyen ⋅ Sai-Kit Yeung
In Room: ExHall D Poster Location: Poster #218 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Hand-held Object Reconstruction from RGB Video with Dynamic Interaction
Shijian Jiang ⋅ Qi Ye ⋅ Rengan Xie ⋅ Yuchi Huo ⋅ Jiming Chen
In Room: ExHall D Poster Location: Poster #151 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DynScene: Scalable Generation of Dynamic Robotic Manipulation Scenes for Embodied AI
Sangmin Lee ⋅ Sungyong Park ⋅ Heewon Kim
In Room: ExHall D Poster Location: Poster #146 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Is Your World Simulator a Good Story Presenter? A Consecutive Events-Based Benchmark for Future Long Video Generation
Yiping Wang ⋅ Xuehai He ⋅ Kuan Wang ⋅ Luyao Ma ⋅ Jianwei Yang ⋅ Shuohang Wang ⋅ Simon Shaolei Du ⋅ yelong shen
In Room: ExHall D Poster Location: Poster #284 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards High-fidelity 3D Talking Avatar with Personalized Dynamic Texture
Xuanchen Li ⋅ Jianyu Wang ⋅ Yuhao Cheng ⋅ Yikun Zeng ⋅ Xingyu Ren ⋅ Wenhan Zhu ⋅ Weiming Zhao ⋅ Yichao Yan
In Room: ExHall D Poster Location: Poster #4 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding
Haoyi Jiang ⋅ Liu Liu ⋅ Tianheng Cheng ⋅ Xinjie wang ⋅ Tianwei Lin ⋅ Zhizhong Su ⋅ Wenyu Liu ⋅ Xinggang Wang
In Room: ExHall D Poster Location: Poster #127 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RobSense: A Robust Multi-modal Foundation Model for Remote Sensing with Static, Temporal, and Incomplete Data Adaptability
Minh Kha Do ⋅ Kang Han ⋅ Phu Lai ⋅ Khoa T. Phan ⋅ Wei Xiang
In Room: ExHall D Poster Location: Poster #197 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Joint Scheduling of Causal Prompts and Tasks for Multi-Task Learning
Chaoyang Li ⋅ Jianyang Qin ⋅ Jinhao Cui ⋅ Zeyu Liu ⋅ Ning Hu ⋅ Qing Liao
In Room: ExHall D Poster Location: Poster #390 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models Project Page ↗
Zhihang Liu ⋅ Chen-Wei Xie ⋅ Pandeng Li ⋅ Liming Zhao ⋅ Longxiang Tang ⋅ Yun Zheng ⋅ Chuanbin Liu ⋅ Hongtao Xie
In Room: ExHall D Poster Location: Poster #305 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Unified Dense Prediction of Video Diffusion
Lehan Yang ⋅ Lu Qi ⋅ Xiangtai Li ⋅ Sheng Li ⋅ Varun Jampani ⋅ Ming-Hsuan Yang
In Room: ExHall D Poster Location: Poster #269 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ChatGarment: Garment Estimation, Generation and Editing via Large Language Models Project Page ↗
Siyuan Bian ⋅ Chenghao Xu ⋅ Yuliang Xiu ⋅ Artur Grigorev ⋅ Zhen Liu ⋅ Cewu Lu ⋅ Michael J. Black ⋅ Yao Feng
In Room: ExHall D Poster Location: Poster #264 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
chaocan xue ⋅ Bineng Zhong ⋅ Qihua Liang ⋅ Yaozong Zheng ⋅ Ning Li ⋅ Yuanliang Xue ⋅ Shuxiang Song
In Room: ExHall D Poster Location: Poster #130 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Explainable and Unprecedented Accuracy in Matching Challenging Finger Crease Patterns
Zhenyu Zhou ⋅ Chengdong Dong ⋅ Ajay Kumar
In Room: ExHall D Poster Location: Poster #74 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MODfinity: Unsupervised Domain Adaptation with Multimodal Information Flow Intertwining
Shanglin Liu ⋅ Jianming Lv ⋅ Jingdan Kang ⋅ Huaidong Zhang ⋅ Zequan Liang ⋅ Shengfeng He
In Room: ExHall D Poster Location: Poster #471 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Universal Soccer Video Understanding
Jiayuan Rao ⋅ Haoning Wu ⋅ Hao Jiang ⋅ Ya Zhang ⋅ Yanfeng Wang ⋅ Weidi Xie
In Room: ExHall D Poster Location: Poster #288 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment Project Page ↗
Katrin Renz ⋅ Long Chen ⋅ Elahe Arani ⋅ Oleg Sinavski
In Room: ExHall D Poster Location: Poster #130 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment Project Page ↗
Soumya Suvra Ghosal ⋅ Souradip Chakraborty ⋅ Vaibhav Singh ⋅ Tianrui Guan ⋅ Mengdi Wang ⋅ Ahmad Beirami ⋅ Furong Huang ⋅ Alvaro Velasquez ⋅ Dinesh Manocha ⋅ Amrit Singh Bedi
In Room: ExHall D Poster Location: Poster #382 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Efficient Video Super-Resolution for Real-time Rendering with Decoupled G-buffer Guidance
Mingjun Zheng ⋅ Long Sun ⋅ Jiangxin Dong ⋅ Jinshan Pan
In Room: ExHall D Poster Location: Poster #64 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ODHSR: Online Dense 3D Reconstruction of Humans and Scenes from Monocular Videos Project Page ↗
Zetong Zhang ⋅ Manuel Kaufmann ⋅ Lixin Xue ⋅ Jie Song ⋅ Martin R. Oswald
In Room: ExHall D Poster Location: Poster #74 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Animate and Sound an Image
Xihua Wang ⋅ Ruihua Song ⋅ Chongxuan Li ⋅ Xin Cheng ⋅ Boyuan Li ⋅ Yihan Wu ⋅ Yuyue Wang ⋅ Hongteng Xu ⋅ Yunfeng Wang
In Room: ExHall D Poster Location: Poster #221 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
Jungsoo Lee ⋅ Debasmit Das ⋅ Munawar Hayat ⋅ Sungha Choi ⋅ Kyuwoong Hwang ⋅ Fatih Porikli
In Room: ExHall D Poster Location: Poster #395 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Volume Tells: Dual Cycle-Consistent Diffusion for 3D Fluorescence Microscopy De-noising and Super-Resolution
ZELIN LI ⋅ Chenwei Wang ⋅ Zhaoke Huang ⋅ Centre for Intelligent Multidimensional Data Analysis ⋅ Hong Kong Baptist University ⋅ Hong Kong Baptist University ⋅ Hong Kong Baptist University
In Room: ExHall D Poster Location: Poster #23 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SleeperMark: Towards Robust Watermark against Fine-Tuning Text-to-image Diffusion Models
Zilan Wang ⋅ Junfeng Guo ⋅ Jiacheng Zhu ⋅ Yiming Li ⋅ Heng Huang ⋅ Muhao Chen ⋅ Zhengzhong Tu
In Room: ExHall D Poster Location: Poster #271 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Prior-free 3D Object Tracking Project Page ↗
Xiuqiang Song ⋅ Li Jin ⋅ Zhengxian Zhang ⋅ Jiachen Li ⋅ Fan Zhong ⋅ Guofeng Zhang ⋅ Xueying Qin
In Room: ExHall D Poster Location: Poster #96 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
The Devil is in the Prompts: Retrieval-Augmented Prompt Optimization for Text-to-Video Generation
Bingjie Gao ⋅ Xinyu Gao ⋅ Xiaoxue Wu ⋅ yujie zhou ⋅ Yu Qiao ⋅ Li Niu ⋅ Xinyuan Chen ⋅ Yaohui Wang
In Room: ExHall D Poster Location: Poster #288 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Enhancing Few-Shot Class-Incremental Learning via Training-Free Bi-Level Modality Calibration
Yiyang Chen ⋅ Tianyu Ding ⋅ Lei Wang ⋅ Jing Huo ⋅ Yang Gao ⋅ Wenbin Li
In Room: ExHall D Poster Location: Poster #429 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Chapter-Llama: Efficient Chaptering in Hour-Long Videos with LLMs
Lucas Ventura ⋅ Antoine Yang ⋅ Cordelia Schmid ⋅ Gul Varol
In Room: ExHall D Poster Location: Poster #301 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SOGS: Second-Order Anchor for Advanced 3D Gaussian Splatting
Jiahui Zhang ⋅ Fangneng Zhan ⋅ Ling Shao ⋅ Shijian Lu
In Room: ExHall D Poster Location: Poster #49 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VoxelSplat: Dynamic Gaussian Splatting as an Effective Loss for Occupancy and Flow Prediction
Ziyue Zhu ⋅ Shenlong Wang ⋅ Jin Xie ⋅ Jiang-Jiang Liu ⋅ Jingdong Wang ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #133 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution Project Page ↗
Shijun Shi ⋅ Jing Xu ⋅ Lijing Lu ⋅ Zhihang Li ⋅ Kai Hu
In Room: ExHall D Poster Location: Poster #193 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins
Yao Mu ⋅ Tianxing Chen ⋅ Zanxin Chen ⋅ ShijiaPeng ⋅ Zhiqian Lan ⋅ Zeyu Gao ⋅ Zhixuan Liang ⋅ Qiaojun Yu ⋅ Yude Zou ⋅ Mingkun Xu ⋅ Lunkai Lin ⋅ Zhiqiang Xie ⋅ Mingyu Ding ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #142 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LION-FS: Fast & Slow Video-Language Thinker as Online Video Assistant
Wei Li ⋅ Bing Hu ⋅ Rui Shao ⋅ Leyang Shen ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #294 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Preconditioners for the Stochastic Training of Neural Fields
Shin-Fang Chng ⋅ Hemanth Saratchandran ⋅ Simon Lucey
In Room: ExHall D Poster Location: Poster #102 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Provoking Multi-modal Few-Shot LVLM via Exploration-Exploitation In-Context Learning
Cheng Chen ⋅ Yunpeng Zhai ⋅ Yifan Zhao ⋅ Jinyang Gao ⋅ Bolin Ding ⋅ Jia Li
In Room: ExHall D Poster Location: Poster #348 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VinaBench: Benchmark for Faithful and Consistent Visual Narratives
Silin Gao ⋅ Sheryl Mathew ⋅ Li Mi ⋅ Sepideh Mamooler ⋅ Mengjie Zhao ⋅ Hiromi Wakaki ⋅ Yuki Mitsufuji ⋅ Syrielle Montariol ⋅ Antoine Bosselut
In Room: ExHall D Poster Location: Poster #259 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Generative Video Propagation
Shaoteng Liu ⋅ Tianyu Wang ⋅ Jui-Hsien Wang ⋅ Qing Liu ⋅ Zhifei Zhang ⋅ Joon-Young Lee ⋅ Yijun Li ⋅ Bei Yu ⋅ Zhe Lin ⋅ Soo Ye Kim ⋅ Jiaya Jia
In Room: ExHall D Poster Location: Poster #182 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PUP 3D-GS: Principled Uncertainty Pruning for 3D Gaussian Splatting Project Page ↗
Alex Hanson ⋅ Allen Tu ⋅ Vasu Singla ⋅ Bethmage Mayuka Jayawardhana ⋅ Matthias Zwicker ⋅ Tom Goldstein
In Room: ExHall D Poster Location: Poster #48 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CLIP is Almost All You Need: Towards Parameter-Efficient Scene Text Retrieval without OCR
Xugong Qin ⋅ peng zhang ⋅ Jun Jie Ou Yang ⋅ Gangyan Zeng ⋅ Yubo Li ⋅ Yuanyuan Wang ⋅ Wanqian Zhang ⋅ Pengwen Dai
In Room: ExHall D Poster Location: Poster #367 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DreamTrack: Dreaming the Future for Multimodal Visual Object Tracking
Mingzhe Guo ⋅ Weiping Tan ⋅ Wenyu Ran ⋅ Liping Jing ⋅ Zhipeng Zhang
In Room: ExHall D Poster Location: Poster #176 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhancing Privacy-Utility Trade-offs to Mitigate Memorization in Diffusion Models Project Page ↗
Chen Chen ⋅ Daochang Liu ⋅ Mubarak Shah ⋅ Chang Xu
In Room: ExHall D Poster Location: Poster #268 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
Zhanhao Liang ⋅ Yuhui Yuan ⋅ Shuyang Gu ⋅ Bohan CHEN ⋅ Tiankai Hang ⋅ Mingxi Cheng ⋅ Ji Li ⋅ Liang Zheng
In Room: ExHall D Poster Location: Poster #243 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning Textual Prompts for Open-World Semi-Supervised Learning
Yuxin Fan ⋅ Junbiao Cui ⋅ Jiye Liang
In Room: ExHall D Poster Location: Poster #393 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VITED: Video Temporal Evidence Distillation
Yujie Lu ⋅ Yale Song ⋅ Lorenzo Torresani ⋅ William Yang Wang ⋅ Tushar Nagarajan
In Room: ExHall D Poster Location: Poster #298 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Efficient Foundation Model for Zero-shot Amodal Segmentation
Zhaochen Liu ⋅ Limeng Qiao ⋅ Xiangxiang Chu ⋅ Lin Ma ⋅ Tingting Jiang
In Room: ExHall D Poster Location: Poster #424 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OSMamba: Omnidirectional Spectral Mamba with Dual-Domain Prior Generator for Exposure Correction
Gehui Li ⋅ Bin Chen ⋅ Chen Zhao ⋅ Lei Zhang ⋅ Jian Zhang
In Room: ExHall D Poster Location: Poster #202 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Synthetic Data is an Elegant GIFT for Continual Vision-Language Models
Bin Wu ⋅ Wuxuan Shi ⋅ Jinqiao Wang ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #254 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
KVQ: Boosting Video Quality Assessment via Saliency-guided Local Perception Project Page ↗
Yunpeng Qu ⋅ Kun Yuan ⋅ Qizhi Xie ⋅ Ming Sun ⋅ Chao Zhou ⋅ Jian Wang
In Room: ExHall D Poster Location: Poster #186 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ProbeSDF: Light Field Probes For Neural Surface Reconstruction
Briac Toussaint ⋅ Diego Thomas ⋅ Jean-Sébastien Franco
In Room: ExHall D Poster Location: Poster #36 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
WeakMCN: Multi-task Collaborative Network for Weakly Supervised Referring Expression Comprehension and Segmentation
Silin Cheng ⋅ Yang Liu ⋅ Xinwei He ⋅ Sebastien Ourselin ⋅ Lei Tan ⋅ Luo
In Room: ExHall D Poster Location: Poster #363 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Detecting Backdoor Attacks in Federated Learning via Direction Alignment Inspection Project Page ↗
Jiahao Xu ⋅ Zikai Zhang ⋅ Rui Hu
In Room: ExHall D Poster Location: Poster #461 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Flow Fields in Attention for Controllable Person Image Generation
Zijian Zhou ⋅ Shikun Liu ⋅ Xiao Han ⋅ Haozhe Liu ⋅ Kam Woh Ng ⋅ Tian Xie ⋅ Yuren Cong ⋅ Hang Li ⋅ Mengmeng Xu ⋅ Juan-Manuel Pérez-Rúa ⋅ Aditya Patel ⋅ Tao Xiang ⋅ Miaojing Shi ⋅ Sen He
In Room: ExHall D Poster Location: Poster #223 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CacheQuant: Comprehensively Accelerated Diffusion Models Project Page ↗
Xuewen Liu ⋅ Zhikai Li ⋅ Qingyi Gu
In Room: ExHall D Poster Location: Poster #211 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reconstructing Close Human Interaction with Appearance and Proxemics Reasoning
Buzhen Huang ⋅ Chen Li ⋅ Chongyang Xu ⋅ Dongyue Lu ⋅ Jinnan Chen ⋅ Yangang Wang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #160 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Distilling Spatially-Heterogeneous Distortion Perception for Blind Image Quality Assessment
Xudong Li ⋅ Wenjie Nie ⋅ Yan Zhang ⋅ Runze Hu ⋅ Ke Li ⋅ Xiawu Zheng ⋅ Liujuan Cao
In Room: ExHall D Poster Location: Poster #205 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Generalizing Deepfake Video Detection with Plug-and-Play: Video-Level Blending and Spatiotemporal Adapter Tuning
Zhiyuan Yan ⋅ Yandan Zhao ⋅ Shen Chen ⋅ Mingyi Guo ⋅ Xinghe Fu ⋅ Taiping Yao ⋅ Shouhong Ding ⋅ Yunsheng Wu ⋅ Li Yuan
In Room: ExHall D Poster Location: Poster #188 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
D2SP: Dynamic Dual-Stage Purification Framework for Dual Noise Mitigation in Vision-based Affective Recognition.
Haoran Wang ⋅ Xinji Mai ⋅ Zeng Tao ⋅ Xuan Tong ⋅ Junxiong Lin ⋅ Yan Wang ⋅ Jiawen Yu ⋅ Shaoqi Yan ⋅ Ziheng Zhou ⋅ Wenqiang Zhang
In Room: ExHall D Poster Location: Poster #326 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AniGrad: Anisotropic Gradient-Adaptive Sampling for 3D Reconstruction From Monocular Video
Noah Stier ⋅ Alex Rich ⋅ Pradeep Sen ⋅ Tobias Höllerer
In Room: ExHall D Poster Location: Poster #73 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Progressive Focused Transformer for Single Image Super-Resolution Project Page ↗
Wei Long ⋅ Xingyu Zhou ⋅ Leheng Zhang ⋅ Shuhang Gu
In Room: ExHall D Poster Location: Poster #199 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Semantic Library Adaptation: LoRA Retrieval and Fusion for Open-Vocabulary Semantic Segmentation
Reza Qorbani ⋅ Gianluca Villani ⋅ Theodoros Panagiotakopoulos ⋅ Marc Botet Colomer ⋅ Linus Härenstam-Nielsen ⋅ Mattia Segu ⋅ Pier Luigi Dovesi ⋅ Jussi Karlgren ⋅ Daniel Cremers ⋅ Federico Tombari ⋅ Matteo Poggi
In Room: ExHall D Poster Location: Poster #422 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Early-Bird Diffusion: Investigating and Leveraging Timestep-Aware Early-Bird Tickets in Diffusion Models for Efficient Training
Lexington Whalen ⋅ Zhenbang Du ⋅ Haoran You ⋅ Chaojian Li ⋅ Sixu Li ⋅ Yingyan (Celine) Lin
In Room: ExHall D Poster Location: Poster #221 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Token Cropr: Faster ViTs for Quite a Few Tasks Project Page ↗
Benjamin Bergner ⋅ Christoph Lippert ⋅ Aravindh Mahendran
In Room: ExHall D Poster Location: Poster #416 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ArticulatedGS: Self-supervised Digital Twin Modeling of Articulated Objects using 3D Gaussian Splatting
Guo Junfu ⋅ Yu Xin ⋅ Gaoyi Liu ⋅ Kai Xu ⋅ Ligang Liu ⋅ Ruizhen Hu
In Room: ExHall D Poster Location: Poster #95 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Detecting Out-of-Distribution Through the Lens of Neural Collapse
Litian Liu ⋅ Yao Qin
In Room: ExHall D Poster Location: Poster #457 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Doppelgangers++: Improved Visual Disambiguation with Geometric 3D Features Project Page ↗
Yuanbo Xiangli ⋅ Ruojin Cai ⋅ Hanyu Chen ⋅ Jeffrey Byrne ⋅ Noah Snavely
In Room: ExHall D Poster Location: Poster #97 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DART: Disease-aware Image-Text Alignment and Self-correcting Re-alignment for Trustworthy Radiology Report Generation
Sang-Jun Park ⋅ Keun-Soo Heo ⋅ Dong-Hee Shin ⋅ Young-Han Son ⋅ Ji-Hye Oh ⋅ Tae-Eui Kam
In Room: ExHall D Poster Location: Poster #472 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
From Faces to Voices: Learning Hierarchical Representations for High-quality Video-to-Speech Project Page ↗
Jihoon Kim ⋅ Jeongsoo Choi ⋅ Jaehun Kim ⋅ Chaeyoung Jung ⋅ Joon Chung
In Room: ExHall D Poster Location: Poster #2 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FreeCloth: Free-form Generation Enhances Challenging Clothed Human Modeling Project Page ↗
Hang Ye ⋅ Xiaoxuan Ma ⋅ Hai Ci ⋅ Wentao Zhu ⋅ Yizhou Wang
In Room: ExHall D Poster Location: Poster #12 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SnowMaster: Comprehensive Real-world Image Desnowing via MLLM with Multi-Model Feedback Optimization
Jianyu LAI ⋅ Sixiang Chen ⋅ yunlong lin ⋅ Tian Ye ⋅ Yun Liu ⋅ Song Fei ⋅ Zhaohu Xing ⋅ Hongtao Wu ⋅ Weiming Wang ⋅ Lei Zhu
In Room: ExHall D Poster Location: Poster #394 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DViN: Dynamic Visual Routing Network for Weakly Supervised Referring Expression Comprehension Project Page ↗
Xiaofu Chen ⋅ Yaxin Luo ⋅ Luo ⋅ Jiayi Ji ⋅ Henghui Ding ⋅ Yiyi Zhou
In Room: ExHall D Poster Location: Poster #353 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Argus: A Compact and Versatile Foundation Model for Vision
Weiming Zhuang ⋅ Chen Chen ⋅ Zhizhong Li ⋅ Sina Sajadmanesh ⋅ Jingtao Li ⋅ Jiabo Huang ⋅ Vikash Sehwag ⋅ Vivek Sharma ⋅ Hirotaka Shinozaki ⋅ Felan Carlo Garcia ⋅ Yihao Zhan ⋅ Naohiro Adachi ⋅ Ryoji Eki ⋅ Michael Spranger ⋅ Peter Stone ⋅ Lingjuan Lyu
In Room: ExHall D Poster Location: Poster #408 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-View Pose-Agnostic Change Localization with Zero Labels Project Page ↗
Chamuditha Jayanga Galappaththige ⋅ Jason Lai ⋅ Lloyd Windrim ⋅ Donald G. Dansereau ⋅ Niko Suenderhauf ⋅ Dimity Miller
In Room: ExHall D Poster Location: Poster #92 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
TSP-Mamba: The Travelling Salesman Problem Meets Mamba for Image Super-resolution and Beyond
Kun Zhou ⋅ Xinyu Lin ⋅ Jiangbo Lu
In Room: ExHall D Poster Location: Poster #187 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Motions as Queries: One-Stage Multi-Person Holistic Human Motion Capture
Kenkun Liu ⋅ Yurong Fu ⋅ Weihao Yuan ⋅ Jing Lin ⋅ Peihao Li ⋅ Xiaodong Gu ⋅ Lingteng Qiu ⋅ Haoqian Wang ⋅ Zilong Dong ⋅ Xiaoguang Han
In Room: ExHall D Poster Location: Poster #165 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding
Yujie Liang ⋅ Xiaobin Hu ⋅ Boyuan Jiang ⋅ Donghao Luo ⋅ Xu Peng ⋅ Kai WU ⋅ Chengming Xu ⋅ Wenhui Han ⋅ Taisong Jin ⋅ Chengjie Wang ⋅ Rongrong Ji
In Room: ExHall D Poster Location: Poster #148 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Any6D: Model-free 6D Pose Estimation of Novel Object Project Page ↗
Taeyeop Lee ⋅ Bowen Wen ⋅ Minjun Kang ⋅ Gyuree Kang ⋅ In So Kweon ⋅ Kuk-Jin Yoon
In Room: ExHall D Poster Location: Poster #95 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DELT: A Simple Diversity-driven EarlyLate Training for Dataset Distillation
Zhiqiang Shen ⋅ Ammar Sherif ⋅ Zeyuan Yin ⋅ Shitong Shao
In Room: ExHall D Poster Location: Poster #443 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Stereo Anywhere: Robust Zero-Shot Deep Stereo Matching Even Where Either Stereo or Mono Fail Project Page ↗
Luca Bartolomei ⋅ Fabio Tosi ⋅ Matteo Poggi ⋅ Stefano Mattoccia
In Room: ExHall D Poster Location: Poster #79 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SpiritSight Agent: Advanced GUI Agent with One Look
Zhiyuan Huang ⋅ Ziming Cheng ⋅ Junting Pan ⋅ Zhaohui Hou ⋅ Mingjie Zhan
In Room: ExHall D Poster Location: Poster #319 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
BOOTPLACE: Bootstrapped Object Placement with Detection Transformers
Hang Zhou ⋅ Xinxin Zuo ⋅ Rui Ma ⋅ Li Cheng
In Room: ExHall D Poster Location: Poster #333 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Enhancing Adversarial Transferability with Checkpoints of a Single Model’s Training
Shixin Li ⋅ Chaoxiang He ⋅ Xiaojing Ma ⋅ Bin Benjamin Zhu ⋅ Shuo Wang ⋅ Hongsheng Hu ⋅ Dongmei Zhang ⋅ Linchen Yu
In Room: ExHall D Poster Location: Poster #464 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
POSTA: A Go-to Framework for Customized Artistic Poster Generation Project Page ↗
Haoyu Chen ⋅ Xiaojie Xu ⋅ Wenbo Li ⋅ Jingjing Ren ⋅ Tian Ye ⋅ Songhua Liu ⋅ Ying-Cong Chen ⋅ Lei Zhu ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #241 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VLsI: Verbalized Layers-to-Interactions from Large to Small Vision Language Models Project Page ↗
Byung-Kwan Lee ⋅ Ryo Hachiuma ⋅ Yu-Chiang Frank Wang ⋅ Yong Man Ro ⋅ Yueh-Hua Wu
In Room: ExHall D Poster Location: Poster #324 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Flash3D: Super-scaling Point Transformers through Joint Hardware-Geometry Locality Project Page ↗
Liyan Chen ⋅ Gregory P. Meyer ⋅ Zaiwei Zhang ⋅ Eric M. Wolff ⋅ Paul Vernaza
In Room: ExHall D Poster Location: Poster #117 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Analyzing the Synthetic-to-Real Domain Gap in 3D Hand Pose Estimation
Zhuoran ZHAO ⋅ Linlin Yang ⋅ Pengzhan Sun ⋅ Pan Hui ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #154 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Comprehensive Relighting: Generalizable and Consistent Monocular Human Relighting and Harmonization Project Page ↗
Junying Wang ⋅ Jingyuan Liu ⋅ Xin Sun ⋅ Krishna Kumar Singh ⋅ ZHIXIN SHU ⋅ He Zhang ⋅ Jimei Yang ⋅ Nanxuan Zhao ⋅ Tuanfeng Y. Wang ⋅ Simon Su Chen ⋅ Ulrich Neumann ⋅ Jae Shin Yoon
In Room: ExHall D Poster Location: Poster #20 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Hyperspectral Pansharpening via Diffusion Models with Iteratively Zero-Shot Guidance
Jin-Liang Xiao ⋅ Ting-Zhu Huang ⋅ Liang-Jian Deng ⋅ Guang Lin ⋅ Zihan Cao ⋅ Chao Li ⋅ Qibin Zhao
In Room: ExHall D Poster Location: Poster #193 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Efficient Motion-Aware Video MLLM
Zijia Zhao ⋅ Yuqi Huo ⋅ Tongtian Yue ⋅ Longteng Guo ⋅ Haoyu Lu ⋅ Bingning Wang ⋅ Weipeng Chen ⋅ Jing Liu
In Room: ExHall D Poster Location: Poster #300 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DSPNet: Dual-vision Scene Perception for Robust 3D Question Answering
Jingzhou Luo ⋅ Yang Liu ⋅ weixing chen ⋅ Zhen Li ⋅ Yaowei Wang ⋅ Guanbin Li ⋅ Liang Lin
In Room: ExHall D Poster Location: Poster #337 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Zero-Shot 4D Lidar Panoptic Segmentation
Yushan Zhang ⋅ Aljoša Ošep ⋅ Laura Leal-Taixe ⋅ Tim Meinhardt
In Room: ExHall D Poster Location: Poster #332 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MAtCha Gaussians: Atlas of Charts for High-Quality Geometry and Photorealism From Sparse Views Project Page ↗
Antoine Guédon ⋅ Tomoki Ichikawa ⋅ Kohei Yamashita ⋅ Ko Nishino
In Room: ExHall D Poster Location: Poster #53 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Extreme Rotation Estimation in the Wild Project Page ↗
Hana Bezalel ⋅ Dotan Ankri ⋅ Ruojin Cai ⋅ Hadar Averbuch-Elor
In Room: ExHall D Poster Location: Poster #83 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ADU: Adaptive Detection of Unknown Categories in Black-Box Domain Adaptation
Yushan Lai ⋅ Guowen Li ⋅ Haoyuan Liang ⋅ Juepeng Zheng ⋅ Zhiyu Ye
In Room: ExHall D Poster Location: Poster #425 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Traversing Distortion-Perception Tradeoff using a Single Score-Based Generative Model
Yuhan Wang ⋅ Suzhi Bi ⋅ Ying-Jun Angela Zhang ⋅ Xiaojun Yuan
In Room: ExHall D Poster Location: Poster #208 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
IceDiff: High Resolution and High-Quality Arctic Sea Ice Forecasting with Generative Diffusion Prior
Jingyi Xu ⋅ Siwei Tu ⋅ Weidong Yang ⋅ Ben Fei ⋅ Shuhao Li ⋅ Keyi Liu ⋅ Yeqi Luo ⋅ Lipeng Ma ⋅ Lei Bai
In Room: ExHall D Poster Location: Poster #184 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DTOS: Dynamic Time Object Sensing with Large Multimodal Model
Jirui Tian ⋅ Jinrong Zhang ⋅ Shenglan Liu ⋅ Luhao Xu ⋅ Zhixiong Huang ⋅ Gao Huang
In Room: ExHall D Poster Location: Poster #302 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
How to Merge Your Multimodal Models Over Time?
Sebastian Dziadzio ⋅ Vishaal Udandarao ⋅ Karsten Roth ⋅ Ameya Prabhu ⋅ Zeynep Akata ⋅ Samuel Albanie ⋅ Matthias Bethge
In Room: ExHall D Poster Location: Poster #445 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Identifying and Mitigating Position Bias of Multi-image Vision-Language Models
Xinyu Tian ⋅ Shu Zou ⋅ Zhaoyuan Yang ⋅ Jing Zhang
In Room: ExHall D Poster Location: Poster #376 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Unsupervised Foundation Model-Agnostic Slide-Level Representation Learning Project Page ↗
Tim Lenz ⋅ Peter Neidlinger ⋅ Marta Ligero ⋅ Georg Wölflein ⋅ Marko van Treeck ⋅ Jakob Nikolas Kather
In Room: ExHall D Poster Location: Poster #446 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Exploring CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
Zhiwei Yang ⋅ Yucong Meng ⋅ Kexue Fu ⋅ feilong tang ⋅ Shuo Wang ⋅ Zhijian Song
In Room: ExHall D Poster Location: Poster #421 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
UNIALIGN: Scaling Multimodal Alignment within One Unified Model
bo zhou ⋅ Liulei Li ⋅ Yujia Wang ⋅ 刘华峰 Liu ⋅ Yazhou Yao ⋅ Wenguan Wang
In Room: ExHall D Poster Location: Poster #335 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ShowHowTo: Generating Scene-Conditioned Step-by-Step Visual Instructions Project Page ↗
Tomas Soucek ⋅ Prajwal Gatti ⋅ Michael Wray ⋅ Ivan Laptev ⋅ Dima Damen ⋅ Josef Sivic
In Room: ExHall D Poster Location: Poster #122 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Exploration-Driven Generative Interactive Environments Project Page ↗
Nedko Savov ⋅ Naser Kazemi ⋅ Mohammad Mahdi ⋅ Danda Paudel ⋅ Xi Wang ⋅ Luc Van Gool
In Room: ExHall D Poster Location: Poster #137 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Task-Agnostic Guided Feature Expansion for Class-Incremental Learning
Bowen Zheng ⋅ Da-Wei Zhou ⋅ Han-Jia Ye ⋅ De-Chuan Zhan
In Room: ExHall D Poster Location: Poster #450 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ShowUI: One Vision-Language-Action Model for GUI Visual Agent
Kevin Qinghong Lin ⋅ Linjie Li ⋅ Difei Gao ⋅ Zhengyuan Yang ⋅ Shiwei Wu ⋅ Zechen Bai ⋅ Stan Weixian Lei ⋅ Lijuan Wang ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #352 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Twinner: Shining Light on Digital Twins in a Few Snaps
Jesus Zarzar ⋅ Tom Monnier ⋅ Roman Shapovalov ⋅ Andrea Vedaldi ⋅ David Novotny
In Room: ExHall D Poster Location: Poster #39 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Infinity∞: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis
Jian Han ⋅ Jinlai Liu ⋅ Yi Jiang ⋅ Bin Yan ⋅ Yuqi Zhang ⋅ Zehuan Yuan ⋅ BINGYUE PENG ⋅ Xiaobing Liu
In Room: ExHall D Poster Location: Poster #248 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DreamText: High Fidelity Scene Text Synthesis
Yibin Wang ⋅ Weizhong Zhang ⋅ honghui xu ⋅ Cheng Jin
In Room: ExHall D Poster Location: Poster #228 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MonoPlace3D: Learning 3D-Aware Object Placement for 3D Monocular Detection
Rishubh Parihar ⋅ Srinjay Sarkar ⋅ Sarthak Vora ⋅ Jogendra Kundu Kundu ⋅ R. Venkatesh Babu
In Room: ExHall D Poster Location: Poster #110 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HumanDreamer: Generating Controllable Human-Motion Videos via Decoupled Generation Project Page ↗
Boyuan Wang ⋅ Xiaofeng Wang ⋅ Chaojun Ni ⋅ Guosheng Zhao ⋅ Zhiqin Yang ⋅ Zheng Zhu ⋅ Muyang Zhang ⋅ YuKun Zhou ⋅ xinze chen ⋅ Guan Huang ⋅ lihong liu ⋅ Xingang Wang
In Room: ExHall D Poster Location: Poster #166 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ReVisionLLM: Recursive Vision-Language Model for Temporal Grounding in Hour-Long Videos Project Page ↗
Tanveer Hannan ⋅ Md Mohaiminul Islam ⋅ Jindong Gu ⋅ Thomas Seidl ⋅ Gedas Bertasius
In Room: ExHall D Poster Location: Poster #307 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ArtiFade: Learning to Generate High-quality Subject from Blemished Images
Shuya Yang ⋅ Shaozhe Hao ⋅ Yukang Cao ⋅ Kwan-Yee K. Wong
In Room: ExHall D Poster Location: Poster #240 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Relation-Rich Visual Document Generator for Visual Information Extraction Project Page ↗
Zi-Han Jiang ⋅ Chien-Wei Lin ⋅ WeiHua Li ⋅ Hsuan-Tung Liu ⋅ Yi-Ren Yeh ⋅ Chu-Song Chen
In Room: ExHall D Poster Location: Poster #363 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CoA: Towards Real Image Dehazing via Compression-and-Adaptation
Long Ma ⋅ Yuxin Feng ⋅ Yan Zhang ⋅ Jinyuan Liu ⋅ Weimin Wang ⋅ Guang-Yong Chen ⋅ Chengpei Xu ⋅ Zhuo Su
In Room: ExHall D Poster Location: Poster #52 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
NightAdapter: Learning a Frequency Adapter for Generalizable Night-time Scene Segmentation
Qi Bi ⋅ Jingjun Yi ⋅ Huimin Huang ⋅ Hao Zheng ⋅ Haolan Zhan ⋅ Yawen Huang ⋅ Yuexiang Li ⋅ Xian Wu ⋅ Yefeng Zheng
In Room: ExHall D Poster Location: Poster #270 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
TopV: Compatible Token Pruning with Inference Time Optimization for Fast and Low-Memory Multimodal Vision Language Model
Cheng Yang ⋅ Yang Sui ⋅ Jinqi Xiao ⋅ Lingyi Huang ⋅ Yu Gong ⋅ Chendi Li ⋅ Jinghua Yan ⋅ Yu Bai ⋅ Ponnuswamy Sadayappan ⋅ Xia Hu ⋅ Bo Yuan
In Room: ExHall D Poster Location: Poster #381 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
Teng Hu ⋅ Jiangning Zhang ⋅ Ran Yi ⋅ Jieyu Weng ⋅ Yabiao Wang ⋅ Xianfang Zeng ⋅ Xuezhucun Xue ⋅ Lizhuang Ma
In Room: ExHall D Poster Location: Poster #379 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learned Binocular-Encoding Optics for RGBD Imaging Using Joint Stereo and Focus Cues
Yuhui Liu ⋅ Liangxun Ou ⋅ Qiang Fu ⋅ Hadi Amata ⋅ Wolfgang Heidrich ⋅ YIFAN PENG
In Room: ExHall D Poster Location: Poster #22 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Dual-view X-ray Detection: Can AI Detect Prohibited Items from Dual-view X-ray Images like Humans? Project Page ↗
Renshuai Tao ⋅ Haoyu Wang ⋅ Yuzhe Guo ⋅ Hairong Chen ⋅ Li Zhang ⋅ Xianglong Liu ⋅ Yunchao Wei ⋅ Yao Zhao
In Room: ExHall D Poster Location: Poster #473 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MobilePortrait: Real-Time One-Shot Neural Head Avatars on Mobile Devices
Jianwen Jiang ⋅ Gaojie Lin ⋅ Zhengkun Rong ⋅ Chao Liang ⋅ Yongming Zhu ⋅ Jiaqi Yang ⋅ Tianyun Zhong
In Room: ExHall D Poster Location: Poster #6 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
D^3: Scaling Up Deepfake Detection by Learning from Discrepancy Project Page ↗
Yongqi Yang ⋅ Zhihao Qian ⋅ Ye Zhu ⋅ Olga Russakovsky ⋅ Yu Wu
In Room: ExHall D Poster Location: Poster #271 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Jailbreaking the Non-Transferable Barrier via Test-Time Data Disguising
Yongli Xiang ⋅ Ziming Hong ⋅ Lina Yao ⋅ Dadong Wang ⋅ Tongliang Liu
In Room: ExHall D Poster Location: Poster #433 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Light3R-SfM: Towards Feed-forward Structure-from-Motion Project Page ↗
Sven Elflein ⋅ Qunjie Zhou ⋅ Laura Leal-Taixe
In Room: ExHall D Poster Location: Poster #91 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Robotic Visual Instruction
Yanbang Li ⋅ ZiYang Gong ⋅ Haoyang Li ⋅ Xiaoqi Huang ⋅ Haolan Kang ⋅ Guangpingbai ⋅ Xianzheng Ma
In Room: ExHall D Poster Location: Poster #145 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Solving Instance Detection from an Open-World Perspective Project Page ↗
Qianqian Shen ⋅ Yunhan Zhao ⋅ Nahyun Kwon ⋅ Jeeeun Kim ⋅ Yanan Li ⋅ Shu Kong
In Room: ExHall D Poster Location: Poster #431 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Percept, Memory, and Imagine: World Feature Simulating for Open-Domain Unknown Object Detection
Aming Wu ⋅ Cheng Deng
In Room: ExHall D Poster Location: Poster #432 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Efficient Depth Estimation for Unstable Stereo Camera Systems on AR Glasses
Yongfan Liu ⋅ Hyoukjun Kwon
In Room: ExHall D Poster Location: Poster #78 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
3D-GRAND: A Million-Scale Dataset for 3D-LLMs with Better Grounding and Less Hallucination
Jianing "Jed" Yang ⋅ Xuweiyi Chen ⋅ Nikhil Madaan ⋅ Madhavan Iyengar ⋅ Shengyi Qian ⋅ David Fouhey ⋅ Joyce Chai
In Room: ExHall D Poster Location: Poster #320 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LiDAR-RT: Gaussian-based Ray Tracing for Dynamic LiDAR Re-simulation Project Page ↗
Chenxu Zhou ⋅ Lvchang Fu ⋅ Sida Peng ⋅ Yunzhi Yan ⋅ Zhanhua Zhang ⋅ chen yong ⋅ Jiazhi Xia ⋅ Xiaowei Zhou
In Room: ExHall D Poster Location: Poster #128 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Large-Scale Text-to-Image Model with Inpainting is a Zero-Shot Subject-Driven Image Generator Project Page ↗
Chaehun Shin ⋅ Jooyoung Choi ⋅ Heeseung Kim ⋅ Sungroh Yoon
In Room: ExHall D Poster Location: Poster #250 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MASt3R-SLAM: Real-Time Dense SLAM with 3D Reconstruction Priors
Riku Murai ⋅ Eric Dexheimer ⋅ Andrew J. Davison
In Room: ExHall D Poster Location: Poster #83 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Cross-modal Information Flow in Multimodal Large Language Models Project Page ↗
Zhi Zhang ⋅ Srishti Yadav ⋅ Fengze Han ⋅ Ekaterina Shutova
In Room: ExHall D Poster Location: Poster #379 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Consistent and Controllable Image Animation with Motion Diffusion Models Project Page ↗
Xin Ma ⋅ Yaohui Wang ⋅ Gengyun Jia ⋅ Xinyuan Chen ⋅ Tien-Tsin Wong ⋅ Yuan-Fang Li ⋅ Cunjian Chen
In Room: ExHall D Poster Location: Poster #184 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards
Zijing Hu ⋅ Fengda Zhang ⋅ Long Chen ⋅ Kun Kuang ⋅ Jiahui Li ⋅ Kaifeng Gao ⋅ Jun Xiao ⋅ Xin Wang ⋅ Wenwu Zhu
In Room: ExHall D Poster Location: Poster #245 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Spatial457: A Diagnostic Benchmark for 6D Spatial Reasoning of Large Mutimodal Models
Xingrui Wang ⋅ Wufei Ma ⋅ Tiezheng Zhang ⋅ Celso M. de Melo ⋅ Jieneng Chen ⋅ Alan L. Yuille
In Room: ExHall D Poster Location: Poster #348 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Omnidirectional Multi-Object Tracking Project Page ↗
Kai Luo ⋅ Hao Shi ⋅ Sheng Wu ⋅ Fei Teng ⋅ Mengfei Duan ⋅ Chang Huang ⋅ Yuhang Wang ⋅ Kaiwei Wang ⋅ Kailun Yang
In Room: ExHall D Poster Location: Poster #87 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Potential Field Based Deep Metric Learning Project Page ↗
Shubhang Bhatnagar ⋅ Narendra Ahuja
In Room: ExHall D Poster Location: Poster #431 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Directional Label Diffusion Model for Learning from Noisy Labels Project Page ↗
Senyu Hou ⋅ Gaoxia Jiang ⋅ Jia Zhang ⋅ Shangrong Yang ⋅ Husheng Guo ⋅ Yaqing Guo ⋅ Wenjian Wang
In Room: ExHall D Poster Location: Poster #450 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AA-CLIP: Enhancing Zero-Shot Anomaly Detection via Anomaly-Aware CLIP
wenxin ma ⋅ Xu Zhang ⋅ Qingsong Yao ⋅ Fenghe Tang ⋅ Chenxu Wu ⋅ Yingtai Li ⋅ Rui Yan ⋅ Zihang Jiang ⋅ S Kevin Zhou
In Room: ExHall D Poster Location: Poster #438 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HybridGS: Decoupling Transients and Statics with 2D and 3D Gaussian Splatting Project Page ↗
Jingyu Lin ⋅ Jiaqi Gu ⋅ Lubin Fan ⋅ Bojian Wu ⋅ Yujing Lou ⋅ Renjie Chen ⋅ Ligang Liu ⋅ Jieping Ye
In Room: ExHall D Poster Location: Poster #58 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Keyframe-Guided Creative Video Inpainting
Yuwei Guo ⋅ Ceyuan Yang ⋅ Anyi Rao ⋅ Chenlin Meng ⋅ Omer Bar-Tal ⋅ Shuangrui Ding ⋅ Maneesh Agrawala ⋅ Dahua Lin ⋅ Bo Dai
In Room: ExHall D Poster Location: Poster #225 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Channel Consistency Prior and Self-Reconstruction Strategy Based Unsupervised Image Deraining
Guanglu Dong ⋅ Tianheng Zheng ⋅ Yuanzhouhan Cao ⋅ Linbo Qing ⋅ Chao Ren
In Room: ExHall D Poster Location: Poster #201 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
Haoyang He ⋅ Jiangning Zhang ⋅ Yuxuan Cai ⋅ Hongxu Chen ⋅ Xiaobin Hu ⋅ Zhenye Gan ⋅ Yabiao Wang ⋅ Chengjie Wang ⋅ Yunsheng Wu ⋅ Lei Xie
In Room: ExHall D Poster Location: Poster #415 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EarthDial: Turning Multi-sensory Earth Observations to Interactive Dialogues
Sagar Soni ⋅ Akshay Dudhane ⋅ Hiyam Debary ⋅ Mustansar Fiaz ⋅ Muhammad Akhtar Munir ⋅ Muhammad Sohail Danish ⋅ Paolo Fraccaro ⋅ Campbell D Watson ⋅ Levente Klein ⋅ Fahad Shahbaz Khan ⋅ Salman Khan
In Room: ExHall D Poster Location: Poster #349 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning Endogenous Attention for Incremental Object Detection
Xiang Song ⋅ Yuhang He ⋅ Jingyuan Li ⋅ Qiang Wang ⋅ Yihong Gong
In Room: ExHall D Poster Location: Poster #403 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SplatAD: Real-Time Lidar and Camera Rendering with 3D Gaussian Splatting for Autonomous Driving
Georg Hess ⋅ Carl Lindström ⋅ Maryam Fatemi ⋅ Christoffer Petersson ⋅ Lennart Svensson
In Room: ExHall D Poster Location: Poster #129 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Seeking Consistent Flat Minima for Better Domain Generalization via Refining Loss Landscapes
Aodi Li ⋅ Liansheng Zhuang ⋅ Xiao Long ⋅ MingHong Yao ⋅ Shafei Wang
In Room: ExHall D Poster Location: Poster #450 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Ev-3DOD: Pushing the Temporal Boundaries of 3D Object Detection with Event Cameras
Hoonhee Cho ⋅ Jae-Young Kang ⋅ Youngho Kim ⋅ Kuk-Jin Yoon
In Room: ExHall D Poster Location: Poster #100 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VideoAutoArena: An Automated Arena for Evaluating Large Multimodal Models in Video Analysis through User Simulation
Ziyang Luo ⋅ Haoning Wu ⋅ Dongxu Li ⋅ Jing Ma ⋅ Mohan Kankanhalli ⋅ Junnan Li
In Room: ExHall D Poster Location: Poster #295 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning to Sample Effective and Diverse Prompts for Text-to-Image Generation
Taeyoung Yun ⋅ Dinghuai Zhang ⋅ Jinkyoo Park ⋅ Ling Pan
In Room: ExHall D Poster Location: Poster #248 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AnyMap: Learning a General Camera Model for Structure-from-Motion with Unknown Distortion in Dynamic Scenes
Andrea Porfiri Dal Cin ⋅ Georgi Dikov ⋅ Jihong Ju ⋅ Mohsen Ghafoorian
In Room: ExHall D Poster Location: Poster #81 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Leveraging 3D Geometric Priors in 2D Rotation Symmetry Detection
Ahyun Seo ⋅ Minsu Cho
In Room: ExHall D Poster Location: Poster #101 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
3D-HGS: 3D Half-Gaussian Splatting Project Page ↗
Haolin Li ⋅ Jinyang Liu ⋅ Mario Sznaier ⋅ Octavia Camps
In Room: ExHall D Poster Location: Poster #33 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Detect-and-Guide: Self-regulation of Diffusion Models for Safe Text-to-Image Generation via Guideline Token Optimization
Feifei Li ⋅ Mi Zhang ⋅ Yiming Sun ⋅ Min Yang
In Room: ExHall D Poster Location: Poster #248 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Plug-and-Play Interpretable Responsible Text-to-Image Generation via Dual-Space Multi-facet Concept Control
Basim Azam ⋅ Naveed Akhtar
In Room: ExHall D Poster Location: Poster #269 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Learning Physics From Video: Unsupervised Physical Parameter Estimation for Continuous Dynamical Systems
Alejandro Castañeda Garcia ⋅ Jan Warchocki ⋅ Jan van Gemert ⋅ Daan Brinks ⋅ Nergis Tomen
In Room: ExHall D Poster Location: Poster #167 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DeClotH: Decomposable 3D Cloth and Human Body Reconstruction from a Single Image
Hyeongjin Nam ⋅ Donghwan Kim ⋅ Jeongtaek Oh ⋅ Kyoung Mu Lee
In Room: ExHall D Poster Location: Poster #18 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DepthCues: Evaluating Monocular Depth Perception in Large Vision Models Project Page ↗
Duolikun Danier ⋅ Mehmet Aygun ⋅ Changjian Li ⋅ Hakan Bilen ⋅ Oisin Mac Aodha
In Room: ExHall D Poster Location: Poster #405 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
TailedCore: Few-Shot Sampling for Unsupervised Long-Tail Noisy Anomaly Detection Project Page ↗
Yoon Gyo Jung ⋅ Jaewoo Park ⋅ Jaeho Yoon ⋅ Kuan-Chuan Peng ⋅ Wonchul Kim ⋅ Andrew Beng Jin Teoh ⋅ Octavia Camps
In Room: ExHall D Poster Location: Poster #430 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Beyond Local Sharpness: Communication-Efficient Global Sharpness-aware Minimization for Federated Learning
Debora Caldarola ⋅ Pietro Cagnasso ⋅ Barbara Caputo ⋅ Marco Ciccone
In Room: ExHall D Poster Location: Poster #396 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
F^3OCUS - Federated Finetuning of Vision-Language Foundation Models with Optimal Client Layer Updating Strategy via Multi-objective Meta-Heuristics
Pramit Saha ⋅ Felix Wagner ⋅ Divyanshu Mishra ⋅ Can Peng ⋅ Anshul Thakur ⋅ David A. Clifton ⋅ Konstantinos Kamnitsas ⋅ Alison Noble
In Room: ExHall D Poster Location: Poster #401 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ConText-CIR: Learning from Concepts in Text for Composed Image Retrieval
Eric Xing ⋅ Pranavi Kolouju ⋅ Robert Pless ⋅ Abby Stylianou ⋅ Nathan Jacobs
In Room: ExHall D Poster Location: Poster #365 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Text Embedding is Not All You Need: Attention Control for Text-to-Image Semantic Alignment with Text Self-Attention Maps Project Page ↗
Jeeyung Kim ⋅ Erfan Esmaeili Fakhabi ⋅ Qiang Qiu
In Room: ExHall D Poster Location: Poster #254 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Navigating Image Restoration with VAR’s Distribution Alignment Prior
Siyang Wang ⋅ Naishan Zheng ⋅ Jie Huang ⋅ Feng Zhao
In Room: ExHall D Poster Location: Poster #209 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ReRAW: RGB-to-RAW Image Reconstruction via Stratified Sampling for Efficient Object Detection on the Edge
Radu Berdan ⋅ Beril Besbinar ⋅ Christoph Reinders ⋅ Junji Otsuka ⋅ Daisuke Iso
In Room: ExHall D Poster Location: Poster #115 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Stop Walking in Circles! Bailing Out Early in Projected Gradient Descent
Philip Doldo ⋅ Derek Everett ⋅ Amol Khanna ⋅ Andre T Nguyen ⋅ Edward Raff
In Room: ExHall D Poster Location: Poster #95 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LoKi: Low-dimensional KAN for Efficient Fine-tuning Image Models
Xuan Cai ⋅ Renjie Pan ⋅ Hua Yang
In Room: ExHall D Poster Location: Poster #403 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DIV-FF: Dynamic Image-Video Feature Fields For Environment Understanding in Egocentric Videos
Lorenzo Mur-Labadia ⋅ Jose J. Guerrero ⋅ Ruben Martinez-Cantin
In Room: ExHall D Poster Location: Poster #315 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Fortifying Federated Learning Towards Trustworthiness via Auditable Data Valuation and Verifiable Client Contribution
Naveen Kumar Kummari ⋅ Ranjeet Ranjan Jha ⋅ Krishna Mohan Chalavadi ⋅ Ravindra Babu Tallamraju
In Room: ExHall D Poster Location: Poster #462 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-Layer Visual Feature Fusion in Multimodal LLMs: Methods, Analysis, and Best Practices
Junyan Lin ⋅ Haoran Chen ⋅ Yue Fan ⋅ Yingqi Fan ⋅ Xin Jin ⋅ Hui Su ⋅ Jinlan Fu ⋅ Xiaoyu Shen
In Room: ExHall D Poster Location: Poster #380 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AdMiT: Adaptive Multi-Source Tuning in Dynamic Environments
Xiangyu Chang ⋅ Fahim Faisal Niloy ⋅ Sk Miraj Ahmed ⋅ Srikanth Krishnamurthy ⋅ Basak Guler ⋅ Ananthram Swami ⋅ Samet Oymak ⋅ Amit K. Roy-Chowdhury
In Room: ExHall D Poster Location: Poster #453 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Notes-guided MLLM Reasoning: Enhancing MLLM with Knowledge and Visual Notes for Visual Question Answering
Wenlong Fang ⋅ Qiaofeng Wu ⋅ Jing Chen ⋅ Yun Xue
In Room: ExHall D Poster Location: Poster #361 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PLeaS - Merging Models with Permutations and Least Squares
Anshul Nasery ⋅ Jonathan Hayase ⋅ Pang Wei Koh ⋅ Sewoong Oh
In Room: ExHall D Poster Location: Poster #416 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Context-Enhanced Memory-Refined Transformer for Online Action Detection
Zhanzhong Pang ⋅ Fadime Sener ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #318 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multi-modal Knowledge Distillation-based Human Trajectory Forecasting
Jaewoo Jeong ⋅ Seohee Lee ⋅ Daehee Park ⋅ Giwon Lee ⋅ Kuk-Jin Yoon
In Room: ExHall D Poster Location: Poster #306 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HORP: Human-Object Relation Priors Guided HOI Detection
Pei Geng ⋅ Jian Yang ⋅ Shanshan Zhang
In Room: ExHall D Poster Location: Poster #409 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
InteractVLM: 3D Interaction Reasoning from 2D Foundational Models Project Page ↗
Sai Kumar Dwivedi ⋅ Dimitrije Antić ⋅ Shashank Tripathi ⋅ Omid Taheri ⋅ Cordelia Schmid ⋅ Michael J. Black ⋅ Dimitrios Tzionas
In Room: ExHall D Poster Location: Poster #147 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Golden Cudgel Network for Real-Time Semantic Segmentation Project Page ↗
Guoyu Yang ⋅ Yuan Wang ⋅ Daming Shi ⋅ Yanzhong Wang
In Room: ExHall D Poster Location: Poster #413 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Viewpoint Rosetta Stone: Unlocking Unpaired Ego-Exo Videos for View-invariant Representation Learning
Mi Luo ⋅ Zihui Xue ⋅ Alex Dimakis ⋅ Kristen Grauman
In Room: ExHall D Poster Location: Poster #88 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Black Hole-Driven Identity Absorbing in Diffusion Models Project Page ↗
Muhammad Shaheryar ⋅ Jong Taek Lee ⋅ Soon Ki Jung
In Room: ExHall D Poster Location: Poster #227 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Toward Robust Neural Reconstruction from Sparse Point Sets
Amine Ouasfi ⋅ Shubhendu Jena ⋅ Eric Marchand ⋅ Adnane Boukhayma
In Room: ExHall D Poster Location: Poster #112 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ForestLPR: LiDAR Place Recognition in Forests Attentioning Multiple BEV Density Images Project Page ↗
Yanqing Shen ⋅ Turcan Tuna ⋅ Marco Hutter ⋅ Cesar Cadena ⋅ Nanning Zheng
In Room: ExHall D Poster Location: Poster #123 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MI-DETR: An Object Detection Model with Multi-time Inquiries Mechanism
Zhixiong Nan ⋅ Xianghong Li ⋅ Tao Xiang ⋅ Jifeng Dai
In Room: ExHall D Poster Location: Poster #434 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LLAVIDAL: A Large LAnguage VIsion Model for Daily Activities of Living
Dominick Reilly ⋅ Rajatsubhra Chakraborty ⋅ Arkaprava Sinha ⋅ Manish Kumar Govind ⋅ Pu Wang ⋅ Francois Bremond ⋅ Le Xue ⋅ Srijan Das
In Room: ExHall D Poster Location: Poster #313 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
3D-MVP: 3D Multiview Pretraining for Manipulation
Shengyi Qian ⋅ Kaichun Mo ⋅ Valts Blukis ⋅ David Fouhey ⋅ Dieter Fox ⋅ Ankit Goyal
In Room: ExHall D Poster Location: Poster #140 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
Aishwarya Agarwal ⋅ Srikrishna Karanam ⋅ Vineet Gandhi
In Room: ExHall D Poster Location: Poster #389 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
InterDyn: Controllable Interactive Dynamics with Video Diffusion Models Project Page ↗
Rick Akkerman ⋅ Haiwen Feng ⋅ Michael J. Black ⋅ Dimitrios Tzionas ⋅ Victoria Abrevaya
In Room: ExHall D Poster Location: Poster #173 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Concept Lancet: Image Editing with Compositional Representation Transplant
Jinqi Luo ⋅ Tianjiao Ding ⋅ Kwan Ho Ryan Chan ⋅ Hancheng Min ⋅ Chris Callison-Burch ⋅ Rene Vidal
In Room: ExHall D Poster Location: Poster #223 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Zero-Shot Novel View and Depth Synthesis with Multi-View Geometric Diffusion
Vitor Guizilini ⋅ Muhammad Zubair Irshad ⋅ Dian Chen ⋅ Greg Shakhnarovich ⋅ Rares Andrei Ambrus
In Room: ExHall D Poster Location: Poster #56 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Instant3dit: Multiview Inpainting for Fast Editing of 3D Objects
Amir Barda ⋅ Matheus Gadelha ⋅ Vladimir G. Kim ⋅ Noam Aigerman ⋅ Amit H. Bermano ⋅ Thibault Groueix
In Room: ExHall D Poster Location: Poster #40 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DiSciPLE: Learning Interpretable Programs for Scientific Visual Discovery
Utkarsh Mall ⋅ Cheng Perng Phoo ⋅ Mia Chiquier ⋅ Bharath Hariharan ⋅ Kavita Bala ⋅ Carl Vondrick
In Room: ExHall D Poster Location: Poster #297 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Preserving Clusters in Prompt Learning for Unsupervised Domain Adaptation Project Page ↗
Long Tung Vuong ⋅ Hoang Phan ⋅ Vy Vo ⋅ Anh Tuan Bui ⋅ Thanh-Toan Do ⋅ Trung Le ⋅ Dinh Phung
In Room: ExHall D Poster Location: Poster #398 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Noise-Resistant Video Anomaly Detection via RGB Error-Guided Multiscale Predictive Coding and Dynamic Memory
Han Hu ⋅ Wenli Du ⋅ Peng Liao ⋅ Bing Wang ⋅ Siyuan Fan
In Room: ExHall D Poster Location: Poster #316 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Investigating the Role of Weight Decay in Enhancing Nonconvex SGD
Tao Sun ⋅ Yuhao Huang ⋅ Li Shen ⋅ Kele Xu ⋅ Bao Wang
In Room: ExHall D Poster Location: Poster #444 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MV-MATH: Evaluating Multimodal Math Reasoning in Multi-Visual Contexts Project Page ↗
Peijie Wang ⋅ Zhong-Zhi Li ⋅ Fei Yin ⋅ Dekang Ran ⋅ Cheng-Lin Liu
In Room: ExHall D Poster Location: Poster #356 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DeSplat: Decomposed Gaussian Splatting for Distractor-Free Rendering Project Page ↗
Yihao Wang ⋅ Marcus Klasson ⋅ Matias Turkulainen ⋅ Shuzhe Wang ⋅ Juho Kannala ⋅ Arno Solin
In Room: ExHall D Poster Location: Poster #52 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EDCFlow: Exploring Temporally Dense Difference Maps for Event-based Optical Flow Estimation
Daikun Liu ⋅ Lei Cheng ⋅ Teng Wang ⋅ Changyin Sun
In Room: ExHall D Poster Location: Poster #168 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Dual Prompting Image Restoration with Diffusion Transformers Project Page ↗
Dehong Kong ⋅ Fan Li ⋅ Zhixin Wang ⋅ Jiaqi Xu ⋅ Renjing Pei ⋅ Wenbo Li ⋅ Wenqi Ren
In Room: ExHall D Poster Location: Poster #206 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
UVGS: Reimagining Unstructured 3D Gaussian Splatting using UV Mapping
Aashish Rai ⋅ Dilin Wang ⋅ Mihir Jain ⋅ Nikolaos Sarafianos ⋅ Kefan Chen ⋅ Srinath Sridhar ⋅ Aayush Prakash
In Room: ExHall D Poster Location: Poster #46 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Z-Magic: Zero-shot Multiple Attributes Guided Image Creator
Yingying Deng ⋅ Xiangyu He ⋅ Fan Tang ⋅ Weiming Dong
In Room: ExHall D Poster Location: Poster #247 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DoraCycle: Domain-Oriented Adaptation of Unified Generative Model in Multimodal Cycles
Rui Zhao ⋅ Weijia Mao ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #256 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PhysVLM: Enabling Visual Language Models to Understand Robotic Physical Reachability Project Page ↗
Weijie Zhou ⋅ Manli Tao ⋅ Chaoyang Zhao ⋅ Haiyun Guo ⋅ Honghui Dong ⋅ Ming Tang ⋅ Jinqiao Wang
In Room: ExHall D Poster Location: Poster #150 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection Project Page ↗
Hou-I Liu ⋅ Christine Wu ⋅ Jen-Hao Cheng ⋅ Wenhao Chai ⋅ Shian-yun Wang ⋅ Gaowen Liu ⋅ Hugo Latapie ⋅ Jhih-Ciang Wu ⋅ Jenq-Neng Hwang ⋅ Hong-Han Shuai ⋅ Wen-Huang Cheng
In Room: ExHall D Poster Location: Poster #116 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Foveated Instance Segmentation
Hongyi Zeng ⋅ Wenxuan Liu ⋅ Tianhua Xia ⋅ Jinhui Chen ⋅ Ziyun Li ⋅ Sai Qian Zhang
In Room: ExHall D Poster Location: Poster #331 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Zero-Shot Head Swapping in Real-World Scenarios
Sohyun Jeong ⋅ Taewoong Kang ⋅ Hyojin Jang ⋅ Jaegul Choo
In Room: ExHall D Poster Location: Poster #14 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Pow3R: Empowering Unconstrained 3D Reconstruction with Camera and Scene Priors
Wonbong Jang ⋅ Philippe Weinzaepfel ⋅ Vincent Leroy ⋅ Lourdes Agapito ⋅ Jerome Revaud
In Room: ExHall D Poster Location: Poster #84 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Sampling Innovation-Based Adaptive Compressive Sensing
Zhifu Tian ⋅ Tao Hu ⋅ Chaoyang Niu ⋅ Di Wu ⋅ Shu Wang
In Room: ExHall D Poster Location: Poster #209 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Scalable Autoregressive Monocular Depth Estimation Project Page ↗
Jinhong Wang ⋅ Jintai Chen ⋅ Jian liu ⋅ Dongqi Tang ⋅ Wentong Li ⋅ Weiqiang Wang ⋅ Danny Chen ⋅ Jian Wu
In Room: ExHall D Poster Location: Poster #79 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FreeScene: Mixed Graph Diffusion for 3D Scene Synthesis from Free Prompts
Tongyuan Bai ⋅ Wangyuanfan Bai ⋅ Dong Chen ⋅ Tieru Wu ⋅ Manyi Li ⋅ Rui Ma
In Room: ExHall D Poster Location: Poster #43 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MaskGWM: A Generalizable Driving World Model with Video Mask Reconstruction
Jingcheng Ni ⋅ Yuxin Guo ⋅ Yichen Liu ⋅ Rui Chen ⋅ Lewei Lu ⋅ Zehuan Wu
In Room: ExHall D Poster Location: Poster #127 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Dual-Agent Optimization framework for Cross-Domain Few-Shot Segmentation
Zhaoyang Li ⋅ Yuan Wang ⋅ Wangkai Li ⋅ Tianzhu Zhang ⋅ Xiang Liu
In Room: ExHall D Poster Location: Poster #426 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HSI-GPT: A General-Purpose Large Scene-Motion-Language Model for Human Scene Interaction
Yuan Wang ⋅ Yali Li ⋅ Lixiang Li ⋅ Shengjin Wang
In Room: ExHall D Poster Location: Poster #171 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HoVLE: Unleashing the Power of Monolithic Vision-Language Models with Holistic Vision-Language Embedding
Chenxin Tao ⋅ Shiqian Su ⋅ Xizhou Zhu ⋅ Chenyu Zhang ⋅ Zhe Chen ⋅ Jiawen Liu ⋅ Wenhai Wang ⋅ Lewei Lu ⋅ Gao Huang ⋅ Yu Qiao ⋅ Jifeng Dai
In Room: ExHall D Poster Location: Poster #374 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Satellite Image Road Graph Extraction: A Global-Scale Dataset and A Novel Method
Pan Yin ⋅ Kaiyu Li ⋅ Xiangyong Cao ⋅ Jing Yao ⋅ Lei Liu ⋅ Xueru Bai ⋅ Feng Zhou ⋅ Deyu Meng
In Room: ExHall D Poster Location: Poster #127 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes Project Page ↗
Jinxiu Liu ⋅ Shaoheng Lin ⋅ Yinxiao Li ⋅ Ming-Hsuan Yang
In Room: ExHall D Poster Location: Poster #67 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VideoGigaGAN: Towards Detail-rich Video Super-Resolution
Yiran Xu ⋅ Taesung Park ⋅ Richard Zhang ⋅ Yang Zhou ⋅ Eli Shechtman ⋅ Feng Liu ⋅ Jia-Bin Huang ⋅ Difan Liu
In Room: ExHall D Poster Location: Poster #185 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Learning Visual Composition through Improved Semantic Guidance
Austin Stone ⋅ Hagen Soltau ⋅ Robert Geirhos ⋅ Xi Yi ⋅ Ye Xia ⋅ Bingyi Cao ⋅ Kaifeng Chen ⋅ Abhijit Ogale ⋅ Jonathon Shlens
In Room: ExHall D Poster Location: Poster #340 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
High Dynamic Range Video Compression: A Large-Scale Benchmark Dataset and A Learned Bit-depth Scalable Compression Algorithm Project Page ↗
Zhaoyi Tian ⋅ Feifeng Wang ⋅ Shiwei Wang ⋅ Zihao Zhou ⋅ Yao Zhu ⋅ Liquan Shen
In Room: ExHall D Poster Location: Poster #187 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Adaptive Parameter Selection for Tuning Vision-Language Models
Yi Zhang ⋅ Yi-Xuan Deng ⋅ Meng-Hao Guo ⋅ Shi-Min Hu
In Room: ExHall D Poster Location: Poster #392 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DL2G: Degradation-guided Local-to-Global Restoration for Eyeglass Reflection Removal
Yizhilv ⋅ Xiao Lu ⋅ Hong Ding ⋅ Jingbo Hu ⋅ Zhi Jiang ⋅ Chunxia Xiao
In Room: ExHall D Poster Location: Poster #19 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
UniGraspTransformer: Simplified Policy Distillation for Scalable Dexterous Robotic Grasping
Wenbo Wang ⋅ Fangyun Wei ⋅ Lei Zhou ⋅ Xi Chen ⋅ Lin Luo ⋅ Xiaohan Yi ⋅ Yizhong Zhang ⋅ Yaobo Liang ⋅ Chang Xu ⋅ Yan Lu ⋅ Jiaolong Yang ⋅ Baining Guo
In Room: ExHall D Poster Location: Poster #149 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RestorGS: Depth-aware Gaussian Splatting for Efficient 3D Scene Restoration Project Page ↗
Yuanjian Qiao ⋅ Mingwen Shao ⋅ Lingzhuang Meng ⋅ Kai Xu
In Room: ExHall D Poster Location: Poster #50 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning
Kailin Li ⋅ Puhao Li ⋅ Tengyu Liu ⋅ Yuyang Li ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #155 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents Project Page ↗
Zhengrong Yue ⋅ Shaobin Zhuang ⋅ Kunchang Li ⋅ Yanbo Ding ⋅ Yali Wang
In Room: ExHall D Poster Location: Poster #290 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UNICL-SAM: Uncertainty-Driven In-Context Segmentation with Part Prototype Discovery
Dianmo Sheng ⋅ Dongdong Chen ⋅ Zhentao Tan ⋅ Qiankun Liu ⋅ Qi Chu ⋅ Tao Gong ⋅ Bin Liu ⋅ Jing Han ⋅ Wenbin Tu ⋅ Shengwei Xu ⋅ Nenghai Yu
In Room: ExHall D Poster Location: Poster #419 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Efficient Decoupled Feature 3D Gaussian Splatting via Hierarchical Compression
Zhenqi Dai ⋅ Ting Liu ⋅ Yanning Zhang
In Room: ExHall D Poster Location: Poster #48 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ControlFace: Harnessing Facial Parametric Control for Face Rigging
Wooseok Jang ⋅ Youngjun Hong ⋅ Geonho Cha ⋅ Seungryong Kim
In Room: ExHall D Poster Location: Poster #16 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance Project Page ↗
Dian Shao ⋅ Mingfei Shi ⋅ Shengda Xu ⋅ Haodong Chen ⋅ Yongle Huang ⋅ Binglu Wang
In Room: ExHall D Poster Location: Poster #161 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
An End-to-End Robust Point Cloud Semantic Segmentation Network with Single-Step Conditional Diffusion Models
Wentao Qu ⋅ Jing Wang ⋅ Yongshun Gong ⋅ Xiaoshui Huang ⋅ Liang Xiao
In Room: ExHall D Poster Location: Poster #112 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RENO: Real-Time Neural Compression for 3D LiDAR Point Clouds
Kang You ⋅ Tong Chen ⋅ Dandan Ding ⋅ M. Salman Asif ⋅ Zhan Ma
In Room: ExHall D Poster Location: Poster #107 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
COB-GS: Clear Object Boundaries in 3DGS Segmentation Based on Boundary-Adaptive Gaussian Splitting
Jiaxin Zhang ⋅ Junjun Jiang ⋅ Youyu Chen ⋅ Kui Jiang ⋅ Xianming Liu
In Room: ExHall D Poster Location: Poster #337 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
BlenderGym: Benchmarking Foundational Model Systems for Graphics Editing
Yunqi Gu ⋅ Ian Huang ⋅ Jihyeon Je ⋅ Guandao Yang ⋅ Leonidas Guibas
In Room: ExHall D Poster Location: Poster #267 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LaVin-DiT: Large Vision Diffusion Transformer
Zhaoqing Wang ⋅ Xiaobo Xia ⋅ Runnan Chen ⋅ Dongdong Yu ⋅ Changhu Wang ⋅ Mingming Gong ⋅ Tongliang Liu
In Room: ExHall D Poster Location: Poster #406 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ComRoPE: Scalable and Robust Rotary Position Embedding Parameterized by Trainable Commuting Angle Matrices
Hao Yu ⋅ Tangyu Jiang ⋅ Shuning Jia ⋅ Shannan Yan ⋅ Shunning Liu ⋅ Haolong Qian ⋅ Guanghao Li ⋅ Shuting Dong ⋅ Chun Yuan
In Room: ExHall D Poster Location: Poster #416 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning
Xu Han ⋅ Yuan Tang ⋅ Jinfeng Xu ⋅ Xianzhi Li
In Room: ExHall D Poster Location: Poster #116 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Where the Devil Hides: Deepfake Detectors Can No Longer Be Trusted
Shuaiwei Yuan ⋅ Junyu Dong ⋅ Yuezun Li
In Room: ExHall D Poster Location: Poster #324 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
From Words to Structured Visuals: A Benchmark and Framework for Text-to-Diagram Generation and Editing
Jingxuan Wei ⋅ Cheng Tan ⋅ Qi Chen ⋅ Gaowei Wu ⋅ Siyuan Li ⋅ Zhangyang Gao ⋅ Linzhuang Sun ⋅ Bihui Yu ⋅ Ruifeng Guo
In Room: ExHall D Poster Location: Poster #254 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Enhancing Testing-Time Robustness for Trusted Multi-View Classification in the Wild
Wei Liu ⋅ Yufei Chen ⋅ Xiaodong Yue
In Room: ExHall D Poster Location: Poster #465 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Accelerating Diffusion Transformer via Increment-Calibrated Caching with Channel-Aware Singular Value Decomposition
Zhiyuan Chen ⋅ Keyi Li ⋅ Yifan Jia ⋅ Le Ye ⋅ Yufei Ma
In Room: ExHall D Poster Location: Poster #210 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill
Jieming Cui ⋅ Tengyu Liu ⋅ Ziyu Meng ⋅ Jiale Yu ⋅ Ran Song ⋅ Wei Zhang ⋅ Yixin Zhu ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #145 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Feat2GS: Probing Visual Foundation Models with Gaussian Splatting Project Page ↗
Yue Chen ⋅ Xingyu Chen ⋅ Anpei Chen ⋅ Gerard Pons-Moll ⋅ Yuliang Xiu
In Room: ExHall D Poster Location: Poster #93 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
STEPS: Sequential Probability Tensor Estimation for Text-to-Image Hard Prompt Search
Yuning Qiu ⋅ Andong Wang ⋅ Chao Li ⋅ Haonan Huang ⋅ Guoxu Zhou ⋅ Qibin Zhao
In Room: ExHall D Poster Location: Poster #236 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Identity-Preserving Text-to-Video Generation by Frequency Decomposition Project Page ↗
Shenghai Yuan ⋅ Jinfa Huang ⋅ Xianyi He ⋅ Yunyang Ge ⋅ Yujun Shi ⋅ Liuhan Chen ⋅ Jiebo Luo ⋅ Li Yuan
In Room: ExHall D Poster Location: Poster #222 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hearing Hands: Generating Sounds from Physical Interactions in 3D Scenes
Yiming Dou ⋅ Wonseok Oh ⋅ Yuqing Luo ⋅ Antonio Loquercio ⋅ Andrew Owens
In Room: ExHall D Poster Location: Poster #151 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ScaMo: Exploring the Scaling Law in Autoregressive Motion Generation Model
Shunlin Lu ⋅ Jingbo Wang ⋅ Zeyu Lu ⋅ Ling-Hao Chen ⋅ Wenxun Dai ⋅ Junting Dong ⋅ Zhiyang Dou ⋅ Bo Dai ⋅ Ruimao Zhang
In Room: ExHall D Poster Location: Poster #162 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PoseTraj: Pose-Aware Trajectory Control in Video Diffusion Project Page ↗
longbin ji ⋅ Lei Zhong ⋅ Pengfei Wei ⋅ Changjian Li
In Room: ExHall D Poster Location: Poster #163 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UCM-VeID V2: A Richer Dataset and A Pre-training Method for UAV Cross-Modality Vehicle Re-Identification
Xingyue Liu ⋅ Jiahao Qi ⋅ Chen Chen ⋅ Kangcheng Bin ⋅ Ping Zhong
In Room: ExHall D Poster Location: Poster #118 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
StageDesigner: Artistic Stage Generation for Scenography via Theater Scripts Project Page ↗
Zhaoxing Gan ⋅ Mengtian Li ⋅ Ruhua Chen ⋅ Zhongxia JI ⋅ Sichen Guo ⋅ Huanling Hu ⋅ Guangnan Ye ⋅ Zuo Hu
In Room: ExHall D Poster Location: Poster #242 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Less is More: Efficient Model Merging with Binary Task Switch
Biqing Qi ⋅ Fangyuan Li ⋅ Zhen Wang ⋅ Junqi Gao ⋅ Dong Li ⋅ Peng Ye ⋅ Bowen Zhou
In Room: ExHall D Poster Location: Poster #442 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Wav2Sem: Plug-and-Play Audio Semantic Decoupling for 3D Speech-Driven Facial Animation
Hao Li ⋅ Ju Dai ⋅ Xin Zhao ⋅ Feng Zhou ⋅ Junjun Pan ⋅ Lei Li
In Room: ExHall D Poster Location: Poster #2 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer
Jiahao Cui ⋅ Hui Li ⋅ Qingkun Su ⋅ Hanlin Shang ⋅ Kaihui Cheng ⋅ Yuqi Ma ⋅ Shan Mu ⋅ Hang Zhou ⋅ Jingdong Wang ⋅ Siyu Zhu
In Room: ExHall D Poster Location: Poster #4 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Forensics Adapter: Adapting CLIP for Generalizable Face Forgery Detection
Xinjie Cui ⋅ Yuezun Li ⋅ Ao Luo ⋅ Jiaran Zhou ⋅ Junyu Dong
In Room: ExHall D Poster Location: Poster #325 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Unlearning through Knowledge Overwriting: Reversible Federated Unlearning via Selective Sparse Adapter
Zhengyi Zhong ⋅ Weidong Bao ⋅ Ji Wang ⋅ Shuai Zhang ⋅ Jingxuan Zhou ⋅ Lingjuan Lyu ⋅ Wei Yang Bryan Lim
In Room: ExHall D Poster Location: Poster #432 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Improving the Transferability of Adversarial Attacks on Face Recognition with Diverse Parameters Augmentation
Fengfan Zhou ⋅ Bangjie Yin ⋅ Hefei Ling ⋅ Qianyu Zhou ⋅ Wenxuan Wang
In Room: ExHall D Poster Location: Poster #319 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Florence-VL: Enhancing Vision-Language Models with Generative Vision Encoder and Depth-Breadth Fusion
Jiuhai Chen ⋅ Jianwei Yang ⋅ Haiping Wu ⋅ Dianqi Li ⋅ Jianfeng Gao ⋅ Tianyi Zhou ⋅ Bin Xiao
In Room: ExHall D Poster Location: Poster #372 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Implicit Correspondence Learning for Image-to-Point Cloud Registration
Xinjun Li ⋅ Wenfei Yang ⋅ Jiacheng Deng ⋅ Zhixin Cheng ⋅ Xu Zhou ⋅ Tianzhu Zhang
In Room: ExHall D Poster Location: Poster #106 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
nnWNet: Rethinking the Use of Transformers in Biomedical Image Segmentation and Calling for a Unified Evaluation Benchmark
Yanfeng Zhou ⋅ Lingrui Li ⋅ Le Lu ⋅ Minfeng Xu
In Room: ExHall D Poster Location: Poster #480 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GuardSplat: Efficient and Robust Watermarking for 3D Gaussian Splatting Project Page ↗
Zixuan Chen ⋅ Guangcong Wang ⋅ Jiahao Zhu ⋅ Jianhuang Lai ⋅ Xiaohua Xie
In Room: ExHall D Poster Location: Poster #45 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SynerGen-VL: Towards Synergistic Image Understanding and Generation with Vision Experts and Token Folding
Hao Li ⋅ Changyao TIAN ⋅ Jie Shao ⋅ Xizhou Zhu ⋅ Zhaokai Wang ⋅ Jinguo Zhu ⋅ Wenhan Dou ⋅ Xiaogang Wang ⋅ Hongsheng Li ⋅ Lewei Lu ⋅ Jifeng Dai
In Room: ExHall D Poster Location: Poster #347 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Continual SFT Matches Multimodal RLHF with Negative Supervision
Ke Zhu ⋅ Yu Wang ⋅ Yanpeng Sun ⋅ Qiang Chen ⋅ Jiang-Jiang Liu ⋅ gang zhang ⋅ Jingdong Wang
In Room: ExHall D Poster Location: Poster #380 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Enhanced Contrastive Learning with Multi-view Longitudinal Data for Chest X-ray Report Generation Project Page ↗
Kang Liu ⋅ Zhuoqi Ma ⋅ Xiaolu Kang ⋅ Yunan Li ⋅ Kun XIE ⋅ Zhicheng Jiao ⋅ Qiguang Miao
In Room: ExHall D Poster Location: Poster #474 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Neural Video Compression with Context Modulation
Chuanbo Tang ⋅ Zhuoyuan Li ⋅ Yifan Bian ⋅ Li Li ⋅ Dong Liu
In Room: ExHall D Poster Location: Poster #181 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
AniMer: Animal Pose and Shape Estimation Using Family Aware Transformer
Jin Lyu ⋅ Tianyi Zhu ⋅ Yi Gu ⋅ Li Lin ⋅ Pujin Cheng ⋅ Yebin Liu ⋅ Xiaoying Tang ⋅ Liang An
In Room: ExHall D Poster Location: Poster #161 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Class Prototypes for Unified Sparse-Supervised 3D Object Detection
Yun Zhu ⋅ Le Hui ⋅ Hang Yang ⋅ Jianjun Qian ⋅ Jin Xie ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #432 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ROCKET-1: Mastering Open-World Interaction with Visual-Temporal Context Prompting
Shaofei Cai ⋅ Zihao Wang ⋅ Kewei Lian ⋅ Zhancun Mu ⋅ Xiaojian Ma ⋅ Anji Liu ⋅ Yitao Liang
In Room: ExHall D Poster Location: Poster #142 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
OPTICAL: Leveraging Optimal Transport for Contribution Allocation in Dataset Distillation
Xiao Cui ⋅ Yulei Qin ⋅ Wengang Zhou ⋅ Hongsheng Li ⋅ Houqiang Li
In Room: ExHall D Poster Location: Poster #440 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key Project Page ↗
Zhihe Yang ⋅ Xufang Luo ⋅ Dongqi Han ⋅ Yunjian Xu ⋅ Dongsheng Li
In Room: ExHall D Poster Location: Poster #373 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Cross-Modal 3D Representation with Multi-View Images and Point Clouds
Ziyang Zhou ⋅ Pinghui Wang ⋅ Zi Liang ⋅ Haitao Bai ⋅ Ruofei Zhang
In Room: ExHall D Poster Location: Poster #339 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer
Hao Chen ⋅ Ze Wang ⋅ Xiang Li ⋅ Ximeng Sun ⋅ Fangyi Chen ⋅ Jiang Liu ⋅ Jindong Wang ⋅ Bhiksha Raj ⋅ Zicheng Liu ⋅ Emad Barsoum
In Room: ExHall D Poster Location: Poster #209 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
Chaoyou Fu ⋅ Yuhan Dai ⋅ Yongdong Luo ⋅ Lei Li ⋅ Shuhuai Ren ⋅ Renrui Zhang ⋅ Zihan Wang ⋅ Chenyu Zhou ⋅ Yunhang Shen ⋅ Mengdan Zhang ⋅ Peixian Chen ⋅ Yanwei Li ⋅ Shaohui Lin ⋅ Sirui Zhao ⋅ Ke Li ⋅ Tong Xu ⋅ Xiawu Zheng ⋅ Enhong Chen ⋅ Caifeng Shan ⋅ Ran He ⋅ Xing Sun
In Room: ExHall D Poster Location: Poster #295 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Bridging Modalities: Improving Universal Multimodal Retrieval by Multimodal Large Language Models Project Page ↗
Xin Zhang ⋅ Yanzhao Zhang ⋅ Wen Xie ⋅ Mingxin Li ⋅ Ziqi Dai ⋅ Dingkun Long ⋅ Pengjun Xie ⋅ Meishan Zhang ⋅ Wenjie Li ⋅ Min Zhang
In Room: ExHall D Poster Location: Poster #372 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GLUS: Global-Local Reasoning Unified into A Single Large Language Model for Video Segmentation
Lang Lin ⋅ Xueyang Yu ⋅ Ziqi Pang ⋅ Yu-Xiong Wang
In Room: ExHall D Poster Location: Poster #314 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Unveiling the Mist over 3D Vision-Language Understanding: Object-centric Evaluation with Chain-of-Analysis Project Page ↗
Jiangyong Huang ⋅ Baoxiong Jia ⋅ Yan Wang ⋅ Ziyu Zhu ⋅ Xiongkun Linghu ⋅ Qing Li ⋅ Song-Chun Zhu ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #339 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CL-MoE: Enhancing Multimodal Large Language Model with Dual Momentum Mixture-of-Experts for Continual Visual Question Answering
Tianyu Huai ⋅ Jie Zhou ⋅ Xingjiao Wu ⋅ Qin Chen ⋅ Qingchun Bai ⋅ Zezhou ⋅ Liang He
In Room: ExHall D Poster Location: Poster #362 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Pay Attention to the Foreground in Object-Centric Learning
Pinzhuo Tian ⋅ Shengjie Yang ⋅ Hang Yu ⋅ Alex C. Kot
In Room: ExHall D Poster Location: Poster #396 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion
Jongseong Bae ⋅ Junwoo Ha ⋅ Ha Young Kim
In Room: ExHall D Poster Location: Poster #125 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MirrorVerse: Pushing Diffusion Models to Realistically Reflect the World Project Page ↗
Ankit Dhiman ⋅ Manan Shah ⋅ R. Venkatesh Babu
In Room: ExHall D Poster Location: Poster #56 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
Qingqing Zhao ⋅ Yao Lu ⋅ Moo Jin Kim ⋅ Zipeng Fu ⋅ Zhuoyang Zhang ⋅ Yecheng Wu ⋅ Max Li ⋅ Qianli Ma ⋅ Song Han ⋅ Chelsea Finn ⋅ Ankur Handa ⋅ Tsung-Yi Lin ⋅ Gordon Wetzstein ⋅ Ming-Yu Liu ⋅ Donglai Xiang
In Room: ExHall D Poster Location: Poster #143 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Active Event-based Stereo Vision
Jianing Li ⋅ Yunjian Zhang ⋅ Haiqian Han ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #75 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
The Devil is in Temporal Token: High Quality Video Reasoning Segmentation
Sitong Gong ⋅ Yunzhi Zhuge ⋅ Lu Zhang ⋅ Zongxin Yang ⋅ Pingping Zhang ⋅ Huchuan Lu
In Room: ExHall D Poster Location: Poster #290 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Two is Better than One: Efficient Ensemble Defense for Robust and Compact Models
Yoojin Jung ⋅ Byung Cheol Song
In Room: ExHall D Poster Location: Poster #412 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Theory of Learning Unified Model via Knowledge Integration from Label Space Varying Domains
Dexuan Zhang ⋅ Thomas Westfechtel ⋅ Tatsuya Harada
In Room: ExHall D Poster Location: Poster #454 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Edge-SD-SR: Low Latency and Parameter Efficient On-device Super-Resolution with Stable Diffusion via Bidirectional Conditioning
Isma Hadji ⋅ Mehdi Noroozi ⋅ Victor Escorcia ⋅ Anestis Zaganidis ⋅ Brais Martinez ⋅ Georgios Tzimiropoulos
In Room: ExHall D Poster Location: Poster #204 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HiLoTs: High-Low Temporal Sensitive Representation Learning for Semi-Supervised LiDAR Segmentation in Autonomous Driving
R.D. Lin ⋅ Pengcheng Weng ⋅ Yinqiao Wang ⋅ Han Ding ⋅ Jinsong Han ⋅ Fei Wang
In Room: ExHall D Poster Location: Poster #118 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
3D Convex Splatting: Radiance Field Rendering with 3D Smooth Convexes Project Page ↗
Jan Held ⋅ Renaud Vandeghen ⋅ Abdullah J Hamdi ⋅ Anthony Cioppa ⋅ Adrien Deliege ⋅ Silvio Giancola ⋅ Andrea Vedaldi ⋅ Bernard Ghanem ⋅ Marc Van Droogenbroeck
In Room: ExHall D Poster Location: Poster #30 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards More General Video-based Deepfake Detection through Facial Component Guided Adaptation for Foundation Model Project Page ↗
Yue-Hua Han ⋅ Tai-Ming Huang ⋅ Kailung Hua ⋅ Jun-Cheng Chen
In Room: ExHall D Poster Location: Poster #184 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LaTexBlend: Scaling Multi-concept Customized Generation with Latent Textual Blending
Jian Jin ⋅ Zhenbo Yu ⋅ Yang Shen ⋅ Zhenyong Fu ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #242 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MLLM-as-a-Judge for Image Safety without Human Labeling
Zhenting Wang ⋅ Shuming Hu ⋅ Shiyu Zhao ⋅ Xiaowen Lin ⋅ Felix Juefei-Xu ⋅ Zhuowei Li ⋅ Ligong Han ⋅ Harihar Subramanyam ⋅ Li Chen ⋅ Jianfa Chen ⋅ nan jiang ⋅ Lingjuan Lyu ⋅ Shiqing Ma ⋅ Dimitris N. Metaxas ⋅ Ankit Jain
In Room: ExHall D Poster Location: Poster #384 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization Project Page ↗
Hongrui Jia ⋅ Chaoya Jiang ⋅ Haiyang Xu ⋅ Wei Ye ⋅ Mengfan Dong ⋅ Ming Yan ⋅ Ji Zhang ⋅ Fei Huang ⋅ Shikun Zhang
In Room: ExHall D Poster Location: Poster #380 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DeSiRe-GS: 4D Street Gaussians for Static-Dynamic Decomposition and Surface Reconstruction for Urban Driving Scenes
Chensheng Peng ⋅ Chengwei Zhang ⋅ Yixiao Wang ⋅ Chenfeng Xu ⋅ Yichen Xie ⋅ Wenzhao Zheng ⋅ Kurt Keutzer ⋅ Masayoshi Tomizuka ⋅ Wei Zhan
In Room: ExHall D Poster Location: Poster #135 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Satellite to GroundScape - Large-scale Consistent Ground View Generation from Satellite Views
Ningli Xu ⋅ Rongjun Qin
In Room: ExHall D Poster Location: Poster #60 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Continuous Space-Time Video Resampling with Invertible Motion Steganography
Yuantong zhang ⋅ Zhenzhong Chen
In Room: ExHall D Poster Location: Poster #183 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Geometry-guided Online 3D Video Synthesis with Multi-View Temporal Consistency
Hyunho Ha ⋅ Lei Xiao ⋅ Christian Richardt ⋅ Thu Nguyen-Phuoc ⋅ Changil Kim ⋅ Min H. Kim ⋅ Douglas Lanman ⋅ Numair Khan
In Room: ExHall D Poster Location: Poster #59 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Vid2Sim: Generalizable, Video-based Reconstruction of Appearance, Geometry and Physics for Mesh-free Simulation
Chuhao Chen ⋅ Zhiyang Dou ⋅ Chen Wang ⋅ Yiming Huang ⋅ Anjun Chen ⋅ Qiao Feng ⋅ Jiatao Gu ⋅ Lingjie Liu
In Room: ExHall D Poster Location: Poster #37 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Conical Visual Concentration for Efficient Large Vision-Language Models Project Page ↗
Long Xing ⋅ Qidong Huang ⋅ Xiaoyi Dong ⋅ Jiajie Lu ⋅ Pan Zhang ⋅ Yuhang Zang ⋅ Yuhang Cao ⋅ Conghui He ⋅ Jiaqi Wang ⋅ Feng Wu ⋅ Dahua Lin
In Room: ExHall D Poster Location: Poster #378 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
OralXrays-9: Towards Hospital-Scale Panoramic X-ray Anomaly Detection via Personalized Multi-Object Query-Aware Mining
Bingzhi Chen ⋅ Sisi Fu ⋅ Xiaocheng Fang ⋅ Jieyi Cai ⋅ Boya Zhang ⋅ Minhua Lu ⋅ Yishu Liu
In Room: ExHall D Poster Location: Poster #471 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
REWIND: Real-Time Egocentric Whole-Body Motion Diffusion with Exemplar-Based Identity Conditioning Project Page ↗
Jihyun Lee ⋅ Weipeng Xu ⋅ Alexander Richard ⋅ Shih-En Wei ⋅ Shunsuke Saito ⋅ Shaojie Bai ⋅ Te-Li Wang ⋅ Minhyuk Sung ⋅ Tae-Kyun Kim ⋅ Jason Saragih
In Room: ExHall D Poster Location: Poster #166 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Tiled Diffusion Project Page ↗
Or Madar ⋅ Ohad Fried
In Room: ExHall D Poster Location: Poster #232 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
BOE-ViT: Boosting Orientation Estimation with Equivariance in Self-Supervised 3D Subtomogram Alignment
Runmin Jiang ⋅ Jackson Daggett ⋅ Shriya Pingulkar ⋅ Yizhou Zhao ⋅ Priyanshu Dhingra ⋅ Daniel Brown ⋅ Qifeng Wu ⋅ Xiangrui Zeng ⋅ Xingjian Li ⋅ Min Xu
In Room: ExHall D Poster Location: Poster #306 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge
Xuan Shen ⋅ Weize Ma ⋅ Jing Liu ⋅ Changdi Yang ⋅ Rui Ding ⋅ Quanyi Wang ⋅ Henghui Ding ⋅ Wei Niu ⋅ Yanzhi Wang ⋅ Pu Zhao ⋅ Jun Lin ⋅ Jiuxiang Gu
In Room: ExHall D Poster Location: Poster #75 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Sufficient Invariant Learning for Distribution Shift
Taero Kim ⋅ Subeen Park ⋅ Sungjun Lim ⋅ Yonghan Jung ⋅ Krikamol Muandet ⋅ Kyungwoo Song
In Room: ExHall D Poster Location: Poster #458 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SceneTAP: Scene-Coherent Typographic Adversarial Planner against Vision-Language Models in Real-World Environments
Yue Cao ⋅ Yun Xing ⋅ Jie Zhang ⋅ Di Lin ⋅ Tianwei Zhang ⋅ Ivor Tsang ⋅ Yang Liu ⋅ Qing Guo
In Room: ExHall D Poster Location: Poster #383 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Polarized Color Screen Matting
Kenji Enomoto ⋅ Scott Cohen ⋅ Brian Price ⋅ TJ Rhodes
In Room: ExHall D Poster Location: Poster #21 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HUNet: Homotopy Unfolding Network for Image Compressive Sensing
Feiyang Shen ⋅ Hongping Gan
In Room: ExHall D Poster Location: Poster #205 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DeNVeR: Deformable Neural Vessel Representations for Unsupervised Video Vessel Segmentation
Chun-Hung Wu ⋅ Shih-Hong Chen ⋅ Chih Yao Hu ⋅ Hsin-Yu Wu ⋅ Kai-Hsin Chen ⋅ Yu-You Chen ⋅ Chih-Hai Su ⋅ Chih-Kuo Lee ⋅ Yu-Lun Liu
In Room: ExHall D Poster Location: Poster #482 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ViUniT: Visual Unit Tests for More Robust Visual Programming Project Page ↗
Artemis Panagopoulou ⋅ Honglu Zhou ⋅ silvio savarese ⋅ Caiming Xiong ⋅ Chris Callison-Burch ⋅ Mark Yatskar ⋅ Juan Carlos Niebles
In Room: ExHall D Poster Location: Poster #346 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Let Humanoids Hike! Integrative Skill Development on Complex Trails
Kwan-Yee Lin ⋅ Stella X. Yu
In Room: ExHall D Poster Location: Poster #137 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Imagine and Seek: Improving Composed Image Retrieval with an Imagined Proxy
You Li ⋅ Fan Ma ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #363 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SynTab-LLaVA: Enhancing Multimodal Table Understanding with Decoupled Synthesis
Bangbang Zhou ⋅ Zuan Gao ⋅ Zixiao Wang ⋅ Boqiang Zhang ⋅ Yuxin Wang ⋅ Zhineng Chen ⋅ Hongtao Xie
In Room: ExHall D Poster Location: Poster #360 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Edit Away and My Face Will not Stay: Personal Biometric Defense against Malicious Generative Editing
Hanhui Wang ⋅ Yihua Zhang ⋅ Ruizheng Bai ⋅ Yue Zhao ⋅ Sijia Liu ⋅ Zhengzhong Tu
In Room: ExHall D Poster Location: Poster #267 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DrVideo: Document Retrieval Based Long Video Understanding
Ziyu Ma ⋅ Chenhui Gou ⋅ Hengcan Shi ⋅ Bin Sun ⋅ Shutao Li ⋅ Hamid Rezatofighi ⋅ Jianfei Cai
In Room: ExHall D Poster Location: Poster #300 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Infighting in the Dark: Multi-Label Backdoor Attack in Federated Learning
Ye Li ⋅ Yanchao Zhao ⋅ chengcheng zhu ⋅ Jiale Zhang
In Room: ExHall D Poster Location: Poster #453 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Buffer Anytime: Zero-Shot Video Depth and Normal from Image Priors
Zhengfei Kuang ⋅ Tianyuan Zhang ⋅ Kai Zhang ⋅ Hao Tan ⋅ Sai Bi ⋅ Yiwei Hu ⋅ Zexiang Xu ⋅ Milos Hasan ⋅ Gordon Wetzstein ⋅ Fujun Luan
In Room: ExHall D Poster Location: Poster #177 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PSHuman: Photorealistic Single-image 3D Human Reconstruction using Cross-Scale Multiview Diffusion and Explicit Remeshing
Peng Li ⋅ Wangguandong Zheng ⋅ Yuan Liu ⋅ Tao Yu ⋅ Yangguang Li ⋅ Xingqun Qi ⋅ Xiaowei Chi ⋅ Siyu Xia ⋅ Yan-Pei Cao ⋅ Wei Xue ⋅ Wenhan Luo ⋅ Yike Guo
In Room: ExHall D Poster Location: Poster #14 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DriveDreamer4D: World Models Are Effective Data Machines for 4D Driving Scene Representation Project Page ↗
Guosheng Zhao ⋅ Chaojun Ni ⋅ Xiaofeng Wang ⋅ Zheng Zhu ⋅ Xueyang Zhang ⋅ Yida Wang ⋅ Guan Huang ⋅ xinze chen ⋅ Boyuan Wang ⋅ Youyi Zhang ⋅ Wenjun Mei ⋅ Xingang Wang
In Room: ExHall D Poster Location: Poster #132 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Handling Spatial-Temporal Data Heterogeneity for Federated Continual Learning via Tail Anchor
Hao Yu ⋅ Xin Yang ⋅ Le Zhang ⋅ Hanlin Gu ⋅ Tianrui Li ⋅ Lixin Fan ⋅ Qiang Yang
In Room: ExHall D Poster Location: Poster #450 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CADCrafter: Generating Computer-Aided Design Models from Unconstrained Images
Chen Cheng ⋅ Jiacheng Wei ⋅ Tianrun Chen ⋅ Chi Zhang ⋅ Xiaofeng Yang ⋅ Shangzhan Zhang ⋅ Bingchen Yang ⋅ Chuan-Sheng Foo ⋅ Guosheng Lin ⋅ Qixing Huang ⋅ Fayao Liu
In Room: ExHall D Poster Location: Poster #40 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hiding Images in Diffusion Models by Editing Learned Score Functions
Haoyu Chen ⋅ Yunqiao Yang ⋅ Nan Zhong ⋅ Kede Ma
In Room: ExHall D Poster Location: Poster #275 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
End-to-End HOI Reconstruction Transformer with Graph-based Encoding Project Page ↗
Zhenrong Wang ⋅ Qi Zheng ⋅ Sihan Ma ⋅ Maosheng Ye ⋅ Yibing Zhan ⋅ Dongjiang Li
In Room: ExHall D Poster Location: Poster #147 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Disco4D: Disentangled 4D Human Generation and Animation from a Single Image Project Page ↗
Hui En Pang ⋅ Shuai Liu ⋅ Zhongang Cai ⋅ Lei Yang ⋅ Tianwei Zhang ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #14 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SketchVideo: Sketch-based Video Generation and Editing
Feng-Lin Liu ⋅ Hongbo Fu ⋅ Xintao Wang ⋅ Weicai Ye ⋅ Pengfei Wan ⋅ Di ZHANG ⋅ Lin Gao
In Room: ExHall D Poster Location: Poster #222 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PhysicsGen: Can Generative Models Learn from Images to Predict Complex Physical Relations? Project Page ↗
Martin Spitznagel ⋅ Jan Vaillant ⋅ Janis Keuper
In Room: ExHall D Poster Location: Poster #45 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Taste More, Taste Better: Diverse Data and Strong Model Boost Semi-Supervised Crowd Counting
Maochen Yang ⋅ Zekun Li ⋅ Jian Zhang ⋅ Lei Qi ⋅ Yinghuan Shi
In Room: ExHall D Poster Location: Poster #326 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SeCap: Self-Calibrating and Adaptive Prompts for Cross-view Person Re-Identification in Aerial-Ground Networks
Shining Wang ⋅ Yunlong Wang ⋅ Ruiqi Wu ⋅ Bingliang Jiao ⋅ Wenxuan Wang ⋅ Peng Wang
In Room: ExHall D Poster Location: Poster #102 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Leveraging Perturbation Robustness to Enhance Out-of-Distribution Detection Project Page ↗
Wenxi Chen ⋅ Raymond A. Yeh ⋅ Shaoshuai Mou ⋅ Yan Gu
In Room: ExHall D Poster Location: Poster #436 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Neural Motion Simulator Pushing the Limit of World Models in Reinforcement Learning Project Page ↗
Chenjie Hao ⋅ Weyl Lu ⋅ Yifan Xu ⋅ Yubei Chen
In Room: ExHall D Poster Location: Poster #138 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
V2V3D: View-to-View Denoised 3D Reconstruction for Light Field Microscopy
Jiayin Zhao ⋅ Zhenqi Fu ⋅ Tao Yu ⋅ Hui Qiao
In Room: ExHall D Poster Location: Poster #25 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Unified Framework for Heterogeneous Semi-supervised Learning
Marzi Heidari ⋅ Abdullah Alchihabi ⋅ Hao Yan ⋅ Yuhong Guo
In Room: ExHall D Poster Location: Poster #452 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels
Erjian Guo ⋅ Zhen Zhao ⋅ Zicheng Wang ⋅ Tong Chen ⋅ YUNYI LIU ⋅ Luping Zhou
In Room: ExHall D Poster Location: Poster #352 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Splatter-360: Generalizable 360 Gaussian Splatting for Wide-baseline Panoramic Images Project Page ↗
Zheng Chen ⋅ Chenming Wu ⋅ Zhelun Shen ⋅ Chen Zhao ⋅ Weicai Ye ⋅ Haocheng Feng ⋅ Errui Ding ⋅ Song-Hai Zhang
In Room: ExHall D Poster Location: Poster #51 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ShowMak3r: Compositional TV Show Reconstruction Project Page ↗
Sangmin Kim ⋅ Seunguk Do ⋅ Jaesik Park
In Room: ExHall D Poster Location: Poster #65 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MODA: Motion-Drift Augmentation for Inertial Human Motion Analysis
Yinghao Wu ⋅ Shihui Guo ⋅ Yipeng Qin
In Room: ExHall D Poster Location: Poster #153 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Learning to Filter Outlier Edges in Global SfM
Nicole Damblon ⋅ Marc Pollefeys ⋅ Daniel Barath
In Room: ExHall D Poster Location: Poster #87 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
UPME: An Unsupervised Peer Review Framework for Multimodal Large Language Model Evaluation Project Page ↗
Qihui Zhang ⋅ Munan Ning ⋅ Zheyuan Liu ⋅ Yanbo Wang ⋅ Jiayi Ye ⋅ Yue Huang ⋅ Shuo Yang ⋅ Xiao Chen ⋅ Yibing Song ⋅ Li Yuan
In Room: ExHall D Poster Location: Poster #362 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FSBench: A Figure Skating Benchmark for Advancing Artistic Sports Understanding
Rong Gao ⋅ Xin Liu ⋅ Zhuozhao Hu ⋅ Bohao Xing ⋅ Baiqiang XIA ⋅ Zitong YU ⋅ Heikki Kälviäinen
In Room: ExHall D Poster Location: Poster #281 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VideoDirector: Precise Video Editing via Text-to-Video Models
Yukun Wang ⋅ Longguang Wang ⋅ Zhiyuan Ma ⋅ Qibin Hu ⋅ Kai Xu ⋅ Yulan Guo
In Room: ExHall D Poster Location: Poster #232 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Understanding How Knowledge Evolves in Large Vision-Language Models
Sudong Wang ⋅ Yunjian Zhang ⋅ Yao Zhu ⋅ Jianing Li ⋅ Zizhe Wang ⋅ Yanwei Liu ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #355 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VISTA: Enhancing Long-Duration and High-Resolution Video Understanding by Video Spatiotemporal Augmentation
Weiming Ren ⋅ Huan Yang ⋅ Jie Min ⋅ Cong Wei ⋅ Wenhu Chen
In Room: ExHall D Poster Location: Poster #346 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OVO-Bench: How Far is Your Video-LLMs from Real-World Online Video Understanding?
Junbo Niu ⋅ Yifei Li ⋅ Ziyang Miao ⋅ Chunjiang Ge ⋅ Zhou Yuanhang ⋅ Qihao He ⋅ Xiaoyi Dong ⋅ Haodong Duan ⋅ Shuangrui Ding ⋅ Rui Qian ⋅ Pan Zhang ⋅ Yuhang Zang ⋅ Yuhang Cao ⋅ Conghui He ⋅ Jiaqi Wang
In Room: ExHall D Poster Location: Poster #297 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GA3CE: Unconstrained 3D Gaze Estimation with Gaze-Aware 3D Context Encoding Project Page ↗
Yuki Kawana ⋅ Shintaro Shiba ⋅ Quan Kong ⋅ Norimasa Kobori
In Room: ExHall D Poster Location: Poster #279 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CoMapGS: Covisibility Map-based Gaussian Splatting for Sparse Novel View Synthesis Project Page ↗
Youngkyoon Jang ⋅ Eduardo Pérez-Pellitero
In Room: ExHall D Poster Location: Poster #61 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification
Xianwei Zhuang ⋅ Zhihong Zhu ⋅ Yuxin Xie ⋅ Liming Liang ⋅ Yuexian Zou
In Room: ExHall D Poster Location: Poster #384 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SPARC: Score Prompting and Adaptive Fusion for Zero-Shot Multi-Label Recognition in Vision-Language Models Project Page ↗
Kevin Miller ⋅ Aditya Gangrade ⋅ Samarth Mishra ⋅ Kate Saenko ⋅ Venkatesh Saligrama
In Room: ExHall D Poster Location: Poster #398 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Noise-Consistent Siamese-Diffusion for Medical Image Synthesis and Segmentation Project Page ↗
Kunpeng Qiu ⋅ Zhiqiang Gao ⋅ Zhiying Zhou ⋅ MINGJIE SUN ⋅ Yongxin Guo
In Room: ExHall D Poster Location: Poster #481 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DefectFill: Realistic Defect Generation with Inpainting Diffusion Model for Visual Inspection
Jaewoo Song ⋅ Daemin Park ⋅ Kanghyun Baek ⋅ Sangyub Lee ⋅ Jooyoung Choi ⋅ Eunji Kim ⋅ Sungroh Yoon
In Room: ExHall D Poster Location: Poster #280 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
FedMIA: An Effective Membership Inference Attack Exploiting "All for One" Principle in Federated Learning
Gongxi Zhu ⋅ Donghao Li ⋅ Hanlin Gu ⋅ Yuan Yao ⋅ Lixin Fan ⋅ Yuxing Han
In Room: ExHall D Poster Location: Poster #460 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DPFlow: Adaptive Optical Flow Estimation with a Dual-Pyramid Framework Project Page ↗
Henrique Morimitsu ⋅ Xiaobin Zhu ⋅ Roberto M. Cesar Jr ⋅ Xiangyang Ji ⋅ Xu-Cheng Yin
In Room: ExHall D Poster Location: Poster #191 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Ferret: An Efficient Online Continual Learning Framework under Varying Memory Constraints
Yuhao Zhou ⋅ Yuxin Tian ⋅ Jindi Lv ⋅ Mingjia Shi ⋅ Yuanxi Li ⋅ Qing Ye ⋅ Shuhao Zhang ⋅ Jiancheng Lv
In Room: ExHall D Poster Location: Poster #448 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Spatiotemporal Skip Guidance for Enhanced Video Diffusion Sampling Project Page ↗
Junha Hyung ⋅ Kinam Kim ⋅ Susung Hong ⋅ Min-Jung Kim ⋅ Jaegul Choo
In Room: ExHall D Poster Location: Poster #34 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation
Ying Jin ⋅ Jinlong Peng ⋅ Qingdong He ⋅ Teng Hu ⋅ Jiafu Wu ⋅ Hao Chen ⋅ Haoxuan Wang ⋅ wenbing zhu ⋅ Mingmin Chi ⋅ Jun Liu ⋅ Yabiao Wang
In Room: ExHall D Poster Location: Poster #409 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Semantic and Sequential Alignment for Referring Video Object Segmentation
Feiyu Pan ⋅ Hao Fang ⋅ Fangkai Li ⋅ Yanyu Xu ⋅ Yawei Li ⋅ Luca Benini ⋅ Xiankai Lu
In Room: ExHall D Poster Location: Poster #312 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ODE: Open-Set Evaluation of Hallucinations in Multimodal Large Language Models
Yahan Tu ⋅ Rui Hu ⋅ Jitao Sang
In Room: ExHall D Poster Location: Poster #384 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Self-Supervised Learning for Color Spike Camera Reconstruction
Yanchen Dong ⋅ Ruiqin Xiong ⋅ Xiaopeng Fan ⋅ Zhaofei Yu ⋅ Yonghong Tian ⋅ Tiejun Huang
In Room: ExHall D Poster Location: Poster #76 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
From Elements to Design: A Layered Approach for Automatic Graphic Design Composition
Jiawei Lin ⋅ Shizhao Sun ⋅ Danqing Huang ⋅ Ting Liu ⋅ Ji Li ⋅ Jiang Bian
In Room: ExHall D Poster Location: Poster #263 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Masking meets Supervision: A Strong Learning Alliance
Byeongho Heo ⋅ Taekyung Kim ⋅ Sangdoo Yun ⋅ Dongyoon Han
In Room: ExHall D Poster Location: Poster #442 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DI-PCG: Diffusion-based Efficient Inverse Procedural Content Generation for High-quality 3D Asset Creation
Wang Zhao ⋅ Yan-Pei Cao ⋅ Jiale Xu ⋅ Yue-Jiang Dong ⋅ Ying Shan
In Room: ExHall D Poster Location: Poster #39 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Are Spatial-Temporal Graph Convolution Networks for Human Action Recognition Over-Parameterized?
Jianyang Xie ⋅ Yitian Zhao ⋅ Yanda Meng ⋅ He Zhao ⋅ Anh Nguyen ⋅ Yalin Zheng
In Room: ExHall D Poster Location: Poster #314 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DA-VPT: Semantic-Guided Visual Prompt Tuning for Vision Transformers
Li Ren ⋅ Chen Chen ⋅ Liqiang Wang ⋅ Kien A. Hua
In Room: ExHall D Poster Location: Poster #402 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MambaIRv2: Attentive State Space Restoration
Hang Guo ⋅ Yong Guo ⋅ Yaohua Zha ⋅ Yulun Zhang ⋅ Wenbo Li ⋅ Tao Dai ⋅ Shu-Tao Xia ⋅ Yawei Li
In Room: ExHall D Poster Location: Poster #186 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Towards Lossless Implicit Neural Representation via Bit Plane Decomposition Project Page ↗
Woo Kyoung Han ⋅ Byeonghun Lee ⋅ Hyunmin Cho ⋅ Sunghoon Im ⋅ Kyong Hwan Jin
In Room: ExHall D Poster Location: Poster #198 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CoMatcher: Multi-View Collaborative Feature Matching
Jintao Zhang ⋅ Zimin Xia ⋅ Mingyue Dong ⋅ Shuhan Shen ⋅ Linwei Yue ⋅ Xianwei Zheng
In Room: ExHall D Poster Location: Poster #88 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Spectral State Space Model for Rotation-Invariant Visual Representation Learning
Sahar Dastani ⋅ Ali Bahri ⋅ Moslem Yazdanpanah ⋅ Mehrdad Noori ⋅ David OSOWIECHI ⋅ Gustavo Vargas Hakim ⋅ Farzad Beizaee ⋅ Milad Cheraghalikhani ⋅ Arnab Mondal ⋅ Herve Lombaert ⋅ Christian Desrosiers
In Room: ExHall D Poster Location: Poster #274 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
BlueLM-V-3B: Algorithm and System Co-Design for Multimodal Large Language Models on Mobile Devices
Xudong LU ⋅ Yinghao Chen ⋅ chencheng Chen ⋅ Hui Tan ⋅ Boheng Chen ⋅ yina xie ⋅ Rui Hu ⋅ Guanxin tan ⋅ Renshou Wu ⋅ Yan Hu ⋅ Yi Zeng ⋅ Lei Wu ⋅ Liuyang Bian ⋅ Zhaoxiong Wang ⋅ Long Liu ⋅ Yanzhou Yang ⋅ Han Xiao ⋅ Aojun Zhou ⋅ Yafei Wen ⋅ Xiaoxin Chen ⋅ Shuai Ren ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #379 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Taming Teacher Forcing for Masked Autoregressive Video Generation
Deyu Zhou ⋅ Quan Sun ⋅ Yuang Peng ⋅ Kun Yan ⋅ Runpei Dong ⋅ Duomin Wang ⋅ Zheng Ge ⋅ Nan Duan ⋅ Xiangyu Zhang
In Room: ExHall D Poster Location: Poster #192 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SAR3D: Autoregressive 3D Object Generation and Understanding via Multi-scale 3D VQVAE Project Page ↗
YONGWEI CHEN ⋅ Yushi Lan ⋅ Shangchen Zhou ⋅ Tengfei Wang ⋅ Xingang Pan
In Room: ExHall D Poster Location: Poster #210 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Sharp-It: A Multi-view to Multi-view Diffusion Model for 3D Synthesis and Manipulation Project Page ↗
Yiftach Edelstein ⋅ Or Patashnik ⋅ Dana Cohen-Bar ⋅ Lihi Zelnik-Manor
In Room: ExHall D Poster Location: Poster #39 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
URWKV: Unified RWKV Model with Multi-state Perspective for Low-light Image Restoration
Rui Xu ⋅ Yuzhen Niu ⋅ Yuezhou Li ⋅ Huangbiao Xu ⋅ Wenxi Liu ⋅ Yuzhong Chen
In Room: ExHall D Poster Location: Poster #21 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift
Siyuan Liang ⋅ Jiawei Liang ⋅ Tianyu Pang ⋅ Chao Du ⋅ Aishan Liu ⋅ Mingli Zhu ⋅ Xiaochun Cao ⋅ Dacheng Tao
In Room: ExHall D Poster Location: Poster #391 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Condensing Action Segmentation Datasets via Generative Network Inversion Project Page ↗
Guodong Ding ⋅ Rongyu Chen ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #184 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Shining Yourself: High-Fidelity Ornaments Virtual Try-on with Diffusion Model
Yingmao Miao ⋅ Zhanpeng Huang ⋅ Rui Han ⋅ Zibin Wang ⋅ Chenhao Lin ⋅ Chao Shen
In Room: ExHall D Poster Location: Poster #18 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Make It Count: Text-to-Image Generation with an Accurate Number of Objects
Lital Binyamin ⋅ Yoad Tewel ⋅ Hilit Segev ⋅ Eran Hirsch ⋅ Royi Rassin ⋅ Gal Chechik
In Room: ExHall D Poster Location: Poster #247 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
AnomalyNCD: Towards Novel Anomaly Class Discovery in Industrial Scenarios Project Page ↗
Ziming Huang ⋅ Xurui Li ⋅ Haotian Liu ⋅ Feng Xue ⋅ Yuzhe Wang ⋅ Yu Zhou
In Room: ExHall D Poster Location: Poster #439 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Task-Specific Gradient Adaptation for Few-Shot One-Class Classification Project Page ↗
Yunlong Li ⋅ Xiabi Liu ⋅ Liyuan Pan ⋅ Yuchen Ren
In Room: ExHall D Poster Location: Poster #422 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TraF-Align: Trajectory-aware Feature Alignment for Asynchronous Multi-agent Perception Project Page ↗
Zhiying Song ⋅ Lei Yang ⋅ Fuxi Wen ⋅ Jun Li
In Room: ExHall D Poster Location: Poster #135 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DreamCache: Finetuning-Free Lightweight Personalized Image Generation via Feature Caching
Emanuele Aiello ⋅ Umberto Michieli ⋅ Diego Valsesia ⋅ Mete Ozay ⋅ Enrico Magli
In Room: ExHall D Poster Location: Poster #174 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
3D Gaussian Inpainting with Depth-Guided Cross-View Consistency Project Page ↗
Sheng-Yu Huang ⋅ Zi-Ting Chou ⋅ Yu-Chiang Frank Wang
In Room: ExHall D Poster Location: Poster #52 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Synthetic Prior for Few-Shot Drivable Head Avatar Inversion Project Page ↗
Wojciech Zielonka ⋅ Stephan J. Garbin ⋅ Alexandros Lattas ⋅ George Kopanas ⋅ Paulo Gotardo ⋅ Thabo Beeler ⋅ Justus Thies ⋅ Timo Bolkart
In Room: ExHall D Poster Location: Poster #8 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Focusing on Tracks for Online Multi-Object Tracking Project Page ↗
Kyujin Shim ⋅ Kangwook Ko ⋅ YuJin Yang ⋅ Changick Kim
In Room: ExHall D Poster Location: Poster #100 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Floxels: Fast Unsupervised Voxel Based Scene Flow Estimation
David T. Hoffmann ⋅ Syed Haseeb Raza ⋅ Hanqiu Jiang ⋅ Steffen Klingenhoefer ⋅ Denis Tananaev ⋅ Martin Meinke
In Room: ExHall D Poster Location: Poster #122 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Identity-preserving Distillation Sampling by Fixed-Point Iterator Project Page ↗
SeonHwa Kim ⋅ Jiwon Kim ⋅ Soobin Park ⋅ Donghoon Ahn ⋅ Jiwon Kang ⋅ Seungryong Kim ⋅ Kyong Hwan Jin ⋅ Eunju Cha
In Room: ExHall D Poster Location: Poster #44 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VladVA: Discriminative Fine-tuning of LVLMs
Yassine Ouali ⋅ Adrian Bulat ⋅ ALEXANDROS XENOS ⋅ Anestis Zaganidis ⋅ Ioannis Maniadis Metaxas ⋅ Brais Martinez ⋅ Georgios Tzimiropoulos
In Room: ExHall D Poster Location: Poster #375 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AlignMamba: Enhancing Multimodal Mamba with Local and Global Cross-modal Alignment
Yan Li ⋅ Yifei Xing ⋅ Xiangyuan Lan ⋅ Xin Li ⋅ Haifeng Chen ⋅ Dongmei Jiang
In Room: ExHall D Poster Location: Poster #358 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VideoComp: Advancing Fine-Grained Compositional and Temporal Alignment in Video-Text Models
Dahun Kim ⋅ AJ Piergiovanni ⋅ Ganesh Satish Mallya ⋅ Anelia Angelova
In Room: ExHall D Poster Location: Poster #279 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MICAS: Multi-grained In-Context Adaptive Sampling for 3D Point Cloud Processing
Feifei Shao ⋅ Ping Liu ⋅ Zhao Wang ⋅ Yawei Luo ⋅ Hongwei Wang ⋅ Jun Xiao
In Room: ExHall D Poster Location: Poster #119 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Can Text-to-Video Generation help Video-Language Alignment? Project Page ↗
Luca Zanella ⋅ Massimiliano Mancini ⋅ Willi Menapace ⋅ Sergey Tulyakov ⋅ Yiming Wang ⋅ Elisa Ricci
In Room: ExHall D Poster Location: Poster #294 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ColabSfM: Collaborative Structure-from-Motion by Point Cloud Registration
Johan Edstedt ⋅ André Mateus ⋅ Alberto Jaenal
In Room: ExHall D Poster Location: Poster #115 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RoadSocial: A Diverse VideoQA Dataset and Benchmark for Road Event Understanding from Social Video Narratives Project Page ↗
Chirag Parikh ⋅ Deepti Rawat ⋅ Rakshitha R. T. ⋅ Tathagata Ghosh ⋅ Ravi Kiran Sarvadevabhatla
In Room: ExHall D Poster Location: Poster #306 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Do We Always Need the Simplicity Bias? Looking for Optimal Inductive Biases in the Wild
Damien Teney ⋅ Liangze Jiang ⋅ Florin Gogianu ⋅ Ehsan Abbasnejad
In Room: ExHall D Poster Location: Poster #396 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MangaNinja: Line Art Colorization with Precise Reference Following
Zhiheng Liu ⋅ Ka Leong Cheng ⋅ Xi Chen ⋅ Jie Xiao ⋅ Hao Ouyang ⋅ Kai Zhu ⋅ Yu Liu ⋅ Yujun Shen ⋅ Qifeng Chen ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #21 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Nonisotropic Gaussian Diffusion for Realistic 3D Human Motion Prediction Project Page ↗
Cecilia Curreli ⋅ Dominik Muhle ⋅ Abhishek Saroha ⋅ Zhenzhang Ye ⋅ Riccardo Marin ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #158 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LookCloser: Frequency-aware Radiance Field for Tiny-Detail Scene Project Page ↗
Xiaoyu Zhang ⋅ Weihong Pan ⋅ Chong Bao ⋅ Xiyu Zhang ⋅ Xiaojun Xiang ⋅ Hanqing Jiang ⋅ Hujun Bao
In Room: ExHall D Poster Location: Poster #26 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PICO: Reconstructing 3D People In Contact with Objects Project Page ↗
Alpár Cseke ⋅ Shashank Tripathi ⋅ Sai Kumar Dwivedi ⋅ Arjun Lakshmipathy ⋅ Agniv Chatterjee ⋅ Michael J. Black ⋅ Dimitrios Tzionas
In Room: ExHall D Poster Location: Poster #150 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TriTex: Learning Texture from a Single Mesh via Triplane Semantic Features
Dana Cohen-Bar ⋅ Daniel Cohen-Or ⋅ Gal Chechik ⋅ Yoni Kasten
In Room: ExHall D Poster Location: Poster #34 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
Yifei Zhang ⋅ Chang Liu ⋅ Jin Wei ⋅ Xiaomeng Yang ⋅ Yu ZHOU ⋅ Can Ma ⋅ Xiangyang Ji
In Room: ExHall D Poster Location: Poster #376 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Scaling up Image Segmentation across Data and Tasks
Pei Wang ⋅ Zhaowei Cai ⋅ Hao Yang ⋅ Ashwin Swaminathan ⋅ R. Manmatha ⋅ Stefano Soatto
In Room: ExHall D Poster Location: Poster #422 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MotionStone: Decoupled Motion Intensity Modulation with Diffusion Transformer for Image-to-Video Generation
Shuwei Shi ⋅ Biao Gong ⋅ Xi Chen ⋅ DanDan Zheng ⋅ Shuai Tan ⋅ Zizheng Yang ⋅ Yuyuan Li ⋅ Jingwen He ⋅ Kecheng Zheng ⋅ Jingdong Chen ⋅ Ming Yang ⋅ Yinqiang Zheng
In Room: ExHall D Poster Location: Poster #172 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Take the Bull by the Horns: Learning to Segment Hard Samples
Yuan Guo ⋅ Jingyu Kong ⋅ Yu Wang ⋅ Yuping Duan
In Room: ExHall D Poster Location: Poster #478 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CARE Transformer: Mobile-Friendly Linear Visual Transformer via Decoupled Dual Interaction
Yuan Zhou ⋅ Qingshan Xu ⋅ Jiequan Cui ⋅ Junbao Zhou ⋅ Jing Zhang ⋅ Richang Hong ⋅ Hanwang Zhang
In Room: ExHall D Poster Location: Poster #413 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Schedule On the Fly: Diffusion Time Prediction for Faster and Better Image Generation
Zilyu Ye ⋅ Zhiyang Chen ⋅ Tiancheng Li ⋅ Zemin Huang ⋅ Weijian Luo ⋅ Guo-Jun Qi
In Room: ExHall D Poster Location: Poster #225 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
All-directional Disparity Estimation for Real-world QPD Images
Hongtao Yu ⋅ Shaohui Song ⋅ Lihu Sun ⋅ Wenkai Su ⋅ Xiaodong Yang ⋅ Chengming Liu
In Room: ExHall D Poster Location: Poster #75 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LC-Mamba: Local and Continuous Mamba with Shifted Windows for Frame Interpolation Project Page ↗
Min Wu Jeong ⋅ Chae Eun Rhee
In Room: ExHall D Poster Location: Poster #178 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Deterministic-to-Stochastic Diverse Latent Feature Mapping for Human Motion Synthesis
Hua Yu ⋅ Weiming Liu ⋅ Gui Xu ⋅ Yaqing Hou ⋅ Yew-Soon Ong ⋅ Qiang Zhang
In Room: ExHall D Poster Location: Poster #158 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GPAvatar: High-fidelity Head Avatars by Learning Efficient Gaussian Projections
Weiqi Feng ⋅ Dong Han ⋅ Zekang Zhou ⋅ Shunkai Li ⋅ Xiaoqiang Liu ⋅ Pengfei Wan ⋅ Di ZHANG ⋅ Miao Wang
In Room: ExHall D Poster Location: Poster #8 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PIAD: Pose and Illumination agnostic Anomaly Detection Project Page ↗
Kaichen Yang ⋅ Junjie Cao ⋅ Zeyu Bai ⋅ Zhixun Su ⋅ Andrea Tagliasacchi
In Room: ExHall D Poster Location: Poster #437 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VISTREAM: Improving Computation Efficiency of Visual Streaming Perception via Law-of-Charge-Conservation Inspired Spiking Neural Network
Kang You ⋅ Ziling Wei ⋅ Jing Yan ⋅ Boning Zhang ⋅ Qinghai Guo ⋅ Yaoyu Zhang ⋅ Zhezhi He
In Room: ExHall D Poster Location: Poster #327 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CAV-MAE Sync: Improving Contrastive Audio-Visual Mask Autoencoders via Fine-Grained Alignment
Edson Araujo ⋅ Andrew Rouditchenko ⋅ Yuan Gong ⋅ Saurabhchand Bhati ⋅ Samuel Thomas ⋅ Brian Kingsbury ⋅ Leonid Karlinsky ⋅ Rogerio Feris ⋅ James Glass ⋅ Hilde Kuehne
In Room: ExHall D Poster Location: Poster #287 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
COBRA: COmBinatorial Retrieval Augmentation for Few-Shot Adaptation
Arnav Mohanty Das ⋅ Gantavya Bhatt ⋅ Lilly Kumari ⋅ Sahil Verma ⋅ Jeff Bilmes
In Room: ExHall D Poster Location: Poster #450 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Dyn-HaMR: Recovering 4D Interacting Hand Motion from a Dynamic Camera Project Page ↗
Zhengdi Yu ⋅ Stefanos Zafeiriou ⋅ Tolga Birdal
In Room: ExHall D Poster Location: Poster #148 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MFogHub: Bridging Multi-Regional and Multi-Satellite Data for Global Marine Fog Detection and Forecasting
Mengqiu XU ⋅ Kaixin Chen ⋅ Heng Guo ⋅ Yixiang Huang ⋅ Ming Wu ⋅ Zhenwei Shi ⋅ Chuang Zhang ⋅ Jun Guo
In Room: ExHall D Poster Location: Poster #190 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dual Consolidation for Pre-Trained Model-Based Domain-Incremental Learning
Da-Wei Zhou ⋅ Zi-Wen Cai ⋅ Han-Jia Ye ⋅ Lijun Zhang ⋅ De-Chuan Zhan
In Room: ExHall D Poster Location: Poster #451 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EmoEdit: Evoking Emotions through Image Manipulation Project Page ↗
Jingyuan Yang ⋅ Jiawei Feng ⋅ Weibin Luo ⋅ Dani Lischinski ⋅ Daniel Cohen-Or ⋅ Hui Huang
In Room: ExHall D Poster Location: Poster #350 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MVPaint: Synchronized Multi-View Diffusion for Painting Anything 3D Project Page ↗
Wei Cheng ⋅ Juncheng Mu ⋅ Xianfang Zeng ⋅ Xin Chen ⋅ Anqi Pang ⋅ Chi Zhang ⋅ Zhibin Wang ⋅ Bin Fu ⋅ Gang Yu ⋅ Ziwei Liu ⋅ Liang Pan
In Room: ExHall D Poster Location: Poster #39 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PIDSR: Complementary Polarized Image Demosaicing and Super-Resolution Project Page ↗
Shuangfan Zhou ⋅ Chu Zhou ⋅ Youwei Lyu ⋅ Heng Guo ⋅ Zhanyu Ma ⋅ Boxin Shi ⋅ Imari Sato
In Room: ExHall D Poster Location: Poster #21 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Video-Bench: Human-Aligned Video Generation Benchmark
Hui Han ⋅ Siyuan Li ⋅ Jiaqi Chen ⋅ Yiwen Yuan ⋅ Yuling Wu ⋅ Yufan Deng ⋅ Chak Tou Leong ⋅ Hanwen Du ⋅ Junchen Fu ⋅ Youhua Li ⋅ Jie Zhang ⋅ Chi Zhang ⋅ Li-jia Li ⋅ Yongxin Ni
In Room: ExHall D Poster Location: Poster #293 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PMNI: Pose-free Multi-view Normal Integration for Reflective and Textureless Surface Reconstruction
Mingzhi Pei ⋅ Xu Cao ⋅ Xiangyi Wang ⋅ Heng Guo ⋅ Zhanyu Ma
In Room: ExHall D Poster Location: Poster #66 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MergeVQ: A Unified Framework for Visual Generation and Representation with Disentangled Token Merging and Quantization Project Page ↗
Siyuan Li ⋅ Luyuan Zhang ⋅ Zedong Wang ⋅ Juanxi Tian ⋅ Cheng Tan ⋅ Zicheng Liu ⋅ Chang Yu ⋅ Qingsong Xie ⋅ Haonan Lu ⋅ Haoqian Wang ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #373 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Meta-Learning Hyperparameters for Parameter Efficient Fine-Tuning
Zichen Tian ⋅ Yaoyao Liu ⋅ Qianru Sun
In Room: ExHall D Poster Location: Poster #188 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EgoPressure: A Dataset for Hand Pressure and Pose Estimation in Egocentric Vision Project Page ↗
Yiming Zhao ⋅ Taein Kwon ⋅ Paul Streli ⋅ Marc Pollefeys ⋅ Christian Holz
In Room: ExHall D Poster Location: Poster #149 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Efficient Test-time Adaptive Object Detection via Sensitivity-Guided Pruning
Kunyu Wang ⋅ Xueyang Fu ⋅ Xin Lu ⋅ Chengjie Ge ⋅ Chengzhi Cao ⋅ Wei Zhai ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #419 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning Project Page ↗
Xin Wen ⋅ Bingchen Zhao ⋅ Yilun Chen ⋅ Jiangmiao Pang ⋅ Xiaojuan Qi
In Room: ExHall D Poster Location: Poster #144 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
TAMT: Temporal-Aware Model Tuning for Cross-Domain Few-Shot Action Recognition Project Page ↗
yilong wang ⋅ Zilin Gao ⋅ Qilong Wang ⋅ Zhaofeng Chen ⋅ Peihua Li ⋅ Qinghua Hu
In Room: ExHall D Poster Location: Poster #313 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
BioX-CPath: Biologically-driven Explainable Diagnostics for Multistain IHC Computational Pathology Project Page ↗
Amaya Gallagher-Syed ⋅ Henry Senior ⋅ Omnia Alwazzan ⋅ Elena Pontarini ⋅ Michele Bombardieri ⋅ Costantino Pitzalis ⋅ Myles J. Lewis ⋅ Michael R Barnes ⋅ Luca Rossi ⋅ Greg Slabaugh
In Room: ExHall D Poster Location: Poster #476 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ARKit LabelMaker: A New Scale for Indoor 3D Scene Understanding Project Page ↗
Guangda Ji ⋅ Silvan Weder ⋅ Francis Engelmann ⋅ Marc Pollefeys ⋅ Hermann Blum
In Room: ExHall D Poster Location: Poster #406 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Dr. Splat: Directly Referring 3D Gaussian Splatting via Direct Language Embedding Registration Project Page ↗
JUNSEONG KIM ⋅ GeonU Kim ⋅ Kim Yu-Ji ⋅ Yu-Chiang Frank Wang ⋅ Jaesung Choe ⋅ Tae-Hyun Oh
In Room: ExHall D Poster Location: Poster #334 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mesh Mamba: A Unified State Space Model for Saliency Prediction in Non-Textured and Textured Meshes
Kaiwei Zhang ⋅ Dandan Zhu ⋅ Xiongkuo Min ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #35 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Wavelet and Prototype Augmented Query-based Transformer for Pixel-level Surface Defect Detection
Feng Yan ⋅ Xiaoheng Jiang ⋅ Yang Lu ⋅ Jiale Cao ⋅ Dong Chen ⋅ Mingliang Xu
In Room: ExHall D Poster Location: Poster #272 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
Wang Jiarui ⋅ Huiyu Duan ⋅ Guangtao Zhai ⋅ Juntong Wang ⋅ Xiongkuo Min
In Room: ExHall D Poster Location: Poster #294 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GauCho: Gaussian Distributions with Cholesky Decomposition for Oriented Object Detection Project Page ↗
Jeffri Erwin Murrugarra Llerena ⋅ José Henrique Marques ⋅ Claudio Jung
In Room: ExHall D Poster Location: Poster #326 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Alignment, Mining and Fusion: Representation Alignment with Hard Negative Mining and Selective Knowledge Fusion for Medical Visual Question Answering
Yuanhao Zou ⋅ Zhaozheng Yin
In Room: ExHall D Poster Location: Poster #332 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Q-Bench-Video: Benchmark the Video Quality Understanding of LMMs
Zicheng Zhang ⋅ Ziheng Jia ⋅ Haoning Wu ⋅ Chunyi Li ⋅ Zijian Chen ⋅ Yingjie Zhou ⋅ Wei Sun ⋅ Xiaohong Liu ⋅ Xiongkuo Min ⋅ Weisi Lin ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #293 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Progressive Correspondence Regenerator for Robust 3D Registration
Guiyu Zhao ⋅ Sheng Ao ⋅ Ye Zhang ⋅ Kai Xu ⋅ Yulan Guo
In Room: ExHall D Poster Location: Poster #97 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Reference-Based 3D-Aware Image Editing with Triplanes Project Page ↗
Bahri Batuhan Bilecen ⋅ Yiğit Yalın ⋅ Ning Yu ⋅ Aysegul Dundar
In Room: ExHall D Poster Location: Poster #44 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Decompositional Neural Scene Reconstruction with Generative Diffusion Prior Project Page ↗
Junfeng Ni ⋅ Yu Liu ⋅ Ruijie Lu ⋅ ZiRui Zhou ⋅ Song-Chun Zhu ⋅ Yixin Chen ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #55 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Unlocking Generalization Power in LiDAR Point Cloud Registration Project Page ↗
Zhenxuan Zeng ⋅ Qiao Wu ⋅ Xiyu Zhang ⋅ Lin Yuanbo Wu ⋅ Pei An ⋅ Jiaqi Yang ⋅ Ji Wang ⋅ Peng Wang
In Room: ExHall D Poster Location: Poster #114 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Distribution Prototype Diffusion Learning for Open-set Supervised Anomaly Detection
Fuyun Wang ⋅ Tong Zhang ⋅ Yuanzhi Wang ⋅ Yide Qiu ⋅ Xin Liu ⋅ Xu Guo ⋅ Zhen Cui
In Room: ExHall D Poster Location: Poster #439 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Not Just Text: Uncovering Vision Modality Typographic Threats in Image Generation Models
Hao Cheng ⋅ Erjia Xiao ⋅ Jiayan Yang ⋅ Jiahang Cao ⋅ Qiang Zhang ⋅ Jize Zhang ⋅ Kaidi Xu ⋅ Jindong Gu ⋅ Renjing Xu
In Room: ExHall D Poster Location: Poster #271 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
3DGUT: Enabling Distorted Cameras and Secondary Rays in Gaussian Splatting Project Page ↗
Qi Wu ⋅ Janick Martinez Esturo ⋅ Ashkan Mirzaei ⋅ Nicolas Moënne-Loccoz ⋅ Žan Gojčič
In Room: ExHall D Poster Location: Poster #28 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering Project Page ↗
Sheng Zhou ⋅ Junbin Xiao ⋅ Qingyun Li ⋅ Yicong Li ⋅ Xun Yang ⋅ Dan Guo ⋅ Meng Wang ⋅ Tat-seng Chua ⋅ Angela Yao
In Room: ExHall D Poster Location: Poster #305 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Teaching Large Language Models to Regress Accurate Image Quality Scores Using Score Distribution
Zhiyuan You ⋅ Xin Cai ⋅ Jinjin Gu ⋅ Tianfan Xue ⋅ Chao Dong
In Room: ExHall D Poster Location: Poster #366 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
v-CLR: View-Consistent Learning for Open-World Instance Segmentation
Chang-Bin Zhang ⋅ Jinhong Ni ⋅ Yujie Zhong ⋅ Kai Han
In Room: ExHall D Poster Location: Poster #429 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Lifting the Veil on Visual Information Flow in MLLMs: Unlocking Pathways to Faster Inference
Hao Yin ⋅ Guangzong Si ⋅ Zilei Wang
In Room: ExHall D Poster Location: Poster #382 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
V^2Dial: Unification of Video and Visual Dialog via Multimodal Experts Project Page ↗
Adnen Abdessaied ⋅ Anna Rohrbach ⋅ Marcus Rohrbach ⋅ Andreas Bulling
In Room: ExHall D Poster Location: Poster #312 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Speedy-Splat: Fast 3D Gaussian Splatting with Sparse Pixels and Sparse Primitives Project Page ↗
Alex Hanson ⋅ Allen Tu ⋅ Geng Lin ⋅ Vasu Singla ⋅ Matthias Zwicker ⋅ Tom Goldstein
In Room: ExHall D Poster Location: Poster #46 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Mamba-Reg: Vision Mamba Also Needs Registers
Feng Wang ⋅ Jiahao Wang ⋅ Sucheng Ren ⋅ Guoyizhe Wei ⋅ Jieru Mei ⋅ Wei Shao ⋅ Yuyin Zhou ⋅ Alan L. Yuille ⋅ Cihang Xie
In Room: ExHall D Poster Location: Poster #411 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
It’s a (Blind) Match! Towards Vision-Language Correspondence without Parallel Data
Dominik Schnaus ⋅ Nikita Araslanov ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #377 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OmniMMI: A Comprehensive Multi-modal Interaction Benchmark in Streaming Video Contexts
Yuxuan Wang ⋅ Yueqian Wang ⋅ Bo Chen ⋅ Tong Wu ⋅ Dongyan Zhao ⋅ Zilong Zheng
In Room: ExHall D Poster Location: Poster #299 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AirRoom: Objects Matter in Room Reidentification Project Page ↗
Runmao Yao ⋅ Yi Du ⋅ Zhuoqun Chen ⋅ Haoze Zheng ⋅ Chen Wang
In Room: ExHall D Poster Location: Poster #113 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Pixel-level and Semantic-level Adjustable Super-resolution: A Dual-LoRA Approach
Lingchen Sun ⋅ Rongyuan Wu ⋅ Zhiyuan Ma ⋅ Shuaizheng Liu ⋅ Qiaosi Yi ⋅ Lei Zhang
In Room: ExHall D Poster Location: Poster #204 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SuperPC: A Single Diffusion Model for Point Cloud Completion, Upsampling, Denoising, and Colorization Project Page ↗
Yi Du ⋅ Zhipeng Zhao ⋅ Shaoshu Su ⋅ Sharath Golluri ⋅ Haoze Zheng ⋅ Runmao Yao ⋅ Chen Wang
In Room: ExHall D Poster Location: Poster #109 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Interpretable Image Classification via Non-parametric Part Prototype Learning
Zhijie Zhu ⋅ Lei Fan ⋅ Maurice Pagnucco ⋅ Yang Song
In Room: ExHall D Poster Location: Poster #418 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Let Samples Speak: Mitigating Spurious Correlation by Exploiting the Clusterness of Samples Project Page ↗
WEIWEI LI ⋅ Junzhuo Liu ⋅ Yuanyuan Ren ⋅ Yuchen Zheng ⋅ Yahao Liu ⋅ Wen Li
In Room: ExHall D Poster Location: Poster #463 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mr. DETR: Instructive Multi-Route Training for Detection Transformers
Chang-Bin Zhang ⋅ Yujie Zhong ⋅ Kai Han
In Room: ExHall D Poster Location: Poster #434 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
Davide Berasi ⋅ Matteo Farina ⋅ Massimiliano Mancini ⋅ Elisa Ricci ⋅ Nicola Strisciuglio
In Room: ExHall D Poster Location: Poster #371 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Prototype-Based Image Prompting for Weakly Supervised Histopathological Image Segmentation
Qingchen Tang ⋅ Lei Fan ⋅ Maurice Pagnucco ⋅ Yang Song
In Room: ExHall D Poster Location: Poster #395 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
HOP: Heterogeneous Topology-based Multimodal Entanglement for Co-Speech Gesture Generation
Hongye Cheng ⋅ Tianyu Wang ⋅ guangsi shi ⋅ Zexing Zhao ⋅ Yanwei Fu
In Room: ExHall D Poster Location: Poster #69 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Minority-Focused Text-to-Image Generation via Prompt Optimization
Soobin Um ⋅ Jong Chul Ye
In Room: ExHall D Poster Location: Poster #243 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Less Attention is More: Prompt Transformer for Generalized Category Discovery
Wei Zhang ⋅ Baopeng Zhang ⋅ Zhu Teng ⋅ Wenxin Luo ⋅ Junnan Zou ⋅ Jianping Fan
In Room: ExHall D Poster Location: Poster #400 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Imputation-free and Alignment-free: Incomplete Multi-view Clustering Driven by Consensus Semantic Learning
yuzhuo dai ⋅ Jiaqi Jin ⋅ Zhibin Dong ⋅ Siwei Wang ⋅ Xinwang Liu ⋅ En Zhu ⋅ Xihong Yang ⋅ Xinbiao Gan ⋅ Yu Feng
In Room: ExHall D Poster Location: Poster #469 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Sensitivity-Aware Efficient Fine-Tuning via Compact Dynamic-Rank Adaptation
Tianran Chen ⋅ Jiarui Chen ⋅ Baoquan Zhang ⋅ Zhehao Yu ⋅ Shidong Chen ⋅ Rui Ye ⋅ Xutao Li ⋅ Yunming Ye
In Room: ExHall D Poster Location: Poster #408 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MoDec-GS: Global-to-Local Motion Decomposition and Temporal Interval Adjustment for Compact Dynamic 3D Gaussian Splatting
Sangwoon Kwak ⋅ Joonsoo Kim ⋅ Jun Young Jeong ⋅ Won-Sik Cheong ⋅ Jihyong Oh ⋅ Munchurl Kim
In Room: ExHall D Poster Location: Poster #65 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CADRef: Robust Out-of-Distribution Detection via Class-Aware Decoupled Relative Feature Leveraging
Zhiwei Ling ⋅ Yachen Chang ⋅ Hailiang Zhao ⋅ Xinkui Zhao ⋅ Kingsum Chow ⋅ Shuiguang Deng
In Room: ExHall D Poster Location: Poster #459 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DaCapo: Score Distillation as Stacked Bridge for Fast and High-quality 3D Editing
Yufei Huang ⋅ Bangyan Liao ⋅ Yuqi Hu ⋅ Haitao Lin ⋅ Lirong Wu ⋅ Siyuan Li ⋅ Cheng Tan ⋅ Zicheng Liu ⋅ Yunfan Liu ⋅ Zelin Zang ⋅ Chang Yu ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #43 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Point2RBox-v2: Rethinking Point-supervised Oriented Object Detection with Spatial Layout Among Instances
Yi Yu ⋅ Botao Ren ⋅ Peiyuan Zhang ⋅ Mingxin Liu ⋅ Junwei Luo ⋅ Shaofeng Zhang ⋅ Feipeng Da ⋅ Junchi Yan ⋅ Xue Yang
In Room: ExHall D Poster Location: Poster #332 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Pathways on the Image Manifold: Image Editing via Video Generation Project Page ↗
Noam Rotstein ⋅ Gal Yona ⋅ Daniel Silver ⋅ Roy Velich ⋅ David Bensaid ⋅ Ron Kimmel
In Room: ExHall D Poster Location: Poster #238 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
EventSplat: 3D Gaussian Splatting from Moving Event Cameras for Real-time Rendering
Toshiya Yura ⋅ Ashkan Mirzaei ⋅ Igor Gilitschenski
In Room: ExHall D Poster Location: Poster #70 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
3D Student Splatting and Scooping
Jialin Zhu ⋅ Jiangbei Yue ⋅ Feixiang He ⋅ He Wang
In Room: ExHall D Poster Location: Poster #337 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LOGICZSL: Exploring Logic-induced Representation for Compositional Zero-shot Learning
Peng Wu ⋅ Xiankai Lu ⋅ Hao Hu ⋅ Yongqin Xian ⋅ Jianbing Shen ⋅ Wenguan Wang
In Room: ExHall D Poster Location: Poster #398 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs Project Page ↗
Wangbo Zhao ⋅ Yizeng Han ⋅ Jiasheng Tang ⋅ Zhikai Li ⋅ Yibing Song ⋅ Kai Wang ⋅ Zhangyang Wang ⋅ Yang You
In Room: ExHall D Poster Location: Poster #382 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Unveiling Visual Perception in Language Models: An Attention Head Analysis Approach Project Page ↗
Jing Bi ⋅ Lianggong Bruce Wen ⋅ Zhang Liu ⋅ JunJia Guo ⋅ Yunlong Tang ⋅ Bingjie Wang ⋅ Chenliang Xu
In Room: ExHall D Poster Location: Poster #378 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models Project Page ↗
Jaerin Lee ⋅ Daniel Jung ⋅ Kanggeon Lee ⋅ Kyoung Mu Lee
In Room: ExHall D Poster Location: Poster #226 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning Partonomic 3D Reconstruction from Image Collections
Xiaoqian Ruan ⋅ Pei Yu ⋅ Dian Jia ⋅ Hyeonjeong Park ⋅ Peixi Xiong ⋅ Wei Tang
In Room: ExHall D Poster Location: Poster #56 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EVOS: Efficient Implicit Neural Training via EVOlutionary Selector Project Page ↗
Weixiang Zhang ⋅ Shuzhao Xie ⋅ Chengwei Ren ⋅ Siyi Xie ⋅ Chen Tang ⋅ Shijia Ge ⋅ Mingzi Wang ⋅ Zhi Wang
In Room: ExHall D Poster Location: Poster #414 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CoMBO: Conflict Mitigation via Branched Optimization for Class Incremental Segmentation
Kai Fang ⋅ Anqi Zhang ⋅ Guangyu Gao ⋅ Jianbo Jiao ⋅ Chi Harold Liu ⋅ Yunchao Wei
In Room: ExHall D Poster Location: Poster #442 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Crab: A Unified Audio-Visual Scene Understanding Model with Explicit Cooperation Project Page ↗
Henghui Du ⋅ Guangyao Li ⋅ Chang Zhou ⋅ Chunjie Zhang ⋅ Alan Zhao ⋅ Di Hu
In Room: ExHall D Poster Location: Poster #288 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Nullu: Mitigating Object Hallucinations in Large Vision-Language Models via HalluSpace Projection
Le Yang ⋅ Ziwei Zheng ⋅ Boxu Chen ⋅ Zhengyu Zhao ⋅ Chenhao Lin ⋅ Chao Shen
In Room: ExHall D Poster Location: Poster #382 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
No Thing, Nothing: Highlighting Safety-Critical Classes for Robust LiDAR Semantic Segmentation in Adverse Weather
Junsung Park ⋅ HwiJeong Lee ⋅ Inha Kang ⋅ Hyunjung Shim
In Room: ExHall D Poster Location: Poster #126 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Cross-Modal Interactive Perception Network with Mamba for Lung Tumor Segmentation in PET-CT Images
Jie Mei ⋅ Chenyu Lin ⋅ Yu Qiu ⋅ Yaonan Wang ⋅ Hui Zhang ⋅ Ziyang Wang ⋅ Dong Dai
In Room: ExHall D Poster Location: Poster #479 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MEET: Towards Memory-Efficient Temporal Sparse Deep Neural Networks
Zeqi Zhu ⋅ Ibrahim Batuhan Akkaya ⋅ Luc Waeijen ⋅ Egor Bondarev ⋅ Arash Pourtaherian ⋅ Orlando Moreira
In Room: ExHall D Poster Location: Poster #302 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Probabilistic Prompt Distribution Learning for Animal Pose Estimation
Jiyong Rao ⋅ Brian Nlong Zhao ⋅ Yu Wang
In Room: ExHall D Poster Location: Poster #314 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reconstructing Humans with a Biomechanically Accurate Skeleton Project Page ↗
Yan Xia ⋅ Xiaowei Zhou ⋅ Etienne Vouga ⋅ Qixing Huang ⋅ Georgios Pavlakos
In Room: ExHall D Poster Location: Poster #91 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AdaCM^2: On Understanding Extremely Long-Term Video with Adaptive Cross-Modality Memory Reduction Project Page ↗
Yuanbin Man ⋅ Ying Huang ⋅ Chengming Zhang ⋅ Bingzhe Li ⋅ Wei Niu ⋅ Miao Yin
In Room: ExHall D Poster Location: Poster #301 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VGGT: Visual Geometry Grounded Transformer
Jianyuan Wang ⋅ Minghao Chen ⋅ Nikita Karaev ⋅ Andrea Vedaldi ⋅ Christian Rupprecht ⋅ David Novotny
In Room: ExHall D Poster Location: Poster #86 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhancing Facial Privacy Protection via Weakening Diffusion Purification Project Page ↗
Ali Salar ⋅ Qing Liu ⋅ Yingli Tian ⋅ Guoying Zhao
In Room: ExHall D Poster Location: Poster #273 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Show and Segment: Universal Medical Image Segmentation via In-Context Learning
Yunhe Gao ⋅ Di Liu ⋅ Zhuowei Li ⋅ Yunsheng Li ⋅ Dongdong Chen ⋅ Mu Zhou ⋅ Dimitris N. Metaxas
In Room: ExHall D Poster Location: Poster #478 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Silent Branding Attack: Trigger-free Data Poisoning Attack on Text-to-Image Diffusion Models Project Page ↗
Sangwon Jang ⋅ June Suk Choi ⋅ Jaehyeong Jo ⋅ Kimin Lee ⋅ Sung Ju Hwang
In Room: ExHall D Poster Location: Poster #270 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Mani-GS: Gaussian Splatting Manipulation with Triangular Mesh
Xiangjun Gao ⋅ Xiaoyu Li ⋅ Yiyu Zhuang ⋅ Qi Zhang ⋅ Wenbo Hu ⋅ Chaopeng Zhang ⋅ Yao Yao ⋅ Ying Shan ⋅ Long Quan
In Room: ExHall D Poster Location: Poster #33 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UniHOPE: A Unified Approach for Hand-Only and Hand-Object Pose Estimation
Yinqiao Wang ⋅ Hao Xu ⋅ Pheng-Ann Heng ⋅ Chi-Wing Fu
In Room: ExHall D Poster Location: Poster #152 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression
Uri Gadot ⋅ Shie Mannor ⋅ Assaf Shocher ⋅ Gal Chechik ⋅ Assaf Hallak
In Room: ExHall D Poster Location: Poster #179 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PHGC: Procedural Heterogeneous Graph Completion for Natural Language Task Verification in Egocentric Videos
Xun Jiang ⋅ Zhiyi Huang ⋅ Xing Xu ⋅ Jingkuan Song ⋅ Fumin Shen ⋅ Heng Tao Shen
In Room: ExHall D Poster Location: Poster #309 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Recognition-Synergistic Scene Text Editing
Zhengyao Fang ⋅ Pengyuan Lyu ⋅ Jingjing Wu ⋅ Chengquan Zhang ⋅ Jun Yu ⋅ Guangming Lu ⋅ Wenjie Pei
In Room: ExHall D Poster Location: Poster #234 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Consistent Multi-Task Learning: Unlocking the Potential of Task-Specific Parameters
Xiaohan Qin ⋅ Xiaoxing Wang ⋅ Junchi Yan
In Room: ExHall D Poster Location: Poster #447 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rectified Diffusion Guidance for Conditional Generation
Mengfei Xia ⋅ Nan Xue ⋅ Yujun Shen ⋅ Ran Yi ⋅ Tieliang Gong ⋅ Yong-Jin Liu
In Room: ExHall D Poster Location: Poster #259 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards In-the-wild 3D Plane Reconstruction from a Single Image
Jiachen Liu ⋅ Rui Yu ⋅ Sili Chen ⋅ Sharon X. Huang ⋅ Hengkai Guo
In Room: ExHall D Poster Location: Poster #84 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LP-Diff: Towards Improved Restoration of Real-World Degraded License Plate
Haoyan Gong ⋅ Zhenrong Zhang ⋅ Yuzheng Feng ⋅ Anh Nguyen ⋅ Hongbin Liu
In Room: ExHall D Poster Location: Poster #193 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Gromov–Wasserstein Problem with Cyclic Symmetry
Shoichiro Takeda ⋅ Yasunori Akagi
In Room: ExHall D Poster Location: Poster #69 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HuPerFlow: A Comprehensive Benchmark for Human vs. Machine Motion Estimation Comparison Project Page ↗
Yung-Hao Yang ⋅ Zitang Sun ⋅ Taiki Fukiage ⋅ Shin'ya Nishida
In Room: ExHall D Poster Location: Poster #166 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
IRIS: Inverse Rendering of Indoor Scenes from Low Dynamic Range Images
Chih-Hao Lin ⋅ Jia-Bin Huang ⋅ Zhengqin Li ⋅ Zhao Dong ⋅ Christian Richardt ⋅ Michael Zollhoefer ⋅ Tuotuo Li ⋅ Johannes Kopf ⋅ Shenlong Wang ⋅ Changil Kim
In Room: ExHall D Poster Location: Poster #28 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RoGSplat: Learning Robust Generalizable Human Gaussian Splatting from Sparse Multi-View Images
Junjin Xiao ⋅ Qing Zhang ⋅ Yongwei Nie ⋅ Lei Zhu ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #51 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SDBF: Steep-Decision-Boundary Fingerprinting for Hard-Label Tampering Detection of DNN Models
Xiaofan Bai ⋅ Shixin Li ⋅ Xiaojing Ma ⋅ Bin Benjamin Zhu ⋅ Dongmei Zhang ⋅ Linchen Yu
In Room: ExHall D Poster Location: Poster #299 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EnliveningGS: Active Locomotion of 3DGS
Siyuan Shen ⋅ Tianjia Shao ⋅ Kun Zhou ⋅ Chenfanfu Jiang ⋅ Yin Yang
In Room: ExHall D Poster Location: Poster #68 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Secret Lies in Color: Enhancing AI-Generated Images Detection with Color Distribution Analysis
Zexi Jia ⋅ Chuanwei Huang ⋅ Yeshuang Zhu ⋅ Hongyan Fei ⋅ Xiaoyue Duan ⋅ Yuan Zhiqiang ⋅ Ying Deng ⋅ Jiapei Zhang ⋅ Jinchao Zhang ⋅ Jie Zhou
In Room: ExHall D Poster Location: Poster #267 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking Project Page ↗
Wenrui Cai ⋅ Qingjie Liu ⋅ Yunhong Wang
In Room: ExHall D Poster Location: Poster #100 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AnyCam: Learning to Recover Camera Poses and Intrinsics from Casual Videos
Felix Wimbauer ⋅ Weirong Chen ⋅ Dominik Muhle ⋅ Christian Rupprecht ⋅ Daniel Cremers
In Room: ExHall D Poster Location: Poster #85 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ExpertAF: Expert Actionable Feedback from Video
Kumar Ashutosh ⋅ Tushar Nagarajan ⋅ Georgios Pavlakos ⋅ Kris Kitani ⋅ Kristen Grauman
In Room: ExHall D Poster Location: Poster #280 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Model Poisoning Attacks to Federated Learning via Multi-Round Consistency
Yueqi Xie ⋅ Minghong Fang ⋅ Neil Zhenqiang Gong
In Room: ExHall D Poster Location: Poster #460 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Knowledge-Aligned Counterfactual-Enhancement Diffusion Perception for Unsupervised Cross-Domain Visual Emotion Recognition Project Page ↗
Wen Yin ⋅ Yong Wang ⋅ Guiduo Duan ⋅ Dongyang Zhang ⋅ XIN Hu ⋅ Yuan-Fang Li ⋅ Tao He
In Room: ExHall D Poster Location: Poster #354 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Distilling Multi-modal Large Language Models for Autonomous Driving
Deepti Hegde ⋅ Rajeev Yasarla ⋅ Hong Cai ⋅ Shizhong Han ⋅ Apratim Bhattacharyya ⋅ Shweta Mahajan ⋅ Litian Liu ⋅ Risheek Garrepalli ⋅ Vishal M. Patel ⋅ Fatih Porikli
In Room: ExHall D Poster Location: Poster #135 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Pixel-aligned RGB-NIR Stereo Imaging and Dataset for Robot Vision
Jinneyong Kim ⋅ Seung-Hwan Baek
In Room: ExHall D Poster Location: Poster #80 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Camera Resection from Known Line Pencils and a Radially Distorted Scanline
Juan Carlos Dibene Simental ⋅ Enrique Dunn
In Room: ExHall D Poster Location: Poster #80 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Can Machines Understand Composition? Dataset and Benchmark for Photographic Image Composition Embedding and Understanding
Zhaoran Zhao ⋅ Peng Lu ⋅ Anran Zhang ⋅ Pei Pei Li ⋅ Xia Li ⋅ Xuannan Liu ⋅ Yang Hu ⋅ Shiyi Chen ⋅ liweiwang ⋅ Wenhao Guo
In Room: ExHall D Poster Location: Poster #360 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Exploring Timeline Control for Facial Motion Generation Project Page ↗
Yifeng Ma ⋅ Jinwei Qi ⋅ Chaonan Ji ⋅ Peng Zhang ⋅ Bang Zhang ⋅ Zhidong Deng ⋅ Liefeng Bo
In Room: ExHall D Poster Location: Poster #164 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
Xiaoqi Li ⋅ Lingyun Xu ⋅ Mingxu Zhang ⋅ Jiaming Liu ⋅ Yan Shen ⋅ Iaroslav Ponomarenko ⋅ Jiahui Xu ⋅ Liang Heng ⋅ Siyuan Huang ⋅ Shanghang Zhang ⋅ Hao Dong
In Room: ExHall D Poster Location: Poster #141 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PhysGen3D: Crafting a Miniature Interactive World from a Single Image
Boyuan Chen ⋅ Hanxiao Jiang ⋅ Shaowei Liu ⋅ Saurabh Gupta ⋅ Yunzhu Li ⋅ Hao Zhao ⋅ Shenlong Wang
In Room: ExHall D Poster Location: Poster #71 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HD-EPIC: A Highly-Detailed Egocentric Video Dataset Project Page ↗
Toby Perrett ⋅ Ahmad Darkhalil ⋅ Saptarshi Sinha ⋅ Omar Emara ⋅ Sam Pollard ⋅ Kranti Kumar Parida ⋅ Kaiting Liu ⋅ Prajwal Gatti ⋅ Siddhant Bansal ⋅ Kevin Flanagan ⋅ Jacob Chalk ⋅ Zhifan Zhu ⋅ Rhodri Guerrier ⋅ Fahd Abdelazim ⋅ Bin Zhu ⋅ Davide Moltisanti ⋅ Michael Wray ⋅ Hazel Doughty ⋅ Dima Damen
In Room: ExHall D Poster Location: Poster #276 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PolarFree: Polarization-based Reflection-Free Imaging Project Page ↗
Mingde Yao ⋅ Menglu Wang ⋅ King Man Tam ⋅ Lingen Li ⋅ Tianfan Xue ⋅ Jinwei Gu
In Room: ExHall D Poster Location: Poster #22 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Exploring Sparse MoE in GANs for Text-conditioned Image Synthesis
Jiapeng Zhu ⋅ Ceyuan Yang ⋅ Kecheng Zheng ⋅ Yinghao Xu ⋅ Zifan Shi ⋅ Yifei Zhang ⋅ Qifeng Chen ⋅ Yujun Shen
In Room: ExHall D Poster Location: Poster #250 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
H-MoRe: Learning Human-centric Motion Representation for Action Analysis Project Page ↗
Zhanbo Huang ⋅ Xiaoming Liu ⋅ Yu Kong
In Room: ExHall D Poster Location: Poster #156 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LATTE-MV: Learning to Anticipate Table Tennis Hits from Monocular Videos
Daniel Etaat ⋅ Dvij Rajesh Kalaria ⋅ Nima Rahmanian ⋅ Shankar Sastry
In Room: ExHall D Poster Location: Poster #168 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MultimodalStudio: A Heterogeneous Sensor Dataset and Framework for Neural Rendering across Multiple Imaging Modalities Project Page ↗
Federico Lincetto ⋅ Gianluca Agresti ⋅ Mattia Rossi ⋅ Pietro Zanuttigh
In Room: ExHall D Poster Location: Poster #29 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Dense-SfM: Structure from Motion with Dense Consistent Matching
JongMin Lee ⋅ Sungjoo Yoo
In Room: ExHall D Poster Location: Poster #98 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FluidNexus: 3D Fluid Reconstruction and Prediction from a Single Video
Yue Gao ⋅ Hong-Xing Yu ⋅ Bo Zhu ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #32 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SimVS: Simulating World Inconsistencies for Robust View Synthesis Project Page ↗
Alex Trevithick ⋅ Roni Paiss ⋅ Philipp Henzler ⋅ Dor Verbin ⋅ Rundi Wu ⋅ Hadi Alzayer ⋅ Ruiqi Gao ⋅ Ben Poole ⋅ Jonathan T. Barron ⋅ Aleksander Holynski ⋅ Ravi Ramamoorthi ⋅ Pratul P. Srinivasan
In Room: ExHall D Poster Location: Poster #60 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MuTri: Multi-view Tri-alignment for OCT to OCTA 3D Image Translation
zhuangzhuang chen ⋅ hualiang wang ⋅ Chubin Ou ⋅ Xiaomeng Li
In Room: ExHall D Poster Location: Poster #483 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Visual Generative Priors without Text
Shuailei Ma ⋅ Kecheng Zheng ⋅ Ying Wei ⋅ Wei Wu ⋅ Fan Lu ⋅ Yifei Zhang ⋅ Chen-Wei Xie ⋅ Biao Gong ⋅ Jiapeng Zhu ⋅ Yujun Shen
In Room: ExHall D Poster Location: Poster #256 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Image Quality Assessment: Investigating Causal Perceptual Effects with Abductive Counterfactual Inference Project Page ↗
Wenhao Shen ⋅ Mingliang Zhou ⋅ Yu Chen ⋅ Xuekai WEI ⋅ Yong Feng ⋅ Huayan Pu ⋅ Weijia Jia
In Room: ExHall D Poster Location: Poster #208 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OCRT: Boosting Foundation Models in the Open World with Object-Concept-Relation Triad
Luyao Tang ⋅ Chaoqi Chen ⋅ Yuxuan Yuan ⋅ Zeyu Zhang ⋅ Yue Huang ⋅ Kun Zhang
In Room: ExHall D Poster Location: Poster #418 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Decouple-Then-Merge: Finetune Diffusion Models as Multi-Task Learning
Qianli Ma ⋅ Xuefei Ning ⋅ Dongrui Liu ⋅ Li Niu ⋅ Linfeng Zhang
In Room: ExHall D Poster Location: Poster #212 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HELVIPAD: A Real-World Dataset for Omnidirectional Stereo Depth Estimation
Mehdi Zayene ⋅ Albias Havolli ⋅ Jannik Endres ⋅ Charles Corbière ⋅ Alexandre Ben Ahmed Kontouli ⋅ Salim Cherkaoui ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #79 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation
Ning Gao ⋅ Yilun Chen ⋅ Shuai Yang ⋅ Xinyi Chen ⋅ Yang Tian ⋅ Hao Li ⋅ Haifeng Huang ⋅ Hanqing Wang ⋅ Tai Wang ⋅ Jiangmiao Pang
In Room: ExHall D Poster Location: Poster #148 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FrugalNeRF: Fast Convergence for Extreme Few-shot Novel View Synthesis without Learned Priors Project Page ↗
Chin-Yang Lin ⋅ Chung-Ho Wu ⋅ Changhan Yeh ⋅ Shih Han Yen ⋅ Cheng Sun ⋅ Yu-Lun Liu
In Room: ExHall D Poster Location: Poster #55 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
From Multimodal LLMs to Generalist Embodied Agents: Methods and Lessons
Andrew Szot ⋅ Bogdan Mazoure ⋅ Omar Attia ⋅ Aleksei Timofeev ⋅ Harsh Agrawal ⋅ R Devon Hjelm ⋅ Zhe Gan ⋅ Zsolt Kira ⋅ Alexander Toshev
In Room: ExHall D Poster Location: Poster #329 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency Project Page ↗
Yikai Wang ⋅ Chenjie Cao ⋅ Junqiu Yu ⋅ Ke Fan ⋅ Xiangyang Xue ⋅ Yanwei Fu
In Room: ExHall D Poster Location: Poster #208 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Audio-Visual Instance Segmentation
Ruohao Guo ⋅ Xianghua Ying ⋅ Yaru Chen ⋅ Dantong Niu ⋅ Guangyao Li ⋅ Liao Qu ⋅ Yanyu Qi ⋅ Jinxing Zhou ⋅ Bowei Xing ⋅ Wenzhen Yue ⋅ Ji Shi ⋅ Qixun Wang ⋅ Peiliang Zhang ⋅ Buwen Liang
In Room: ExHall D Poster Location: Poster #277 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Optimus-2: Multimodal Minecraft Agent with Goal-Observation-Action Conditioned Policy Project Page ↗
Zaijing Li ⋅ Yuquan Xie ⋅ Rui Shao ⋅ Gongwei Chen ⋅ Dongmei Jiang ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #351 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GEM: A Generalizable Ego-Vision Multimodal World Model for Fine-Grained Ego-Motion, Object Dynamics, and Scene Composition Control
Mariam Hassan ⋅ Sebastian Stapf ⋅ Ahmad Rahimi ⋅ Pedro M B Rezende ⋅ Yasaman Haghighi ⋅ David Brüggemann ⋅ Isinsu Katircioglu ⋅ Lin Zhang ⋅ Xiaoran Chen ⋅ Suman Saha ⋅ Marco Cannici ⋅ Elie Aljalbout ⋅ Botao Ye ⋅ Xi Wang ⋅ Aram Davtyan ⋅ Mathieu Salzmann ⋅ Davide Scaramuzza ⋅ Marc Pollefeys ⋅ Paolo Favaro ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #129 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Prompt-CAM: Making Vision Transformers Interpretable for Fine-Grained Analysis
Arpita Chowdhury ⋅ Dipanjyoti Paul ⋅ Zheda Mai ⋅ Jianyang Gu ⋅ Ziheng Zhang ⋅ Kazi Sajeed Mehrab ⋅ Elizabeth Campolongo ⋅ Daniel Rubenstein ⋅ Charles Stewart ⋅ Anuj Karpatne ⋅ Tanya Berger-Wolf ⋅ Yu Su ⋅ Wei-Lun Chao
In Room: ExHall D Poster Location: Poster #404 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LatentHOI: On the Generalizable Hand Object Motion Generation with Latent Hand Diffusion. Project Page ↗
Muchen Li ⋅ Sammy Christen ⋅ Chengde Wan ⋅ Yujun Cai ⋅ Renjie Liao ⋅ Leonid Sigal ⋅ Shugao Ma
In Room: ExHall D Poster Location: Poster #155 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Practical Solutions to the Relative Pose of Three Calibrated Cameras Project Page ↗
Charalambos Tzamos ⋅ Viktor Kocur ⋅ Yaqing Ding ⋅ Daniel Barath ⋅ Zuzana Berger Haladova ⋅ Torsten Sattler ⋅ Zuzana Kukelova
In Room: ExHall D Poster Location: Poster #82 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GenAssets: Generating in-the-wild 3D Assets in Latent Space Project Page ↗
Ze Yang ⋅ Jingkang Wang ⋅ Haowei Zhang ⋅ Sivabalan Manivasagam ⋅ Yun Chen ⋅ Raquel Urtasun
In Room: ExHall D Poster Location: Poster #128 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SemiDAViL: Semi-supervised Domain Adaptation with Vision-Language Guidance for Semantic Segmentation
Hritam Basak ⋅ Zhaozheng Yin
In Room: ExHall D Poster Location: Poster #423 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
Bin Wang ⋅ Fan Wu ⋅ Linke Ouyang ⋅ Zhuangcheng Gu ⋅ Rui Zhang ⋅ Renqiu Xia ⋅ Botian Shi ⋅ Bo Zhang ⋅ Conghui He
In Room: ExHall D Poster Location: Poster #369 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
Linke Ouyang ⋅ Yuan Qu ⋅ Hongbin Zhou ⋅ Jiawei Zhu ⋅ Rui Zhang ⋅ Qunshu Lin ⋅ Bin Wang ⋅ Zhiyuan Zhao ⋅ Man Jiang ⋅ Xiaomeng Zhao ⋅ Jin Shi ⋅ Fan Wu ⋅ Pei Chu ⋅ Minghao Liu ⋅ Zhenxiang Li ⋅ Chao Xu ⋅ Bo Zhang ⋅ Botian Shi ⋅ Zhongying Tu ⋅ Conghui He
In Room: ExHall D Poster Location: Poster #364 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion Project Page ↗
Haotian Wang ⋅ Yuzhe Weng ⋅ Yueyan Li ⋅ Zilu Guo ⋅ Jun Du ⋅ Shutong Niu ⋅ Jiefeng Ma ⋅ Shan He ⋅ Wu Xiaoyan ⋅ Qiming Hu ⋅ Bing Yin ⋅ Cong Liu ⋅ Qingfeng Liu
In Room: ExHall D Poster Location: Poster #1 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Docopilot: Improving Multimodal Models for Document-Level Understanding
Yuchen Duan ⋅ Zhe Chen ⋅ Yusong Hu ⋅ Weiyun Wang ⋅ Shenglong Ye ⋅ Botian Shi ⋅ Lewei Lu ⋅ Qibin Hou ⋅ Tong Lu ⋅ Hongsheng Li ⋅ Jifeng Dai ⋅ Wenhai Wang
In Room: ExHall D Poster Location: Poster #367 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ESCAPE: Equivariant Shape Completion via Anchor Point Encoding
Burak Bekci ⋅ Nassir Navab ⋅ Federico Tombari ⋅ Mahdi Saleh
In Room: ExHall D Poster Location: Poster #105 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SPC-GS: Gaussian Splatting with Semantic-Prompt Consistency for Indoor Open-World Free-view Synthesis from Sparse Inputs Project Page ↗
Guibiao Liao ⋅ Qing Li ⋅ Zhenyu Bao ⋅ Guoping Qiu ⋅ KANGLIN LIU
In Room: ExHall D Poster Location: Poster #58 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
IRGS: Inter-Reflective Gaussian Splatting with 2D Gaussian Ray Tracing Project Page ↗
Chun Gu ⋅ Xiaofei Wei ⋅ Zixuan Zeng ⋅ Yuxuan Yao ⋅ Li Zhang
In Room: ExHall D Poster Location: Poster #27 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Generalized Zero-Shot Classification via Semantics-Free Inter-Class Feature Generation
Libiao Chen ⋅ Dong Nie ⋅ Junjun Pan ⋅ Jing Yan ⋅ Zhenyu Tang
In Room: ExHall D Poster Location: Poster #427 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
M3amba: Memory Mamba is All You Need for Whole Slide Image Classification
Tingting Zheng ⋅ Kui Jiang ⋅ Yi Xiao ⋅ Sicheng Zhao ⋅ Hongxun Yao
In Room: ExHall D Poster Location: Poster #474 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GoalFlow: Goal-Driven Flow Matching for Multimodal Trajectories Generation in End-to-End Autonomous Driving
Zebin Xing ⋅ Xingyu Zhang ⋅ Yang Hu ⋅ Bo Jiang ⋅ Tong He ⋅ Qian Zhang ⋅ Xiaoxiao Long ⋅ Wei Yin
In Room: ExHall D Poster Location: Poster #134 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Variance-Based Membership Inference Attacks Against Large-Scale Image Captioning Models
Daniel Samira ⋅ Edan Habler ⋅ Yuval Elovici ⋅ Asaf Shabtai
In Room: ExHall D Poster Location: Poster #366 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Redefining <Creative> in Dictionary: Towards an Enhanced Semantic Understanding of Creative Generation
Fu Feng ⋅ Yucheng Xie ⋅ Xu Yang ⋅ Jing Wang ⋅ Xin Geng
In Room: ExHall D Poster Location: Poster #255 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Temporal Alignment-Free Video Matching for Few-shot Action Recognition Project Page ↗
SuBeen Lee ⋅ WonJun Moon ⋅ Hyun Seok Seong ⋅ Jae-Pil Heo
In Room: ExHall D Poster Location: Poster #302 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FLAVC: Learned Video Compression with Feature Level Attention
Chun Zhang ⋅ Heming Sun ⋅ Jiro Katto
In Room: ExHall D Poster Location: Poster #176 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Revealing Key Details to See Differences: A Novel Prototypical Perspective for Skeleton-based Action Recognition
Hongda Liu ⋅ Yunfan Liu ⋅ Min Ren ⋅ Hao Wang ⋅ Yunlong Wang ⋅ Zhenan Sun
In Room: ExHall D Poster Location: Poster #296 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Cross-Rejective Open-Set SAR Image Registration
Shasha Mao ⋅ Shiming Lu ⋅ Zhaolong Du ⋅ Licheng Jiao ⋅ Shuiping Gou ⋅ Luntian Mou ⋅ Xuequan Lu ⋅ Lin Xiong ⋅ Yimeng Zhang
In Room: ExHall D Poster Location: Poster #187 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Weakly Supervised Semantic Segmentation via Progressive Confidence Region Expansion
Xiangfeng Xu ⋅ Pinyi Zhang ⋅ Wenxuan Huang ⋅ Yunhang Shen ⋅ Haosheng Chen ⋅ Jingzhong Lin ⋅ Wei Li ⋅ Gaoqi He ⋅ Jiao Xie ⋅ Shaohui Lin
In Room: ExHall D Poster Location: Poster #424 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer Project Page ↗
Chunnan Shang ⋅ Zhizhong Wang ⋅ Hongwei Wang ⋅ Xiangming Meng
In Room: ExHall D Poster Location: Poster #229 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VIRES: Video Instance Repainting via Sketch and Text Guided Generation
Shuchen Weng ⋅ Haojie Zheng ⋅ Peixuan Zhang ⋅ Yuchen Hong ⋅ Han Jiang ⋅ Si Li ⋅ Boxin Shi
In Room: ExHall D Poster Location: Poster #215 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
Feng Liu ⋅ Shiwei Zhang ⋅ Xiaofeng Wang ⋅ Yujie Wei ⋅ Haonan Qiu ⋅ Yuzhong Zhao ⋅ Yingya Zhang ⋅ Qixiang Ye ⋅ Fang Wan
In Room: ExHall D Poster Location: Poster #190 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Towards Practical Real-Time Neural Video Compression
Zhaoyang Jia ⋅ Bin Li ⋅ Jiahao Li ⋅ Wenxuan Xie ⋅ Linfeng Qi ⋅ Houqiang Li ⋅ Yan Lu
In Room: ExHall D Poster Location: Poster #180 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Can't Slow Me Down: Learning Robust and Hardware-Adaptive Object Detectors against Latency Attacks for Edge Devices
Tianyi Wang ⋅ Zichen Wang ⋅ Cong Wang ⋅ Yuanchao Shu ⋅ Ruilong Deng ⋅ Peng Cheng ⋅ Jiming Chen
In Room: ExHall D Poster Location: Poster #327 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SAM2Object: Consolidating View Consistency via SAM2 for Zero-Shot 3D Instance Segmentation
Jihuai Zhao ⋅ Junbao Zhuo ⋅ Jiansheng Chen ⋅ Huimin Ma
In Room: ExHall D Poster Location: Poster #336 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Bridging Gait Recognition and Large Language Models Sequence Modeling
Shaopeng Yang ⋅ Jilong Wang ⋅ Saihui Hou ⋅ Xu Liu ⋅ Chunshui Cao ⋅ Liang Wang ⋅ Yongzhen Huang
In Room: ExHall D Poster Location: Poster #314 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CDI: Copyrighted Data Identification in Diffusion Models
Jan Dubiński ⋅ Antoni Kowalczuk ⋅ Franziska Boenisch ⋅ Adam Dziedzic
In Room: ExHall D Poster Location: Poster #276 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Binarized Neural Network for Multi-spectral Image Fusion
Junming Hou ⋅ Xiaoyu Chen ⋅ Ran Ran ⋅ Xiaofeng Cong ⋅ Xinyang Liu ⋅ Jian Wei You ⋅ Liang-Jian Deng
In Room: ExHall D Poster Location: Poster #194 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CRISP: Object Pose and Shape Estimation with Test-Time Adaptation Project Page ↗
Jingnan Shi ⋅ Rajat Talak ⋅ Harry Zhang ⋅ David Jin ⋅ Luca Carlone
In Room: ExHall D Poster Location: Poster #96 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior
Zichen Tang ⋅ Yuan Yao ⋅ Miaomiao Cui ⋅ Liefeng Bo ⋅ Hongyu Yang
In Room: ExHall D Poster Location: Poster #17 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Creating Your Editable 3D Photorealistic Avatar with Tetrahedron-constrained Gaussian Splatting
Hanxi Liu ⋅ Yifang Men ⋅ Zhouhui Lian
In Room: ExHall D Poster Location: Poster #11 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Event Fields: Capturing Light Fields at High Speed, Resolution, and Dynamic Range
Ziyuan Qu ⋅ Zihao Zou ⋅ Vivek Boominathan ⋅ Praneeth Chakravarthula ⋅ Adithya Pediredla
In Room: ExHall D Poster Location: Poster #73 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Object-Shot Enhanced Grounding Network for Egocentric Video
Yisen Feng ⋅ Haoyu Zhang ⋅ Meng Liu ⋅ Weili Guan ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #303 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MANTA: Diffusion Mamba for Efficient and Effective Stochastic Long-Term Dense Action Anticipation
Olga Zatsarynna ⋅ Emad Bahrami ⋅ Yazan Abu Farha ⋅ Gianpiero Francesca ⋅ Jürgen Gall
In Room: ExHall D Poster Location: Poster #312 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
METASCENES: Towards Automated Replica Creation for Real-world 3D Scans
Huangyue Yu ⋅ Baoxiong Jia ⋅ Yixin Chen ⋅ Yandan Yang ⋅ Puhao Li ⋅ Rongpeng Su ⋅ Jiaxin Li ⋅ Qing Li ⋅ Wei Liang ⋅ Song-Chun Zhu ⋅ Tengyu Liu ⋅ Siyuan Huang
In Room: ExHall D Poster Location: Poster #140 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Robust Multimodal Survival Prediction with Conditional Latent Differentiation Variational AutoEncoder
Junjie Zhou ⋅ Jiao Tang ⋅ Yingli Zuo ⋅ Peng Wan ⋅ Daoqiang Zhang ⋅ WEI SHAO
In Room: ExHall D Poster Location: Poster #477 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Sim-to-Real Causal Transfer: A Metric Learning Approach to Causally-Aware Interaction Representations
Ahmad Rahimi ⋅ Po-Chien Luan ⋅ Yuejiang Liu ⋅ Frano Rajič ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #139 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Zero-Shot Blind-spot Image Denoising via Implicit Neural Sampling
Yuhui Quan ⋅ Tianxiang Zheng ⋅ Zhiyuan Ma ⋅ Hui Ji
In Room: ExHall D Poster Location: Poster #204 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Nearly Zero-Cost Protection Against Mimicry by Personalized Diffusion Models Project Page ↗
Namhyuk Ahn ⋅ KiYoon Yoo ⋅ Wonhyuk Ahn ⋅ Daesik Kim ⋅ Seung-Hun Nam
In Room: ExHall D Poster Location: Poster #251 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PerLA: Perceptive 3D Language Assistant Project Page ↗
Guofeng Mei ⋅ Wei Lin ⋅ Luigi Riz ⋅ Yujiao Wu ⋅ Fabio Poiesi ⋅ Yiming Wang
In Room: ExHall D Poster Location: Poster #355 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
beta-FFT: Nonlinear Interpolation and Differentiated Training Strategies for Semi-Supervised Medical Image Segmentation
Ming Hu ⋅ Jianfu Yin ⋅ Zhuangzhuang Ma ⋅ Jianheng Ma ⋅ Feiyu Zhu ⋅ Bingbing Wu ⋅ Ya Wen ⋅ Meng Wu ⋅ C Hu ⋅ Bingliang Hu ⋅ Quan Wang
In Room: ExHall D Poster Location: Poster #449 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PACT: Pruning and Clustering-Based Token Reduction for Faster Visual Language Models Project Page ↗
Dhouib Mohamed ⋅ Davide Buscaldi ⋅ Vanier Sonia ⋅ Aymen Shabou
In Room: ExHall D Poster Location: Poster #377 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LITA-GS: Illumination-Agnostic Novel View Synthesis via Reference-Free 3D Gaussian Splatting and Physical Priors Project Page ↗
Han Zhou ⋅ Wei Dong ⋅ Jun Chen
In Room: ExHall D Poster Location: Poster #50 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PhyT2V: LLM-Guided Iterative Self-Refinement for Physics-Grounded Text-to-Video Generation Project Page ↗
Qiyao Xue ⋅ Xiangyu Yin ⋅ Boyuan Yang ⋅ Wei Gao
In Room: ExHall D Poster Location: Poster #290 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation Project Page ↗
Hyeonho Jeong ⋅ Chun-Hao P. Huang ⋅ Jong Chul Ye ⋅ Niloy J. Mitra ⋅ Duygu Ceylan
In Room: ExHall D Poster Location: Poster #183 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
JamMa: Ultra-lightweight Local Feature Matching with Joint Mamba Project Page ↗
Xiaoyong Lu ⋅ Songlin Du
In Room: ExHall D Poster Location: Poster #409 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DyCoke: Dynamic Compression of Tokens for Fast Video Large Language Models Project Page ↗
Keda Tao ⋅ Can Qin ⋅ Haoxuan You ⋅ Yang Sui ⋅ Huan Wang
In Room: ExHall D Poster Location: Poster #305 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PersonaBooth: Personalized Text-to-Motion Generation Project Page ↗
Boeun Kim ⋅ Hea In Jeong ⋅ JungHoon Sung ⋅ Yihua Cheng ⋅ Jeongmin Lee ⋅ Ju Yong Chang ⋅ Sang-Il Choi ⋅ YOUNGGEUN CHOI ⋅ Saim Shin ⋅ Jungho Kim ⋅ Hyung Jin Chang
In Room: ExHall D Poster Location: Poster #161 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Revisiting Fairness in Multitask Learning: A Performance-Driven Approach for Variance Reduction
Xiaohan Qin ⋅ Xiaoxing Wang ⋅ Junchi Yan
In Room: ExHall D Poster Location: Poster #446 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning from Synchronization: Self-Supervised Uncalibrated Multi-View Person Association in Challenging Scenes
Keqi Chen ⋅ vinkle srivastav ⋅ Didier MUTTER ⋅ Nicolas Padoy
In Room: ExHall D Poster Location: Poster #324 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RC-AutoCalib: An End-to-End Radar-Camera Automatic Calibration Network
Van-Tin Luu ⋅ Yong-Lin Cai ⋅ Vu-Hoang Tran ⋅ Wei-Chen Chiu ⋅ Yi-Ting Chen ⋅ Ching-Chun Huang
In Room: ExHall D Poster Location: Poster #127 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CLIP-driven Coarse-to-fine Semantic Guidance for Fine-grained Open-set Semi-supervised Learning Project Page ↗
Xiaokun Li ⋅ Yaping Huang ⋅ Qingji Guan
In Room: ExHall D Poster Location: Poster #399 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
InsTaG: Learning Personalized 3D Talking Head from Few-Second Video Project Page ↗
Jiahe Li ⋅ Jiawei Zhang ⋅ Xiao Bai ⋅ Jin Zheng ⋅ Jun Zhou ⋅ Lin Gu
In Room: ExHall D Poster Location: Poster #4 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Benchmarking Large Vision-Language Models via Directed Scene Graph for Comprehensive Image Captioning
Fan Lu ⋅ Wei Wu ⋅ Kecheng Zheng ⋅ Shuailei Ma ⋅ Biao Gong ⋅ Jiawei Liu ⋅ Wei Zhai ⋅ Yang Cao ⋅ Yujun Shen ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #363 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ART: Anonymous Region Transformer for Variable Multi-Layer Transparent Image Generation
Yifan Pu ⋅ Yiming Zhao ⋅ Zhicong Tang ⋅ Ruihong Yin ⋅ Haoxing Ye ⋅ Yuhui Yuan ⋅ Dong Chen ⋅ Jianmin Bao ⋅ Sirui Zhang ⋅ Yanbin Wang ⋅ Lin Liang ⋅ Lijuan Wang ⋅ Ji Li ⋅ Xiu Li ⋅ Zhouhui Lian ⋅ Gao Huang ⋅ Baining Guo
In Room: ExHall D Poster Location: Poster #247 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rotation-Equivariant Self-Supervised Method in Image Denoising
Hanze Liu ⋅ Jiahong Fu ⋅ Qi Xie ⋅ Deyu Meng
In Room: ExHall D Poster Location: Poster #198 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GLane3D: Detecting Lanes with Graph of 3D Keypoints Project Page ↗
Halil İbrahim Öztürk ⋅ Muhammet Esat Kalfaoglu ⋅ Ozsel Kilinc
In Room: ExHall D Poster Location: Poster #129 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Minimal Interaction Seperated Tuning: A New Paradigm for Visual Adaptation
Ningyuan Tang ⋅ Minghao Fu ⋅ Jianxin Wu
In Room: ExHall D Poster Location: Poster #398 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hardware-Rasterized Ray-Based Gaussian Splatting Project Page ↗
Samuel Rota Bulò ⋅ Lorenzo Porzi ⋅ Nemanja Bartolovic ⋅ Peter Kontschieder
In Room: ExHall D Poster Location: Poster #30 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FreqDebias: Towards Generalizable Deepfake Detection via Consistency-Driven Frequency Debiasing
Hossein Kashiani ⋅ Niloufar Alipour Talemi ⋅ Fatemeh Afghah
In Room: ExHall D Poster Location: Poster #325 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
4DTAM: Non-Rigid Tracking and Mapping via Dynamic Surface Gaussians Project Page ↗
Hidenobu Matsuki ⋅ Gwangbin Bae ⋅ Andrew J. Davison
In Room: ExHall D Poster Location: Poster #74 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Unseen Visual Anomaly Generation Project Page ↗
HAN SUN ⋅ Yunkang Cao ⋅ Hao Dong ⋅ Olga Fink
In Room: ExHall D Poster Location: Poster #427 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ReNeg: Learning Negative Embedding with Reward Guidance
Xiaomin Li ⋅ yixuan liu ⋅ Takashi Isobe ⋅ Xu Jia ⋅ Qinpeng Cui ⋅ Dong Zhou ⋅ Dong Li ⋅ You He ⋅ Huchuan Lu ⋅ Zhongdao Wang ⋅ Emad Barsoum
In Room: ExHall D Poster Location: Poster #249 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Decoder Gradient Shield: Provable and High-Fidelity Prevention of Gradient-Based Box-Free Watermark Removal
Haonan An ⋅ Guang Hua ⋅ Zhengru Fang ⋅ Guowen Xu ⋅ Susanto Rahardja ⋅ Yuguang Fang
In Room: ExHall D Poster Location: Poster #265 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MotionPro: A Precise Motion Controller for Image-to-Video Generation Project Page ↗
Zhongwei Zhang ⋅ Fuchen Long ⋅ Zhaofan Qiu ⋅ Yingwei Pan ⋅ Wu Liu ⋅ Ting Yao ⋅ Tao Mei
In Room: ExHall D Poster Location: Poster #170 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Goku: Flow Based Video Generative Foundation Models
Shoufa Chen ⋅ Chongjian GE ⋅ Yuqi Zhang ⋅ Yida Zhang ⋅ Fengda Zhu ⋅ Hao Yang ⋅ Hongxiang Hao ⋅ hui wu ⋅ Zhichao Lai ⋅ Yifei Hu ⋅ Ting-Che Lin ⋅ Shilong Zhang ⋅ Fu Li ⋅ Chuan Li ⋅ Xing Wang ⋅ Yanghua Peng ⋅ Peize Sun ⋅ Ping Luo ⋅ Yi Jiang ⋅ Zehuan Yuan ⋅ BINGYUE PENG ⋅ Xiaobing Liu
In Room: ExHall D Poster Location: Poster #235 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning Conditional Space-Time Prompt Distributions for Video Class-Incremental Learning
Xiaohan Zou ⋅ Wenchao Ma ⋅ Shu Zhao
In Room: ExHall D Poster Location: Poster #449 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Convex Combination Star Shape Prior for Data-driven Image Semantic Segmentation
Xinyu Zhao ⋅ Jun Xie ⋅ Shengzhe Chen ⋅ Jun Liu
In Room: ExHall D Poster Location: Poster #327 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hyperbolic Safety-Aware Vision-Language Models Project Page ↗
Tobia Poppi ⋅ Tejaswi Kasarla ⋅ Pascal Mettes ⋅ Lorenzo Baraldi ⋅ Rita Cucchiara
In Room: ExHall D Poster Location: Poster #387 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
WISH: Weakly Supervised Instance Segmentation using Heterogeneous Labels
Hyeokjun Kweon ⋅ Kuk-Jin Yoon
In Room: ExHall D Poster Location: Poster #414 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Relative Pose Estimation through Affine Corrections of Monocular Depth Priors Project Page ↗
Yifan Yu ⋅ Shaohui Liu ⋅ Rémi Pautrat ⋅ Marc Pollefeys ⋅ Viktor Larsson
In Room: ExHall D Poster Location: Poster #84 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Occlusion-aware Text-Image-Point Cloud Pretraining for Open-World 3D Object Recognition Project Page ↗
Khanh Nguyen ⋅ Ghulam Mubashar Hassan ⋅ Ajmal Mian
In Room: ExHall D Poster Location: Poster #110 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
V2X-R: Cooperative LiDAR-4D Radar Fusion with Denoising Diffusion for 3D Object Detection
Xun Huang ⋅ Jinlong Wang ⋅ Qiming Xia ⋅ Siheng Chen ⋅ Bisheng Yang ⋅ Xin Li ⋅ Cheng Wang ⋅ Chenglu Wen
In Room: ExHall D Poster Location: Poster #118 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Foundations of the Theory of Performance-Based Ranking
Sébastien Piérard ⋅ Anaïs Halin ⋅ Anthony Cioppa ⋅ Adrien Deliege ⋅ Marc Van Droogenbroeck
In Room: ExHall D Poster Location: Poster #348 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Community Forensics: Using Thousands of Generators to Train Fake Image Detectors Project Page ↗
Jeongsoo Park ⋅ Andrew Owens
In Room: ExHall D Poster Location: Poster #274 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Generating Multimodal Driving Scenes via Next-Scene Prediction
Yanhao Wu ⋅ Haoyang Zhang ⋅ Tianwei Lin ⋅ Alan Huang ⋅ Shujie Luo ⋅ Rui Wu ⋅ Congpei Qiu ⋅ Wei Ke ⋅ Tong Zhang
In Room: ExHall D Poster Location: Poster #141 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
BIGS: Bimanual Category-agnostic Interaction Reconstruction from Monocular Videos via 3D Gaussian Splatting Project Page ↗
Jeongwan On ⋅ Kyeonghwan Gwak ⋅ Gunyoung Kang ⋅ Junuk Cha ⋅ Soohyun Hwang ⋅ Hyein Hwang ⋅ Seungryul Baek
In Room: ExHall D Poster Location: Poster #157 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MetaWriter: Personalized Handwritten Text Recognition Using Meta-Learned Prompt Tuning
Wenhao Gu ⋅ Li Gu ⋅ Ching Suen ⋅ Yang Wang
In Room: ExHall D Poster Location: Poster #233 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Subnet-Aware Dynamic Supernet Training for Neural Architecture Search Project Page ↗
Jeimin Jeon ⋅ Youngmin Oh ⋅ Junghyup Lee ⋅ Donghyeon Baek ⋅ Dohyung Kim ⋅ Chanho Eom ⋅ Bumsub Ham
In Room: ExHall D Poster Location: Poster #381 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MoVE-KD: Knowledge Distillation for VLMs with Mixture of Visual Encoders
jiajun cao ⋅ Yuan Zhang ⋅ Tao Huang ⋅ Ming Lu ⋅ Qizhe Zhang ⋅ Ruichuan An ⋅ Ningning Ma ⋅ Shanghang Zhang
In Room: ExHall D Poster Location: Poster #385 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
CamFreeDiff: Camera-free Image to Panorama Generation with Diffusion Model
Xiaoding Yuan ⋅ Shitao Tang ⋅ Kejie Li ⋅ Peng Wang
In Room: ExHall D Poster Location: Poster #54 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Improving Visual and Downstream Performance of Low-Light Enhancer with Vision Foundation Models Collaboration
yuxuan Gu ⋅ Huaian Chen ⋅ Yi Jin ⋅ Haoxuan Wang ⋅ Pengyang Ling ⋅ ZHIXIANG WEI ⋅ Enhong Chen
In Room: ExHall D Poster Location: Poster #20 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EchoWorld: Learning Motion-Aware World Models for Echocardiography Probe Guidance
Yang Yue ⋅ Yulin Wang ⋅ Haojun Jiang ⋅ Pan Liu ⋅ Shiji Song ⋅ Gao Huang
In Room: ExHall D Poster Location: Poster #476 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FineLIP: Extending CLIP’s Reach via Fine-Grained Alignment with Longer Text Inputs
Mothilal Asokan ⋅ Kebin wu ⋅ Fatima Albreiki
In Room: ExHall D Poster Location: Poster #367 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Neural Hierarchical Decomposition for Single Image Plant Modeling
Zhihao Liu ⋅ Zhanglin Cheng ⋅ Naoto Yokoya
In Room: ExHall D Poster Location: Poster #53 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Illumination Spectrum Estimation for Multispectral Images via Surface Reflectance Modeling and Spatial-Spectral Feature Generation
Hyejin Oh ⋅ Woo-Shik Kim ⋅ Sangyoon Lee ⋅ YungKyung Park ⋅ Jewon Kang
In Room: ExHall D Poster Location: Poster #192 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UHD-processer: Unified UHD Image Restoration with Progressive Frequency Learning and Degradation-aware Prompts
Yidi Liu ⋅ Dong Li ⋅ Xueyang Fu ⋅ Xin Lu ⋅ Jie Huang ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #196 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models Project Page ↗
Jiacong Xu ⋅ Shao-Yuan Lo ⋅ Bardia Safaei ⋅ Vishal M. Patel ⋅ Isht Dwivedi
In Room: ExHall D Poster Location: Poster #435 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AIpparel: A Multimodal Foundation Model for Digital Garments Project Page ↗
Kiyohiro Nakayama ⋅ Jan Ackermann ⋅ Timur Levent Kesdogan ⋅ Yang Zheng ⋅ Maria Korosteleva ⋅ Olga Sorkine-Hornung ⋅ Leonidas Guibas ⋅ Guandao Yang ⋅ Gordon Wetzstein
In Room: ExHall D Poster Location: Poster #264 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Video-Guided Foley Sound Generation with Multimodal Controls Project Page ↗
Ziyang Chen ⋅ Prem Seetharaman ⋅ Bryan Russell ⋅ Oriol Nieto ⋅ David Bourgin ⋅ Andrew Owens ⋅ Justin Salamon
In Room: ExHall D Poster Location: Poster #285 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SACB-Net: Spatial-awareness Convolutions for Medical Image Registration Project Page ↗
Xinxing Cheng ⋅ Tianyang Zhang ⋅ Wenqi Lu ⋅ Qingjie Meng ⋅ Alejandro F Frangi ⋅ Jinming Duan
In Room: ExHall D Poster Location: Poster #484 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DCEvo: Discriminative Cross-Dimensional Evolutionary Learning for Infrared and Visible Image Fusion
Jinyuan Liu ⋅ Bowei Zhang ⋅ Qingyun Mei ⋅ Xingyuan Li ⋅ Yang Zou ⋅ Zhiying Jiang ⋅ Long Ma ⋅ Risheng Liu ⋅ Xin Fan
In Room: ExHall D Poster Location: Poster #193 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TSD-SR: One-Step Diffusion with Target Score Distillation for Real-World Image Super-Resolution
linwei dong ⋅ Qingnan Fan ⋅ Yihong Guo ⋅ Zhonghao Wang ⋅ Qi Zhang ⋅ Jinwei Chen ⋅ Yawei Luo ⋅ Changqing Zou
In Room: ExHall D Poster Location: Poster #202 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Fast3R: Towards 3D Reconstruction of 1000+ Images in One Forward Pass
Jianing "Jed" Yang ⋅ Alexander Sax ⋅ Kevin Liang ⋅ Mikael Henaff ⋅ Hao Tang ⋅ Ang Cao ⋅ Joyce Chai ⋅ Franziska Meier ⋅ Matt Feiszli
In Room: ExHall D Poster Location: Poster #83 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CTRL-O: Language-Controllable Object-Centric Visual Representation Learning Project Page ↗
Aniket Rajiv Didolkar ⋅ Andrii Zadaianchuk ⋅ Rabiul Awal ⋅ Maximilian Seitzer ⋅ Efstratios Gavves ⋅ Aishwarya Agrawal
In Room: ExHall D Poster Location: Poster #322 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PO3AD: Predicting Point Offsets toward Better 3D Point Cloud Anomaly Detection
Jianan Ye ⋅ Weiguang Zhao ⋅ Xi Yang ⋅ Guangliang Cheng ⋅ Kaizhu Huang
In Room: ExHall D Poster Location: Poster #110 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation Project Page ↗
Gyeongrok Oh ⋅ Sung June Kim ⋅ Heeju Ko ⋅ Hyunggun Chi ⋅ Jinkyu Kim ⋅ Dongwook Lee ⋅ Daehyun Ji ⋅ Sungjoon Choi ⋅ Sujin Jang ⋅ Sangpil Kim
In Room: ExHall D Poster Location: Poster #126 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Can Large Vision-Language Models Correct Semantic Grounding Errors By Themselves? Project Page ↗
Yuan-Hong Liao ⋅ Rafid Mahmood ⋅ Sanja Fidler ⋅ David Acuna
In Room: ExHall D Poster Location: Poster #385 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SET: Spectral Enhancement for Tiny Object Detection
Huixin Sun ⋅ Runqi Wang ⋅ Yanjing Li ⋅ Linlin Yang ⋅ Shaohui Lin ⋅ Xianbin Cao ⋅ Baochang Zhang
In Room: ExHall D Poster Location: Poster #435 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks Project Page ↗
Zihan Wang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #339 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Arc2Avatar: Generating Expressive 3D Avatars from a Single Image via ID Guidance Project Page ↗
Dimitrios Gerogiannis ⋅ Foivos Paraperas Papantoniou ⋅ Rolandos Alexandros Potamias ⋅ Alexandros Lattas ⋅ Stefanos Zafeiriou
In Room: ExHall D Poster Location: Poster #11 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Temporal Action Detection Model Compression by Progressive Block Drop
Xiaoyong Chen ⋅ Yong Guo ⋅ Jiaming Liang ⋅ Sitong Zhuang ⋅ Runhao Zeng ⋅ Xiping Hu
In Room: ExHall D Poster Location: Poster #294 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Face Forgery Video Detection via Temporal Forgery Cue Unraveling Project Page ↗
Zonghui Guo ⋅ YingJie Liu ⋅ Jie Zhang ⋅ Haiyong Zheng ⋅ Shiguang Shan
In Room: ExHall D Poster Location: Poster #194 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Temporally Consistent Object-Centric Learning by Contrasting Slots
Anna Manasyan ⋅ Maximilian Seitzer ⋅ Filip Radovic ⋅ Georg Martius ⋅ Andrii Zadaianchuk
In Room: ExHall D Poster Location: Poster #161 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
Dong Li ⋅ Wenqi Zhong ⋅ Wei Yu ⋅ Yingwei Pan ⋅ Dingwen Zhang ⋅ Ting Yao ⋅ Junwei Han ⋅ Tao Mei
In Room: ExHall D Poster Location: Poster #151 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Exploring Contextual Attribute Density in Referring Expression Counting
Zhicheng Wang ⋅ Zhiyu Pan ⋅ Zhan Peng ⋅ Jian Cheng ⋅ Liwen Xiao ⋅ Wei Jiang ⋅ Zhiguo Cao
In Room: ExHall D Poster Location: Poster #360 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DINOv2 Meets Text: A Unified Framework for Image- and Pixel-Level Vision-Language Alignment
Dahyun Kang ⋅ Piotr Bojanowski ⋅ Huy V. Vo ⋅ Théo Moutakanni ⋅ Cijo Jose ⋅ Federico Baldassarre ⋅ Patrick Labatut ⋅ Michael Ramamonjisoa ⋅ Maxime Oquab ⋅ Timothée Darcet ⋅ Hu Xu ⋅ Shang-Wen Li ⋅ Oriane Simeoni ⋅ Marc Szafraniec
In Room: ExHall D Poster Location: Poster #370 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning Affine Correspondences by Integrating Geometric Constraints Project Page ↗
Pengju Sun ⋅ Banglei Guan ⋅ Zhenbao Yu ⋅ Yang Shang ⋅ Qifeng Yu ⋅ Daniel Barath
In Room: ExHall D Poster Location: Poster #85 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Multi-Modal Contrastive Masked Autoencoders: A Two-Stage Progressive Pre-training Approach for RGBD Datasets
Muhammad Abdullah Jamal ⋅ Omid Mohareri
In Room: ExHall D Poster Location: Poster #204 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
HaWoR: World-Space Hand Motion Reconstruction from Egocentric Videos Project Page ↗
Jinglei Zhang ⋅ Jiankang Deng ⋅ Chao Ma ⋅ Rolandos Alexandros Potamias
In Room: ExHall D Poster Location: Poster #152 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Font-Agent: Enhancing Font Understanding with Large Language Models
Yingxin Lai ⋅ Cuijie Xu ⋅ Haitian Shi ⋅ Guoqing Yang ⋅ Xiaoning Li ⋅ Zhiming Luo ⋅ Shaozi Li
In Room: ExHall D Poster Location: Poster #368 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
RADIOv2.5: Improved Baselines for Agglomerative Vision Foundation Models
Greg Heinrich ⋅ Mike Ranzinger ⋅ Danny Yin ⋅ Yao Lu ⋅ Jan Kautz ⋅ Bryan Catanzaro ⋅ Andrew Tao ⋅ Pavlo Molchanov
In Room: ExHall D Poster Location: Poster #136 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
High Temporal Consistency through Semantic Similarity Propagation in Semi-Supervised Video Semantic Segmentation for Autonomous Flight Project Page ↗
Cédric Vincent ⋅ Taehyoung Kim ⋅ Henri Meeß
In Room: ExHall D Poster Location: Poster #121 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding Project Page ↗
Jinlong Li ⋅ Cristiano Saltori ⋅ Fabio Poiesi ⋅ Nicu Sebe
In Room: ExHall D Poster Location: Poster #342 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SVLTA: Benchmarking Vision-Language Temporal Alignment via Synthetic Video Situation Project Page ↗
Hao Du ⋅ Bo Wu ⋅ Yan Lu ⋅ Zhendong Mao
In Room: ExHall D Poster Location: Poster #301 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Mixture of Submodules for Domain Adaptive Person Search
Minsu Kim ⋅ Seungryong Kim ⋅ Kwanghoon Sohn
In Room: ExHall D Poster Location: Poster #320 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Unsupervised Discovery of Facial Landmarks and Head Pose
Satyajit Tourani ⋅ Siddharth Tourani ⋅ Arif Mahmood ⋅ Muhammad Haris Khan
In Room: ExHall D Poster Location: Poster #14 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Instruct-CLIP: Improving Instruction-Guided Image Editing with Automated Data Refinement Using Contrastive Learning
Sherry X. Chen ⋅ Misha Sra ⋅ Pradeep Sen
In Room: ExHall D Poster Location: Poster #224 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Stabilizing and Accelerating Autofocus with Expert Trajectory Regularized Deep Reinforcement Learning
Shouhang Zhu ⋅ Chenglin Li ⋅ Yuankun Jiang ⋅ Li Wei ⋅ Nuowen Kan ⋅ Ziyang Zheng ⋅ Wenrui Dai ⋅ Junni Zou ⋅ Hongkai Xiong
In Room: ExHall D Poster Location: Poster #24 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SharpDepth: Sharpening Metric Depth Predictions Using Diffusion Distillation Project Page ↗
Duc-Hai Pham ⋅ Tung Do ⋅ Phong Nguyen ⋅ Binh-Son Hua ⋅ Khoi Nguyen ⋅ Rang Nguyen
In Room: ExHall D Poster Location: Poster #119 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MambaVision: A Hybrid Mamba-Transformer Vision Backbone Project Page ↗
Ali Hatamizadeh ⋅ Jan Kautz
In Room: ExHall D Poster Location: Poster #403 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
NTClick: Achieving Precise Interactive Segmentation With Noise-tolerant Clicks
Chenyi Zhang ⋅ Ting Liu ⋅ Xiaochao Qu ⋅ Luoqi Liu ⋅ Yao Zhao ⋅ Yunchao Wei
In Room: ExHall D Poster Location: Poster #340 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Repurposing Stable Diffusion Attention for Training-Free Unsupervised Interactive Segmentation
Markus Karmann ⋅ Onay Urfalioglu
In Room: ExHall D Poster Location: Poster #333 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reason-before-Retrieve: One-Stage Reflective Chain-of-Thoughts for Training-Free Zero-Shot Composed Image Retrieval Project Page ↗
Yuanmin Tang ⋅ Jue Zhang ⋅ Xiaoting Qin ⋅ Jing Yu ⋅ Gaopeng Gou ⋅ Gang Xiong ⋅ Qingwei Lin ⋅ Saravan Rajmohan ⋅ Dongmei Zhang ⋅ Qi Wu
In Room: ExHall D Poster Location: Poster #359 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GO-N3RDet: Geometry Optimized NeRF-enhanced 3D Object Detector Project Page ↗
Zechuan Li ⋅ Hongshan Yu ⋅ Yihao Ding ⋅ Jinhao Qiao ⋅ Basim Azam ⋅ Naveed Akhtar
In Room: ExHall D Poster Location: Poster #101 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
EvEnhancer: Empowering Effectiveness, Efficiency and Generalizability for Continuous Space-Time Video Super-Resolution with Events Project Page ↗
Shuoyan Wei ⋅ Feng Li ⋅ Shengeng Tang ⋅ Yao Zhao ⋅ Huihui Bai
In Room: ExHall D Poster Location: Poster #186 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Simulator HC: Regression-based Online Simulation of Starting Problem-Solution Pairs for Homotopy Continuation in Geometric Vision Project Page ↗
Xinyue Zhang ⋅ Zijia Dai ⋅ Wanting Xu ⋅ Laurent Kneip
In Room: ExHall D Poster Location: Poster #91 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dynamic Integration of Task-Specific Adapters for Class Incremental Learning
Jiashuo Li ⋅ Shaokun Wang ⋅ Bo Qian ⋅ Yuhang He ⋅ Xing Wei ⋅ Qiang Wang ⋅ Yihong Gong
In Room: ExHall D Poster Location: Poster #421 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MoFlow: One-Step Flow Matching for Human Trajectory Forecasting via Implicit Maximum Likelihood Estimation based Distillation Project Page ↗
Yuxiang Fu ⋅ Qi Yan ⋅ Ke Li ⋅ Lele Wang ⋅ Renjie Liao
In Room: ExHall D Poster Location: Poster #140 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Narrating the Video: Boosting Text-Video Retrieval via Comprehensive Utilization of Frame-Level Captions Project Page ↗
Chan Hur ⋅ Jeong-hun Hong ⋅ Dong-hun Lee ⋅ Dabin Kang ⋅ Semin Myeong ⋅ Sang-hyo Park ⋅ Hyeyoung Park
In Room: ExHall D Poster Location: Poster #292 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MaRI: Material Retrieval Integration across Domains
Jianhui Wang ⋅ Zhifei Yang ⋅ Yangfan He ⋅ Huixiong Zhang ⋅ Yuxuan Chen ⋅ Jingwei Huang
In Room: ExHall D Poster Location: Poster #35 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GeoMM: On Geodesic Perspective for Multi-modal Learning
Shibin Mei ⋅ Hang Wang ⋅ Bingbing Ni
In Room: ExHall D Poster Location: Poster #441 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
Xueqing Wu ⋅ Yuheng Ding ⋅ Bingxuan Li ⋅ Pan Lu ⋅ Da Yin ⋅ Kai-Wei Chang ⋅ Nanyun Peng
In Room: ExHall D Poster Location: Poster #396 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhanced OoD Detection through Cross-Modal Alignment of Multi-Modal Representations Project Page ↗
Jeonghyeon Kim ⋅ Sangheum Hwang
In Room: ExHall D Poster Location: Poster #366 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Breaking the Memory Barrier of Contrastive Loss via Tile-Based Strategy
Zesen Cheng ⋅ Hang Zhang ⋅ Kehan Li ⋅ Sicong Leng ⋅ Zhiqiang Hu ⋅ Fei Wu ⋅ Deli Zhao ⋅ Xin Li ⋅ Lidong Bing
In Room: ExHall D Poster Location: Poster #444 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training
Raktim Gautam Goswami ⋅ Prashanth Krishnamurthy ⋅ Yann LeCun ⋅ Farshad Khorrami
In Room: ExHall D Poster Location: Poster #149 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dissecting and Mitigating Diffusion Bias via Mechanistic Interpretability Project Page ↗
Yingdong Shi ⋅ Changming Li ⋅ Yifan Wang ⋅ Yongxiang Zhao ⋅ Anqi Pang ⋅ Sibei Yang ⋅ Jingyi Yu ⋅ Kan Ren
In Room: ExHall D Poster Location: Poster #269 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Learning Physics-Based Full-Body Human Reaching and Grasping from Brief Walking References Project Page ↗
Yitang Li ⋅ Mingxian Lin ⋅ Zhuo Lin ⋅ Yipeng Deng ⋅ Yue Cao ⋅ Li Yi
In Room: ExHall D Poster Location: Poster #144 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Commonsense Video Question Answering through Video-Grounded Entailment Tree Reasoning
Huabin Liu ⋅ Filip Ilievski ⋅ Cees G. M. Snoek
In Room: ExHall D Poster Location: Poster #296 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GPVK-VL: Geometry-Preserving Virtual Keyframes for Visual Localization under Large Viewpoint Changes
Yunxuan Li ⋅ Lei Fan ⋅ Xiaoying Xing ⋅ Jianxiong Zhou ⋅ Ying Wu
In Room: ExHall D Poster Location: Poster #86 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Graph Neural Network Combining Event Stream and Periodic Aggregation for Low-Latency Event-based Vision
Manon Dampfhoffer ⋅ Thomas Mesquida ⋅ Damien Joubert ⋅ Thomas Dalgaty ⋅ Pascal Vivet ⋅ Christoph Posch
In Room: ExHall D Poster Location: Poster #147 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Be More Specific: Evaluating Object-centric Realism in Synthetic Images
Anqi Liang ⋅ Ciprian Adrian Corneanu ⋅ Qianli Feng ⋅ Giorgio Giannone ⋅ Aleix Martinez
In Room: ExHall D Poster Location: Poster #255 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Correlative and Discriminative Label Grouping for Multi-Label Visual Prompt Tuning Project Page ↗
Lei-Lei Ma ⋅ Shuo Xu ⋅ Ming-Kun Xie ⋅ Lei Wang ⋅ Dengdi Sun ⋅ Haifeng Zhao
In Room: ExHall D Poster Location: Poster #419 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models Project Page ↗
Enis Simsar ⋅ Thomas Hofmann ⋅ Federico Tombari ⋅ Pinar Yanardag
In Room: ExHall D Poster Location: Poster #242 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ArtFormer: Controllable Generation of Diverse 3D Articulated Objects Project Page ↗
Jiayi Su ⋅ Youhe Feng ⋅ Zheng Li ⋅ Jinhua Song ⋅ Yangfan He ⋅ Botao Ren ⋅ Botian Xu
In Room: ExHall D Poster Location: Poster #160 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Opportunistic Single-Photon Time of Flight
Sotiris Nousias ⋅ Mian Wei ⋅ Howard Xiao ⋅ Maxx Wu ⋅ Shahmeer Athar ⋅ Kevin J Wang ⋅ Anagh Malik ⋅ David A. Barmherzig ⋅ David B. Lindell ⋅ Kiriakos Kutulakos
In Room: ExHall D Poster Location: Poster #68 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Finsler Multi-Dimensional Scaling: Manifold Learning for Asymmetric Dimensionality Reduction and Embedding
Thomas Dagès ⋅ Simon Weber ⋅ Ya-Wei Eileen Lin ⋅ Ronen Talmon ⋅ Daniel Cremers ⋅ Michael Lindenbaum ⋅ Alfred M. Bruckstein ⋅ Ron Kimmel
In Room: ExHall D Poster Location: Poster #462 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Argus: Vision-Centric Reasoning with Grounded Chain-of-Thought
Yunze Man ⋅ De-An Huang ⋅ Guilin Liu ⋅ Shiwei Sheng ⋅ Shilong Liu ⋅ Liangyan Gui ⋅ Jan Kautz ⋅ Yu-Xiong Wang ⋅ Zhiding Yu
In Room: ExHall D Poster Location: Poster #346 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Bootstrap Your Own Views: Masked Ego-Exo Modeling for Fine-grained View-invariant Video Representations
Jungin Park ⋅ Jiyoung Lee ⋅ Kwanghoon Sohn
In Room: ExHall D Poster Location: Poster #288 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SFDM: Robust Decomposition of Geometry and Reflectance for Realistic Face Rendering from Sparse-view Images
Daisheng Jin ⋅ Jiangbei Hu ⋅ Baixin Xu ⋅ Yuxin Dai ⋅ Chen Qian ⋅ Ying He
In Room: ExHall D Poster Location: Poster #21 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiSRT-In-Bed: Diffusion-Based Sim-to-Real Transfer Framework for In-Bed Human Mesh Recovery Project Page ↗
Jing Gao ⋅ Ce Zheng ⋅ Laszlo Jeni ⋅ Zackory Erickson
In Room: ExHall D Poster Location: Poster #154 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
QMambaBSR: Burst Image Super-Resolution with Query State Space Model
Xin Di ⋅ Long Peng ⋅ Peizhe Xia ⋅ Wenbo Li ⋅ Renjing Pei ⋅ Yang Wang ⋅ Yang Cao ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #192 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ArcPro: Architectural Programs for Structured 3D Abstraction of Sparse Points Project Page ↗
Qirui Huang ⋅ Runze Zhang ⋅ Kangjun Liu ⋅ Minglun Gong ⋅ Hao Zhang ⋅ Hui Huang
In Room: ExHall D Poster Location: Poster #114 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis
Tongtong Su ⋅ Chengyu Wang ⋅ Bingyan Liu ⋅ Jun Huang ⋅ Dongming Lu
In Room: ExHall D Poster Location: Poster #229 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Multi-Group Proportional Representations for Text-to-Image Models
Sangwon Jung ⋅ Alex Oesterling ⋅ Claudio Mayrink Verdun ⋅ Sajani Vithana ⋅ Taesup Moon ⋅ Flavio Calmon
In Room: ExHall D Poster Location: Poster #261 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Generalizable Trajectory Prediction using Dual-Level Representation Learning and Adaptive Prompting
Kaouther Messaoud ⋅ Matthieu Cord ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #134 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Seeing A 3D World in A Grain of Sand Project Page ↗
Yufan Zhang ⋅ Yu Ji ⋅ Yu Guo ⋅ Jinwei Ye
In Room: ExHall D Poster Location: Poster #51 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
COUNTS: Benchmarking Object Detectors and Multimodal Large Language Models under Distribution Shifts
Jiansheng Li ⋅ Xingxuan Zhang ⋅ Hao Zou ⋅ Yige Guo ⋅ Renzhe Xu ⋅ Yilong Liu ⋅ Chuzhao Zhu ⋅ Yue He ⋅ Peng Cui
In Room: ExHall D Poster Location: Poster #364 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Retrieving Semantics from the Deep: an RAG Solution for Gesture Synthesis Project Page ↗
M. Hamza Mughal ⋅ Rishabh Dabral ⋅ Merel CJ Scholman ⋅ Vera Demberg ⋅ Christian Theobalt
In Room: ExHall D Poster Location: Poster #71 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards a Universal Synthetic Video Detector: From Face or Background Manipulations to Fully AI-Generated Content Project Page ↗
Rohit Kundu ⋅ Hao Xiong ⋅ Vishal Mohanty ⋅ Athula Balachandran ⋅ Amit K. Roy-Chowdhury
In Room: ExHall D Poster Location: Poster #179 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
All-Day Multi-Camera Multi-Target Tracking
Huijie Fan ⋅ Yu Qiao ⋅ Yihao Zhen ⋅ Tinghui Zhao ⋅ Baojie Fan ⋅ Qiang Wang
In Room: ExHall D Poster Location: Poster #103 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Blurred LiDAR for Sharper 3D: Robust Handheld 3D Scanning with Diffuse LiDAR and RGB Project Page ↗
Nikhil Behari ⋅ Aaron Young ⋅ Siddharth Somasundaram ⋅ Tzofi Klinghoffer ⋅ Akshat Dave ⋅ Ramesh Raskar
In Room: ExHall D Poster Location: Poster #77 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TAROT: Towards Essentially Domain-Invariant Robustness with Theoretical Justification Project Page ↗
Dongyoon Yang ⋅ Jihu Lee ⋅ Yongdai Kim
In Room: ExHall D Poster Location: Poster #454 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PatchDEMUX: A Certifiably Robust Framework for Multi-label Classifiers Against Adversarial Patches Project Page ↗
Dennis Jacob ⋅ Chong Xiang ⋅ Prateek Mittal
In Room: ExHall D Poster Location: Poster #435 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
StarVector: Generating Scalable Vector Graphics Code from Images and Text
Juan Rodriguez ⋅ Abhay Puri ⋅ Shubham Agarwal ⋅ Issam Laradji ⋅ Pau Rodriguez ⋅ Sai Rajeswar ⋅ David Vazquez ⋅ Christopher Pal ⋅ Marco Pedersoli
In Room: ExHall D Poster Location: Poster #31 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Novel View Synthesis with Pixel-Space Diffusion Models
Noam Elata ⋅ Bahjat Kawar ⋅ Yaron Ostrovsky-Berman ⋅ Miriam Farber ⋅ Ron Sokolovsky
In Room: ExHall D Poster Location: Poster #59 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
STCOcc: Sparse Spatial-Temporal Cascade Renovation for 3D Occupancy and Scene Flow Prediction
Zhimin Liao ⋅ Ping Wei ⋅ Shuaijia Chen ⋅ Haoxuan Wang ⋅ Ziyang Ren
In Room: ExHall D Poster Location: Poster #126 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GASP: Gaussian Avatars with Synthetic Priors Project Page ↗
Jack Saunders ⋅ Charlie Hewitt ⋅ Yanan Jian ⋅ Marek Kowalski ⋅ Tadas Baltrusaitis ⋅ Yiye Chen ⋅ Darren Cosker ⋅ Virginia Estellers ⋅ Nicholas Gydé ⋅ Vinay P. Namboodiri ⋅ Benjamin E Lundell
In Room: ExHall D Poster Location: Poster #10 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Object Detection using Event Camera: A MoE Heat Conduction based Detector and A New Benchmark Dataset Project Page ↗
Xiao Wang ⋅ Yu Jin ⋅ Wentao Wu ⋅ Wei Zhang ⋅ Lin Zhu ⋅ Bo Jiang ⋅ Yonghong Tian
In Room: ExHall D Poster Location: Poster #303 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Document Haystacks: Vision-Language Reasoning Over Piles of 1000+ Documents
Jun Chen ⋅ Dannong Xu ⋅ Junjie Fei ⋅ Chun-Mei Feng ⋅ Mohamed Elhoseiny
In Room: ExHall D Poster Location: Poster #362 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
Matteo Farina ⋅ Massimiliano Mancini ⋅ Giovanni Iacca ⋅ Elisa Ricci
In Room: ExHall D Poster Location: Poster #367 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TAGA: Self-supervised Learning for Template-free Animatable Gaussian Articulated Model
Zhichao Zhai ⋅ Guikun Chen ⋅ Wenguan Wang ⋅ Dong Zheng ⋅ Jun Xiao
In Room: ExHall D Poster Location: Poster #11 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
MambaVO: Deep Visual Odometry Based on Sequential Matching Refinement and Training Smoothing
Shuo Wang ⋅ Wanting Li ⋅ Yongcai Wang ⋅ Zhaoxin Fan ⋅ Zhe Huang ⋅ xudong cai ⋅ Jian Zhao ⋅ Deying Li
In Room: ExHall D Poster Location: Poster #101 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Enhancing Online Continual Learning with Plug-and-Play State Space Model and Class-Conditional Mixture of Discretization
Sihao Liu ⋅ Yibo Yang ⋅ Xiaojie Li ⋅ David A. Clifton ⋅ Bernard Ghanem
In Room: ExHall D Poster Location: Poster #447 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Explaining in Diffusion: Explaining a Classifier with Diffusion Semantics Project Page ↗
Tahira Kazimi ⋅ Ritika Allada ⋅ Pinar Yanardag
In Room: ExHall D Poster Location: Poster #397 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Horizon-GS: Unified 3D Gaussian Splatting for Large-Scale Aerial-to-Ground Scenes
Lihan Jiang ⋅ Kerui Ren ⋅ Mulin Yu ⋅ Linning Xu ⋅ Junting Dong ⋅ Tao Lu ⋅ Feng Zhao ⋅ Dahua Lin ⋅ Bo Dai
In Room: ExHall D Poster Location: Poster #62 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Attention Distillation: A Unified Approach to Visual Characteristics Transfer Project Page ↗
Yang Zhou ⋅ Xu Gao ⋅ Zichong Chen ⋅ Hui Huang
In Room: ExHall D Poster Location: Poster #236 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Instant Gaussian Stream: Fast and Generalizable Streaming of Dynamic Scene Reconstruction via Gaussian Splatting Project Page ↗
Jinbo Yan ⋅ Rui Peng ⋅ Zhiyan Wang ⋅ Luyang Tang ⋅ Jiayu Yang ⋅ Jie Liang ⋅ Jiahao Wu ⋅ Ronggang Wang
In Room: ExHall D Poster Location: Poster #65 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DreamRelation: Bridging Customization and Relation Generation
Qingyu Shi ⋅ Lu Qi ⋅ Jianzong Wu ⋅ Jinbin Bai ⋅ Jingbo Wang ⋅ Yunhai Tong ⋅ Xiangtai Li
In Room: ExHall D Poster Location: Poster #251 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
IndoorGS: Geometric Cues Guided Gaussian Splatting for Indoor Scene Reconstruction
Cong Ruan ⋅ Yuesong Wang ⋅ Bin Zhang ⋅ Lili Ju ⋅ Tao Guan
In Room: ExHall D Poster Location: Poster #63 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages
Ashmal Vayani ⋅ Dinura Dissanayake ⋅ Hasindri Watawana ⋅ Noor Ahsan ⋅ Nevasini Sasikumar ⋅ Omkar Thawakar ⋅ Henok Biadglign Ademtew ⋅ Yahya Hmaiti ⋅ Amandeep Kumar ⋅ Kartik Kuckreja ⋅ Mykola Maslych ⋅ Wafa Al Ghallabi ⋅ Mihail Minkov Mihaylov ⋅ Chao Qin ⋅ Abdelrahman Shaker ⋅ Mike Zhang ⋅ Mahardika Krisna Ihsani ⋅ Amiel Gian Esplana ⋅ Monil Gokani ⋅ Shachar Mirkin ⋅ Harsh Singh ⋅ Ashay Srivastava ⋅ Endre Hamerlik ⋅ Fathinah Asma Izzati ⋅ Fadillah Adamsyah Maani ⋅ Sebastian Cavada ⋅ Jenny Chim ⋅ Rohit Gupta ⋅ Sanjay Manjunath ⋅ Kamila Zhumakhanova ⋅ Feno Heriniaina Rabevohitra ⋅ Azril Hafizi Amirudin ⋅ Muhammad Ridzuan ⋅ Daniya Najiha Abdul Kareem ⋅ Ketan Pravin More ⋅ Kunyang Li ⋅ Pramesh Shakya ⋅ Muhammad Saad ⋅ Amirpouya Ghasemaghaei ⋅ Amirbek Djanibekov ⋅ Dilshod Azizov ⋅ Branislava Jankovic ⋅ Naman Bhatia ⋅ Alvaro Cabrera Berobide ⋅ Johan Obando-Ceron ⋅ Olympiah Otieno ⋅ Fabian Farestam ⋅ Muztoba Rabbani ⋅ Sanoojan Baliah ⋅ Santosh Sanjeev ⋅ Abduragim Shtanchaev ⋅ Maheen Fatima ⋅ Thao Nguyen ⋅ Amrin Kareem ⋅ Toluwani Aremu ⋅ Nathan Augusto Zacarias Xavier ⋅ Amit Bhatkal ⋅ Hawau Olamide Toyin ⋅ Aman Chadha ⋅ Hisham Cholakkal ⋅ Rao Anwer ⋅ Michael Felsberg ⋅ Jorma Laaksonen ⋅ Thamar Solorio ⋅ Monojit Choudhury ⋅ Ivan Laptev ⋅ Mubarak Shah ⋅ Salman Khan ⋅ Fahad Shahbaz Khan
In Room: ExHall D Poster Location: Poster #358 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Point-Cache: Test-time Dynamic and Hierarchical Cache for Robust and Generalizable Point Cloud Analysis Project Page ↗
Hongyu Sun ⋅ Qiuhong Ke ⋅ Ming Cheng ⋅ Yongcai Wang ⋅ Deying Li ⋅ Chenhui Gou ⋅ Jianfei Cai
In Room: ExHall D Poster Location: Poster #102 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MoManipVLA: Transferring Vision-language-action Models for General Mobile Manipulation
Zhenyu Wu ⋅ Yuheng Zhou ⋅ Xiuwei Xu ⋅ Ziwei Wang ⋅ Haibin Yan
In Room: ExHall D Poster Location: Poster #144 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Depth-Guided Bundle Sampling for Efficient Generalizable Neural Radiance Field Reconstruction
Li Fang ⋅ Hao Zhu ⋅ Longlong Chen ⋅ Fei Hu ⋅ Long Ye ⋅ Zhan Ma
In Room: ExHall D Poster Location: Poster #54 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Text Augmented Correlation Transformer For Few-shot Classification & Segmentation
Srinivasa Rao Nandam ⋅ Sara Atito ⋅ Zhenhua Feng ⋅ Josef Kittler ⋅ Muhammad Awais
In Room: ExHall D Poster Location: Poster #412 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Ref-GS: Directional Factorization for 2D Gaussian Splatting Project Page ↗
Youjia Zhang ⋅ Anpei Chen ⋅ Yumin Wan ⋅ Zikai Song ⋅ Junqing Yu ⋅ Yawei Luo ⋅ Wei Yang
In Room: ExHall D Poster Location: Poster #30 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ViKIENet: Towards Efficient 3D Object Detection with Virtual Key Instance Enhanced Network
Zhuochen Yu ⋅ Bijie Qiu ⋅ Andy W. H. Khong
In Room: ExHall D Poster Location: Poster #116 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Feature Selection for Latent Factor Models Project Page ↗
Rittwika Kansabanik ⋅ Adrian Barbu
In Room: ExHall D Poster Location: Poster #440 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MaIR: A Locality- and Continuity-Preserving Mamba for Image Restoration
Boyun Li ⋅ Haiyu Zhao ⋅ Wenxin Wang ⋅ Peng Hu ⋅ Yuanbiao Gou ⋅ Xi Peng
In Room: ExHall D Poster Location: Poster #203 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Few-shot Implicit Function Generation via Equivariance
Suizhi Huang ⋅ Xingyi Yang ⋅ Hongtao Lu ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #39 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards Million-Scale Adversarial Robustness Evaluation With Stronger Individual Attacks
Yong Xie ⋅ Weijie Zheng ⋅ Hanxun Huang ⋅ Guangnan Ye ⋅ Xingjun Ma
In Room: ExHall D Poster Location: Poster #436 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
RSAR: Restricted State Angle Resolver and Rotated SAR Benchmark
Xin Zhang ⋅ Xue Yang ⋅ Yuxuan Li ⋅ Jian Yang ⋅ Ming-Ming Cheng ⋅ Xiang Li
In Room: ExHall D Poster Location: Poster #196 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dual Energy-Based Model with Open-World Uncertainty Estimation for Out-of-distribution Detection
Qi Chen ⋅ Hu Ding
In Room: ExHall D Poster Location: Poster #449 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DTGBrepGen: A Novel B-rep Generative Model through Decoupling Topology and Geometry Project Page ↗
Jing Li ⋅ Yihang Fu ⋅ Falai Chen
In Room: ExHall D Poster Location: Poster #37 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Revisiting MAE Pre-training for 3D Medical Image Segmentation
Tassilo Wald ⋅ Constantin Ulrich ⋅ Stanislav Lukyanenko ⋅ Andrei Goncharov ⋅ Alberto Paderno ⋅ Maximilian Miller ⋅ Leander Maerkisch ⋅ Paul F Jaeger ⋅ Klaus Maier-Hein
In Room: ExHall D Poster Location: Poster #480 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-Modal Synergistic Implicit Image Enhancement for Efficient Optical Flow Estimation
Weichen Dai ⋅ wu hexing ⋅ xiaoyang weng ⋅ Yuxin Zheng ⋅ Yuhang Ming ⋅ Wanzeng Kong
In Room: ExHall D Poster Location: Poster #188 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Test-Time Backdoor Detection for Object Detection Models
Hangtao Zhang ⋅ Yichen Wang ⋅ Shihui Yan ⋅ Chenyu Zhu ⋅ Ziqi Zhou ⋅ Linshan Hou ⋅ Shengshan Hu ⋅ Minghui Li ⋅ Yanjun Zhang ⋅ Leo Yu Zhang
In Room: ExHall D Poster Location: Poster #320 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Learning Audio-guided Video Representation with Gated Attention for Video-Text Retrieval
Boseung Jeong ⋅ Jicheol Park ⋅ Sungyeon Kim ⋅ Suha Kwak
In Room: ExHall D Poster Location: Poster #263 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ProtoDepth: Unsupervised Continual Depth Completion with Prototypes
Patrick Rim ⋅ Hyoungseob Park ⋅ Suchisrit Gangopadhyay ⋅ Ziyao Zeng ⋅ Younjoon Chung ⋅ Alex Wong
In Room: ExHall D Poster Location: Poster #85 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Generative Multiview Relighting for 3D Reconstruction under Extreme Illumination Variation Project Page ↗
Hadi Alzayer ⋅ Philipp Henzler ⋅ Jonathan T. Barron ⋅ Jia-Bin Huang ⋅ Pratul P. Srinivasan ⋅ Dor Verbin
In Room: ExHall D Poster Location: Poster #26 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation Project Page ↗
Hongxiang Zhao ⋅ Xingchen Liu ⋅ Mutian Xu ⋅ Yiming Hao ⋅ Weikai Chen ⋅ Xiaoguang Han
In Room: ExHall D Poster Location: Poster #145 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
NoT: Federated Unlearning via Weight Negation
Yasser Khalil ⋅ Leo Maxime Brunswic ⋅ Soufiane Lamghari ⋅ Xu Li ⋅ Mahdi Beitollahi ⋅ Xi Chen
In Room: ExHall D Poster Location: Poster #452 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
ParaHome: Parameterizing Everyday Home Activities Towards 3D Generative Modeling of Human-Object Interactions Project Page ↗
Jeonghwan Kim ⋅ Jisoo Kim ⋅ Jeonghyeon Na ⋅ Hanbyul Joo
In Room: ExHall D Poster Location: Poster #153 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Adapting to the Unknown: Training-Free Audio-Visual Event Perception with Dynamic Thresholds
Eitan Shaar ⋅ Ariel Shaulov ⋅ Gal Chechik ⋅ Lior Wolf
In Room: ExHall D Poster Location: Poster #285 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DecoupledGaussian: Object-Scene Decoupling for Physics-Based Interaction Project Page ↗
Miaowei Wang ⋅ Yibo Zhang ⋅ Rui Ma ⋅ Weiwei Xu ⋅ Changqing Zou ⋅ Daniel Morris
In Room: ExHall D Poster Location: Poster #67 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation
Hui Li ⋅ Mingwang Xu ⋅ Qingkun Su ⋅ Shan Mu ⋅ Li jiaye ⋅ Kaihui Cheng ⋅ Chen Yuxuan ⋅ Tan Chen ⋅ Mao Ye ⋅ Jingdong Wang ⋅ Siyu Zhu
In Room: ExHall D Poster Location: Poster #228 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Classifier-Free Guidance Inside the Attraction Basin May Cause Memorization
Anubhav Jain ⋅ Yuya Kobayashi ⋅ Takashi Shibuya ⋅ Yuhta Takida ⋅ Nasir Memon ⋅ Julian Togelius ⋅ Yuki Mitsufuji
In Room: ExHall D Poster Location: Poster #212 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Vid2Avatar-Pro: Authentic Avatar from Videos in the Wild via Universal Prior Project Page ↗
Chen Guo ⋅ Junxuan Li ⋅ Yash Kant ⋅ Yaser Sheikh ⋅ Shunsuke Saito ⋅ Chen Cao
In Room: ExHall D Poster Location: Poster #11 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
RANGE: Retrieval Augmented Neural Fields for Multi-Resolution Geo-Embeddings
Aayush Dhakal ⋅ Srikumar Sastry ⋅ Subash Khanal ⋅ Adeel Ahmad ⋅ Eric Xing ⋅ Nathan Jacobs
In Room: ExHall D Poster Location: Poster #349 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SimMotionEdit: Text-Based Human Motion Editing with Motion Similarity Prediction
Zhengyuan Li ⋅ Kai Cheng ⋅ Anindita Ghosh ⋅ Uttaran Bhattacharya ⋅ Liangyan Gui ⋅ Aniket Bera
In Room: ExHall D Poster Location: Poster #158 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SerialGen: Personalized Image Generation by First Standardization Then Personalization
Cong Xie ⋅ Han Zou ⋅ Ruiqi Yu ⋅ Yan Zhang ⋅ Zhan Zhenpeng
In Room: ExHall D Poster Location: Poster #257 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SimAvatar: Simulation-Ready Avatars with Layered Hair and Clothing
Xueting Li ⋅ Ye Yuan ⋅ Shalini De Mello ⋅ Miles Macklin ⋅ Jonathan Leaf ⋅ Gilles Daviet ⋅ Jan Kautz ⋅ Umar Iqbal
In Room: ExHall D Poster Location: Poster #13 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
From Head to Tail: Efficient Black-box Model Inversion Attack via Long-tailed Learning
Ziang Li ⋅ Hongguang Zhang ⋅ Juan Wang ⋅ Meihui Chen ⋅ Hongxin Hu ⋅ Wenzhe Yi ⋅ Xiaoyang Xu ⋅ Mengda Yang ⋅ Chenjun Ma
In Room: ExHall D Poster Location: Poster #300 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Matrix3D: Large Photogrammetry Model All-in-One Project Page ↗
Yuanxun Lu ⋅ Jingyang Zhang ⋅ Tian Fang ⋅ Jean-Daniel Nahmias ⋅ Yanghai Tsin ⋅ Long Quan ⋅ Xun Cao ⋅ Yao Yao ⋅ Shiwei Li
In Room: ExHall D Poster Location: Poster #57 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Proximal Algorithm Unrolling: Flexible and Efficient Reconstruction Networks for Single-Pixel Imaging
Ping Wang ⋅ Lishun Wang ⋅ Gang Qu ⋅ Xiaodong Wang ⋅ Yulun Zhang ⋅ Xin Yuan
In Room: ExHall D Poster Location: Poster #23 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Depth Any Camera: Zero-Shot Metric Depth Estimation from Any Camera
Yuliang Guo ⋅ Sparsh Garg ⋅ S. Mahdi H. Miangoleh ⋅ Xinyu Huang ⋅ Liu Ren
In Room: ExHall D Poster Location: Poster #81 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Image Quality Assessment: From Human to Machine Preference
Chunyi Li ⋅ Yuan Tian ⋅ Xiaoyue Ling ⋅ Zicheng Zhang ⋅ Haodong Duan ⋅ Haoning Wu ⋅ Ziheng Jia ⋅ Xiaohong Liu ⋅ Xiongkuo Min ⋅ Guo Lu ⋅ Weisi Lin ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #210 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AdaptCMVC: Robust Adaption to Incremental Views in Continual Multi-view Clustering
Jing Wang ⋅ Songhe Feng ⋅ Kristoffer Knutsen Wickstrøm ⋅ Michael C. Kampffmeyer
In Room: ExHall D Poster Location: Poster #468 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
UA-Pose: Uncertainty-Aware 6D Object Pose Estimation and Online Object Completion with Partial References
Ming-Feng Li ⋅ Xin Yang ⋅ Fu-En Wang ⋅ Hritam Basak ⋅ Yuyin Sun ⋅ Shreekant Gayaka ⋅ Min Sun ⋅ Cheng-Hao Kuo
In Room: ExHall D Poster Location: Poster #94 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Missing Target-Relevant Information Prediction with World Model for Accurate Zero-Shot Composed Image Retrieval
Yuanmin Tang ⋅ Jing Yu ⋅ Keke Gai ⋅ Jiamin Zhuang ⋅ Gang Xiong ⋅ Gaopeng Gou ⋅ Qi Wu
In Room: ExHall D Poster Location: Poster #359 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Binarized Mamba-Transformer for Lightweight Quad Bayer HybridEVS Demosaicing
Shiyang Zhou ⋅ Haijin Zeng ⋅ Yunfan Lu ⋅ Tong Shao ⋅ Ke Tang ⋅ Yongyong Chen ⋅ Jie Liu ⋅ Jingyong Su
In Room: ExHall D Poster Location: Poster #329 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
Jianzong Wu ⋅ Chao Tang ⋅ Jingbo Wang ⋅ Yanhong Zeng ⋅ Xiangtai Li ⋅ Yunhai Tong
In Room: ExHall D Poster Location: Poster #240 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PhD: A ChatGPT-Prompted Visual Hallucination Evaluation Dataset Project Page ↗
Jiazhen Liu ⋅ Yuhan Fu ⋅ Ruobing Xie ⋅ Runquan Xie ⋅ Xingwu Sun ⋅ Fengzong Lian ⋅ Zhanhui Kang ⋅ Xirong Li
In Room: ExHall D Poster Location: Poster #386 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ClimbingCap: Multi-Modal Dataset and Method for Rock Climbing in World Coordinate Project Page ↗
Ming Yan ⋅ Xincheng Lin ⋅ Yuhua Luo ⋅ Shuqi Fan ⋅ Yudi Dai ⋅ Qixin Zhong ⋅ Lincai Zhong ⋅ Yuexin Ma ⋅ Lan Xu ⋅ Chenglu Wen ⋅ Siqi Shen ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #159 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Estimating Body and Hand Motion in an Ego‑sensed World Project Page ↗
Brent Yi ⋅ Vickie Ye ⋅ Maya Zheng ⋅ Yunqi Li ⋅ Lea Müller ⋅ Georgios Pavlakos ⋅ Yi Ma ⋅ Jitendra Malik ⋅ Angjoo Kanazawa
In Room: ExHall D Poster Location: Poster #164 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Bias-Free Training Paradigm for More General AI-generated Image Detection Project Page ↗
Fabrizio Guillaro ⋅ Giada Zingarini ⋅ Ben Usman ⋅ Avneesh Sud ⋅ Davide Cozzolino ⋅ Luisa Verdoliva
In Room: ExHall D Poster Location: Poster #277 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Evaluating Vision-Language Models as Evaluators in Path Planning
Mohamed Aghzal ⋅ Xiang Yue ⋅ Erion Plaku ⋅ Ziyu Yao
In Room: ExHall D Poster Location: Poster #145 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Transformers without Normalization Project Page ↗
Jiachen Zhu ⋅ Xinlei Chen ⋅ Kaiming He ⋅ Yann LeCun ⋅ Zhuang Liu
In Room: ExHall D Poster Location: Poster #406 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SGC-Net: Stratified Granular Comparison Network for Open-Vocabulary HOI Detection Project Page ↗
Xin Lin ⋅ Chong Shi ⋅ Zuopeng Yang ⋅ Haojin Tang ⋅ Zhili Zhou
In Room: ExHall D Poster Location: Poster #419 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Certified Human Trajectory Prediction Project Page ↗
Mohammadhossein Bahari ⋅ Saeed Saadatnejad ⋅ Amirhossein Askari Farsangi ⋅ Seyed-Mohsen Moosavi-Dezfooli ⋅ Alex Alahi
In Room: ExHall D Poster Location: Poster #158 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Galaxy Walker: Geometry-aware VLMs For Galaxy-scale Understanding
Tianyu Chen ⋅ Xingcheng Fu ⋅ Yisen Gao ⋅ Haodong Qian ⋅ Yuecen Wei ⋅ Kun Yan ⋅ Haoyi Zhou ⋅ Jianxin Li
In Room: ExHall D Poster Location: Poster #376 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DFM: Differentiable Feature Matching for Anomaly Detection
Wu Sheng ⋅ Yimi Wang ⋅ Xudong Liu ⋅ Yuguang Yang ⋅ Runqi Wang ⋅ Guodong Guo ⋅ David Doermann ⋅ Baochang Zhang
In Room: ExHall D Poster Location: Poster #438 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PointSR: Self-Regularized Point Supervision for Drone-View Object Detection
Weizhuo Li ⋅ Yue Xi ⋅ Wenjing Jia ⋅ zehao zhang ⋅ Fei Li ⋅ Xiangzeng Liu ⋅ Qiguang Miao
In Room: ExHall D Poster Location: Poster #102 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MVDoppler-Pose: Multi-Modal Multi-View mmWave Sensing for Long-Distance Self-Occluded Human Walking Pose Estimation Project Page ↗
Jae-Ho Choi ⋅ Soheil Hor ⋅ Shubo Yang ⋅ Amin Arbabian
In Room: ExHall D Poster Location: Poster #151 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Gain from Neighbors: Boosting Model Robustness in the Wild via Adversarial Perturbations Toward Neighboring Classes
Zhou Yang ⋅ Mingtao Feng ⋅ Tao Huang ⋅ Fangfang Wu ⋅ Weisheng Dong ⋅ Xin Li ⋅ Guangming Shi
In Room: ExHall D Poster Location: Poster #426 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
De^2Gaze: Deformable and Decoupled Representation Learning for 3D Gaze Estimation
Yunfeng Xiao ⋅ Xiaowei Bai ⋅ Baojun Chen ⋅ Hao Su ⋅ Hao He ⋅ Liang Xie ⋅ Erwei Yin
In Room: ExHall D Poster Location: Poster #280 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
M^3-VOS: Multi-Phase, Multi-Transition, and Multi-Scenery Video Object Segmentation
Zixuan Chen ⋅ Jiaxin Li ⋅ Junxuan Liang ⋅ Liming Tan ⋅ Yejie Guo ⋅ Cewu Lu ⋅ Yonglu Li
In Room: ExHall D Poster Location: Poster #291 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Self-Expansion of Pre-trained Models with Mixture of Adapters for Continual Learning
Huiyi Wang ⋅ Haodong Lu ⋅ Lina Yao ⋅ Dong Gong
In Room: ExHall D Poster Location: Poster #449 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Brain-Inspired Spiking Neural Networks for Energy-Efficient Object Detection
Ziqi Li ⋅ Tao Gao ⋅ Yisheng An ⋅ Ting Chen ⋅ Jing Zhang ⋅ Yuanbo Wen ⋅ Mengkun Liu ⋅ Qianxi Zhang
In Room: ExHall D Poster Location: Poster #322 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Multi-Granularity Class Prototype Topology Distillation for Class-Incremental Source-Free Unsupervised Domain Adaptation Project Page ↗
Peihua Deng ⋅ Jiehua Zhang ⋅ Xichun Sheng ⋅ Chenggang Yan ⋅ Yaoqi Sun ⋅ Ying Fu ⋅ Liang Li
In Room: ExHall D Poster Location: Poster #423 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Polarization-Aided Transformer for Image Deblurring via Motion Vector Decomposition
Duosheng Chen ⋅ Shihao Zhou ⋅ Jinshan Pan ⋅ Jinglei Shi ⋅ lishen qu ⋅ Jufeng Yang
In Room: ExHall D Poster Location: Poster #180 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Language-Guided Image Tokenization for Generation
Kaiwen Zha ⋅ Lijun Yu ⋅ Alireza Fathi ⋅ David A. Ross ⋅ Cordelia Schmid ⋅ Dina Katabi ⋅ Xiuye Gu
In Room: ExHall D Poster Location: Poster #252 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Img-Diff: Contrastive Data Synthesis for Multimodal Large Language Models Project Page ↗
Qirui Jiao ⋅ Daoyuan Chen ⋅ Yilun Huang ⋅ Bolin Ding ⋅ Yaliang Li ⋅ Ying Shen
In Room: ExHall D Poster Location: Poster #374 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CocoER: Aligning Multi-Level Feature by Competition and Coordination for Emotion Recognition
Xuli Shen ⋅ Hua Cai ⋅ Weilin Shen ⋅ Qing Xu ⋅ Dingding Yu ⋅ Weifeng Ge ⋅ Xiangyang Xue
In Room: ExHall D Poster Location: Poster #328 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Medusa: A Multi-Scale High-order Contrastive Dual-Diffusion Approach for Multi-View Clustering
Liang Chen ⋅ Zhe Xue ⋅ Yawen Li ⋅ Meiyu Liang ⋅ Yan Wang ⋅ Anton van den Hengel ⋅ Yuankai Qi
In Room: ExHall D Poster Location: Poster #469 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Enhancing Creative Generation on Stable Diffusion-based Models
Jiyeon Han ⋅ Dahee Kwon ⋅ Gayoung Lee ⋅ Junho Kim ⋅ Jaesik Choi
In Room: ExHall D Poster Location: Poster #233 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Denoising Functional Maps: Diffusion Models for Shape Correspondence
Aleksei Zhuravlev ⋅ Zorah Lähner ⋅ Vladislav Golyanik
In Room: ExHall D Poster Location: Poster #72 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GAF: Gaussian Avatar Reconstruction from Monocular Videos via Multi-view Diffusion
Jiapeng Tang ⋅ Davide Davoli ⋅ Tobias Kirschstein ⋅ Liam Schoneveld ⋅ Matthias Nießner
In Room: ExHall D Poster Location: Poster #10 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GenVDM: Generating Vector Displacement Maps From a Single Image Project Page ↗
Yuezhi Yang ⋅ Qimin Chen ⋅ Vladimir G. Kim ⋅ Siddhartha Chaudhuri ⋅ Qixing Huang ⋅ Zhiqin Chen
In Room: ExHall D Poster Location: Poster #44 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Effective SAM Combination for Open-Vocabulary Semantic Segmentation
Minhyeok Lee ⋅ Suhwan Cho ⋅ Jungho Lee ⋅ Sunghun Yang ⋅ Heeseung Choi ⋅ Ig-Jae Kim ⋅ Sangyoun Lee
In Room: ExHall D Poster Location: Poster #383 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Masked Scene Modeling: Narrowing the Gap Between Supervised and Self-Supervised Learning in 3D Scene Understanding Project Page ↗
Pedro Hermosilla ⋅ Christian Stippel ⋅ Leon Sick
In Room: ExHall D Poster Location: Poster #400 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ScribbleLight: Single Image Indoor Relighting with Scribbles
Jun Myeong Choi ⋅ Annie N. Wang ⋅ Pieter Peers ⋅ Anand Bhattad ⋅ Roni Sengupta
In Room: ExHall D Poster Location: Poster #26 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Models
Yongting Zhang ⋅ Lu Chen ⋅ Guodong Zheng ⋅ Yifeng Gao ⋅ Rui Zheng ⋅ Jinlan Fu ⋅ Zhenfei Yin ⋅ Senjie Jin ⋅ Yu Qiao ⋅ Xuanjing Huang ⋅ Feng Zhao ⋅ Tao Gui ⋅ Jing Shao
In Room: ExHall D Poster Location: Poster #387 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
UniAP: Unifying Inter- and Intra-Layer Automatic Parallelism by Mixed Integer Quadratic Programming
Hao Lin ⋅ Ke Wu ⋅ Jie Li ⋅ Jun Li ⋅ Wu-Jun Li
In Room: ExHall D Poster Location: Poster #214 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model Project Page ↗
Xiang Gao ⋅ Shuai Yang ⋅ Jiaying Liu
In Room: ExHall D Poster Location: Poster #233 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Attend to Not Attended: Structure-then-Detail Token Merging for Post-training DiT Acceleration
Haipeng Fang ⋅ Sheng Tang ⋅ Juan Cao ⋅ Enshuo Zhang ⋅ Fan Tang ⋅ Tong-yee Lee
In Room: ExHall D Poster Location: Poster #217 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Quantization without Tears Project Page ↗
Minghao Fu ⋅ Hao Yu ⋅ Jie Shao ⋅ Junjie Zhou ⋅ Ke Zhu ⋅ Jianxin Wu
In Room: ExHall D Poster Location: Poster #412 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Turbo3D: Ultra-fast Text-to-3D Generation
Hanzhe Hu ⋅ Tianwei Yin ⋅ Fujun Luan ⋅ Yiwei Hu ⋅ Hao Tan ⋅ Zexiang Xu ⋅ Sai Bi ⋅ Shubham Tulsiani ⋅ Kai Zhang
In Room: ExHall D Poster Location: Poster #252 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SUM Parts: Benchmarking Part-Level Semantic Segmentation of Urban Meshes Project Page ↗
Weixiao Gao ⋅ Liangliang Nan ⋅ Hugo Ledoux
In Room: ExHall D Poster Location: Poster #329 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Higher-Order Ratio Cycles for Fast and Globally Optimal Shape Matching
Paul Roetzer ⋅ Viktoria Ehm ⋅ Daniel Cremers ⋅ Zorah Lähner ⋅ Florian Bernard
In Room: ExHall D Poster Location: Poster #71 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hyperdimensional Uncertainty Quantification for Multimodal Uncertainty Fusion in Autonomous Vehicles Perception
Luke Chen ⋅ Junyao Wang ⋅ Trier Mortlock ⋅ Pramod Khargonekar ⋅ Mohammad Al Faruque
In Room: ExHall D Poster Location: Poster #120 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EDM: Equirectangular Projection-Oriented Dense Kernelized Feature Matching Project Page ↗
Dongki Jung ⋅ Jaehoon Choi ⋅ Yonghan Lee ⋅ Somi Jeong ⋅ Taejae Lee ⋅ Dinesh Manocha ⋅ Suyong Yeon
In Room: ExHall D Poster Location: Poster #92 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Simpler Diffusion: 1.5 FID on ImageNet512 with Pixel-space Diffusion
Emiel Hoogeboom ⋅ Thomas Mensink ⋅ Jonathan Heek ⋅ Kay Lamerigts ⋅ Ruiqi Gao ⋅ Tim Salimans
In Room: ExHall D Poster Location: Poster #215 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Few-shot Personalized Scanpath Prediction Project Page ↗
Ruoyu Xue ⋅ Jingyi Xu ⋅ Sounak Mondal ⋅ Hieu Le ⋅ Gregory Zelinsky ⋅ Minh Hoai ⋅ Dimitris Samaras
In Room: ExHall D Poster Location: Poster #272 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
EZSR: Event-based Zero-Shot Recognition
Yan Yang ⋅ Liyuan Pan ⋅ Dongxu Li ⋅ Liu Liu
In Room: ExHall D Poster Location: Poster #427 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation
Sen Wang ⋅ Le Wang ⋅ Sanping Zhou ⋅ Jingyi Tian ⋅ lijiayi ⋅ Haowen Sun ⋅ Wei Tang
In Room: ExHall D Poster Location: Poster #147 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models Project Page ↗
Ashshak Sharifdeen ⋅ Muhammad Akhtar Munir ⋅ Sanoojan Baliah ⋅ Salman Khan ⋅ Muhammad Haris Khan
In Room: ExHall D Poster Location: Poster #394 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SVFR: A Unified Framework for Generalized Video Face Restoration
Zhiyao Wang ⋅ Xu Chen ⋅ Chengming Xu ⋅ Junwei Zhu ⋅ Xiaobin Hu ⋅ Jiangning Zhang ⋅ Chengjie Wang ⋅ Yuqi Liu ⋅ Yiyi Zhou ⋅ Rongrong Ji
In Room: ExHall D Poster Location: Poster #195 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Dinomaly: The Less Is More Philosophy in Multi-Class Unsupervised Anomaly Detection Project Page ↗
Jia Guo ⋅ Shuai Lu ⋅ Weihang Zhang ⋅ Fang Chen ⋅ Hongen Liao ⋅ Huiqi Li
In Room: ExHall D Poster Location: Poster #438 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Test-Time Visual In-Context Tuning Project Page ↗
Jiahao Xie ⋅ Alessio Tonioni ⋅ Nathalie Rauschmayr ⋅ Federico Tombari ⋅ Bernt Schiele
In Room: ExHall D Poster Location: Poster #400 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Feature4X: Bridging Any Monocular Video to 4D Agentic AI with Versatile Gaussian Feature Fields Project Page ↗
Shijie Zhou ⋅ Hui Ren ⋅ Yijia Weng ⋅ Shuwang Zhang ⋅ Zhen Wang ⋅ Dejia Xu ⋅ Zhiwen Fan ⋅ Suya You ⋅ Zhangyang Wang ⋅ Leonidas Guibas ⋅ Achuta Kadambi
In Room: ExHall D Poster Location: Poster #338 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Prior Does Matter: Visual Navigation via Denoising Diffusion Bridge Models Project Page ↗
Hao Ren ⋅ Yiming Zeng ⋅ Zetong Bi ⋅ Zhaoliang Wan ⋅ Junlong Huang ⋅ Hui Cheng
In Room: ExHall D Poster Location: Poster #140 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SegEarth-OV: Towards Training-Free Open-Vocabulary Segmentation for Remote Sensing Images Project Page ↗
Kaiyu Li ⋅ Ruixun Liu ⋅ Xiangyong Cao ⋅ Xueru Bai ⋅ Feng Zhou ⋅ Deyu Meng ⋅ Wang Zhi
In Room: ExHall D Poster Location: Poster #319 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MeshGen: Generating PBR Textured Mesh with Render-Enhanced Auto-Encoder and Generative Data Augmentation Project Page ↗
Zilong Chen ⋅ Yikai Wang ⋅ Wenqiang Sun ⋅ Feng Wang ⋅ Yiwen Chen ⋅ Huaping Liu
In Room: ExHall D Poster Location: Poster #37 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GIFStream: 4D Gaussian-based Immersive Video with Feature Stream Project Page ↗
Hao Li ⋅ Sicheng Li ⋅ Xiang Gao ⋅ AbudouaihatiBatuer ⋅ Lu Yu ⋅ Yiyi Liao
In Room: ExHall D Poster Location: Poster #67 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Multi-Scale Neighborhood Occupancy Masked Autoencoder for Self-Supervised Learning in LiDAR Point Clouds
Mohamed Abdelsamad ⋅ Michael Ulrich ⋅ Claudius Glaeser ⋅ Abhinav Valada
In Room: ExHall D Poster Location: Poster #113 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DV-Matcher: Deformation-based Non-rigid Point Cloud Matching Guided by Pre-trained Visual Features
Zhangquan Chen ⋅ Puhua Jiang ⋅ Ruqi Huang
In Room: ExHall D Poster Location: Poster #106 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reasoning Mamba: Hypergraph-Guided Region Relation Calculating for Weakly Supervised Affordance Grounding
Yuxuan Wang ⋅ Aming Wu ⋅ Muli Yang ⋅ Yukuan Min ⋅ Yihang Zhu ⋅ Cheng Deng
In Room: ExHall D Poster Location: Poster #139 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Adapter Merging with Centroid Prototype Mapping for Scalable Class-Incremental Learning Project Page ↗
Takuma Fukuda ⋅ Hiroshi Kera ⋅ Kazuhiko Kawamoto
In Room: ExHall D Poster Location: Poster #451 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
OpenSDI: Spotting Diffusion-Generated Images in the Open World Project Page ↗
Yabin Wang ⋅ Zhiwu Huang ⋅ Xiaopeng Hong
In Room: ExHall D Poster Location: Poster #393 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Rethinking Correspondence-based Category-Level Object Pose Estimation Project Page ↗
Huan Ren ⋅ Wenfei Yang ⋅ Shifeng Zhang ⋅ Tianzhu Zhang
In Room: ExHall D Poster Location: Poster #93 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Adaptive Part Learning for Fine-Grained Generalized Category Discovery: A Plug-and-Play Enhancement
Qiyuan Dai ⋅ Hanzhuo Huang ⋅ Yu Wu ⋅ Sibei Yang
In Room: ExHall D Poster Location: Poster #420 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Lux Post Facto: Learning Portrait Performance Relighting with Conditional Video Diffusion and a Hybrid Dataset
Yiqun Mei ⋅ Mingming He ⋅ Li Ma ⋅ Julien Philip ⋅ Wenqi Xian ⋅ David M George ⋅ Xueming Yu ⋅ Gabriel Dedic ⋅ Ahmet Levent Taşel ⋅ Ning Yu ⋅ Vishal M. Patel ⋅ Paul Debevec
In Room: ExHall D Poster Location: Poster #6 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention Project Page ↗
Lianghui Zhu ⋅ Zilong Huang ⋅ Bencheng Liao ⋅ Jun Hao Liew ⋅ Hanshu Yan ⋅ Jiashi Feng ⋅ Xinggang Wang
In Room: ExHall D Poster Location: Poster #219 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Monocular and Generalizable Gaussian Talking Head Animation
Shengjie Gong ⋅ Haojie Li ⋅ Jiapeng Tang ⋅ Dongming Hu ⋅ Shuangping Huang ⋅ Hao Chen ⋅ Tianshui Chen ⋅ Zhuoman Liu
In Room: ExHall D Poster Location: Poster #7 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rethinking Token Reduction with Parameter-Efficient Fine-Tuning in ViT for Pixel-Level Tasks
Cheng Lei ⋅ Ao Li ⋅ Hu Yao ⋅ Ce Zhu ⋅ Le Zhang
In Room: ExHall D Poster Location: Poster #412 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SVDC: Consistent Direct Time-of-Flight Video Depth Completion with Frequency Selective Fusion
Xuan Zhu ⋅ Jijun Xiang ⋅ Xianqi Wang ⋅ Longliang Liu ⋅ Yu Wang ⋅ Hong Zhang ⋅ Fei Guo ⋅ Xin Yang
In Room: ExHall D Poster Location: Poster #75 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Locally Orderless Images for Optimization in Differentiable Rendering Project Page ↗
Ishit Mehta ⋅ Manmohan Chandraker ⋅ Ravi Ramamoorthi
In Room: ExHall D Poster Location: Poster #30 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rethinking Training for De-biasing Text-to-Image Generation: Unlocking the Potential of Stable Diffusion
Eunji Kim ⋅ Siwon Kim ⋅ Minjun Park ⋅ Rahim Entezari ⋅ Sungroh Yoon
In Room: ExHall D Poster Location: Poster #258 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FLAIR: VLM with Fine-grained Language-informed Image Representations
Rui Xiao ⋅ Sanghwan Kim ⋅ Iuliana Georgescu ⋅ Zeynep Akata ⋅ Stephan Alaniz
In Room: ExHall D Poster Location: Poster #368 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GG-SSMs: Graph-Generating State Space Models Project Page ↗
Nikola Zubic ⋅ Davide Scaramuzza
In Room: ExHall D Poster Location: Poster #257 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
STDD: Spatio-Temporal Dual Diffusion for Video Generation
Shuaizhen Yao ⋅ Xiaoya Zhang ⋅ Xin Liu ⋅ Mengyi Liu ⋅ Zhen Cui
In Room: ExHall D Poster Location: Poster #183 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Continuous Adverse Weather Removal via Degradation-Aware Distillation
Xin Lu ⋅ Jie Xiao ⋅ Yurui Zhu ⋅ Xueyang Fu
In Room: ExHall D Poster Location: Poster #185 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models
Kartik Thakral ⋅ Tamar Glaser ⋅ Tal Hassner ⋅ Mayank Vatsa ⋅ Richa Singh
In Room: ExHall D Poster Location: Poster #358 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CryptoFace: End-to-End Encrypted Face Recognition
Wei Ao ⋅ Vishnu Naresh Boddeti
In Room: ExHall D Poster Location: Poster #324 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Exploiting Temporal State Space Sharing for Video Semantic Segmentation
Hesham Syed ⋅ Yun Liu ⋅ Guolei Sun ⋅ Henghui Ding ⋅ Jing Yang ⋅ Ender Konukoglu ⋅ Xue Geng ⋅ Xudong Jiang
In Room: ExHall D Poster Location: Poster #305 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
DeRS: Towards Extremely Efficient Upcycled Mixture-of-Experts Models
Yongqi Huang ⋅ Peng Ye ⋅ Chenyu Huang ⋅ Jianjian Cao ⋅ Lin Zhang ⋅ Baopu Li ⋅ Gang Yu ⋅ Tao Chen
In Room: ExHall D Poster Location: Poster #446 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GeoDepth: From Point-to-Depth to Plane-to-Depth Modeling for Self-Supervised Monocular Depth Estimation
Haifeng Wu ⋅ Shuhang Gu ⋅ Lixin Duan ⋅ Wen Li
In Room: ExHall D Poster Location: Poster #84 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
Junchen Yu ⋅ Siyuan Cao ⋅ Runmin Zhang ⋅ Chenghao Zhang ⋅ Zhu Yu ⋅ Shujie Chen ⋅ Bailin Yang ⋅ Hui-Liang Shen
In Room: ExHall D Poster Location: Poster #82 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
High-fidelity 3D Object Generation from Single Image with RGBN-Volume Gaussian Reconstruction Model
Yiyang Shen ⋅ Kun Zhou ⋅ He Wang ⋅ Yin Yang ⋅ Tianjia Shao
In Room: ExHall D Poster Location: Poster #48 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Robust 3D Shape Reconstruction in Zero-Shot from a Single Image in the Wild Project Page ↗
Junhyeong Cho ⋅ Kim Youwang ⋅ Hunmin Yang ⋅ Tae-Hyun Oh
In Room: ExHall D Poster Location: Poster #164 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Adventurer: Optimizing Vision Mamba Architecture Designs for Efficiency
Feng Wang ⋅ Timing Yang ⋅ Yaodong Yu ⋅ Sucheng Ren ⋅ Guoyizhe Wei ⋅ Angtian Wang ⋅ Wei Shao ⋅ Yuyin Zhou ⋅ Alan L. Yuille ⋅ Cihang Xie
In Room: ExHall D Poster Location: Poster #384 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DirectTriGS: Triplane-based Gaussian Splatting Field Representation for 3D Generation
Xiaoliang Ju ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #36 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
Zigeng Chen ⋅ Xinyin Ma ⋅ Gongfan Fang ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #218 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
Zilong Huang ⋅ Jun He ⋅ Junyan Ye ⋅ Lihan Jiang ⋅ Weijia Li ⋅ Yiping Chen ⋅ Ting Han
In Room: ExHall D Poster Location: Poster #55 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Make-It-Animatable: An Efficient Framework for Authoring Animation-Ready 3D Characters Project Page ↗
Zhiyang Guo ⋅ Jinxu Xiang ⋅ Kai Ma ⋅ Wengang Zhou ⋅ Houqiang Li ⋅ Ran Zhang
In Room: ExHall D Poster Location: Poster #12 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
IterIS: Iterative Inference-Solving Alignment for LoRA Merging
Hongxu chen ⋅ Zhen Wang ⋅ Runshi Li ⋅ Bowei Zhu ⋅ Long Chen
In Room: ExHall D Poster Location: Poster #446 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ACAttack: Adaptive Cross Attacking RGB-T Tracker via Multi-Modal Response Decoupling
Xinyu Xiang ⋅ Qinglong Yan ⋅ HAO ZHANG ⋅ Jiayi Ma
In Room: ExHall D Poster Location: Poster #100 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models
Rundi Wu ⋅ Ruiqi Gao ⋅ Ben Poole ⋅ Alex Trevithick ⋅ Changxi Zheng ⋅ Jonathan T. Barron ⋅ Aleksander Holynski
In Room: ExHall D Poster Location: Poster #53 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Exploring Semantic Feature Discrimination for Perceptual Image Super-Resolution and Opinion-Unaware No-Reference Image Quality Assessment
Guanglu Dong ⋅ Xiangyu Liao ⋅ Mingyang Li ⋅ Guihuan Guo ⋅ Chao Ren
In Room: ExHall D Poster Location: Poster #192 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Distilling Long-tailed Datasets
Zhenghao Zhao ⋅ Haoxuan Wang ⋅ Yuzhang Shang ⋅ Kai Wang ⋅ Yan Yan
In Room: ExHall D Poster Location: Poster #427 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Gaze-LLE: Gaze Target Estimation via Large-Scale Learned Encoders
Fiona Ryan ⋅ Ajay Bati ⋅ Sangmin Lee ⋅ Daniel Bolya ⋅ Judy Hoffman ⋅ James Rehg
In Room: ExHall D Poster Location: Poster #258 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Distilling Spectral Graph for Object-Context Aware Open-Vocabulary Semantic Segmentation
Chanyoung Kim ⋅ Dayun Ju ⋅ Woojung Han ⋅ Ming-Hsuan Yang ⋅ Seong Jae Hwang
In Room: ExHall D Poster Location: Poster #420 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Geometry Field Splatting with Gaussian Surfels
Kaiwen Jiang ⋅ Venkataram Sivaram ⋅ Cheng Peng ⋅ Ravi Ramamoorthi
In Room: ExHall D Poster Location: Poster #29 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Stereo4D: Learning How Things Move in 3D from Internet Stereo Videos Project Page ↗
Linyi Jin ⋅ Richard Tucker ⋅ Zhengqi Li ⋅ David Fouhey ⋅ Noah Snavely ⋅ Aleksander Holynski
In Room: ExHall D Poster Location: Poster #88 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PS-EIP: Robust Photometric Stereo Based on Event Interval Profile
Kazuma Kitazawa ⋅ Takahito Aoto ⋅ Satoshi Ikehata ⋅ Tsuyoshi Takatani
In Room: ExHall D Poster Location: Poster #77 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GenPC: Zero-shot Point Cloud Completion via 3D Generative Priors
An Li ⋅ Zhe Zhu ⋅ Mingqiang Wei
In Room: ExHall D Poster Location: Poster #106 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FoundHand: Large-Scale Domain-Specific Learning for Controllable Hand Image Generation Project Page ↗
Kefan Chen ⋅ Chaerin Min ⋅ Linguang Zhang ⋅ Shreyas Hampali ⋅ Cem Keskin ⋅ Srinath Sridhar
In Room: ExHall D Poster Location: Poster #158 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Unified Uncertainty-Aware Diffusion for Multi-Agent Trajectory Modeling
Guillem Capellera ⋅ Antonio Rubio ⋅ Luis Ferraz ⋅ Antonio Agudo
In Room: ExHall D Poster Location: Poster #135 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
WeGen: A Unified Model for Interactive Multimodal Generation as We Chat
Zhipeng Huang ⋅ Shaobin Zhuang ⋅ Canmiao Fu ⋅ Binxin Yang ⋅ Ying Zhang ⋅ Chong Sun ⋅ Chen Li ⋅ Yali Wang ⋅ Zhizheng Zhang ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #253 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HRAvatar: High-Quality and Relightable Gaussian Head Avatar Project Page ↗
Dongbin Zhang ⋅ Yunfei Liu ⋅ Lijian Lin ⋅ Ye Zhu ⋅ Kangjie Chen ⋅ Minghan Qin ⋅ Yu Li ⋅ Haoqian Wang
In Room: ExHall D Poster Location: Poster #8 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Latent Drifting in Diffusion Models for Counterfactual Medical Image Synthesis Project Page ↗
Yousef Yeganeh ⋅ Ioannis Charisiadis ⋅ Marta Hasny ⋅ Martin Hartenberger ⋅ Björn Ommer ⋅ Nassir Navab ⋅ Azade Farshad ⋅ Ehsan Adeli
In Room: ExHall D Poster Location: Poster #222 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rethinking Spiking Self-Attention Mechanism: Implementing α-XNOR Similarity Calculation in Spiking Transformers
Yichen Xiao ⋅ Shuai Wang ⋅ Dehao Zhang ⋅ Wenjie Wei ⋅ Yimeng Shan ⋅ Xiaoli Liu ⋅ Yulin Jiang ⋅ Malu Zhang
In Room: ExHall D Poster Location: Poster #310 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MagicQuill: An Intelligent Interactive Image Editing System
Zichen Liu ⋅ Yue Yu ⋅ Hao Ouyang ⋅ Qiuyu Wang ⋅ Ka Leong Cheng ⋅ Wen Wang ⋅ Zhiheng Liu ⋅ Qifeng Chen ⋅ Yujun Shen
In Room: ExHall D Poster Location: Poster #231 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Hunyuan-Portrait: Implicit Condition Control for Enhanced Portrait Animation
Zunnan Xu ⋅ Zhentao Yu ⋅ Zixiang Zhou ⋅ Jun Zhou ⋅ Xiaoyu Jin ⋅ Fa-Ting Hong ⋅ Xiaozhong Ji ⋅ Junwei Zhu ⋅ Chengfei Cai ⋅ Shiyu Tang ⋅ Qin Lin ⋅ Xiu Li ⋅ qinglin lu
In Room: ExHall D Poster Location: Poster #5 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
HeMoRa: Unsupervised Heuristic Consensus Sampling for Robust Point Cloud Registration
Shaocheng Yan ⋅ Yiming Wang ⋅ Kaiyan Zhao ⋅ Pengcheng Shi ⋅ Zhenjun Zhao ⋅ Yongjun Zhang ⋅ Jiayuan Li
In Room: ExHall D Poster Location: Poster #111 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Reducing Class-wise Confusion for Incremental Learning with Disentangled Manifolds
Huitong Chen ⋅ Yu Wang ⋅ Yan Fan ⋅ Guosong Jiang ⋅ Qinghua Hu
In Room: ExHall D Poster Location: Poster #452 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Open-Vocabulary Functional 3D Scene Graphs for Real-World Indoor Spaces
Chenyangguang Zhang ⋅ Alexandros Delitzas ⋅ Fangjinhua Wang ⋅ Ruida Zhang ⋅ Xiangyang Ji ⋅ Marc Pollefeys ⋅ Francis Engelmann
In Room: ExHall D Poster Location: Poster #343 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Boosting Adversarial Transferability through Augmentation in Hypothesis Space
Yu Guo ⋅ Weiquan Liu ⋅ Qingshan Xu ⋅ Shijun Zheng ⋅ Shujun Huang ⋅ Yu Zang ⋅ Siqi Shen ⋅ Chenglu Wen ⋅ Cheng Wang
In Room: ExHall D Poster Location: Poster #322 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
AniMo: Species-Aware Model for Text-Driven Animal Motion Generation Project Page ↗
Xuan Wang ⋅ Kai Ruan ⋅ Xing Zhang ⋅ Gaoang Wang
In Room: ExHall D Poster Location: Poster #163 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EditAR: Unified Conditional Generation with Autoregressive Models
Jiteng Mu ⋅ Nuno Vasconcelos ⋅ Xiaolong Wang
In Room: ExHall D Poster Location: Poster #242 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Instance-wise Supervision-level Optimization in Active Learning
Shinnosuke Matsuo ⋅ Riku Togashi ⋅ Ryoma Bise ⋅ Seiichi Uchida ⋅ Masahiro Nomura
In Room: ExHall D Poster Location: Poster #456 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ViiNeuS: Volumetric Initialization for Implicit Neural Surface Reconstruction of Urban Scenes with Limited Image Overlap
Hala Djeghim ⋅ Nathan Piasco ⋅ Moussab Bennehar ⋅ Luis Guillermo Roldao Jimenez ⋅ Dzmitry Tsishkou ⋅ Désiré Sidibé
In Room: ExHall D Poster Location: Poster #117 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Model Diagnosis and Correction via Linguistic and Implicit Attribute Editing
Xuanbai Chen ⋅ Xiang Xu ⋅ Zhihua Li ⋅ Tianchen Zhao ⋅ Pietro Perona ⋅ Qin ZHANG ⋅ Yifan Xing
In Room: ExHall D Poster Location: Poster #347 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
STAA-SNN: Spatial-Temporal Attention Aggregator for Spiking Neural Networks
Tianqing Zhang ⋅ Kairong Yu ⋅ Xian Zhong ⋅ Hongwei Wang ⋅ Qi Xu ⋅ Qiang Zhang
In Room: ExHall D Poster Location: Poster #316 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Knowledge Memorization and Rumination for Pre-trained Model-based Class-Incremental Learning
Zijian Gao ⋅ Wangwang Jia ⋅ Xingxing Zhang ⋅ Dulan Zhou ⋅ Kele Xu ⋅ Feng Dawei ⋅ Yong Dou ⋅ Xinjun Mao ⋅ Huaimin Wang
In Room: ExHall D Poster Location: Poster #449 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
A Distractor-Aware Memory for Visual Object Tracking with SAM2 Project Page ↗
Alan Lukezic ⋅ Jovana Videnović ⋅ Matej Kristan
In Room: ExHall D Poster Location: Poster #309 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Activating Sparse Part Concepts for 3D Class Incremental Learning
Zhenya Tian ⋅ Jun Xiao ⋅ Liu lupeng ⋅ Haiyong Jiang
In Room: ExHall D Poster Location: Poster #402 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ProxyTransformation: Preshaping Point Cloud Manifold With Proxy Attention For 3D Visual Grounding Project Page ↗
Qihang Peng ⋅ Henry Zheng ⋅ Gao Huang
In Room: ExHall D Poster Location: Poster #340 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
BFANet: Revisiting 3D Semantic Segmentation with Boundary Feature Analysis
Weiguang Zhao ⋅ Rui Zhang ⋅ Qiufeng Wang ⋅ Guangliang Cheng ⋅ Kaizhu Huang
In Room: ExHall D Poster Location: Poster #310 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Stable Flow: Vital Layers for Training-Free Image Editing Project Page ↗
Omri Avrahami ⋅ Or Patashnik ⋅ Ohad Fried ⋅ Egor Nemchinov ⋅ Kfir Aberman ⋅ Dani Lischinski ⋅ Daniel Cohen-Or
In Room: ExHall D Poster Location: Poster #240 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
Arun Reddy ⋅ Alexander Martin ⋅ Eugene Yang ⋅ Andrew Yates ⋅ Kate Sanders ⋅ Kenton Murray ⋅ Reno Kriz ⋅ Celso M. de Melo ⋅ Benjamin Van Durme ⋅ Rama Chellappa
In Room: ExHall D Poster Location: Poster #370 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Flexible Group Count Enables Hassle-Free Structured Pruning Project Page ↗
Jiamu Zhang ⋅ Shaochen (Henry) Zhong ⋅ Andrew Ye ⋅ Zirui Liu ⋅ Sebastian Zhao ⋅ Kaixiong Zhou ⋅ Li Li ⋅ Soo-Hyun Choi ⋅ Rui Chen ⋅ Xia Hu ⋅ Shuai Xu ⋅ Vipin Chaudhary
In Room: ExHall D Poster Location: Poster #444 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DFormerv2: Geometry Self-Attention for RGBD Semantic Segmentation Project Page ↗
Bo-Wen Yin ⋅ Jiao-Long Cao ⋅ Ming-Ming Cheng ⋅ Qibin Hou
In Room: ExHall D Poster Location: Poster #338 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
GarmentPile: Point-Level Visual Affordance Guided Retrieval and Adaptation for Cluttered Garments Manipulation
Ruihai Wu ⋅ Ziyu Zhu ⋅ Yuran Wang ⋅ Yue Chen ⋅ Jiarui Wang ⋅ Hao Dong
In Room: ExHall D Poster Location: Poster #151 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GroomLight: Hybrid Inverse Rendering for Relightable Human Hair Appearance Modeling
Yang Zheng ⋅ Menglei Chai ⋅ Delio Vicini ⋅ Yuxiao Zhou ⋅ Yinghao Xu ⋅ Leonidas Guibas ⋅ Gordon Wetzstein ⋅ Thabo Beeler
In Room: ExHall D Poster Location: Poster #17 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Improving Editability in Image Generation with Layer-wise Memory Project Page ↗
Daneul Kim ⋅ Jaeah Lee ⋅ Jaesik Park
In Room: ExHall D Poster Location: Poster #241 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CL-LoRA: Continual Low-Rank Adaptation for Rehearsal-Free Class-Incremental Learning
Jiangpeng He ⋅ Zhihao Duan ⋅ Fengqing Zhu
In Room: ExHall D Poster Location: Poster #420 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Generative Modeling of Class Probability for Multi-Modal Representation Learning
JungKyoo Shin ⋅ Bumsoo Kim ⋅ Eunwoo Kim
In Room: ExHall D Poster Location: Poster #469 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
VisionZip: Longer is Better but Not Necessary in Vision Language Models Project Page ↗
Senqiao Yang ⋅ Yukang Chen ⋅ Zhuotao Tian ⋅ Chengyao Wang ⋅ Jingyao Li ⋅ Bei Yu ⋅ Jiaya Jia
In Room: ExHall D Poster Location: Poster #380 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Simplification Is All You Need against Out-of-Distribution Overconfidence
Keke Tang ⋅ Chao Hou ⋅ Weilong Peng ⋅ Xiang Fang ⋅ Zhize Wu ⋅ Yongwei Nie ⋅ Wenping Wang ⋅ Zhihong Tian
In Room: ExHall D Poster Location: Poster #465 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LOD-GS: Achieving Levels of Detail using Scalable Gaussian Soup
Jianxiong Shen ⋅ Yue Qian ⋅ Xiaohang Zhan
In Room: ExHall D Poster Location: Poster #47 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VoteFlow: Enforcing Local Rigidity in Self-Supervised Scene Flow Project Page ↗
Yancong Lin ⋅ Shiming Wang ⋅ Liangliang Nan ⋅ Julian F. P. Kooij ⋅ Holger Caesar
In Room: ExHall D Poster Location: Poster #128 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
When Domain Generalization meets Generalized Category Discovery: An Adaptive Task-Arithmetic Driven Approach Project Page ↗
Vaibhav Rathore ⋅ Shubhranil B ⋅ Saikat Dutta ⋅ Sarthak Mehrotra ⋅ Zsolt Kira ⋅ Biplab Banerjee
In Room: ExHall D Poster Location: Poster #453 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Design2GarmentCode: Turning Design Concepts to Tangible Garments Through Program Synthesis Project Page ↗
Feng Zhou ⋅ Ruiyang Liu ⋅ chen liu ⋅ Gaofeng He ⋅ Yonglu Li ⋅ Xiaogang Jin ⋅ Huamin Wang
In Room: ExHall D Poster Location: Poster #257 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Efficient Dynamic Scene Editing via 4D Gaussian-based Static-Dynamic Separation Project Page ↗
Joohyun Kwon ⋅ Hanbyel Cho ⋅ Junmo Kim
In Room: ExHall D Poster Location: Poster #68 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SocialMOIF: Multi-Order Intention Fusion for Pedestrian Trajectory Prediction Project Page ↗
Kai Chen ⋅ Xiaodong Zhao ⋅ Yujie Huang ⋅ GuoyuFang ⋅ Xiao Song ⋅ Ruiping Wang ⋅ Ziyuan Wang
In Room: ExHall D Poster Location: Poster #134 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FFaceNeRF: Few-shot Face Editing in Neural Radiance Fields Project Page ↗
Kwan Yun ⋅ Chaelin Kim ⋅ Hangyeul Shin ⋅ Junyong Noh
In Room: ExHall D Poster Location: Poster #16 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observations
Shengeng Tang ⋅ Jiayi He ⋅ Lechao Cheng ⋅ Jingjing Wu ⋅ Dan Guo ⋅ Richang Hong
In Room: ExHall D Poster Location: Poster #316 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
HistoFS: Non-IID Histopathologic Whole Slide Image Classification via Federated Style Transfer with RoI-Preserving Project Page ↗
Farchan Hakim Raswa ⋅ Chun-Shien Lu ⋅ Jia-Ching Wang
In Room: ExHall D Poster Location: Poster #393 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Unified Medical Lesion Segmentation via Self-referring Indicator
Shijie Chang ⋅ Xiaoqi Zhao ⋅ Lihe Zhang ⋅ Tiancheng Wang
In Room: ExHall D Poster Location: Poster #480 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
Haiming Zhang ⋅ Wending Zhou ⋅ Shenzhen The Chinese University of Hongkong ⋅ Hong Kong University of Science and Technology ⋅ Huawei Technologies Ltd. ⋅ Huawei Technologies Ltd. ⋅ Huawei Technologies Ltd. ⋅ Huawei Technologies Ltd. ⋅ Huawei Technologies Ltd. ⋅ Shenzhen The Chinese University of Hong Kong
In Room: ExHall D Poster Location: Poster #129 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SGSST: Scaling Gaussian Splatting Style Transfer
Bruno Galerne ⋅ Jianling WANG ⋅ Lara Raad ⋅ Jean-michel Morel
In Room: ExHall D Poster Location: Poster #36 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VinTAGe: Joint Video and Text Conditioning for Holistic Audio Generation Project Page ↗
Saksham Singh Kushwaha ⋅ Yapeng Tian
In Room: ExHall D Poster Location: Poster #275 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning Bijective Surface Parameterization for Inferring Signed Distance Functions from Sparse Point Clouds with Grid Deformation
Takeshi Noda ⋅ Chao Chen ⋅ Junsheng Zhou ⋅ Weiqi Zhang ⋅ Yu-Shen Liu ⋅ Zhizhong Han
In Room: ExHall D Poster Location: Poster #104 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Layer- and Timestep-Adaptive Differentiable Token Compression Ratios for Efficient Diffusion Transformers
Haoran You ⋅ Connelly Barnes ⋅ Yuqian Zhou ⋅ Yan Kang ⋅ Zhenbang Du ⋅ Wei Zhou ⋅ Lingzhi Zhang ⋅ Yotam Nitzan ⋅ Xiaoyang Liu ⋅ Zhe Lin ⋅ Eli Shechtman ⋅ Sohrab Amirghodsi ⋅ Yingyan (Celine) Lin
In Room: ExHall D Poster Location: Poster #216 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Zero-shot RGB-D Point Cloud Registration with Pre-trained Large Vision Model Project Page ↗
Haobo Jiang ⋅ Jin Xie ⋅ Jian Yang ⋅ Liang Yu ⋅ Jianmin Zheng
In Room: ExHall D Poster Location: Poster #108 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Balancing Two Classifiers via A Simplex ETF Structure for Model Calibration
Jiani Ni ⋅ He Zhao ⋅ Jintong Gao ⋅ Dandan Guo ⋅ Hongyuan Zha
In Room: ExHall D Poster Location: Poster #437 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DAMM-Diffusion: Learning Divergence-Aware Multi-Modal Diffusion Model for Nanoparticles Distribution Prediction
Junjie Zhou ⋅ Shouju Wang ⋅ Yuxia Tang ⋅ Qi Zhu ⋅ Daoqiang Zhang ⋅ WEI SHAO
In Room: ExHall D Poster Location: Poster #453 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models Project Page ↗
Lei Li ⋅ wei yuancheng ⋅ Zhihui Xie ⋅ Xuqing Yang ⋅ Yifan Song ⋅ Peiyi Wang ⋅ Chenxin An ⋅ Tianyu Liu ⋅ Sujian Li ⋅ Bill Yuchen Lin ⋅ Lingpeng Kong ⋅ Qi Liu
In Room: ExHall D Poster Location: Poster #347 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Unveiling Differences in Generative Models: A Scalable Differential Clustering Approach Project Page ↗
Jingwei Zhang ⋅ Mohammad Jalali ⋅ Cheuk Ting Li ⋅ Farzan Farnia
In Room: ExHall D Poster Location: Poster #276 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
U-Know-DiffPAN: An Uncertainty-aware Knowledge Distillation Diffusion Framework with Details Enhancement for PAN-Sharpening
Sungpyo Kim ⋅ Jeonghyeok Do ⋅ Jaehyup Lee ⋅ Munchurl Kim
In Room: ExHall D Poster Location: Poster #191 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Gaussian Splatting Feature Fields for (Privacy-Preserving) Visual Localization
Maxime Pietrantoni ⋅ Gabriela Csurka ⋅ Torsten Sattler
In Room: ExHall D Poster Location: Poster #85 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Gazing Into Missteps: Leveraging Eye-Gaze for Unsupervised Mistake Detection in Egocentric Videos of Skilled Human Activities
Michele Mazzamuto ⋅ Antonino Furnari ⋅ Yoichi Sato ⋅ Giovanni Maria Farinella
In Room: ExHall D Poster Location: Poster #281 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Recover and Match: Open-Vocabulary Multi-Label Recognition through Knowledge-Constrained Optimal Transport Project Page ↗
Hao Tan ⋅ Zichang Tan ⋅ Jun Li ⋅ Ajian Liu ⋅ Jun Wan ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #429 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RelationField: Relate Anything in Radiance Fields Project Page ↗
Sebastian Koch ⋅ Johanna Wald ⋅ Mirco Colosi ⋅ Narunas Vaskevicius ⋅ Pedro Hermosilla ⋅ Federico Tombari ⋅ Timo Ropinski
In Room: ExHall D Poster Location: Poster #62 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Decision SpikeFormer: Spike-Driven Transformer for Decision Making Project Page ↗
Wei Huang ⋅ Qinying Gu ⋅ Nanyang Ye
In Room: ExHall D Poster Location: Poster #328 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SF2T: Self-supervised Fragment Finetuning of Video-LLMs for Fine-Grained Understanding
Yangliu Hu ⋅ Zikai Song ⋅ Na Feng ⋅ Yawei Luo ⋅ Junqing Yu ⋅ Yi-Ping Phoebe Chen ⋅ Wei Yang
In Room: ExHall D Poster Location: Poster #283 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Theory-Inspired Deep Multi-View Multi-Label Learning with Incomplete Views and Noisy Labels
Quanjiang Li ⋅ Tingjin Luo ⋅ Jiahui Liao
In Room: ExHall D Poster Location: Poster #466 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Fitted Neural Lossless Image Compression
Zhe Zhang ⋅ Zhenzhong Chen ⋅ Shan Liu
In Room: ExHall D Poster Location: Poster #209 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EMOE: Modality-Specific Enhanced Dynamic Emotion Experts
Yiyang Fang ⋅ Wenke Huang ⋅ Guancheng Wan ⋅ Kehua Su ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #350 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
JarvisIR: Elevating Autonomous Driving Perception with Intelligent Image Restoration
yunlong lin ⋅ Zixu Lin ⋅ Haoyu Chen ⋅ Panwang Pan ⋅ Chenxin Li ⋅ Sixiang Chen ⋅ Kairun Wen ⋅ Yeying Jin ⋅ Wenbo Li ⋅ Xinghao Ding
In Room: ExHall D Poster Location: Poster #126 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UniPre3D: Unified Pre-training of 3D Point Cloud Models with Cross-Modal Gaussian Splatting
Ziyi Wang ⋅ Yanran Zhang ⋅ Jie Zhou ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #107 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EntityErasure: Erasing Entity Cleanly via Amodal Entity Segmentation and Completion
Yixing Zhu ⋅ Qing Zhang ⋅ Yitong Wang ⋅ Yongwei Nie ⋅ Wei-Shi Zheng
In Room: ExHall D Poster Location: Poster #201 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mosaic3D: Foundation Dataset and Model for Open-Vocabulary 3D Segmentation
Junha Lee ⋅ Chunghyun Park ⋅ Jaesung Choe ⋅ Yu-Chiang Frank Wang ⋅ Jan Kautz ⋅ Minsu Cho ⋅ Chris Choy
In Room: ExHall D Poster Location: Poster #330 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
T-CIL: Temperature Scaling using Adversarial Perturbation for Calibration in Class-Incremental Learning
Seong-Hyeon Hwang ⋅ Minsu Kim ⋅ Steven Euijong Whang
In Room: ExHall D Poster Location: Poster #449 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Joint Out-of-Distribution Filtering and Data Discovery Active Learning
Sebastian Schmidt ⋅ Leonard Schenk ⋅ Leo Schwinn ⋅ Stephan Günnemann
In Room: ExHall D Poster Location: Poster #444 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Finding Local Diffusion Schrödinger Bridge using Kolmogorov-Arnold Network Project Page ↗
Xingyu Qiu ⋅ Mengying Yang ⋅ Xinghua Ma ⋅ Fanding Li ⋅ Dong Liang ⋅ Gongning Luo ⋅ wei wang ⋅ Kuanquan Wang ⋅ Shuo Li
In Room: ExHall D Poster Location: Poster #207 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CorrBEV: Multi-View 3D Object Detection by Correlation Learning with Multi-modal Prototypes
ziteng xue ⋅ Mingzhe Guo ⋅ Heng Fan ⋅ Shihui Zhang ⋅ Zhipeng Zhang
In Room: ExHall D Poster Location: Poster #120 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SeeGround: See and Ground for Zero-Shot Open-Vocabulary 3D Visual Grounding Project Page ↗
Rong Li ⋅ Shijie Li ⋅ Lingdong Kong ⋅ Xulei Yang ⋅ Junwei Liang
In Room: ExHall D Poster Location: Poster #337 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Linear Attention Modeling for Learned Image Compression
Donghui Feng ⋅ Zhengxue Cheng ⋅ Shen Wang ⋅ Ronghua Wu ⋅ Hongwei Hu ⋅ Guo Lu ⋅ Li Song
In Room: ExHall D Poster Location: Poster #215 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Around the World in 80 Timesteps: A Generative Approach to Global Visual Geolocation
Nicolas Dufour ⋅ Vicky Kalogeiton ⋅ David Picard ⋅ Loic Landrieu
In Room: ExHall D Poster Location: Poster #186 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Asynchronous Collaborative Graph Representation for Frames and Events
Dianze Li ⋅ Jianing Li ⋅ Xu Liu ⋅ Xiaopeng Fan ⋅ Yonghong Tian
In Room: ExHall D Poster Location: Poster #139 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Real-time High-fidelity Gaussian Human Avatars with Position-based Interpolation of Spatially Distributed MLPs
Youyi Zhan ⋅ Tianjia Shao ⋅ Yin Yang ⋅ Kun Zhou
In Room: ExHall D Poster Location: Poster #9 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Self-Supervised Large Scale Point Cloud Completion for Archaeological Site Restoration
Aocheng Li ⋅ James R. Zimmer-Dauphinee ⋅ Rajesh Kalyanam ⋅ Ian Lindsay ⋅ Parker VanValkenburgh ⋅ Steven Wernke ⋅ Daniel Aliaga
In Room: ExHall D Poster Location: Poster #107 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks
Peng Xie ⋅ Yequan Bie ⋅ Jianda Mao ⋅ Yangqiu Song ⋅ Yang Wang ⋅ Hao Chen ⋅ Kani Chen
In Room: ExHall D Poster Location: Poster #386 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
DeCLIP: Decoupled Learning for Open-Vocabulary Dense Perception Project Page ↗
Junjie Wang ⋅ BIN CHEN ⋅ Yulin Li ⋅ Bin Kang ⋅ Yichi Chen ⋅ Zhuotao Tian
In Room: ExHall D Poster Location: Poster #399 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SocialGesture: Delving into Multi-person Gesture Understanding Project Page ↗
Xu Cao ⋅ Pranav Virupaksha ⋅ Wenqi Jia ⋅ Bolin Lai ⋅ Fiona Ryan ⋅ Sangmin Lee ⋅ James Rehg
In Room: ExHall D Poster Location: Poster #353 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
The PanAf-FGBG Dataset: Understanding the Impact of Backgrounds in Wildlife Behaviour Recognition Project Page ↗
Otto Brookes ⋅ Maksim Kukushkin ⋅ Majid Mirmehdi ⋅ Colleen Stephens ⋅ Paula Dieguez ⋅ Thurston Cleveland Hicks ⋅ Sorrel CZ Jones ⋅ Kevin C. Lee ⋅ Maureen S. McCarthy ⋅ Amelia C. Meier ⋅ NORMAND E. ⋅ Erin G. Wessling ⋅ Roman M. Wittig ⋅ Kevin Langergraber ⋅ Klaus Zuberbühler ⋅ Lukas Boesch ⋅ Thomas Schmid ⋅ Mimi Arandjelovic ⋅ Hjalmar S. Kühl ⋅ Tilo Burghardt
In Room: ExHall D Poster Location: Poster #277 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multi-modal Topology-embedded Graph Learning for Spatially Resolved Genes Prediction from Pathology Images with Prior Gene Similarity Information
Hang Shi ⋅ Chi Changxi ⋅ Peng Wan ⋅ Daoqiang Zhang ⋅ WEI SHAO
In Room: ExHall D Poster Location: Poster #476 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Question-Aware Gaussian Experts for Audio-Visual Question Answering Project Page ↗
Hongyeob Kim ⋅ Inyoung Jung ⋅ Dayoon Suh ⋅ Youjia Zhang ⋅ Sangmin Lee ⋅ Sungeun Hong
In Room: ExHall D Poster Location: Poster #290 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Multitwine: Multi-Object Compositing with Text and Layout Control Project Page ↗
Gemma Canet Tarrés ⋅ Zhe Lin ⋅ Zhifei Zhang ⋅ He Zhang ⋅ Andrew Gilbert ⋅ John Collomosse ⋅ Soo Ye Kim
In Room: ExHall D Poster Location: Poster #260 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Adaptive Rectangular Convolution for Remote Sensing Pansharpening Project Page ↗
Xueyang Wang ⋅ Zhixin Zheng ⋅ Jiandong Shao ⋅ Yule Duan ⋅ Liang-Jian Deng
In Room: ExHall D Poster Location: Poster #197 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Video Depth without Video Models Project Page ↗
Bingxin Ke ⋅ Dominik Narnhofer ⋅ Shengyu Huang ⋅ Lei Ke ⋅ Torben Peters ⋅ Katerina Fragkiadaki ⋅ Anton Obukhov ⋅ Konrad Schindler
In Room: ExHall D Poster Location: Poster #179 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
PointLoRA: Low-Rank Adaptation with Token Selection for Point Cloud Learning Project Page ↗
Song Wang ⋅ Xiaolu Liu ⋅ Lingdong Kong ⋅ Jianyun Xu ⋅ Chunyong Hu ⋅ Gongfan Fang ⋅ Wentong Li ⋅ Jianke Zhu ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #118 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HumanRig: Learning Automatic Rigging for Humanoid Character in a Large Scale Dataset Project Page ↗
Zedong Chu ⋅ Feng Xiong ⋅ Meiduo Liu ⋅ Jinzhi Zhang ⋅ Mingqi Shao ⋅ Zhaoxu Sun ⋅ Di Wang ⋅ Mu Xu
In Room: ExHall D Poster Location: Poster #13 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
UIBDiffusion: Universal Imperceptible Backdoor Attack for Diffusion Models Project Page ↗
Yuning Han ⋅ Bingyin Zhao ⋅ Rui Chu ⋅ Feng Luo ⋅ Biplab Sikdar ⋅ Yingjie Lao
In Room: ExHall D Poster Location: Poster #323 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Seeing Far and Clearly: Mitigating Hallucinations in MLLMs with Attention Causal Decoding
feilong tang ⋅ Chengzhi Liu ⋅ Zhongxing Xu ⋅ Ming Hu ⋅ Zile Huang ⋅ Haochen Xue ⋅ Ziyang Chen ⋅ Zelin Peng ⋅ Zhiwei Yang ⋅ Sijin Zhou ⋅ Wenxue Li ⋅ Yulong Li ⋅ Wenxuan Song ⋅ Shiyan Su ⋅ Wei Feng ⋅ Jionglong Su ⋅ Mingquan Lin ⋅ Yifan Peng ⋅ Xuelian Cheng ⋅ Imran Razzak ⋅ Zongyuan Ge
In Room: ExHall D Poster Location: Poster #272 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dynamic Camera Poses and Where to Find Them
Chris Rockwell ⋅ Joseph Tung ⋅ Tsung-Yi Lin ⋅ Ming-Yu Liu ⋅ David Fouhey ⋅ Chen-Hsuan Lin
In Room: ExHall D Poster Location: Poster #171 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GCE-Pose: Global Context Enhancement for Category-level Object Pose Estimation Project Page ↗
Weihang Li ⋅ Hongli XU ⋅ Junwen Huang ⋅ HyunJun Jung ⋅ Kuan-Ting Yu ⋅ Nassir Navab ⋅ Benjamin Busam
In Room: ExHall D Poster Location: Poster #96 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
OmniGen: Unified Image Generation Project Page ↗
Shitao Xiao ⋅ Yueze Wang ⋅ Junjie Zhou ⋅ Huaying Yuan ⋅ Xingrun Xing ⋅ Ruiran Yan ⋅ Chaofan Li ⋅ Shuting Wang ⋅ Tiejun Huang ⋅ Zheng Liu
In Room: ExHall D Poster Location: Poster #252 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
QuCOOP: A Versatile Framework for Solving Composite and Binary-Parametrised Problems on Quantum Annealers Project Page ↗
Natacha Kuete Meli ⋅ Vladislav Golyanik ⋅ Marcel Seelbach Benkner ⋅ Michael Moeller
In Room: ExHall D Poster Location: Poster #70 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Calibrated Multi-Preference Optimization for Aligning Diffusion Models
Kyungmin Lee ⋅ Xiaohang Li ⋅ Qifei Wang ⋅ Junfeng He ⋅ Junjie Ke ⋅ Ming-Hsuan Yang ⋅ Irfan Essa ⋅ Jinwoo Shin ⋅ Feng Yang ⋅ Yinxiao Li
In Room: ExHall D Poster Location: Poster #257 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning from Neighbors: Category Extrapolation for Long-Tail Learning
Shizhen Zhao ⋅ Xin Wen ⋅ Jiahui Liu ⋅ Chuofan Ma ⋅ Chunfeng Yuan ⋅ Xiaojuan Qi
In Room: ExHall D Poster Location: Poster #415 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Material Anything: Generating Materials for Any 3D Object via Diffusion Project Page ↗
Xin Huang ⋅ Tengfei Wang ⋅ Ziwei Liu ⋅ Qing Wang
In Room: ExHall D Poster Location: Poster #38 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TokenHSI: Unified Synthesis of Physical Human-Scene Interactions through Task Tokenization Project Page ↗
Liang Pan ⋅ Zeshi Yang ⋅ Zhiyang Dou ⋅ Wenjia Wang ⋅ Buzhen Huang ⋅ Bo Dai ⋅ Taku Komura ⋅ Jingbo Wang
In Room: ExHall D Poster Location: Poster #159 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ImagineFSL: Self-Supervised Pretraining Matters on Imagined Base Set for VLM-based Few-shot Learning Project Page ↗
Haoyuan Yang ⋅ Xiaoou Li ⋅ Jiaming Lv ⋅ Xianjun Cheng ⋅ Qilong Wang ⋅ Peihua Li
In Room: ExHall D Poster Location: Poster #370 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Project-Probe-Aggregate: Efficient Fine-Tuning for Group Robustness
Beier Zhu ⋅ Jiequan Cui ⋅ Hanwang Zhang ⋅ Chi Zhang
In Room: ExHall D Poster Location: Poster #424 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Implicit Bias Injection Attacks against Text-to-Image Diffusion Models
Huayang Huang ⋅ Xiangye Jin ⋅ Jiaxu Miao ⋅ Yu Wu
In Room: ExHall D Poster Location: Poster #249 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ROICtrl: Boosting Instance Control for Visual Generation
Yuchao Gu ⋅ Yipin Zhou ⋅ Yunfan Ye ⋅ Yixin Nie ⋅ Licheng Yu ⋅ Pingchuan Ma ⋅ Kevin Qinghong Lin ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #251 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
FRESA: Feedforward Reconstruction of Personalized Skinned Avatars from Few Images Project Page ↗
Rong Wang ⋅ Fabian Prada ⋅ Ziyan Wang ⋅ Zhongshi Jiang ⋅ Chengxiang Yin ⋅ Junxuan Li ⋅ Shunsuke Saito ⋅ Igor Santesteban ⋅ Javier Romero ⋅ Rohan Joshi ⋅ Hongdong Li ⋅ Jason Saragih ⋅ Yaser Sheikh
In Room: ExHall D Poster Location: Poster #11 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ReasonGrounder: LVLM-Guided Hierarchical Feature Splatting for Open-Vocabulary 3D Visual Grounding and Reasoning
Zhenyang Liu ⋅ Yikai Wang ⋅ Sixiao Zheng ⋅ Tongying Pan ⋅ Longfei Liang ⋅ Yanwei Fu ⋅ Xiangyang Xue
In Room: ExHall D Poster Location: Poster #338 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Cropper: Vision-Language Model for Image Cropping through In-Context Learning
Seung Hyun Lee ⋅ Jijun jiang ⋅ Yiran Xu ⋅ Zhuofang Li ⋅ Junjie Ke ⋅ Yinxiao Li ⋅ Junfeng He ⋅ Steven Hickson ⋅ Katie Datsenko ⋅ Sangpil Kim ⋅ Ming-Hsuan Yang ⋅ Irfan Essa ⋅ Feng Yang
In Room: ExHall D Poster Location: Poster #369 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Advancing Adversarial Robustness in GNeRFs: The IL2-NeRF Attack
Nicole Meng ⋅ Caleb Manicke ⋅ Ronak Sahu ⋅ Caiwen Ding ⋅ Yingjie Lao
In Room: ExHall D Poster Location: Poster #52 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
WonderWorld: Interactive 3D Scene Generation from a Single Image Project Page ↗
Hong-Xing Yu ⋅ Haoyi Duan ⋅ Charles Herrmann ⋅ William Freeman ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #45 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Lightweight UDF Learning Framework for 3D Reconstruction Based on Local Shape Functions
Jiangbei Hu ⋅ Yanggeng Li ⋅ Fei Hou ⋅ Junhui Hou ⋅ Zhebin Zhang ⋅ Shengfa Wang ⋅ Na Lei ⋅ Ying He
In Room: ExHall D Poster Location: Poster #105 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DiffCAM: Data-Driven Saliency Maps by Capturing Feature Differences
Xingjian Li ⋅ Qiming Zhao ⋅ Neelesh Bisht ⋅ Mostofa Uddin Uddin ⋅ Jin Yu Kim ⋅ Bryan Zhang ⋅ Min Xu
In Room: ExHall D Poster Location: Poster #472 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
PolarNeXt: Rethink Instance Segmentation with Polar Representation
Jiacheng Sun ⋅ Xinghong Zhou ⋅ Yiqiang Wu ⋅ Bin Zhu ⋅ Jiaxuan Lu ⋅ Yu Qin ⋅ Xiaomao Li
In Room: ExHall D Poster Location: Poster #335 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SAM-REF: Introducing Image-Prompt Synergy during Interaction for Detail Enhancement in the Segment Anything Model
Chongkai Yu ⋅ Ting Liu ⋅ Li Anqi ⋅ Xiaochao Qu ⋅ WU CHENGJING ⋅ Luoqi Liu ⋅ Xiaolin Hu
In Room: ExHall D Poster Location: Poster #339 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DarkIR: Robust Low-Light Image Restoration Project Page ↗
Daniel Feijoo ⋅ Juan C. Benito ⋅ Alvaro Garcia ⋅ Marcos Conde
In Room: ExHall D Poster Location: Poster #21 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
R2C: Mapping Room to Chessboard to Unlock LLM As Low-Level Action Planner Project Page ↗
Ziyi Bai ⋅ Hanxuan Li ⋅ Bin Fu ⋅ Chuyan Xiong ⋅ Ruiping Wang ⋅ Xilin Chen
In Room: ExHall D Poster Location: Poster #348 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ICE: Intrinsic Concept Extraction from a Single Image via Diffusion Models Project Page ↗
Fernando Julio Cendra ⋅ Kai Han
In Room: ExHall D Poster Location: Poster #260 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reversing Flow for Image Restoration
Haina Qin ⋅ Wenyang Luo ⋅ Bing Li ⋅ Weiming Hu ⋅ libin wang ⋅ DanDan Zheng ⋅ Jingdong Chen ⋅ Ming Yang
In Room: ExHall D Poster Location: Poster #208 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Any3DIS: Class-Agnostic 3D Instance Segmentation by 2D Mask Tracking Project Page ↗
Phuc Nguyen ⋅ Minh Luu ⋅ Anh Tran ⋅ Cuong Pham ⋅ Khoi Nguyen
In Room: ExHall D Poster Location: Poster #330 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FDS: Frequency-Aware Denoising Score for Text-Guided Latent Diffusion Image Editing
Yufan Ren ⋅ Zicong Jiang ⋅ Tong Zhang ⋅ Søren Forchhammer ⋅ Sabine Süsstrunk
In Room: ExHall D Poster Location: Poster #238 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
Zhe Shan ⋅ Yang Liu ⋅ Lei Zhou ⋅ Cheng Yan ⋅ Heng Wang ⋅ Xia Xie
In Room: ExHall D Poster Location: Poster #329 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
MultiMorph: On-demand Atlas Construction Project Page ↗
Mazdak Abulnaga ⋅ Andrew Hoopes ⋅ Neel Dey ⋅ Malte Hoffmann ⋅ Bruce Fischl ⋅ John Guttag ⋅ Adrian V. Dalca
In Room: ExHall D Poster Location: Poster #455 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
From Prototypes to General Distributions: An Efficient Curriculum for Masked Image Modeling
Jinhong Lin ⋅ Cheng-En Wu ⋅ Huanran Li ⋅ Jifan Zhang ⋅ Yu Hen Hu ⋅ Pedro Morgado
In Room: ExHall D Poster Location: Poster #403 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Synthetic Visual Genome
Jae Sung Park ⋅ Zixian Ma ⋅ Linjie Li ⋅ Chenhao Zheng ⋅ Cheng-Yu Hsieh ⋅ Ximing Lu ⋅ Khyathi Chandu ⋅ Quan Kong ⋅ Norimasa Kobori ⋅ Ali Farhadi ⋅ Yejin Choi ⋅ Ranjay Krishna
In Room: ExHall D Poster Location: Poster #354 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Difference Inversion: Interpolate and Isolate the Difference with Token Consistency for Image Analogy Generation
Hyunsoo Kim ⋅ Donghyun Kim ⋅ Suhyun Kim
In Room: ExHall D Poster Location: Poster #234 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
PhyS-EdiT: Physics-aware Semantic Image Editing with Text Description
Ziqi Cai ⋅ Shuchen Weng ⋅ Yifei Xia ⋅ Boxin Shi
In Room: ExHall D Poster Location: Poster #239 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Single Domain Generalization for Few-Shot Counting via Universal Representation Matching
Xianing Chen ⋅ Si Huo ⋅ Borui Jiang ⋅ Hailin Hu ⋅ Xinghao Chen
In Room: ExHall D Poster Location: Poster #428 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FedAWA: Adaptive Optimization of Aggregation Weights in Federated Learning Using Client Vectors
Changlong Shi ⋅ He Zhao ⋅ Bingjie Zhang ⋅ Mingyuan Zhou ⋅ Dandan Guo ⋅ Yi Chang
In Room: ExHall D Poster Location: Poster #431 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mono-InternVL: Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training
Luo ⋅ Xue Yang ⋅ Wenhan Dou ⋅ Zhaokai Wang ⋅ Jiawen Liu ⋅ Jifeng Dai ⋅ Yu Qiao ⋅ Xizhou Zhu
In Room: ExHall D Poster Location: Poster #375 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Instruction-based Image Manipulation by Watching How Things Move
Mingdeng Cao ⋅ Xuaner Zhang ⋅ Yinqiang Zheng ⋅ Zhihao Xia
In Room: ExHall D Poster Location: Poster #243 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Embodied Scene Understanding for Vision Language Models via MetaVQA
Weizhen Wang ⋅ Chenda Duan ⋅ Zhenghao Peng ⋅ Yuxin Liu ⋅ Bolei Zhou
In Room: ExHall D Poster Location: Poster #133 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
PEER Pressure: Model-to-Model Regularization for Single Source Domain Generalization
Dongkyu Cho ⋅ Inwoo Hwang ⋅ Sanghack Lee
In Room: ExHall D Poster Location: Poster #451 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Steering Away from Harm: An Adaptive Approach to Defending Vision Language Model Against Jailbreaks
Han Wang ⋅ Gang Wang ⋅ Huan Zhang
In Room: ExHall D Poster Location: Poster #363 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Functionality Understanding and Segmentation in 3D Scenes Project Page ↗
Jaime Corsetti ⋅ Francesco Giuliari ⋅ Alice Fasoli ⋅ Davide Boscaini ⋅ Fabio Poiesi
In Room: ExHall D Poster Location: Poster #336 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Less is More: Efficient Image Vectorization with Adaptive Parameterization
Kaibo Zhao ⋅ Liang Bao ⋅ Yufei Li ⋅ Xu Su ⋅ Ke Zhang ⋅ Xiaotian Qiao
In Room: ExHall D Poster Location: Poster #225 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MESC-3D:Mining Effective Semantic Cues for 3D Reconstruction from a Single Image
Shaoming Li ⋅ Qing Cai ⋅ Songqi KONG ⋅ Runqing Tan ⋅ Heng Tong ⋅ Shiji Qiu ⋅ Yongguo Jiang ⋅ Zhi Liu
In Room: ExHall D Poster Location: Poster #105 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Probing the Mid-level Vision Capabilities of Self-Supervised Learning
Xuweiyi Chen ⋅ Markus Marks ⋅ Zezhou Cheng
In Room: ExHall D Poster Location: Poster #377 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Style Evolving along Chain-of-Thought for Unknown-Domain Object Detection
Zihao Zhang ⋅ Aming Wu ⋅ Yahong Han
In Room: ExHall D Poster Location: Poster #342 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Exploring Scene Affinity for Semi-Supervised LiDAR Semantic Segmentation
Chuandong Liu ⋅ Xingxing Weng ⋅ Shuguo Jiang ⋅ Pengcheng Li ⋅ Lei Yu ⋅ Gui-Song Xia
In Room: ExHall D Poster Location: Poster #117 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation Project Page ↗
Minghong Cai ⋅ Xiaodong Cun ⋅ Xiaoyu Li ⋅ Wenze Liu ⋅ Zhaoyang Zhang ⋅ Yong Zhang ⋅ Ying Shan ⋅ Xiangyu Yue
In Room: ExHall D Poster Location: Poster #229 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Multi-Resolution Pathology-Language Pre-training Model with Text-Guided Visual Representation
Shahad Albastaki ⋅ Anabia Sohail ⋅ IYYAKUTTI IYAPPAN GANAPATHI ⋅ Basit Alawode ⋅ Asim Khan ⋅ Sajid Javed ⋅ Naoufel Werghi ⋅ Mohammed Bennamoun ⋅ Arif Mahmood
In Room: ExHall D Poster Location: Poster #468 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SpecTRe-GS: Modeling Highly Specular Surfaces with Reflected Nearby Objects by Tracing Rays in 3D Gaussian Splatting Project Page ↗
Jiajun Tang ⋅ Fan Fei ⋅ Zhihao Li ⋅ Xiao Tang ⋅ Shiyong Liu ⋅ Youyu Chen ⋅ Binxiao Huang ⋅ Dave Zhenyu Chen ⋅ Xiaofei Wu ⋅ Boxin Shi
In Room: ExHall D Poster Location: Poster #27 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
T2SG: Traffic Topology Scene Graph for Topology Reasoning in Autonomous Driving
Changsheng Lv ⋅ Mengshi Qi ⋅ Liang Liu ⋅ Huadong Ma
In Room: ExHall D Poster Location: Poster #132 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
ReCon: Enhancing True Correspondence Discrimination through Relation Consistency for Robust Noisy Correspondence Learning
Quanxing Zha ⋅ Xin Liu ⋅ Shu-Juan Peng ⋅ Yiu-ming Cheung ⋅ Xing Xu ⋅ Nannan Wang
In Room: ExHall D Poster Location: Poster #338 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation
Zirun Guo ⋅ Tao Jin
In Room: ExHall D Poster Location: Poster #266 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AKiRa: Augmentation Kit on Rays for Optical Video Generation
Xi Wang ⋅ Robin Courant ⋅ Marc Christie ⋅ Vicky Kalogeiton
In Room: ExHall D Poster Location: Poster #234 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RASP: Revisiting 3D Anamorphic Art for Shadow-Guided Packing of Irregular Objects
Soumyaratna Debnath ⋅ Ashish Tiwari ⋅ Kaustubh Sadekar ⋅ Shanmuganathan Raman
In Room: ExHall D Poster Location: Poster #38 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Exploring Historical Information for RGBE Visual Tracking with Mamba
Chuanyu Sun ⋅ Jiqing Zhang ⋅ Yang Wang ⋅ Huilin Ge ⋅ qianchen xia ⋅ Baocai Yin ⋅ Xin Yang
In Room: ExHall D Poster Location: Poster #107 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Rate-In: Information-Driven Adaptive Dropout Rates for Improved Inference-Time Uncertainty Estimation
Tal Zeevi ⋅ Ravid Shwartz-Ziv ⋅ Yann LeCun ⋅ Lawrence Staib ⋅ John A Onofrey
In Room: ExHall D Poster Location: Poster #471 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MP-GUI: Modality Perception with MLLMs for GUI Understanding Project Page ↗
Ziwei Wang ⋅ Weizhi Chen ⋅ Leyang Yang ⋅ Sheng Zhou ⋅ Shengchu Zhao ⋅ Hanbei Zhan ⋅ Jiongchao Jin ⋅ Liangcheng Li ⋅ Zirui Shao ⋅ Jiajun Bu
In Room: ExHall D Poster Location: Poster #342 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Adaptive Markup Language Generation for Contextually-Grounded Visual Document Understanding
Han Xiao ⋅ yina xie ⋅ Guanxin tan ⋅ Yinghao Chen ⋅ Rui Hu ⋅ Ke Wang ⋅ Aojun Zhou ⋅ Hao Li ⋅ Hao Shao ⋅ Xudong LU ⋅ Peng Gao ⋅ Yafei Wen ⋅ Xiaoxin Chen ⋅ Shuai Ren ⋅ Hongsheng Li
In Room: ExHall D Poster Location: Poster #325 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Identifying and Mitigating Spurious Correlation in Multi-Task Learning
Junyi Chai ⋅ Shenyu Lu ⋅ Xiaoqian Wang
In Room: ExHall D Poster Location: Poster #446 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention
Wenbin An ⋅ Feng Tian ⋅ Sicong Leng ⋅ Jiahao Nie ⋅ Haonan Lin ⋅ QianYing Wang ⋅ Ping Chen ⋅ Xiaoqin Zhang ⋅ Shijian Lu
In Room: ExHall D Poster Location: Poster #360 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Sketchy Bounding-box Supervision for 3D Instance Segmentation
qian deng ⋅ Le Hui ⋅ Jin Xie ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #336 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Continuous, Subject-Specific Attribute Control in T2I Models by Identifying Semantic Directions Project Page ↗
Stefan Andreas Baumann ⋅ Felix Krause ⋅ Michael Neumayr ⋅ Nick Stracke ⋅ Melvin Sevi ⋅ Vincent Tao Hu ⋅ Björn Ommer
In Room: ExHall D Poster Location: Poster #246 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FSboard: Over 3 Million Characters of ASL Fingerspelling Collected via Smartphones
Manfred Georg ⋅ Garrett Tanzer ⋅ Esha Uboweja ⋅ Saad Hassan ⋅ Maximus Shengelia ⋅ Sam Sepah ⋅ Sean Forbes ⋅ Thad Starner
In Room: ExHall D Poster Location: Poster #310 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Adversarial Domain Prompt Tuning and Generation for Single Domain Generalization
Zhipeng Xu ⋅ De Cheng ⋅ XINYANG JIANG ⋅ Nannan Wang ⋅ Dongsheng Li ⋅ Xinbo Gao
In Room: ExHall D Poster Location: Poster #268 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Full-DoF Egomotion Estimation for Event Cameras Using Geometric Solvers Project Page ↗
Ji Zhao ⋅ Banglei Guan ⋅ Zibin Liu ⋅ Laurent Kneip
In Room: ExHall D Poster Location: Poster #83 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PERSE: Personalized 3D Generative Avatars from A Single Portrait
Hyunsoo Cha ⋅ Inhee Lee ⋅ Hanbyul Joo
In Room: ExHall D Poster Location: Poster #9 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Discovering Hidden Visual Concepts Beyond Linguistic Input in Infant Learning
Xueyi Ke ⋅ Satoshi Tsutsui ⋅ Yayun Zhang ⋅ Bihan Wen
In Room: ExHall D Poster Location: Poster #401 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GauSTAR: Gaussian Surface Tracking and Reconstruction
Chengwei Zheng ⋅ Lixin Xue ⋅ Juan Jose Zarate ⋅ Jie Song
In Room: ExHall D Poster Location: Poster #67 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Latent Space Imaging
Matheus Souza ⋅ Yidan Zheng ⋅ Kaizhang Kang ⋅ Yogeshwar Nath Mishra ⋅ Qiang Fu ⋅ Wolfgang Heidrich
In Room: ExHall D Poster Location: Poster #203 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion Project Page ↗
Zhaoxi Chen ⋅ Jiaxiang Tang ⋅ Yuhao Dong ⋅ Ziang Cao ⋅ Fangzhou Hong ⋅ Yushi Lan ⋅ Tengfei Wang ⋅ Haozhe Xie ⋅ Tong Wu ⋅ Shunsuke Saito ⋅ Liang Pan ⋅ Dahua Lin ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #40 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Unraveling Normal Anatomy via Fluid-Driven Anomaly Randomization Project Page ↗
Peirong Liu ⋅ Ana Lawry Aguila ⋅ Juan Iglesias
In Room: ExHall D Poster Location: Poster #484 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
FaithDiff: Unleashing Diffusion Priors for Faithful Image Super-resolution
Junyang Chen ⋅ Jinshan Pan ⋅ Jiangxin Dong
In Room: ExHall D Poster Location: Poster #193 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Learned Image Compression with Dictionary-based Entropy Model
Jingbo Lu ⋅ Leheng Zhang ⋅ Xingyu Zhou ⋅ Mu Li ⋅ Wen Li ⋅ Shuhang Gu
In Room: ExHall D Poster Location: Poster #210 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ONDA-Pose: Occlusion-Aware Neural Domain Adaptation for Self-Supervised 6D Object Pose Estimation
Tao Tan ⋅ Qiulei Dong
In Room: ExHall D Poster Location: Poster #96 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
BEVDiffuser: Plug-and-Play Diffusion Model for BEV Denoising with Ground-Truth Guidance
Xin Ye ⋅ Burhan Yaman ⋅ Sheng Cheng ⋅ Feng Tao ⋅ Abhirup Mallik ⋅ Liu Ren
In Room: ExHall D Poster Location: Poster #124 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VoCo-LLaMA: Towards Vision Compression with Large Language Models Project Page ↗
Xubing Ye ⋅ Yukang Gan ⋅ Xiaoke Huang ⋅ Yixiao Ge ⋅ Yansong Tang
In Room: ExHall D Poster Location: Poster #353 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SnapGen: Taming High-Resolution Text-to-Image Models for Mobile Devices with Efficient Architectures and Training Project Page ↗
Jierun Chen ⋅ Dongting Hu ⋅ Xijie Huang ⋅ Huseyin Coskun ⋅ Arpit Sahni ⋅ Aarush Gupta ⋅ Anujraaj Goyal "argo" ⋅ Dishani Lahiri ⋅ Rajesh Singh ⋅ Yerlan Idelbayev ⋅ Junli Cao ⋅ Yanyu Li ⋅ Kwang-Ting Cheng ⋅ Mingming Gong ⋅ S.-H. Gary Chan ⋅ Sergey Tulyakov ⋅ Anil Kag ⋅ Yanwu Xu ⋅ Jian Ren
In Room: ExHall D Poster Location: Poster #251 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Think Small, Act Big: Primitive Prompt Learning for Lifelong Robot Manipulation
Yuanqi Yao ⋅ Siao Liu ⋅ Haoming Song ⋅ Delin Qu ⋅ Qizhi Chen ⋅ Yan Ding ⋅ Bin Zhao ⋅ Zhigang Wang ⋅ Dong Wang ⋅ Xuelong Li
In Room: ExHall D Poster Location: Poster #144 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Large Model Enhancement
Qianhan Feng ⋅ Wenshuo Li ⋅ Tong Lin ⋅ Xinghao Chen
In Room: ExHall D Poster Location: Poster #383 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale Project Page ↗
Joya Chen ⋅ Yiqi Lin ⋅ Ziyun Zeng ⋅ Wei Li ⋅ Zejun Ma ⋅ Mike Zheng Shou
In Room: ExHall D Poster Location: Poster #281 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ETAP: Event-based Tracking of Any Point Project Page ↗
Friedhelm Hamann ⋅ Daniel Gehrig ⋅ Filbert Febryanto ⋅ Kostas Daniilidis ⋅ Guillermo Gallego
In Room: ExHall D Poster Location: Poster #99 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Feature Spectrum Learning for Remote Sensing Change Detection
Qi Zang ⋅ Dong Zhao ⋅ Shuang Wang ⋅ Dou Quan ⋅ Licheng Jiao ⋅ Zhun Zhong
In Room: ExHall D Poster Location: Poster #191 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Free Lunch Enhancements for Multi-modal Crowd Counting Project Page ↗
Haoliang Meng ⋅ Xiaopeng Hong ⋅ Zhengqin Lai ⋅ Miao Shang
In Room: ExHall D Poster Location: Poster #322 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
LiSu: A Dataset and Method for LiDAR Surface Normal Estimation
Dušan Malić ⋅ Christian Fruhwirth-Reisinger ⋅ Samuel Schulter ⋅ Horst Possegger
In Room: ExHall D Poster Location: Poster #117 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Learning Phase Distortion with Selective State Space Models for Video Turbulence Mitigation
Xingguang Zhang ⋅ Nicholas M Chimitt ⋅ Xijun Wang ⋅ Yu Yuan ⋅ Stanley H. Chan
In Room: ExHall D Poster Location: Poster #184 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Adapting to Observation Length of Trajectory Prediction via Contrastive Learning
Ruiqi Qiu ⋅ JUN GONG ⋅ Xinyu Zhang ⋅ Siqi Luo ⋅ Bowen Zhang ⋅ Yi Cen
In Room: ExHall D Poster Location: Poster #138 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GaussHDR: High Dynamic Range Gaussian Splatting via Learning Unified 3D and 2D Local Tone Mapping Project Page ↗
Jinfeng Liu ⋅ Lingtong Kong ⋅ Bo Li ⋅ Dan Xu
In Room: ExHall D Poster Location: Poster #52 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model Project Page ↗
Yuting Zhang ⋅ Hao Lu ⋅ Qingyong Hu ⋅ Yin Wang ⋅ Kaishen Yuan ⋅ Xin Liu ⋅ Kaishun Wu
In Room: ExHall D Poster Location: Poster #295 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PSBD: Prediction Shift Uncertainty Unlocks Backdoor Detection Project Page ↗
Wei Li ⋅ Pin-Yu Chen ⋅ Sijia Liu ⋅ Ren Wang
In Room: ExHall D Poster Location: Poster #465 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Improve Representation for Imbalanced Regression through Geometric Constraints
Zijian Dong ⋅ Yilei Wu ⋅ Chongyao Chen ⋅ Yingtian Zou ⋅ Yichi Zhang ⋅ Juan Helen Zhou
In Room: ExHall D Poster Location: Poster #470 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Your Large Vision-Language Model Only Needs A Few Attention Heads For Visual Grounding
seil kang ⋅ Jinyeong Kim ⋅ Junhyeok Kim ⋅ Seong Jae Hwang
In Room: ExHall D Poster Location: Poster #378 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Differentiable Inverse Rendering with Interpretable Basis BRDFs
Hoon-Gyu Chung ⋅ Seokjun Choi ⋅ Seung-Hwan Baek
In Room: ExHall D Poster Location: Poster #29 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Beyond Background Shift: Rethinking Instance Replay in Continual Semantic Segmentation
Hongmei Yin ⋅ Tingliang Feng ⋅ Fan Lyu ⋅ Fanhua Shang ⋅ Hongying Liu ⋅ Wei Feng ⋅ Liang Wan
In Room: ExHall D Poster Location: Poster #425 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ShapeShifter: 3D Variations Using Multiscale and Sparse Point-Voxel Diffusion Project Page ↗
Nissim Maruani ⋅ Wang Yifan ⋅ Matthew Fisher ⋅ Pierre Alliez ⋅ Mathieu Desbrun
In Room: ExHall D Poster Location: Poster #41 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
ziang yan ⋅ Zhilin Li ⋅ Yinan He ⋅ Chenting Wang ⋅ Kunchang Li ⋅ Xinhao Li ⋅ Xiangyu Zeng ⋅ Zilei Wang ⋅ Yali Wang ⋅ Yu Qiao ⋅ Limin Wang ⋅ Yi Wang
In Room: ExHall D Poster Location: Poster #357 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Integral Fast Fourier Color Constancy
Wenjun Wei ⋅ Yanlin Qian ⋅ Huaian Chen ⋅ Junkang Dai ⋅ Yi Jin
In Room: ExHall D Poster Location: Poster #22 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
TreeMeshGPT: Artistic Mesh Generation with Autoregressive Tree Sequencing Project Page ↗
Stefan Lionar ⋅ Jiabin Liang ⋅ Gim Hee Lee
In Room: ExHall D Poster Location: Poster #43 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Training Data Provenance Verification: Did Your Model Use Synthetic Data from My Generative Model for Training?
Yuechen Xie ⋅ Jie Song ⋅ Huiqiong Wang ⋅ Mingli Song
In Room: ExHall D Poster Location: Poster #268 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
vesselFM: A Foundation Model for Universal 3D Blood Vessel Segmentation Project Page ↗
Bastian Wittmann ⋅ Yannick Wattenberg ⋅ Tamaz Amiranashvili ⋅ Suprosanna Shit ⋅ Bjoern Menze
In Room: ExHall D Poster Location: Poster #482 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DistinctAD: Distinctive Audio Description Generation in Contexts
Bo Fang ⋅ Wenhao Wu ⋅ Qiangqiang Wu ⋅ YuXin Song ⋅ Antoni B. Chan
In Room: ExHall D Poster Location: Poster #279 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
HOT: Hadamard-based Optimized Training
Seonggon Kim ⋅ Juncheol Shin ⋅ Seung-taek Woo ⋅ Eunhyeok Park
In Room: ExHall D Poster Location: Poster #442 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects Project Page ↗
Weimin Qiu ⋅ Jieke Wang ⋅ Meng Tang
In Room: ExHall D Poster Location: Poster #236 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
3D Gaussian Head Avatars with Expressive Dynamic Appearances by Compact Tensorial Representations
yating wang ⋅ Xuan Wang ⋅ Ran Yi ⋅ Yanbo Fan ⋅ Jichen Hu ⋅ Jingcheng Zhu ⋅ Lizhuang Ma
In Room: ExHall D Poster Location: Poster #7 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
The Illusion of Unlearning: The Unstable Nature of Machine Unlearning in Text-to-Image Diffusion Models Project Page ↗
Naveen George ⋅ Karthik Nandan Dasaraju ⋅ Rutheesh Reddy Chittepu ⋅ Konda Reddy Mopuri
In Room: ExHall D Poster Location: Poster #261 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
SaMam: Style-aware State Space Model for Arbitrary Image Style Transfer Project Page ↗
Hongda Liu ⋅ Longguang Wang ⋅ Ye Zhang ⋅ Ziru YU ⋅ Yulan Guo
In Room: ExHall D Poster Location: Poster #220 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Auto-Encoded Supervision for Perceptual Image Super-Resolution
MinKyu Lee ⋅ Sangeek Hyun ⋅ Woojin Jun ⋅ Jae-Pil Heo
In Room: ExHall D Poster Location: Poster #205 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model
Zhenglin Huang ⋅ Jinwei Hu ⋅ Yiwei He ⋅ Xiangtai Li ⋅ Xiaowei Huang ⋅ Bei Peng ⋅ Xingyu Zhao ⋅ Baoyuan Wu ⋅ Guangliang Cheng
In Room: ExHall D Poster Location: Poster #254 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
One2Any: One-Reference 6D Pose Estimation for Any Object
Mengya Liu ⋅ Siyuan Li ⋅ Ajad Chhatkuli ⋅ Prune Truong ⋅ Luc Van Gool ⋅ Federico Tombari
In Room: ExHall D Poster Location: Poster #103 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
A Comprehensive Study of Decoder-Only LLMs for Text-to-Image Generation
Andrew Z Wang ⋅ Songwei Ge ⋅ Tero Karras ⋅ Ming-Yu Liu ⋅ Yogesh Balaji
In Room: ExHall D Poster Location: Poster #230 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PreciseCam: Precise Camera Control for Text-to-Image Generation Project Page ↗
Edurne Bernal-Berdun ⋅ Ana Serrano ⋅ Belen Masia ⋅ Matheus Gadelha ⋅ Yannick Hold-Geoffroy ⋅ Xin Sun ⋅ Diego Gutierrez
In Room: ExHall D Poster Location: Poster #246 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EventGPT: Event Stream Understanding with Multimodal Large Language Models
shaoyu liu ⋅ Jianing Li ⋅ guanghui zhao ⋅ Yunjian Zhang ⋅ Xin Meng ⋅ Fei Richard Yu ⋅ Xiangyang Ji ⋅ Ming Li
In Room: ExHall D Poster Location: Poster #286 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Synthetic-to-Real Self-supervised Robust Depth Estimation via Learning with Motion and Structure Priors
Weilong Yan ⋅ Ming Li ⋅ Li Haipeng ⋅ Shuwei Shao ⋅ Robby T. Tan
In Room: ExHall D Poster Location: Poster #79 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
From Zero to Detail: Deconstructing Ultra-High-Definition Image Restoration from Progressive Spectral Perspective Project Page ↗
Chen Zhao ⋅ Zhizhou Chen ⋅ Yunzhe Xu ⋅ Enxuan Gu ⋅ Jian Li ⋅ Zili Yi ⋅ qian Wang ⋅ Jian Yang ⋅ Ying Tai
In Room: ExHall D Poster Location: Poster #203 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Rectification-specific Supervision and Constrained Estimator for Online Stereo Rectification
Rui Gong ⋅ Kim-Hui Yap ⋅ Weide Liu ⋅ Xulei Yang ⋅ Jun Cheng
In Room: ExHall D Poster Location: Poster #124 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Morpheus: Text-Driven 3D Gaussian Splat Shape and Color Stylization
Jamie Wynn ⋅ Zawar Qureshi ⋅ Jakub Powierza ⋅ Jamie Watson ⋅ Mohamed Sayed
In Room: ExHall D Poster Location: Poster #235 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Leveraging Global Stereo Consistency for Category-Level Shape and 6D Pose Estimation from Stereo Images
Junning Qiu ⋅ Minglei Lu ⋅ Fei Wang ⋅ Yu Guo ⋅ Yonggen Ling
In Room: ExHall D Poster Location: Poster #97 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
EfficientLLaVA: Generalizable Auto-Pruning for Large Vision-language Models
Yinan Liang ⋅ Ziwei Wang ⋅ Xiuwei Xu ⋅ Jie Zhou ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #388 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Detection-Friendly Nonuniformity Correction: A Union Framework for Infrared UAV Target Detection Project Page ↗
Houzhang Fang ⋅ Xiaolin Wang ⋅ Zengyang Li ⋅ Lu Wang ⋅ Qingshan Li ⋅ Yi Chang ⋅ Luxin Yan
In Room: ExHall D Poster Location: Poster #121 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Articulated Kinematics Distillation from Video Diffusion Models
Xuan Li ⋅ Qianli Ma ⋅ Tsung-Yi Lin ⋅ Yongxin Chen ⋅ Chenfanfu Jiang ⋅ Ming-Yu Liu ⋅ Donglai Xiang
In Room: ExHall D Poster Location: Poster #169 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MP-SfM: Monocular Surface Priors for Robust Structure-from-Motion Project Page ↗
Zador Pataki ⋅ Paul-Edouard Sarlin ⋅ Johannes Schönberger ⋅ Marc Pollefeys
In Room: ExHall D Poster Location: Poster #80 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
OnlineAnySeg: Online Zero-Shot 3D Segmentation by Visual Foundation Model Guided 2D Mask Merging
Yijie Tang ⋅ Jiazhao Zhang ⋅ Yuqing Lan ⋅ Yulan Guo ⋅ Dezun Dong ⋅ Chenyang Zhu ⋅ Kai Xu
In Room: ExHall D Poster Location: Poster #334 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Tora: Trajectory-oriented Diffusion Transformer for Video Generation Project Page ↗
Zhenghao Zhang ⋅ Junchao Liao ⋅ Menghao Li ⋅ Zuozhuo Dai ⋅ Bingxue Qiu ⋅ Siyu Zhu ⋅ Long Qin ⋅ Weizhi Wang
In Room: ExHall D Poster Location: Poster #178 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Volumetrically Consistent 3D Gaussian Rasterization Project Page ↗
Chinmay Talegaonkar ⋅ Yash Belhe ⋅ Ravi Ramamoorthi ⋅ Nicholas Antipa
In Room: ExHall D Poster Location: Poster #28 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
The Impact Label Noise and Choice of Threshold has on Cross-Entropy and Soft-Dice in Image Segmentation
Marcus Nordström ⋅ Atsuto Maki ⋅ Henrik Hult
In Room: ExHall D Poster Location: Poster #477 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Open-World Objectness Modeling Unifies Novel Object Detection
Shan Zhang ⋅ Yao Ni ⋅ Jinhao Du ⋅ Yuan Xue ⋅ Philip H.S. Torr ⋅ Piotr Koniusz ⋅ Anton van den Hengel
In Room: ExHall D Poster Location: Poster #401 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
LLaVA-Critic: Learning to Evaluate Multimodal Models Project Page ↗
Tianyi Xiong ⋅ Xiyao Wang ⋅ Dong Guo ⋅ Qinghao Ye ⋅ Haoqi Fan ⋅ Quanquan Gu ⋅ Heng Huang ⋅ Chunyuan Li
In Room: ExHall D Poster Location: Poster #283 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
MotionPRO: Exploring the Role of Pressure in Human MoCap and Beyond Project Page ↗
Shenghao Ren ⋅ Yi Lu ⋅ Jiayi Huang ⋅ Jiayi Zhao ⋅ He Zhang ⋅ Tao Yu ⋅ Qiu Shen ⋅ Xun Cao
In Room: ExHall D Poster Location: Poster #152 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
DiffVsgg: Diffusion-Driven Online Video Scene Graph Generation
Mu Chen ⋅ Liulei Li ⋅ Wenguan Wang ⋅ Yi Yang
In Room: ExHall D Poster Location: Poster #288 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Large-scale Multi-view Tensor Clustering with Implicit Linear Kernels
Jiyuan Liu ⋅ Xinwang Liu ⋅ chuankun Li ⋅ Xinhang Wan ⋅ Hao Tan ⋅ Yi Zhang ⋅ Weixuan Liang ⋅ Qian Qu ⋅ Yu Feng ⋅ Renxiang Guan ⋅ KE LIANG
In Room: ExHall D Poster Location: Poster #468 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Generalized Diffusion Detector: Mining Robust Features from Diffusion Models for Domain-Generalized Detection Project Page ↗
Boyong He ⋅ Yuxiang Ji ⋅ Qianwen Ye ⋅ Zhuoyue Tan ⋅ Liaoni Wu
In Room: ExHall D Poster Location: Poster #433 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Q-Eval-100K: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
Zicheng Zhang ⋅ Tengchuan Kou ⋅ Chunyi Li ⋅ Shushi Wang ⋅ Wei Sun ⋅ Wei Wang ⋅ Xiaoyu Li ⋅ ZongYu Wang ⋅ Xuezhi Cao ⋅ Xiongkuo Min ⋅ Xiaohong Liu ⋅ Guangtao Zhai
In Room: ExHall D Poster Location: Poster #358 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Prompting Depth Anything for 4K Resolution Accurate Metric Depth Estimation
Haotong Lin ⋅ Sida Peng ⋅ Jingxiao Chen ⋅ Songyou Peng ⋅ Jiaming Sun ⋅ Minghuan Liu ⋅ Hujun Bao ⋅ Jiashi Feng ⋅ Xiaowei Zhou ⋅ Bingyi Kang
In Room: ExHall D Poster Location: Poster #120 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Advancing Semantic Future Prediction through Multimodal Visual Sequence Transformers Project Page ↗
Efstathios Karypidis ⋅ Ioannis Kakogeorgiou ⋅ Spyros Gidaris ⋅ Nikos Komodakis
In Room: ExHall D Poster Location: Poster #345 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
GET: Unlocking the Multi-modal Potential of CLIP for Generalized Category Discovery Project Page ↗
Enguang Wang ⋅ Zhimao Peng ⋅ Zhengyuan Xie ⋅ Fei Yang ⋅ Xialei Liu ⋅ Ming-Ming Cheng
In Room: ExHall D Poster Location: Poster #428 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
On the Out-Of-Distribution Generalization of Large Multimodal Models
Xingxuan Zhang ⋅ Jiansheng Li ⋅ Wenjing Chu ⋅ junjia hai ⋅ Renzhe Xu ⋅ Yuqing Yang ⋅ Shikai Guan ⋅ Jiazheng Xu ⋅ Liping Jing ⋅ Peng Cui
In Room: ExHall D Poster Location: Poster #471 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Test-Time Domain Generalization via Universe Learning: A Multi-Graph Matching Approach for Medical Image Segmentation
Xingguo Lv ⋅ Xingbo Dong ⋅ Liwen Wang ⋅ Jiewen Yang ⋅ Lei Zhao ⋅ Bin Pu ⋅ Zhe Jin ⋅ Xuejun Li
In Room: ExHall D Poster Location: Poster #476 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Easy-editable Image Vectorization with Multi-layer Multi-scale Distributed Visual Feature Embedding
Ye Chen ⋅ Zhangli Hu ⋅ Zhongyin Zhao ⋅ Yupeng Zhu ⋅ Yue Shi ⋅ Yuxuan Xiong ⋅ Bingbing Ni
In Room: ExHall D Poster Location: Poster #219 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Acquire and then Adapt: Squeezing out Text-to-Image Model for Image Restoration
Junyuan Deng ⋅ Xinyi Wu ⋅ Yongxing Yang ⋅ Congchao Zhu ⋅ Song Wang ⋅ Zhenyao Wu
In Room: ExHall D Poster Location: Poster #204 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Towards Scalable Human-aligned Benchmark for Text-guided Image Editing Project Page ↗
Suho Ryu ⋅ Kihyun Kim ⋅ Eugene Baek ⋅ Dongsoo Shin ⋅ Joonseok Lee
In Room: ExHall D Poster Location: Poster #238 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Devils in Middle Layers of Large Vision-Language Models: Interpreting, Detecting and Mitigating Object Hallucinations via Attention Lens
Zhangqi Jiang ⋅ Junkai Chen ⋅ Beier Zhu ⋅ Tingjin Luo ⋅ Yankun Shen ⋅ Xu Yang
In Room: ExHall D Poster Location: Poster #379 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
SpectroMotion: Dynamic 3D Reconstruction of Specular Scenes
Cheng-De Fan ⋅ Chen-Wei Chang ⋅ Yi-Ruei Liu ⋅ Jie-Ying Lee ⋅ Jiun-Long Huang ⋅ Yu-Chee Tseng ⋅ Yu-Lun Liu
In Room: ExHall D Poster Location: Poster #27 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Scaling Inference Time Compute for Diffusion Models
Nanye Ma ⋅ Shangyuan Tong ⋅ Haolin Jia ⋅ Hexiang Hu ⋅ Yu-Chuan Su ⋅ Mingda Zhang ⋅ Xuan Yang ⋅ Yandong Li ⋅ Tommi Jaakkola ⋅ Xuhui Jia ⋅ Saining Xie
In Room: ExHall D Poster Location: Poster #226 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Coeff-Tuning: A Graph Filter Subspace View for Tuning Attention-Based Large Models
Zichen Miao ⋅ WEI CHEN ⋅ Qiang Qiu
In Room: ExHall D Poster Location: Poster #414 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MVBoost: Boost 3D Reconstruction with Multi-View Refinement
Xiangyu Liu ⋅ Xiaomei Zhang ⋅ Zhiyuan Ma ⋅ Xiangyu Zhu ⋅ Zhen Lei
In Room: ExHall D Poster Location: Poster #58 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Chat-based Person Retrieval via Dialogue-Refined Cross-Modal Alignment
Yang Bai ⋅ Yucheng Ji ⋅ Min Cao ⋅ Jinqiao Wang ⋅ Mang Ye
In Room: ExHall D Poster Location: Poster #360 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Category-Agnostic Neural Object Rigging
Guangzhao He ⋅ Chen Geng ⋅ Shangzhe Wu ⋅ Jiajun Wu
In Room: ExHall D Poster Location: Poster #98 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AVF-MAE++: Scaling Affective Video Facial Masked Autoencoders via Efficient Audio-Visual Self-Supervised Learning
Xuecheng Wu ⋅ Heli Sun ⋅ Yifan Wang ⋅ Jiayu Nie ⋅ Jie Zhang ⋅ Yabing Wang ⋅ Junxiao Xue ⋅ Liang He
In Room: ExHall D Poster Location: Poster #360 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
DynFocus: Dynamic Cooperative Network Empowers LLMs with Video Understanding
Yudong Han ⋅ Qingpei Guo ⋅ Liyuan Pan ⋅ Liu Liu ⋅ Yu Guan ⋅ Ming Yang
In Room: ExHall D Poster Location: Poster #299 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation
Lanyun Zhu ⋅ Tianrun Chen ⋅ Qianxiong Xu ⋅ Xuanyi Liu ⋅ Deyi Ji ⋅ Haiyang Wu ⋅ De Soh Soh ⋅ Jun Liu
In Room: ExHall D Poster Location: Poster #391 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
GroundingFace: Fine-grained Face Understanding via Pixel Grounding Multimodal Large Language Model
Yue Han ⋅ Jiangning Zhang ⋅ Junwei Zhu ⋅ Runze Hou ⋅ Xiaozhong Ji ⋅ Chuming Lin ⋅ Xiaobin Hu ⋅ Xuezhucun Xue ⋅ Yong Liu
In Room: ExHall D Poster Location: Poster #359 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Self-Supervised Cross-View Correspondence with Predictive Cycle Consistency
Alan Baade ⋅ Changan Chen
In Room: ExHall D Poster Location: Poster #89 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis Project Page ↗
Ho Kei Cheng ⋅ Masato Ishii ⋅ Akio Hayakawa ⋅ Takashi Shibuya ⋅ Alexander G. Schwing ⋅ Yuki Mitsufuji
In Room: ExHall D Poster Location: Poster #260 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Mimic In-Context Learning for Multimodal Tasks Project Page ↗
Yuchu Jiang ⋅ Jiale Fu ⋅ chenduo hao ⋅ Xinting Hu ⋅ Yingzhe Peng ⋅ Xin Geng ⋅ Xu Yang
In Room: ExHall D Poster Location: Poster #352 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
PromptHash: Affinity-Prompted Collaborative Cross-Modal Learning for Adaptive Hashing Retrieval Project Page ↗
Qiang Zou ⋅ Shuli Cheng ⋅ Jiayi Chen
In Room: ExHall D Poster Location: Poster #366 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Vision-Language Models Do Not Understand Negation Project Page ↗
Kumail Alhamoud ⋅ Shaden Alshammari ⋅ Yonglong Tian ⋅ Guohao Li ⋅ Philip H.S. Torr ⋅ Yoon Kim ⋅ Marzyeh Ghassemi
In Room: ExHall D Poster Location: Poster #331 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ID-Patch: Robust ID Association for Group Photo Personalization Project Page ↗
Yimeng Zhang ⋅ Tiancheng Zhi ⋅ Jing Liu ⋅ Shen Sang ⋅ Liming Jiang ⋅ Qing Yan ⋅ Sijia Liu ⋅ Linjie Luo
In Room: ExHall D Poster Location: Poster #270 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
iG-6DoF: Model-free 6DoF Pose Estimation for Unseen Object via Iterative 3D Gaussian Splatting
Tuo Cao ⋅ Fei LUO ⋅ Jiongming Qin ⋅ Yu Jiang ⋅ Yusen Wang ⋅ Chunxia Xiao
In Room: ExHall D Poster Location: Poster #101 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
HyperNet Fields: Efficiently Training Hypernetworks without Ground Truth by Learning Weight Trajectories
Eric Hedlin ⋅ Munawar Hayat ⋅ Fatih Porikli ⋅ Kwang Moo Yi ⋅ Shweta Mahajan
In Room: ExHall D Poster Location: Poster #103 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
RICCARDO: Radar Hit Prediction and Convolution for Camera-Radar 3D Object Detection
Yunfei Long ⋅ Abhinav Kumar ⋅ Xiaoming Liu ⋅ Daniel Morris
In Room: ExHall D Poster Location: Poster #117 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
Yiyang Du ⋅ Xiaochen Wang ⋅ Chi Chen ⋅ Jiabo Ye ⋅ Yiru Wang ⋅ Peng Li ⋅ Ming Yan ⋅ Ji Zhang ⋅ Fei Huang ⋅ Zhifang Sui ⋅ Maosong Sun ⋅ Yang Liu
In Room: ExHall D Poster Location: Poster #385 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation
Qi Lv ⋅ Hao Li ⋅ Xiang Deng ⋅ Rui Shao ⋅ Yinchuan Li ⋅ Jianye Hao ⋅ Longxiang Gao ⋅ MICHAEL YU WANG ⋅ Liqiang Nie
In Room: ExHall D Poster Location: Poster #153 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
Huaize Liu ⋅ WenZhang Sun ⋅ Donglin Di ⋅ Shibo Sun ⋅ Jiahui Yang ⋅ Hujun Bao ⋅ Changqing Zou
In Room: ExHall D Poster Location: Poster #2 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ReCap: Better Gaussian Relighting with Cross-Environment Captures Project Page ↗
Jingzhi Li ⋅ Zongwei Wu ⋅ Eduard Zamfir ⋅ Radu Timofte
In Room: ExHall D Poster Location: Poster #25 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Split Adaptation for Pre-trained Vision Transformers Project Page ↗
Lixu Wang ⋅ Bingqi Shang ⋅ Yi Li ⋅ Payal Mohapatra ⋅ Wei Dong ⋅ Xiao Wang ⋅ Qi Zhu
In Room: ExHall D Poster Location: Poster #409 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SpatialLLM: A Compound 3D-Informed Design towards Spatially-Intelligent Large Multimodal Models
Wufei Ma ⋅ Luoxin Ye ⋅ Nessa McWeeney ⋅ Celso M. de Melo ⋅ Alan L. Yuille ⋅ Jieneng Chen
In Room: ExHall D Poster Location: Poster #137 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method
Xinshuai Song ⋅ weixing chen ⋅ Yang Liu ⋅ Weikai Chen ⋅ Guanbin Li ⋅ Liang Lin
In Room: ExHall D Poster Location: Poster #138 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BimArt: A Unified Approach for the Synthesis of 3D Bimanual Interaction with Articulated Objects
Wanyue Zhang ⋅ Rishabh Dabral ⋅ Vladislav Golyanik ⋅ Vasileios Choutas ⋅ Eduardo Alvarado ⋅ Thabo Beeler ⋅ Marc Habermann ⋅ Christian Theobalt
In Room: ExHall D Poster Location: Poster #146 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Open-World Amodal Appearance Completion Project Page ↗
Jiayang Ao ⋅ Yanbei Jiang ⋅ Qiuhong Ke ⋅ Krista A. Ehinger
In Room: ExHall D Poster Location: Poster #106 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CoSpace: Benchmarking Continuous Space Perception Ability for Vision-Language Models
Yiqi Zhu ⋅ Ziyue Wang ⋅ Can Zhang ⋅ Peng Li ⋅ Yang Liu
In Room: ExHall D Poster Location: Poster #326 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Detecting Adversarial Data Using Perturbation Forgery
Qian Wang ⋅ Chen Li ⋅ Yuchen Luo ⋅ Hefei Ling ⋅ Shijuan Huang ⋅ Ruoxi Jia ⋅ Ning Yu
In Room: ExHall D Poster Location: Poster #312 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RivuletMLP: An MLP-based Architecture for Efficient Compressed Video Quality Enhancement
Gang He ⋅ Weiran Wang ⋅ Guancheng Quan ⋅ Shihao Wang ⋅ Dajiang Zhou ⋅ Yunsong Li
In Room: ExHall D Poster Location: Poster #189 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
OmniManip: Towards General Robotic Manipulation via Object-Centric Interaction Primitives as Spatial Constraints Project Page ↗
Mingjie Pan ⋅ Jiyao Zhang ⋅ Tianshu Wu ⋅ Yinghao Zhao ⋅ Wenlong Gao ⋅ Hao Dong
In Room: ExHall D Poster Location: Poster #150 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Show and Tell: Visually Explainable Deep Neural Nets via Spatially-Aware Concept Bottleneck Models Project Page ↗
Itay Benou ⋅ Tammy Riklin Raviv
In Room: ExHall D Poster Location: Poster #374 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Reanimating Images using Neural Representations of Dynamic Stimuli Project Page ↗
Jacob Yeung ⋅ Andrew Luo ⋅ Gabriel Sarch ⋅ Margaret Marie Henderson ⋅ Deva Ramanan ⋅ Michael J. Tarr
In Room: ExHall D Poster Location: Poster #220 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Visual-Instructed Degradation Diffusion for All-in-One Image Restoration
Haina Qin ⋅ Wenyang Luo ⋅ Zewen Chen ⋅ Yufan Liu ⋅ Bing Li ⋅ Weiming Hu ⋅ libin wang ⋅ DanDan Zheng ⋅ Yuming Li
In Room: ExHall D Poster Location: Poster #202 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Insightful Instance Features for 3D Instance Segmentation
Wonseok Roh ⋅ Hwanhee Jung ⋅ Giljoo Nam ⋅ Dong In Lee ⋅ Hyeongcheol Park ⋅ Sang Ho Yoon ⋅ Jungseock Joo ⋅ Sangpil Kim
In Room: ExHall D Poster Location: Poster #326 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Learning 4D Panoptic Scene Graph Generation from Rich 2D Visual Scene Project Page ↗
Shengqiong Wu ⋅ Hao Fei ⋅ Jingkang Yang ⋅ Xiangtai Li ⋅ Juncheng Li ⋅ Hanwang Zhang ⋅ Tat-seng Chua
In Room: ExHall D Poster Location: Poster #335 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Knowledge Bridger: Towards Training-Free Missing Modality Completion
Guanzhou Ke ⋅ Shengfeng He ⋅ Xiao-Li Wang ⋅ Bo Wang ⋅ Guoqing Chao ⋅ Yuanyang Zhang ⋅ Yi Xie ⋅ HeXing Su
In Room: ExHall D Poster Location: Poster #464 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EmoDubber: Towards High Quality and Emotion Controllable Movie Dubbing
Gaoxiang Cong ⋅ Jiadong Pan ⋅ Liang Li ⋅ Yuankai Qi ⋅ Yuxin Peng ⋅ Anton van den Hengel ⋅ Jian Yang ⋅ Qingming Huang
In Room: ExHall D Poster Location: Poster #1 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos Project Page ↗
Wenbo Hu ⋅ Xiangjun Gao ⋅ Xiaoyu Li ⋅ Sijie Zhao ⋅ Xiaodong Cun ⋅ Yong Zhang ⋅ Long Quan ⋅ Ying Shan
In Room: ExHall D Poster Location: Poster #171 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
TexGarment: Consistent Garment UV Texture Generation via Efficient 3D Structure-Guided Diffusion Transformer
Jialun Liu ⋅ Jinbo Wu ⋅ Xiaobo Gao ⋅ JiaKui Hu ⋅ Bojun Xiong ⋅ Xing Liu ⋅ Chen Zhao ⋅ Hongbin Pei ⋅ Haocheng Feng ⋅ Yingying Li ⋅ Errui Ding ⋅ Jingdong Wang
In Room: ExHall D Poster Location: Poster #39 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
A Hubness Perspective on Representation Learning for Graph-Based Multi-View Clustering
Zheming Xu ⋅ He Liu ⋅ Congyan Lang ⋅ Tao Wang ⋅ Yidong Li ⋅ Michael C. Kampffmeyer
In Room: ExHall D Poster Location: Poster #467 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Semi-Supervised State-Space Model with Dynamic Stacking Filter for Real-World Video Deraining
Shangquan Sun ⋅ Wenqi Ren ⋅ Juxiang Zhou ⋅ Shu Wang ⋅ Jianhou Gan ⋅ Xiaochun Cao
In Room: ExHall D Poster Location: Poster #188 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face Detector
Xiao Guo ⋅ Xiufeng Song ⋅ Yue Zhang ⋅ Xiaohong Liu ⋅ Xiaoming Liu
In Room: ExHall D Poster Location: Poster #381 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VSNet: Focusing on the Linguistic Characteristics of Sign Language
Yuhao Li ⋅ Xinyue Chen ⋅ Hongkai Li ⋅ Xiaorong Pu ⋅ Peng Jin ⋅ Yazhou Ren
In Room: ExHall D Poster Location: Poster #315 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Active Hyperspectral Imaging Using an Event Camera
Bohan Yu ⋅ Jinxiu Liang ⋅ Zhuofeng Wang ⋅ Bin Fan ⋅ Art Subpaasa ⋅ Boxin Shi ⋅ Imari Sato
In Room: ExHall D Poster Location: Poster #71 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Bridging the Gap between Gaussian Diffusion Models and Universal Quantization for Image Compression
Lucas Relic ⋅ Roberto Azevedo ⋅ Yang Zhang ⋅ Markus Gross ⋅ Christopher Schroers
In Room: ExHall D Poster Location: Poster #217 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VideoRefer Suite: Advancing Spatial-Temporal Object Understanding with Video LLM
Yuqian Yuan ⋅ Hang Zhang ⋅ Wentong Li ⋅ Zesen Cheng ⋅ Boqiang Zhang ⋅ Long Li ⋅ Xin Li ⋅ Deli Zhao ⋅ Wenqiao Zhang ⋅ Yueting Zhuang ⋅ Jianke Zhu ⋅ Lidong Bing
In Room: ExHall D Poster Location: Poster #303 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Multi-modal Medical Diagnosis via Large-small Model Collaboration
Wanyi Chen ⋅ Zihua Zhao ⋅ Jiangchao Yao ⋅ Ya Zhang ⋅ Jiajun Bu ⋅ Haishuai Wang
In Room: ExHall D Poster Location: Poster #442 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
SAMBLE: Shape-Specific Point Cloud Sampling for an Optimal Trade-Off Between Local Detail and Global Uniformity
Chengzhi Wu ⋅ Yuxin Wan ⋅ Hao Fu ⋅ Julius Pfrommer ⋅ Zeyun Zhong ⋅ Junwei Zheng ⋅ Jiaming Zhang ⋅ Jürgen Beyerer
In Room: ExHall D Poster Location: Poster #109 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SkySense-O: Towards Open-World Remote Sensing Interpretation with Vision-Centric Visual-Language Modeling
Qi Zhu ⋅ Jiangwei Lao ⋅ Deyi Ji ⋅ Junwei Luo ⋅ Kang Wu ⋅ Yingying Zhang ⋅ Lixiang Ru ⋅ Jian Wang ⋅ Jingdong Chen ⋅ Ming Yang ⋅ Dong Liu ⋅ Feng Zhao
In Room: ExHall D Poster Location: Poster #391 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
AdaDARE-gamma: Balancing Stability and Plasticity in Multi-modal LLMs through Efficient Adaptation
Jingyi Xie ⋅ Jintao Yang ⋅ Zhunchen Luo ⋅ Yunbo Cao ⋅ Qiang Gao ⋅ Mengyuan Zhang ⋅ Wenpeng Hu
In Room: ExHall D Poster Location: Poster #377 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
LeviTor: 3D Trajectory Oriented Image-to-Video Synthesis
Hanlin Wang ⋅ Hao Ouyang ⋅ Qiuyu Wang ⋅ Wen Wang ⋅ Ka Leong Cheng ⋅ Qifeng Chen ⋅ Yujun Shen ⋅ Limin Wang
In Room: ExHall D Poster Location: Poster #175 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ABC-Former: Auxiliary Bimodal Cross-domain Transformer with Interactive Channel Attention for White Balance
Yu-Cheng Chiu ⋅ GUAN-RONG CHEN ⋅ Zihao Chen ⋅ Yan-Tsung Peng
In Room: ExHall D Poster Location: Poster #20 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Fingerprinting Denoising Diffusion Probabilistic Models
Huan Teng ⋅ Yuhui Quan ⋅ Chengyu Wang ⋅ Jun Huang ⋅ Hui Ji
In Room: ExHall D Poster Location: Poster #252 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
InstanceGaussian: Appearance-Semantic Joint Gaussian Representation for 3D Instance-Level Perception
Haijie Li ⋅ Yanmin Wu ⋅ Jiarui Meng ⋅ Qiankun Gao ⋅ Zhiyao Zhang ⋅ Ronggang Wang ⋅ Jian Zhang
In Room: ExHall D Poster Location: Poster #328 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
CSC-PA: Cross-image Semantic Correlation via Prototype Attentions for Single-network Semi-supervised Breast Tumor Segmentation
Zhenhui Ding ⋅ Guilian Chen ⋅ Qin Zhang ⋅ Huisi Wu ⋅ Jing Qin
In Room: ExHall D Poster Location: Poster #477 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
BIP3D: Bridging 2D Images and 3D Perception for Embodied Intelligence
Xuewu Lin ⋅ Tianwei Lin ⋅ Alan Huang ⋅ HONGYU XIE ⋅ Zhizhong Su
In Room: ExHall D Poster Location: Poster #348 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Query Efficient Black-Box Visual Prompting with Subspace Learning
Haozhen Zhang ⋅ Zhaogeng Liu ⋅ Hualin Zhang ⋅ Xingchen Li ⋅ Wanli Shi ⋅ Bin Gu ⋅ Yi Chang
In Room: ExHall D Poster Location: Poster #399 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DiffusionSfM: Predicting Structure and Motion via Ray Origin and Endpoint Diffusion
Qitao Zhao ⋅ Amy Lin ⋅ Jeff Tan ⋅ Jason Y. Zhang ⋅ Deva Ramanan ⋅ Shubham Tulsiani
In Room: ExHall D Poster Location: Poster #87 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Gyro-based Neural Single Image Deblurring
Heemin Yang ⋅ Jaesung Rim ⋅ Seungyong Lee ⋅ Seung-Hwan Baek ⋅ Sunghyun Cho
In Room: ExHall D Poster Location: Poster #195 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HSI: A Holistic Style Injector for Arbitrary Style Transfer
Shuhao Zhang ⋅ Hui Kang ⋅ Yang Liu ⋅ Fang Mei ⋅ Hongjuan Li
In Room: ExHall D Poster Location: Poster #227 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction
Huiwon Jang ⋅ Sihyun Yu ⋅ Jinwoo Shin ⋅ Pieter Abbeel ⋅ Younggyo Seo
In Room: ExHall D Poster Location: Poster #171 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reconstructing Animals and the Wild Project Page ↗
Peter Kulits ⋅ Michael J. Black ⋅ Silvia Zuffi
In Room: ExHall D Poster Location: Poster #70 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
A General Adaptive Dual-level Weighting Mechanism for Remote Sensing Pansharpening
Jie Huang ⋅ Haorui Chen ⋅ Jiaxuan Ren ⋅ Siran Peng ⋅ Liang-Jian Deng
In Room: ExHall D Poster Location: Poster #199 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Controllable Human Image Generation with Personalized Multi-Garments Project Page ↗
Yisol Choi ⋅ Sangkyung Kwak ⋅ Sihyun Yu ⋅ Hyungwon Choi ⋅ Jinwoo Shin
In Room: ExHall D Poster Location: Poster #245 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
What’s in the Image? A Deep-Dive into the Vision of Vision Language Models Project Page ↗
Omri Kaduri ⋅ Shai Bagon ⋅ Tali Dekel
In Room: ExHall D Poster Location: Poster #372 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Just Dance with pi! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection
Snehashis Majhi ⋅ Giacomo D'Amicantonio ⋅ Antitza Dantcheva ⋅ Quan Kong ⋅ Lorenzo Garattoni ⋅ Gianpiero Francesca ⋅ Egor Bondarev ⋅ Francois Bremond
In Room: ExHall D Poster Location: Poster #310 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Do ImageNet-trained Models Learn Shortcuts? The Impact of Frequency Shortcuts on Generalization
Shunxin Wang ⋅ Raymond Veldhuis ⋅ Nicola Strisciuglio
In Room: ExHall D Poster Location: Poster #397 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
Yang Chen ⋅ Jingcai Guo ⋅ Song Guo ⋅ Dacheng Tao
In Room: ExHall D Poster Location: Poster #320 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
GIF: Generative Inspiration for Face Recognition at Scale
Mohammad Saadabadi Saadabadi ⋅ Sahar Rahimi Malakshan ⋅ Ali Dabouei ⋅ Srinjoy Das ⋅ Jeremy M. Dawson ⋅ Nasser M Nasrabadi
In Room: ExHall D Poster Location: Poster #320 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Pos3R: 6D Pose Estimation for Unseen Objects Made Easy
Weijian Deng ⋅ Dylan Campbell ⋅ Chunyi Sun ⋅ Jiahao Zhang ⋅ Shubham Kanitkar ⋅ Matthew Shaffer ⋅ Stephen Gould
In Room: ExHall D Poster Location: Poster #95 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation
Yu Qi ⋅ Yuanchen Ju ⋅ Tianming Wei ⋅ Chi Chu ⋅ Lawson L.S. Wong ⋅ Huazhe Xu
In Room: ExHall D Poster Location: Poster #152 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Co-op: Correspondence-based Novel Object Pose Estimation Project Page ↗
Sungphill Moon ⋅ Hyeontae Son ⋅ Dongcheol Hur ⋅ Sangwook Kim
In Room: ExHall D Poster Location: Poster #94 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Tripartite Weight-Space Ensemble for Few-Shot Class-Incremental Learning
Juntae Lee ⋅ Munawar Hayat ⋅ Sungrack Yun
In Room: ExHall D Poster Location: Poster #448 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
ALIEN: Implicit Neural Representations for Human Motion Prediction under Arbitrary Latency
Dong Wei ⋅ Xiaoning Sun ⋅ Xizhan Gao ⋅ Shengxiang Hu ⋅ Huaijiang Sun
In Room: ExHall D Poster Location: Poster #157 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Seurat: From Moving Points to Depth
Seokju Cho ⋅ Gabriel Huang ⋅ Seungryong Kim ⋅ Joon-Young Lee
In Room: ExHall D Poster Location: Poster #177 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
NexusGS: Sparse View Synthesis with Epipolar Depth Priors in 3D Gaussian Splatting
Yulong Zheng ⋅ Zicheng Jiang ⋅ Shengfeng He ⋅ Yandu Sun ⋅ Junyu Dong ⋅ Huaidong Zhang ⋅ Yong Du
In Room: ExHall D Poster Location: Poster #63 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Decentralized Diffusion Models
David McAllister ⋅ Matthew Tancik ⋅ Jiaming Song ⋅ Angjoo Kanazawa
In Room: ExHall D Poster Location: Poster #217 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
CheckManual: A New Challenge and Benchmark for Manual-based Appliance Manipulation Project Page ↗
Yuxing Long ⋅ Jiyao Zhang ⋅ Mingjie Pan ⋅ Tianshu Wu ⋅ Taewhan Kim ⋅ Hao Dong
In Room: ExHall D Poster Location: Poster #146 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Forensic Self-Descriptions Are All You Need for Zero-Shot Detection, Open-Set Source Attribution, and Clustering of AI-generated Images
Tai Nguyen ⋅ Aref Azizpour ⋅ Matthew Stamm
In Room: ExHall D Poster Location: Poster #275 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
CARL: A Framework for Equivariant Image Registration
Hastings Greer ⋅ Lin Tian ⋅ François-Xavier Vialard ⋅ Roland Kwitt ⋅ Raúl San José Estépar ⋅ Marc Niethammer
In Room: ExHall D Poster Location: Poster #478 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Autoregressive Distillation of Diffusion Transformers
Yeongmin Kim ⋅ Sotiris Anagnostidis ⋅ Yuming Du ⋅ Edgar Schoenfeld ⋅ Jonas Kohler ⋅ Markos Georgopoulos ⋅ Albert Pumarola ⋅ Ali Thabet ⋅ Artsiom Sanakoyeu
In Room: ExHall D Poster Location: Poster #230 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Blurry-Edges: Photon-Limited Depth Estimation from Defocused Boundaries Project Page ↗
Wei Xu ⋅ Charlie Wagner ⋅ Junjie Luo ⋅ Qi Guo
In Room: ExHall D Poster Location: Poster #25 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
FlexiDiT: Your Diffusion Transformer Can Easily Generate High-Quality Samples with Less Compute
Sotiris Anagnostidis ⋅ Gregor Bachmann ⋅ Yeongmin Kim ⋅ Jonas Kohler ⋅ Markos Georgopoulos ⋅ Artsiom Sanakoyeu ⋅ Yuming Du ⋅ Albert Pumarola ⋅ Ali Thabet ⋅ Edgar Schoenfeld
In Room: ExHall D Poster Location: Poster #205 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
CrossSDF: 3D Reconstruction of Thin Structures From Cross-Sections
Thomas Walker ⋅ Salvatore Esposito ⋅ Daniel Rebain ⋅ Amir Vaxman ⋅ Arno Onken ⋅ Changjian Li ⋅ Oisin Mac Aodha
In Room: ExHall D Poster Location: Poster #457 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
POT: Prototypical Optimal Transport for Weakly Supervised Semantic Segmentation
Jian Wang ⋅ Tianhong Dai ⋅ Bingfeng Zhang ⋅ Siyue Yu ⋅ ENG GEE LIM ⋅ Jimin Xiao
In Room: ExHall D Poster Location: Poster #422 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Perceptual Inductive Bias Is What You Need Before Contrastive Learning
Junru Zhao ⋅ Tianqin Li ⋅ Dunhan Jiang ⋅ Shenghao Wu ⋅ Alan Ramirez ⋅ Tai Sing Lee
In Room: ExHall D Poster Location: Poster #405 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Pseudo Visible Feature Fine-Grained Fusion for Thermal Object Detection
Ting Li ⋅ Mao Ye ⋅ Tianwen Wu ⋅ Nianxin Li ⋅ Shuaifeng Li ⋅ Song Tang ⋅ Luping Ji
In Room: ExHall D Poster Location: Poster #128 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
TinyFusion: Diffusion Transformers Learned Shallow
Gongfan Fang ⋅ Kunjun Li ⋅ Xinyin Ma ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #223 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
NSD-Imagery: A Benchmark Dataset for Extending fMRI Vision Decoding Methods to Mental Imagery
Reese Kneeland ⋅ Paul Scotti ⋅ Ghislain St-Yves ⋅ Jesse L Breedlove ⋅ Kendrick N Kay ⋅ Thomas Naselaris
In Room: ExHall D Poster Location: Poster #256 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Poly-Autoregressive Prediction for Modeling Interactions
Neerja Thakkar ⋅ Tara Sadjadpour ⋅ Jathushan Rajasegaran ⋅ Shiry Ginosar ⋅ Jitendra Malik
In Room: ExHall D Poster Location: Poster #167 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Link-based Contrastive Learning for One-Shot Unsupervised Domain Adaptation
Yue Zhang ⋅ Mingyue Bin ⋅ Yuyang Zhang ⋅ Zhongyuan Wang ⋅ Zhen Han ⋅ Chao Liang
In Room: ExHall D Poster Location: Poster #454 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SAM2-LOVE: Segment Anything Model 2 in Language-aided Audio-Visual Scenes
Yuji Wang ⋅ Haoran Xu ⋅ Yong Liu ⋅ Jiaze Li ⋅ Yansong Tang
In Room: ExHall D Poster Location: Poster #264 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MC^2: Multi-concept Guidance for Customized Multi-concept Generation
Jiaxiu Jiang ⋅ Yabo Zhang ⋅ Kailai Feng ⋅ Xiaohe Wu ⋅ Wenbo Li ⋅ Renjing Pei ⋅ Fan Li ⋅ Wangmeng Zuo
In Room: ExHall D Poster Location: Poster #253 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation
Leigang Qu ⋅ Haochuan Li ⋅ Wenjie Wang ⋅ Xiang Liu ⋅ Juncheng Li ⋅ Liqiang Nie ⋅ Tat-seng Chua
In Room: ExHall D Poster Location: Poster #260 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
DocSAM: Unified Document Image Segmentation via Query Decomposition and Heterogeneous Mixed Learning
Xiao-Hui Li ⋅ Fei Yin ⋅ Cheng-Lin Liu
In Room: ExHall D Poster Location: Poster #418 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
Yuheng Ji ⋅ Huajie Tan ⋅ Jiayu Shi ⋅ Xiaoshuai Hao ⋅ Yuan Zhang ⋅ Hengyuan Zhang ⋅ Pengwei Wang ⋅ Mengdi Zhao ⋅ Yao Mu ⋅ Pengju An ⋅ Xinda Xue ⋅ Qinghang Su ⋅ Huaihai Lyu ⋅ Xiaolong Zheng ⋅ Jiaming Liu ⋅ Zhongyuan Wang ⋅ Shanghang Zhang
In Room: ExHall D Poster Location: Poster #145 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RayFlow: Instance-Aware Diffusion Acceleration via Adaptive Flow Trajectories
Huiyang Shao ⋅ Xin Xia ⋅ Yuhong Yang ⋅ Ren Yuxi ⋅ XING WANG ⋅ Xuefeng Xiao
In Room: ExHall D Poster Location: Poster #220 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Generative Sparse-View Gaussian Splatting
Hanyang Kong ⋅ Xingyi Yang ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #58 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting
Jingyi Xu ⋅ Xieyuanli Chen ⋅ Junyi Ma ⋅ Jiawei Huang ⋅ Jintao Xu ⋅ Yue Wang ⋅ Ling Pei
In Room: ExHall D Poster Location: Poster #123 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Diffusion Model is Effectively Its Own Teacher
Xinyin Ma ⋅ Runpeng Yu ⋅ Songhua Liu ⋅ Gongfan Fang ⋅ Xinchao Wang
In Room: ExHall D Poster Location: Poster #215 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
AVQACL: A Novel Benchmark for Audio-Visual Question Answering Continual Learning
Kaixuan Wu ⋅ Xinde Li ⋅ Xinglin Li ⋅ Chuanfei Hu ⋅ Guoliang Wu
In Room: ExHall D Poster Location: Poster #295 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Science-T2I: Addressing Scientific Illusions in Image Synthesis
Jialuo Li ⋅ Wenhao Chai ⋅ XINGYU FU ⋅ Haiyang Xu ⋅ Saining Xie
In Room: ExHall D Poster Location: Poster #247 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
EASEMVC:Efficient Dual Selection Mechanism for Deep Multi-View Clustering
Baili Xiao ⋅ Zhibin Dong ⋅ KE LIANG ⋅ Suyuan Liu ⋅ Siwei Wang ⋅ Tianrui Liu ⋅ Xingchen Hu ⋅ En Zhu ⋅ Xinwang Liu
In Room: ExHall D Poster Location: Poster #467 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
StyleSSP: Sampling StartPoint Enhancement for Training-free Diffusion-based Method for Style Transfer
ruojun xu ⋅ Weijie Xi ⋅ Xiaodi Wang ⋅ Yongbo Mao ⋅ Zach Cheng
In Room: ExHall D Poster Location: Poster #235 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SoftShadow: Leveraging Soft Masks for Penumbra-Aware Shadow Removal
Xinrui Wang ⋅ Lanqing Guo ⋅ Xiyu Wang ⋅ Siyu Huang ⋅ Bihan Wen
In Room: ExHall D Poster Location: Poster #206 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Hearing Anywhere in Any Environment Project Page ↗
Xiulong Liu ⋅ Anurag Kumar ⋅ Paul Calamia ⋅ Sebastia Vicenc Amengual Gari ⋅ Calvin Murdock ⋅ Ishwarya Ananthabhotla ⋅ Philip W Robinson ⋅ Eli Shlizerman ⋅ Vamsi Krishna Ithapu ⋅ Ruohan Gao
In Room: ExHall D Poster Location: Poster #27 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Parameterized Blur Kernel Prior Learning for Local Motion Deblurring
Zhenxuan Fang ⋅ Fangfang Wu ⋅ Tao Huang ⋅ Le Dong ⋅ Weisheng Dong ⋅ Xin Li ⋅ Guangming Shi
In Room: ExHall D Poster Location: Poster #185 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Driving by the Rules: A Benchmark for Integrating Traffic Sign Regulations into Vectorized HD Map
Xinyuan Chang ⋅ Maixuan Xue ⋅ Xinran Liu ⋅ Zheng Pan ⋅ Xing Wei
In Room: ExHall D Poster Location: Poster #139 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
AeroGen: Enhancing Remote Sensing Object Detection with Diffusion-Driven Data Generation
Datao Tang ⋅ Xiangyong Cao ⋅ Xuan Wu ⋅ Jialin Li ⋅ Jing Yao ⋅ Xueru Bai ⋅ Dongsheng Jiang ⋅ Yin Li ⋅ Deyu Meng
In Room: ExHall D Poster Location: Poster #328 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
IDEA-Bench: How Far are Generative Models from Professional Designing?
Chen Liang ⋅ Lianghua Huang ⋅ Jingwu Fang ⋅ Huanzhang Dou ⋅ Wei Wang ⋅ Zhi-Fan Wu ⋅ Yupeng Shi ⋅ Junge Zhang ⋅ Xin Zhao ⋅ Yu Liu
In Room: ExHall D Poster Location: Poster #264 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Enhancing Dataset Distillation via Non-Critical Region Refinement
Minh-Tuan Tran ⋅ Trung Le ⋅ Xuan-May Le ⋅ Thanh-Toan Do ⋅ Dinh Phung
In Room: ExHall D Poster Location: Poster #442 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Logits DeConfusion with CLIP for Few-Shot Learning Project Page ↗
Shuo Li ⋅ Fang Liu ⋅ Zehua Hao ⋅ Xinyi Wang ⋅ Lingling Li ⋅ Xu Liu ⋅ Puhua Chen ⋅ Wenping Ma
In Room: ExHall D Poster Location: Poster #417 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
When the Future Becomes the Past: Taming Temporal Correspondence for Self-supervised Video Representation Learning Project Page ↗
Yang Liu ⋅ Qianqian Xu ⋅ Peisong Wen ⋅ Siran Dai ⋅ Qingming Huang
In Room: ExHall D Poster Location: Poster #288 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
GraphMimic: Graph-to-Graphs Generative Modeling from Videos for Policy Learning
Guangyan Chen ⋅ Te Cui ⋅ Meiling Wang ⋅ Yang Chengcai ⋅ Mengxiao Hu ⋅ Haoyang Lu ⋅ Yao Mu ⋅ Zicai Peng ⋅ Tianxing Zhou ⋅ XINRAN JIANG ⋅ Yi Yang ⋅ Yufeng Yue
In Room: ExHall D Poster Location: Poster #148 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DEFOM-Stereo: Depth Foundation Model Based Stereo Matching Project Page ↗
Hualie Jiang ⋅ Zhiqiang Lou ⋅ Laiyan Ding ⋅ Rui Xu ⋅ Minglang Tan ⋅ jerett ⋅ Rui Huang
In Room: ExHall D Poster Location: Poster #77 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Minding Fuzzy Regions: A Data-driven Alternating Learning Paradigm for Stable Lesion Segmentation
Lexin Fang ⋅ Yunyang Xu ⋅ Xiang Ma ⋅ Xuemei Li ⋅ Caiming Zhang
In Room: ExHall D Poster Location: Poster #481 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LumiNet: Latent Intrinsics Meets Diffusion Models for Indoor Scene Relighting
Xiaoyan Xing ⋅ Konrad Groh ⋅ Sezer Karaoglu ⋅ Theo Gevers ⋅ Anand Bhattad
In Room: ExHall D Poster Location: Poster #26 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Towards Visual Discrimination and Reasoning of Real-World Physical Dynamics: Physics-Grounded Anomaly Detection
wenqiao Li ⋅ Yao Gu ⋅ Xintao Chen ⋅ Xiaohao Xu ⋅ Ming Hu ⋅ Xiaonan Huang ⋅ Yingna Wu
In Room: ExHall D Poster Location: Poster #408 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
ProjAttacker: A Configurable Physical Adversarial Attack for Face Recognition via Projector
Yuanwei Liu ⋅ Hui Wei ⋅ Chengyu Jia ⋅ Ruqi Xiao ⋅ Weijian Ruan ⋅ Xingxing Wei ⋅ Joey Tianyi Zhou ⋅ Zheng Wang
In Room: ExHall D Poster Location: Poster #19 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Reasoning to Attend: Try to Understand How <SEG> Token Works Project Page ↗
Rui Qian ⋅ Xin Yin ⋅ Dejing Dou
In Room: ExHall D Poster Location: Poster #353 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines
Chen Tang ⋅ Xinzhu Ma ⋅ Encheng Su ⋅ Xiufeng Song ⋅ Xiaohong Liu ⋅ Wei-Hong Li ⋅ Lei Bai ⋅ Wanli Ouyang ⋅ Xiangyu Yue
In Room: ExHall D Poster Location: Poster #293 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Flow-NeRF: Joint Learning of Geometry, Poses, and Dense Flow within Unified Neural Representations
Xunzhi Zheng ⋅ Dan Xu
In Room: ExHall D Poster Location: Poster #77 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
AMR-Transformer: Enabling Efficient Long-range Interaction for Complex Neural Fluid Simulation
Zeyi Xu ⋅ Jinfan Liu ⋅ Kuangxu Chen ⋅ Ye Chen ⋅ Zhangli Hu ⋅ Bingbing Ni
In Room: ExHall D Poster Location: Poster #34 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Eval3D: Interpretable and Fine-grained Evaluation for 3D Generation
Shivam Duggal ⋅ Yushi Hu ⋅ Oscar Michel ⋅ Aniruddha Kembhavi ⋅ William Freeman ⋅ Noah A. Smith ⋅ Ranjay Krishna ⋅ Antonio Torralba ⋅ Ali Farhadi ⋅ Wei-Chiu Ma
In Room: ExHall D Poster Location: Poster #255 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
PromptHMR: Promptable Human Mesh Recovery Project Page ↗
Yufu Wang ⋅ Yu Sun ⋅ Priyanka Patel ⋅ Kostas Daniilidis ⋅ Michael J. Black ⋅ Muhammed Kocabas
In Room: ExHall D Poster Location: Poster #91 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
RLAIF-V: Open-Source AI Feedback Leads to Super GPT-4V Trustworthiness
Tianyu Yu ⋅ Haoye Zhang ⋅ Qiming Li ⋅ Qixin Xu ⋅ Yuan Yao ⋅ Da Chen ⋅ Xiaoman Lu ⋅ Ganqu Cui ⋅ Yunkai Dang ⋅ Taiwen He ⋅ Xiaocheng Feng ⋅ Jun Song ⋅ Bo Zheng ⋅ Zhiyuan Liu ⋅ Tat-seng Chua ⋅ Maosong Sun
In Room: ExHall D Poster Location: Poster #399 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
RoomPainter: View-Integrated Diffusion for Consistent Indoor Scene Texturing
Zhipeng Huang ⋅ Wangbo Yu ⋅ Xinhua Cheng ⋅ ChengShu Zhao ⋅ Yunyang Ge ⋅ Mingyi Guo ⋅ Li Yuan ⋅ Yonghong Tian
In Room: ExHall D Poster Location: Poster #38 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Sparse Point Cloud Patches Rendering via Splitting 2D Gaussians Project Page ↗
Changfeng Ma ⋅ Ran Bi ⋅ Jie Guo ⋅ Chongjun Wang ⋅ Yanwen Guo
In Room: ExHall D Poster Location: Poster #108 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
Shiyao Li ⋅ Yingchun Hu ⋅ Xuefei Ning ⋅ Xihui Liu ⋅ Ke Hong ⋅ xiaotao jia ⋅ Xiuhong Li ⋅ Yaqi Yan ⋅ PEI RAN ⋅ Guohao Dai ⋅ Shengen Yan ⋅ Huazhong Yang ⋅ Yu Wang
In Room: ExHall D Poster Location: Poster #382 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
VTON 360: High-Fidelity Virtual Try-On from Any Viewing Direction Project Page ↗
Zijian He ⋅ Yuwei Ning ⋅ Yipeng Qin ⋅ Guangrun Wang ⋅ Sibei Yang ⋅ Liang Lin ⋅ Guanbin Li
In Room: ExHall D Poster Location: Poster #19 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Associative Transformer Project Page ↗
Yuwei Sun ⋅ Hideya Ochiai ⋅ Zhirong Wu ⋅ Stephen Lin ⋅ Ryota Kanai
In Room: ExHall D Poster Location: Poster #417 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
USP-Gaussian: Unifying Spike-based Image Reconstruction, Pose Correction and Gaussian Splatting
Kang Chen ⋅ Jiyuan Zhang ⋅ Zecheng Hao ⋅ Yajing Zheng ⋅ Tiejun Huang ⋅ Zhaofei Yu
In Room: ExHall D Poster Location: Poster #74 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
SGCR: Spherical Gaussians for Efficient 3D Curve Reconstruction Project Page ↗
Xinran Yang ⋅ Donghao Ji ⋅ Yuanqi Li ⋅ Jie Guo ⋅ Yanwen Guo ⋅ Junyuan Xie
In Room: ExHall D Poster Location: Poster #33 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
EdgeMovingNet: Edge-preserving Point Cloud Reconstruction via Joint Geometry Features Project Page ↗
Xinran Yang ⋅ Donghao Ji ⋅ Yuanqi Li ⋅ Junyuan Xie ⋅ Jie Guo ⋅ Yanwen Guo
In Room: ExHall D Poster Location: Poster #105 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding
Kangsan Kim ⋅ Geon Park ⋅ Youngwan Lee ⋅ Woongyeong Yeo ⋅ Sung Ju Hwang
In Room: ExHall D Poster Location: Poster #299 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Omnia de EgoTempo: Benchmarking Temporal Understanding of Multi-Modal LLMs in Egocentric Videos
Chiara Plizzari ⋅ Alessio Tonioni ⋅ Yongqin Xian ⋅ Achin Kulshrestha ⋅ Federico Tombari
In Room: ExHall D Poster Location: Poster #297 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Active Data Curation Effectively Distills Large-Scale Multimodal Models
Vishaal Udandarao ⋅ Nikhil Parthasarathy ⋅ Muhammad Ferjad Naeem ⋅ Talfan Evans ⋅ Samuel Albanie ⋅ Federico Tombari ⋅ Yongqin Xian ⋅ Alessio Tonioni ⋅ Olivier J Henaff
In Room: ExHall D Poster Location: Poster #361 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Attraction Diminishing and Distributing for Few-Shot Class-Incremental Learning
Li-Jun Zhao ⋅ Zhen-Duo Chen ⋅ Yongxin Wang ⋅ Xin Luo ⋅ Xin-Shun Xu
In Room: ExHall D Poster Location: Poster #441 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
InterMimic: Towards Universal Whole-Body Control for Physics-Based Human-Object Interactions Project Page ↗
Sirui Xu ⋅ Hung Yu Ling ⋅ Yu-Xiong Wang ⋅ Liangyan Gui
In Room: ExHall D Poster Location: Poster #155 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation
Yuying Ge ⋅ Yizhuo Li ⋅ Yixiao Ge ⋅ Ying Shan
In Room: ExHall D Poster Location: Poster #282 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
A Simple Data Augmentation for Feature Distribution Skewed Federated Learning
Yunlu Yan ⋅ Huazhu Fu ⋅ Yuexiang Li ⋅ Jinheng Xie ⋅ Jun Ma ⋅ Guang Yang ⋅ Lei Zhu
In Room: ExHall D Poster Location: Poster #451 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Track Any Anomalous Object:A Granular Video Anomaly Detection Pipeline
Yuzhi Huang ⋅ Chenxin Li ⋅ Haitao Zhang ⋅ Zixu Lin ⋅ yunlong lin ⋅ Hengyu Liu ⋅ Wuyang Li ⋅ Xinyu Liu ⋅ Jiechao Gao ⋅ Yue Huang ⋅ Xinghao Ding ⋅ Yixuan Yuan
In Room: ExHall D Poster Location: Poster #317 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
Shengqu Cai ⋅ Eric Ryan Chan ⋅ Yunzhi Zhang ⋅ Leonidas Guibas ⋅ Jiajun Wu ⋅ Gordon Wetzstein
In Room: ExHall D Poster Location: Poster #254 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Soft Self-labeling and Potts Relaxations for Weakly-supervised Segmentation
Zhongwen Zhang ⋅ Yuri Boykov
In Room: ExHall D Poster Location: Poster #423 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
TopNet: Transformer-Efficient Occupancy Prediction Network for Octree-Structured Point Cloud Geometry Compression
Xinjie Wang ⋅ Yifan Zhang ⋅ Ting Liu ⋅ Xinpu Liu ⋅ Ke Xu ⋅ Jianwei Wan ⋅ Yulan Guo ⋅ Hanyun Wang
In Room: ExHall D Poster Location: Poster #110 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Dispider: Enabling Video LLMs with Active Real-Time Interaction via Disentangled Perception, Decision, and Reaction Project Page ↗
Rui Qian ⋅ Shuangrui Ding ⋅ Xiaoyi Dong ⋅ Pan Zhang ⋅ Yuhang Zang ⋅ Yuhang Cao ⋅ Dahua Lin ⋅ Jiaqi Wang
In Room: ExHall D Poster Location: Poster #289 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
HiFi-Portrait: Zero-shot Identity-preserved Portrait Generation with High-fidelity Multi-face Fusion
Yifang Xu ⋅ BenXiang Zhai ⋅ Yunzhuo Sun ⋅ Ming Li ⋅ Yang Li ⋅ Sidan Du
In Room: ExHall D Poster Location: Poster #17 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
ZeroVO: Visual Odometry with Minimal Assumptions
Lei Lai ⋅ Zekai Yin ⋅ Eshed Ohn-Bar
In Room: ExHall D Poster Location: Poster #122 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation
Zelin Peng ⋅ Zhengqin Xu ⋅ Zhilin Zeng ⋅ Yu Huang ⋅ Yaoming Wang ⋅ Wei Shen
In Room: ExHall D Poster Location: Poster #417 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Domain Generalization in CLIP via Learning with Diverse Text Prompts
Changsong Wen ⋅ Zelin Peng ⋅ Yu Huang ⋅ Xiaokang Yang ⋅ Wei Shen
In Room: ExHall D Poster Location: Poster #399 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MambaIC: State Space Models for High-Performance Learned Image Compression Project Page ↗
Fanhu Zeng ⋅ Hao Tang ⋅ Yihua Shao ⋅ Siyu Chen ⋅ Ling Shao ⋅ Yan Wang
In Room: ExHall D Poster Location: Poster #213 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Six-CD: Benchmarking Concept Removals for Text-to-image Diffusion Models
Jie Ren ⋅ Kangrui Chen ⋅ Yingqian Cui ⋅ Shenglai Zeng ⋅ Hui Liu ⋅ Yue Xing ⋅ Jiliang Tang ⋅ Lingjuan Lyu
In Room: ExHall D Poster Location: Poster #248 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Alias-Free Latent Diffusion Models: Improving Fractional Shift Equivariance of Diffusion Latent Space
Yifan Zhou ⋅ Zeqi Xiao ⋅ Shuai Yang ⋅ Xingang Pan
In Room: ExHall D Poster Location: Poster #214 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Gaussian Splashing: Unified Particles for Versatile Motion Synthesis and Rendering
Yutao Feng ⋅ Xiang Feng ⋅ Yintong Shang ⋅ Ying Jiang ⋅ Chang Yu ⋅ Zeshun Zong ⋅ Tianjia Shao ⋅ Hongzhi Wu ⋅ Kun Zhou ⋅ Chenfanfu Jiang ⋅ Yin Yang
In Room: ExHall D Poster Location: Poster #33 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
NoPain: No-box Point Cloud Attack via Optimal Transport Singular Boundary Project Page ↗
Zezeng Li ⋅ Xiaoyu Du ⋅ Na Lei ⋅ Liming Chen ⋅ Weimin Wang
In Room: ExHall D Poster Location: Poster #317 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
DeformCL: Learning Deformable Centerline Representation for Vessel Extraction in 3D Medical Image
Ziwei Zhao ⋅ Zhixing Zhang ⋅ Yuhang Liu ⋅ Zhao Zhang ⋅ Haojun Yu ⋅ Dong Wang ⋅ Liwei Wang
In Room: ExHall D Poster Location: Poster #454 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Coarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model
Benlin Liu ⋅ Yuhao Dong ⋅ Yiqin Wang ⋅ Zixian Ma ⋅ Yansong Tang ⋅ Luming Tang ⋅ Yongming Rao ⋅ Wei-Chiu Ma ⋅ Ranjay Krishna
In Room: ExHall D Poster Location: Poster #344 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
PrEditor3D: Fast and Precise 3D Shape Editing
Ziya Erkoc ⋅ Can Gümeli ⋅ Chaoyang Wang ⋅ Matthias Nießner ⋅ Angela Dai ⋅ Peter Wonka ⋅ Hsin-Ying Lee ⋅ Peiye Zhuang
In Room: ExHall D Poster Location: Poster #44 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Co-Speech Gesture Video Generation with Implicit Motion-Audio Entanglement
Xinjie Li ⋅ Ziyi Chen ⋅ Xinlu Yu ⋅ Iek-Heng Chu ⋅ Peng Chang ⋅ Jing Xiao
In Room: ExHall D Poster Location: Poster #69 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
VILA-M3: Enhancing Vision-Language Models with Medical Expert Knowledge
Vishwesh Nath ⋅ Wenqi Li ⋅ Dong Yang ⋅ Andriy Myronenko ⋅ Yao Lu ⋅ Zhijian Liu ⋅ Danny Yin ⋅ Yucheng Tang ⋅ Pengfei Guo ⋅ Ziyue Xu ⋅ Can Zhao ⋅ Yufan He ⋅ Greg Heinrich ⋅ Mingxin Zheng ⋅ Benjamin D. Simon ⋅ Stephanie Anne Harmon ⋅ Michael Zephyr ⋅ Marc Edgar ⋅ Stephen R. Aylward ⋅ Pavlo Molchanov ⋅ Yan Mee LAW ⋅ Baris Turkbey ⋅ Holger R. Roth ⋅ Daguang Xu
In Room: ExHall D Poster Location: Poster #396 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Stable-SCore: A Stable Registration-based Framework for 3D Shape Correspondence
Haolin Liu ⋅ Xiaohang Zhan ⋅ Zizheng Yan ⋅ Zhongjin Luo ⋅ Yuxin Wen ⋅ Xiaoguang Han
In Room: ExHall D Poster Location: Poster #70 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation
Chengyue Wu ⋅ Xiaokang Chen ⋅ Zhiyu Wu ⋅ Yiyang Ma ⋅ Xingchao Liu ⋅ Zizheng Pan ⋅ Wen Liu ⋅ Zhenda Xie ⋅ Xingkai Yu ⋅ Chong Ruan ⋅ Ping Luo
In Room: ExHall D Poster Location: Poster #221 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Reward Fine-Tuning Two-Step Diffusion Models via Learning Differentiable Latent-Space Surrogate Reward
Zhiwei Jia ⋅ Yuesong Nan ⋅ Huixi Zhao ⋅ Gengdai Liu
In Room: ExHall D Poster Location: Poster #216 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
FATE: Full-head Gaussian Avatar with Textural Editing from Monocular Video
Jiawei Zhang ⋅ Zijian Wu ⋅ Zhiyang Liang ⋅ Yicheng Gong ⋅ Dongfang Hu ⋅ Yao Yao ⋅ Xun Cao ⋅ Hao Zhu
In Room: ExHall D Poster Location: Poster #8 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
LMO: Linear Mamba Operator for MRI Reconstruction Project Page ↗
Wei Li ⋅ jiawei jiang ⋅ Jie Wu ⋅ Kaihao Yu ⋅ Jianwei Zheng
In Room: ExHall D Poster Location: Poster #473 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Mimir: Improving Video Diffusion Models for Precise Text Understanding
Shuai Tan ⋅ Biao Gong ⋅ Yutong Feng ⋅ Kecheng Zheng ⋅ DanDan Zheng ⋅ Shuwei Shi ⋅ Yujun Shen ⋅ Jingdong Chen ⋅ Ming Yang
In Room: ExHall D Poster Location: Poster #283 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Improved Video VAE for Latent Video Diffusion Model
Pingyu Wu ⋅ Kai Zhu ⋅ Yu Liu ⋅ Liming Zhao ⋅ Wei Zhai ⋅ Yang Cao ⋅ Zheng-Jun Zha
In Room: ExHall D Poster Location: Poster #221 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Towards Continual Universal Segmentation
Zihan Lin ⋅ Zilei Wang ⋅ Xu Wang
In Room: ExHall D Poster Location: Poster #312 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
Building a Mind Palace: Structuring Environment-Grounded Semantic Graphs for Effective Long Video Analysis with LLMs
Zeyi Huang ⋅ Yuyang Ji ⋅ Xiaofang Wang ⋅ Nikhil Mehta ⋅ Tong Xiao ⋅ Donghyun Lee ⋅ Sigmund VanValkenburgh ⋅ Shengxin Zha ⋅ Bolin Lai ⋅ Licheng Yu ⋅ Ning Zhang ⋅ Yong Jae Lee ⋅ Miao Liu
In Room: ExHall D Poster Location: Poster #301 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Your Scale Factors are My Weapon: Targeted Bit-Flip Attacks on Vision Transformers via Scale Factor Manipulation
Jialai Wang ⋅ Yuxiao Wu ⋅ Weiye Xu ⋅ Yating Huang ⋅ Chao Zhang ⋅ Zongpeng Li ⋅ Mingwei Xu ⋅ Zhenkai Liang
In Room: ExHall D Poster Location: Poster #410 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
HiPART: Hierarchical Pose AutoRegressive Transformer for Occluded 3D Human Pose Estimation
Hongwei Zheng ⋅ Han Li ⋅ Wenrui Dai ⋅ Ziyang Zheng ⋅ Chenglin Li ⋅ Junni Zou ⋅ Hongkai Xiong
In Room: ExHall D Poster Location: Poster #94 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
Adaptive Dropout: Unleashing Dropout across Layers for Generalizable Image Super-Resolution
Hang Xu ⋅ Jie Huang ⋅ Wei Yu ⋅ Jiangtong Tan ⋅ Zhen Zou ⋅ Feng Zhao
In Room: ExHall D Poster Location: Poster #205 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation Project Page ↗
Zehuan Huang ⋅ Yuanchen Guo ⋅ Xingqiao An ⋅ Yunhan Yang ⋅ Yangguang Li ⋅ Zi-Xin Zou ⋅ Ding Liang ⋅ Xihui Liu ⋅ Yan-Pei Cao ⋅ Lu Sheng
In Room: ExHall D Poster Location: Poster #250 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
EasyCraft: A Robust and Efficient Framework for Automatic Avatar Crafting
Suzhen Wang ⋅ Weijie Chen ⋅ Wei Zhang ⋅ Minda Zhao ⋅ Lincheng Li ⋅ Rongsheng Zhang ⋅ Zhipeng Hu ⋅ Xin Yu
In Room: ExHall D Poster Location: Poster #13 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
World-consistent Video Diffusion with Explicit 3D Modeling Project Page ↗
Qihang Zhang ⋅ Shuangfei Zhai ⋅ Miguel Ángel Bautista ⋅ Kevin Miao ⋅ Alexander Toshev ⋅ Joshua Susskind ⋅ Jiatao Gu
In Room: ExHall D Poster Location: Poster #60 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Generative Gaussian Splatting for Unbounded 3D City Generation Project Page ↗
Haozhe Xie ⋅ Zhaoxi Chen ⋅ Fangzhou Hong ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #64 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
CaricatureBooth: Data-Free Interactive Caricature Generation in a Photo Booth
Zhiyu Qu ⋅ Yunqi Miao ⋅ Zhensong Zhang ⋅ Jifei Song ⋅ Jiankang Deng ⋅ Yi-Zhe Song
In Room: ExHall D Poster Location: Poster #15 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
Sicheng Zuo ⋅ Wenzhao Zheng ⋅ Yuanhui Huang ⋅ Jie Zhou ⋅ Jiwen Lu
In Room: ExHall D Poster Location: Poster #134 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models Project Page ↗
Yuhao Dong ⋅ Zuyan Liu ⋅ Hai-Long Sun ⋅ Jingkang Yang ⋅ Winston Hu ⋅ Yongming Rao ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #353 at 4:00 PM CDT (America/Chicago) in Poster Session 2.
WildAvatar: Learning In-the-wild 3D Avatars from the Web
Zihao Huang ⋅ Shoukang Hu ⋅ Guangcong Wang ⋅ Tianqi Liu ⋅ Yuhang Zang ⋅ Zhiguo Cao ⋅ Wei Li ⋅ Ziwei Liu
In Room: ExHall D Poster Location: Poster #10 at 5:00 PM CDT (America/Chicago) in Poster Session 4.
MAGE : Single Image to Material-Aware 3D via the Multi-View G-Buffer Estimation Model Project Page ↗
Haoyuan Wang ⋅ Zhenwei Wang ⋅ Xiaoxiao Long ⋅ Cheng Lin ⋅ Gerhard Hancke ⋅ Rynson W.H. Lau
In Room: ExHall D Poster Location: Poster #32 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Decoupled Motion Expression Video Segmentation
Hao Fang ⋅ Runmin Cong ⋅ Xiankai Lu ⋅ Xiaofei Zhou ⋅ Sam Kwong ⋅ Wei Zhang
In Room: ExHall D Poster Location: Poster #303 at 10:30 AM CDT (America/Chicago) in Poster Session 3.
Incremental Object Keypoint Learning
Mingfu Liang ⋅ Jiahuan Zhou ⋅ Xu Zou ⋅ Ying Wu
In Room: ExHall D Poster Location: Poster #416 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Completion as Enhancement: A Degradation-Aware Selective Image Guided Network for Depth Completion
Zhiqiang Yan ⋅ Zhengxue Wang ⋅ Kun Wang ⋅ Jun Li ⋅ Jian Yang
In Room: ExHall D Poster Location: Poster #76 at 4:00 PM CDT (America/Chicago) in Poster Session 6.
StableAnimator: High-Quality Identity-Preserving Human Image Animation
Shuyuan Tu ⋅ Zhen Xing ⋅ Xintong Han ⋅ Zhi-Qi Cheng ⋅ Qi Dai ⋅ Chong Luo ⋅ Zuxuan Wu
In Room: ExHall D Poster Location: Poster #5 at 10:30 AM CDT (America/Chicago) in Poster Session 5.
Beyond Human Perception: Understanding Multi-Object World from Monocular View
Keyu Guo ⋅ Yongle Huang ⋅ Shijie Sun ⋅ Xiangyu Song ⋅ Mingtao Feng ⋅ Zedong Liu ⋅ Huansheng Song ⋅ Tiantian Wang ⋅ Jianxin Li ⋅ Naveed Akhtar ⋅ Ajmal Mian
In Room: ExHall D Poster Location: Poster #341 at 10:30 AM CDT (America/Chicago) in Poster Session 1.
Motion-Grounded Video Reasoning: Understanding and Perceiving Motion at Pixel Level
Andong Deng ⋅ Tongjia Chen ⋅ Shoubin Yu ⋅ Taojiannan Yang ⋅ Lincoln Spencer ⋅ Yapeng Tian ⋅ Ajmal Mian ⋅ Mohit Bansal ⋅ Chen Chen
In Room: ExHall D Poster Location: Poster #311 at 4:00 PM CDT (America/Chicago) in Poster Session 2.