TP8a.3: MV-SA-CLIP: A Stage-Wise Hybrid Vision Encoder for Cross-Modal Retrieval and Zero-Shot Classification
Ambarish Parthasarathy, Sumohana Channappayya, Indian Institute of Technology, Hyderabad, India
TP8a.4: Multi-Modal Speaker Classification in Educational Settings
Nitya Khamar, Chongyu He, Jonathan McGee, Peter Youngs, Scott Acton, University of Virginia, United States
TP8a.5: Lightweight Contrastive Adaptation of EO Foundation Models for Cross-Modal Classification
Stefanos Koutoupis, Michaela Areti Zervou, Panagiotis Tsakalides, Grigorios Tsagkatakis, University of Crete; Foundation for Research and Technology - Hellas, Greece
TP8a.7: Deep Pseudo-Proximal Map: A Self-Supervised Data-Fitting Agent for Iterative Reconstruction
Haley Duba-Sullivan, Purdue University, United States; Emma J. Reid, Oak Ridge National Laboratory, United States; Charles A. Bouman, Gregery T. Buzzard, Purdue University, United States
TP8a.9: Domain Randomization Reveals Systematic Brittleness in GUI Grounding Models
Yangyue Wang, Harshvardhan Sikka, Fig, United States; Yash Mathur, Tony Zhou, Jinu Nyachhyon, Manifold Research Group, United States; Pranav Guruprasad, Fig, United States
TP8a.13: Multimodal Fusion Model for Action Segmentation in Suturing Datase
PrasanthSai Gouripeddi, Nupur Thakur, Baoxin Li, Arizona State University, United States; Hannah Eherenfeldt, Benjamin Knapp, ReSuture, United States
TP8a.16: SplatStream: Fine Granular Scalable Gaussian Splatting for Adaptive 3D Scene Streaming
Muhammad Talha, University of Missouri-Kansas City, United States; William Gordon, BASIS Independent Silicon Valley, United States; Sajid Umair, Zhu Li, University of Missouri-Kansas City, United States; Anique Akhtar, Joel Jung, Qualcomm, Inc., United States
TP8a.18: GTNet: An Efficient GAN-Transformer Pair for AV1 In-loop Super-resolution and Restoration
Yuming Han, Zixiang Xiong, Texas A&M University, United States; Anders Host-Madsen, University of Hawaii at Manoa, United States
TP8a.19: Leveraging Graph Neural Networks for Robust Dynamic Sound Source Tracking
Priyadarshini Dwivedi, Muskan -, Indian Institute of Technology Kanpur, India; Gyanajyoti Routray, SRM University AP Amaravati, India; Rajesh M. Hegde, Indian Institute of Technology Kanpur, India
TP8a.20: Adversarial Masking Approach for Robust Target Source Localization in the SH Domain
Gyanajyoti Routray, SRM University AP Amaravati, India; Priyadarshini Dwivedi, Indian Institute of Technology Kanpur, India; Rahul Peter, BITS Pilani, India; Rajesh M. Hegde, Indian Institute of Technology Kanpur, India
TP8a.23: MULTISpoof: A Multilingual Dataset for Cross-Lingual Synthetic Speech Detection
Maria Risques, Kratika Bhagtani, Amit Kumar Singh Yadav, Edward J. Delp, Purdue University, Spain