| 1 | MuyBridge: Mobile Human Center-of-Mass Estimation from Monocular Video via Sparse Fusion | Aidan Bradshaw, Marco Giordano, David Rode +8 | cs.CV | 2026-09-02 |
| 2 | RoGe: Novel View Synthesis via End-to-End Implicit Reconstruction and Generation | Xiaolei Lang, Ze Kang, Zehao Huang +1 | cs.CV | 2026-09-02 |
| 3 | GDB-Reward: From Evaluation Metrics to Training Rewards for Graphic Design | Adrienne Deganutti, Purvanshi Mehta, Simon Hadfield +1 | cs.CV | 2026-09-02 |
| #4 | Generating Medical Image Counterfactuals using Causal Explanations | David A. Kelly, Tom Yaacov, Nathan Blake +2 | cs.CV | 2026-09-02 |
| #5 | Characterizing Text Branch Sensitivity in Medical Vision-Language Segmentation via Evidence Decoupling | Ziquan Liu, Zhewei Zhu, Xuyang Shi | cs.CV | 2026-09-02 |
| #6 | AffectDelta: Beyond Emotion Labels for Image Editing | Xingzu Zhan, Lin Gu, Ruogu Fang | cs.CV | 2026-09-02 |
| #7 | MARS: What Retrieval Signals Are Hidden in Multimodal Large Language Models for Text-Video Retrieval? | Uicheol Jung, Juyoung Hong, Geuntaek Lim +1 | cs.CV | 2026-09-02 |
| #8 | Stereo 4D Radar for 3D Object Detection: Integrating Geometric Alignment and Absolute Velocity Estimation | Seung-Hyun Song, Dong-Hee Paek, Woong-Chan Byun +1 | cs.CV | 2026-09-02 |
| #9 | RGB-to-IR image translation for infrared vehicle detection in unseen UAV domains | Thijs A. Eker, Ella P. Fokkinga, Jan Erik van Woerden +4 | cs.CV | 2026-09-02 |
| #10 | Spatially Aware World Action Model via Geometric Latent Diffusion | Javier Alejandro Lopetegui Gonzalez, Paul Pacaud, Cordelia Schmid | cs.CV | 2026-09-02 |
| #11 | Fine-Grained Anomaly Perception in Wild UGC-Enhanced Images: A Comprehensive Dataset and Difference-Fusion Framework | Yan Zhong, Gefei Chen, Qiufang Ma +4 | cs.CV | 2026-09-02 |
| #12 | RINSE: Robust Target-Time Normality Estimation for Zero-Shot Graph Anomaly Detection | Taufikur Rahman Fuad, Md Abrar Jahin, Amir Hussain | cs.LG | 2026-09-02 |
| #13 | Learning to Fuse LLMs with Ontology Rankers for Rare-Disease Diagnosis | Zhaoyang Jiang, Zhizhong Fu, Yunsoo Kim +5 | cs.CL | 2026-09-02 |
| #14 | Uncertainty-Guided Adverse Weather Restoration via Gated Transformer Network | Zheke Jin, Yuning Cui, Tianle Jin +2 | cs.CV | 2026-09-02 |
| #15 | The Diagnosis a Reporter Leaves Unspoken: Surfacing Frozen Tumor Features for Brain-Tumor MRI Reporting | Khawaja Murad ul Hassan, Ruqiyya Adil, Adil Qayyum +4 | cs.CV | 2026-09-02 |
| #16 | ProSR: Semantic-Prototype-Guided Discrete Modeling for Physically Consistent SAR Super-Resolution | Byoungwoo Kim, Munchurl Kim | cs.CV | 2026-09-02 |
| #17 | GlyphAnchor: Enhancing Visual Text Rendering via Position-Anchored Glyph Priors | Qiang Xiang, Shuang Sun, Binglei Li +4 | cs.CV | 2026-09-02 |
| #18 | Structured-Prior-Guided Diffusion Inpainting with Physical Consistency for Traffic Sign Augmentation | Luo Li, Chongchong Huang, Jun Jia +4 | cs.CV | 2026-09-02 |
| #19 | DiffIE: Diffusion-based Open Information Extraction | Konstantin Fedorov, Valentin Malykh | cs.CL | 2026-09-02 |
| #20 | Domain shift-robust object detection with GenAI image editing | Isabel D. Stein, Thijs A. Eker, Sebastiaan P. Snel +4 | cs.CV | 2026-09-02 |
| #21 | VoRTeC: Taming Foundation Flow for One-step Real time Video Compression | Yichong Xia, Qinhong Wu, Qinhong Wu +3 | cs.CV | 2026-09-02 |
| #22 | Diffusion-Encoding Gaussian Field for Joint k-q dMRI Reconstruction | Zhibo Chen, Yajuan Huang, Yu Guan +3 | cs.CV | 2026-09-02 |
| #23 | RouteGraph-Mona: Confusion-Aware Routing Fine-Tuning for Mineral Image Classification | Jierui Li, Zhiyuan Qi, Hao Zhu +7 | cs.CV | 2026-09-02 |
| #24 | CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Traffic Scenario Generation | Shucheng Zhang, Yuang Zhang, Bingzhang Wang +3 | cs.RO | 2026-09-02 |
| #25 | Codebook Agent: Amortized Topology Design for LLM Multi-Agent Systems | Jinxi Yu, Yubei Li, Eric Hanchen Jiang +6 | cs.AI | 2026-09-02 |
| #26 | DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion and Action Space | Steffen Hagedorn, Aron Distelzweig, Alexandru P. Condurache | cs.RO | 2026-09-02 |
| #27 | TAME: Temporal-Aware Mixture-of-Experts for Text-Video Retrieval | Uicheol Jung, Juyoung Hong, Hojung Kwon +1 | cs.CV | 2026-09-02 |
| #28 | GeoSPRINT: Geometric Redundancy-Aware Step Pruning for Inference in Diffusion Trajectories | Arpita Joshi | cs.LG | 2026-09-02 |
| #29 | Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language Models | Haobo Xu, Sirui Chen, Yuanchen Bei +5 | cs.CL | 2026-09-02 |
| #30 | XMerge: Cross-Axis Selection and Reconstructive Layer Merging for LLM Depth Compression | Jundong Hu, Shekar Ramachandran | cs.LG | 2026-09-02 |
| #31 | DPA: Decoupling Product-Agnostic Anomaly Representations for Zero-shot Anomaly Generation | Hang Yao, Yansheng Fu, Ming Liu +4 | cs.CV | 2026-09-02 |
| #32 | DynG-Diff: A State-Aware Dynamic Guidance Diffusion Framework for Probabilistic Time Series Forecasting | Zhente Zhang, Zhengwei Ni, Wei Fan | cs.LG | 2026-09-02 |
| #33 | SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution Transition | Tingyan Wen, Chenqian Yan, Xurui Peng +4 | cs.CV | 2026-09-02 |
| #34 | Perceptually Regularized Diffusion Model for Image Super-Resolution | Chuxiangbo Wang, Pavithra Venkatachalapathy, Ying Liang +4 | eess.IV | 2026-09-02 |
| #35 | InstEditSeg: Instruction-Driven Image Editing for Polyp and Skin Lesion Segmentation | Ziquan Liu, Zhewei Zhu, Xuyang Shi | cs.CV | 2026-09-02 |
| #36 | Linear Fusion MultiDiffusion for Fast Training-Free Spherical Panorama Generation | Akio Hayakawa, Yusuke Mukuta, Tatsuya Harada | cs.CV | 2026-09-02 |
| #37 | The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents | Jundong Hu, Shekar Ramachandran | cs.AI | 2026-09-01 |
| #38 | Video2Reaction: Training Foundation Video Models to Predict Audience Reaction | Sidong Zhang, Trang Nguyen, Shiv Shankar +4 | cs.CV | 2026-09-01 |
| #39 | Designing Versatile Samples for Learned Trajectory Scoring | Yaguang Li, Jiaru Zhang, Chuheng Wei +2 | cs.RO | 2026-09-01 |
| #40 | AlphaRAD: Grounded Zero-Shot Classification in Chest Radiology via $α$-Corrected Binary Cross Entropy and Factorized Latent Supervision | Jianzhong You, Yuan Gao, Chris McIntosh | cs.CV | 2026-09-01 |
| #41 | A Study of Conditional Diffusion Models for Open-Loop Control under Dry Friction and Stiction | Eric Aislan Antonelo | cs.LG | 2026-09-01 |
| #42 | Swin Meets EfficientNet: Lightweight Architectures for GAN-Based Face Forensics | Sejuti Basu, Ashima Sood, Vijay Kumar +1 | cs.CV | 2026-09-01 |
| #43 | CAT-Flow: Curvature-Adaptive sTeps for Flow Matching | Qinchan Li, Pedro Cisneros-Velarde, Keru Fu +3 | cs.LG | 2026-09-01 |
| #44 | Evidential Deep Learning for Multi-Modal Anti-UAV Detection | Dmitry Golovchits, Seyed Sahand Mohammadi Ziabari, Ali Mohammed Mansoor Alsahag | cs.CV | 2026-09-01 |
| #45 | SpeakPay: Domain-Adaptive LoRA Fine-Tuning of Whisper for Low-Resource Nepali Financial Speech Recognition | Biraj Subedi | cs.CL | 2026-09-01 |
| #46 | Generative Diffusion Surrogates with Analytical Variance Schedule | Patrick Reichherzer, Gianluca Gregori, David N. Hosking +1 | cs.LG | 2026-09-01 |
| #47 | From Confusion to Clarity: Confusion-Aware Retrieval and Knowledge Injection for Text Classification | Manish Gupta, Chaitanya Giri, Jayasimha Talur | cs.CL | 2026-09-01 |
| #48 | DualDiff3D: Dual Structure-Appearance Diffusion Priors for Reliability-Enhanced 3D Gaussian Splatting | Qian Wang, Yu Wang, Weiqi Li +4 | cs.CV | 2026-09-01 |
| #49 | Rethinking Learnability in Offline Data-driven Optimization | Chao Qian, Chen-Guang Wang, Rong-Xi Tan +1 | cs.LG | 2026-09-01 |
| #50 | CameraEditor: Camera-Controlled Image Editing via Video-Prior Sequential Modeling | Xin Shen, Chengyou Jia, Keshuo Xing +6 | cs.CV | 2026-09-01 |