| 1 | RoGe: Novel View Synthesis via End-to-End Implicit Reconstruction and Generation | Xiaolei Lang, Ze Kang, Zehao Huang +1 | cs.CV | 2026-09-02 |
| 2 | GDB-Reward: From Evaluation Metrics to Training Rewards for Graphic Design | Adrienne Deganutti, Purvanshi Mehta, Simon Hadfield +1 | cs.CV | 2026-09-02 |
| 3 | Generating Medical Image Counterfactuals using Causal Explanations | David A. Kelly, Tom Yaacov, Nathan Blake +2 | cs.CV | 2026-09-02 |
| #4 | AffectDelta: Beyond Emotion Labels for Image Editing | Xingzu Zhan, Lin Gu, Ruogu Fang | cs.CV | 2026-09-02 |
| #5 | RGB-to-IR image translation for infrared vehicle detection in unseen UAV domains | Thijs A. Eker, Ella P. Fokkinga, Jan Erik van Woerden +4 | cs.CV | 2026-09-02 |
| #6 | Spatially Aware World Action Model via Geometric Latent Diffusion | Javier Alejandro Lopetegui Gonzalez, Paul Pacaud, Cordelia Schmid | cs.CV | 2026-09-02 |
| #7 | ProSR: Semantic-Prototype-Guided Discrete Modeling for Physically Consistent SAR Super-Resolution | Byoungwoo Kim, Munchurl Kim | cs.CV | 2026-09-02 |
| #8 | GlyphAnchor: Enhancing Visual Text Rendering via Position-Anchored Glyph Priors | Qiang Xiang, Shuang Sun, Binglei Li +4 | cs.CV | 2026-09-02 |
| #9 | Structured-Prior-Guided Diffusion Inpainting with Physical Consistency for Traffic Sign Augmentation | Luo Li, Chongchong Huang, Jun Jia +4 | cs.CV | 2026-09-02 |
| #10 | DiffIE: Diffusion-based Open Information Extraction | Konstantin Fedorov, Valentin Malykh | cs.CL | 2026-09-02 |
| #11 | Domain shift-robust object detection with GenAI image editing | Isabel D. Stein, Thijs A. Eker, Sebastiaan P. Snel +4 | cs.CV | 2026-09-02 |
| #12 | VoRTeC: Taming Foundation Flow for One-step Real time Video Compression | Yichong Xia, Qinhong Wu, Qinhong Wu +3 | cs.CV | 2026-09-02 |
| #13 | Diffusion-Encoding Gaussian Field for Joint k-q dMRI Reconstruction | Zhibo Chen, Yajuan Huang, Yu Guan +3 | cs.CV | 2026-09-02 |
| #14 | CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Traffic Scenario Generation | Shucheng Zhang, Yuang Zhang, Bingzhang Wang +3 | cs.RO | 2026-09-02 |
| #15 | Codebook Agent: Amortized Topology Design for LLM Multi-Agent Systems | Jinxi Yu, Yubei Li, Eric Hanchen Jiang +6 | cs.AI | 2026-09-02 |
| #16 | DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion and Action Space | Steffen Hagedorn, Aron Distelzweig, Alexandru P. Condurache | cs.RO | 2026-09-02 |
| #17 | GeoSPRINT: Geometric Redundancy-Aware Step Pruning for Inference in Diffusion Trajectories | Arpita Joshi | cs.LG | 2026-09-02 |
| #18 | Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language Models | Haobo Xu, Sirui Chen, Yuanchen Bei +5 | cs.CL | 2026-09-02 |
| #19 | DPA: Decoupling Product-Agnostic Anomaly Representations for Zero-shot Anomaly Generation | Hang Yao, Yansheng Fu, Ming Liu +4 | cs.CV | 2026-09-02 |
| #20 | DynG-Diff: A State-Aware Dynamic Guidance Diffusion Framework for Probabilistic Time Series Forecasting | Zhente Zhang, Zhengwei Ni, Wei Fan | cs.LG | 2026-09-02 |
| #21 | SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution Transition | Tingyan Wen, Chenqian Yan, Xurui Peng +4 | cs.CV | 2026-09-02 |
| #22 | Perceptually Regularized Diffusion Model for Image Super-Resolution | Chuxiangbo Wang, Pavithra Venkatachalapathy, Ying Liang +4 | eess.IV | 2026-09-02 |
| #23 | InstEditSeg: Instruction-Driven Image Editing for Polyp and Skin Lesion Segmentation | Ziquan Liu, Zhewei Zhu, Xuyang Shi | cs.CV | 2026-09-02 |
| #24 | Linear Fusion MultiDiffusion for Fast Training-Free Spherical Panorama Generation | Akio Hayakawa, Yusuke Mukuta, Tatsuya Harada | cs.CV | 2026-09-02 |
| #25 | Designing Versatile Samples for Learned Trajectory Scoring | Yaguang Li, Jiaru Zhang, Chuheng Wei +2 | cs.RO | 2026-09-01 |
| #26 | A Study of Conditional Diffusion Models for Open-Loop Control under Dry Friction and Stiction | Eric Aislan Antonelo | cs.LG | 2026-09-01 |
| #27 | Swin Meets EfficientNet: Lightweight Architectures for GAN-Based Face Forensics | Sejuti Basu, Ashima Sood, Vijay Kumar +1 | cs.CV | 2026-09-01 |
| #28 | CAT-Flow: Curvature-Adaptive sTeps for Flow Matching | Qinchan Li, Pedro Cisneros-Velarde, Keru Fu +3 | cs.LG | 2026-09-01 |
| #29 | Generative Diffusion Surrogates with Analytical Variance Schedule | Patrick Reichherzer, Gianluca Gregori, David N. Hosking +1 | cs.LG | 2026-09-01 |
| #30 | DualDiff3D: Dual Structure-Appearance Diffusion Priors for Reliability-Enhanced 3D Gaussian Splatting | Qian Wang, Yu Wang, Weiqi Li +4 | cs.CV | 2026-09-01 |
| #31 | Rethinking Learnability in Offline Data-driven Optimization | Chao Qian, Chen-Guang Wang, Rong-Xi Tan +1 | cs.LG | 2026-09-01 |
| #32 | CameraEditor: Camera-Controlled Image Editing via Video-Prior Sequential Modeling | Xin Shen, Chengyou Jia, Keshuo Xing +6 | cs.CV | 2026-09-01 |
| #33 | Diffusion as a Training Curriculum for Timestep-Free Iterative Reasoning | Mariia Drozdova, Aidan Sirbu, Pietro Miotti +4 | cs.LG | 2026-09-01 |
| #34 | Gaussian Core LoRA: Distribution-Aware Dynamic Adaptation for Broad Concept Erasure | Qinghui Gong, Xunlei Chen, Yu-Xuan Zhang +2 | cs.CV | 2026-09-01 |
| #35 | Diffusion Based Unpaired Data Learning for Inverse Problems | Chenglong Bao, Yiming Dang, Chenguang Duan +2 | cs.CV | 2026-09-01 |
| #36 | Reliability Challenges in Diffusion Vision-Language Models | Md. Atabuzzaman, Chris Thomas | cs.CV | 2026-09-01 |
| #37 | TimeSteer: Inference-Time Speech Scheduling in Joint Audio-Visual Diffusion Models | Chao Zhou, Yiling Chen, Qi Chu +3 | cs.CV | 2026-09-01 |
| #38 | Seeing the World and the Self from Egocentric Video | Kai Guan, Minchao Jiang, Ruichen WangLi +2 | cs.CV | 2026-09-01 |
| #39 | Dotting the Eye: An Intent-Driven Image Retouching Agent for Visual Focus Enhancement | Chujie Qin, Zilong Zhang, Zewei Chang +5 | cs.CV | 2026-09-01 |
| #40 | P-PatchDiff: Progressive Patch Diffusion Models for Low-light Image Enhancement | Ruoyu Guo, Haonan Zhong, Maurice Pagnucco +1 | cs.CV | 2026-09-01 |
| #41 | Space Generative AI with Solar Energy Harvesting | Jierui Zhang, Jianhao Huang, Zhanwei Wang +1 | cs.AI | 2026-09-01 |
| #42 | From Truncation to Commitment: Persistent Context in Uniform Discrete Diffusion | Satoshi Hayakawa | cs.LG | 2026-09-01 |
| #43 | Prior-Guided Implicit Neural Representations for Single-Subject Diffusion MRI Super-Resolution | Abdulkader Ghandoura, Marsil Zakour, William Consagra +1 | eess.IV | 2026-09-01 |
| #44 | ReFlowSET: Representation-Aligned Latent Flow Matching for SAR-to-EO Image Translation | Jeonghyeok Do, Seungchul Lee, Munchurl Kim | cs.CV | 2026-09-01 |
| #45 | Conditional Flow Matching for Cross-Field MRI Harmonisation | Baris Imre, Aram Salehi, Levente Baljer +3 | cs.CV | 2026-09-01 |
| #46 | ASSERT: Adaptive Stochastic Sampling for Robust Diffusion Models on Analog Compute-in-Memory Hardware | Yuannuo Feng, Yizhe Chen, Wenshuai Yao +4 | cs.CV | 2026-09-01 |
| #47 | HELIOS: From midnight to noon, continuous outdoor urban scene relighting | Hala Djeghim, Nathan Piasco, Luis Roldão +4 | cs.CV | 2026-09-01 |
| #48 | Denoising Diffusion Generative Models Secretly Calculate Attentions | Farzan Haddadi, Leila Monfared, Ebrahim Rezaii +3 | cs.AI | 2026-09-01 |
| #49 | Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization Asymmetry | Shengfang Zhai, Leo Marchyok, Yuling Shi +4 | cs.CL | 2026-09-01 |
| #50 | Conditional Flow Matching for ML-Based Inverse Design Problems | Juliana Felder, Milad Habibi, Soheyl Massoudi +1 | cs.LG | 2026-09-01 |