| 1 | ReCite: Agentic Reasoning for Faithful Citation | Yuyang Huang, Bobo Li, Jiajia Song +4 | cs.CL | 2026-09-08 |
| 2 | ActReview: Rebuttal-Guided Training Data and Rubric Rewards for Actionable Peer Review Generation | Yiling Ma, Yilun Zhao, Sihong Wu +3 | cs.CL | 2026-09-08 |
| 3 | Concentrate After Imagination: Text-Conditioned Evidence Grounding for Partially Relevant Video Retrieval | Shuaiqi Cheng, Siyu You, Yanbi Wu +3 | cs.CV | 2026-09-08 |
| #4 | Evaluating and Improving Evidence-Grounded Fact-Checking in LLMs via Multi-Round Evidence Ablation | Xingyu Deng, Mingzi Cao, Nikolaos Aletras +2 | cs.CL | 2026-09-08 |
| #5 | When Models Defer to Wrong Answers: A Robustness Audit of Source-Attributed Cues in Multiple-Choice QA | Manikandan Ravikiran, Siddharth Vohra | cs.CL | 2026-09-08 |
| #6 | SeGDeP: Semantic- and Geometric-Aware Decoupled Prompts for Reasoning Segmentation | Linnan Zhao, Xu Liu, Lingling Li +3 | cs.CV | 2026-09-08 |
| #7 | DSE-VTG: Dual-Side Enhancement for Training-Free Video Temporal Grounding | Zhuo Cao, Bingqing Zhang, Sen Wang +1 | cs.CV | 2026-09-08 |
| #8 | Evidence-Grounded Retrieval for Investigation Hunt Lead Generation from CTI Reports | Akash Prakash, Boubakr Nour, Makan Pourzandi +2 | cs.CR | 2026-09-08 |
| #9 | From Where to How: Continuous 4D Interaction Forecasting from Egocentric Video | Qiaohui Chu, Haoyu Zhang, Meng Liu +3 | cs.CV | 2026-09-08 |
| #10 | CLAMP: Constrained Decoding for Vision-Language Embodied Planning | Tianyi Ma, Parisa Kordjamshidi | cs.AI | 2026-09-08 |
| #11 | SignRefine: Adapting Foundational Video Models for Sign Language Generation | Anton Pelykh, Edward Fish, Ozge Mercanoglu Sincan +1 | cs.CV | 2026-09-08 |
| #12 | AirAnchor: Bridging Local and Global Spatial Information for Zero-Shot Aerial Vision-and-Language Navigation | Shanwei Fan, Bin Zhang, Zhiwei Xu +4 | cs.CV | 2026-09-08 |
| #13 | From Coordinates to Candidate Regions: Temporal Change Localization via Region Selection in Remote Sensing Multimodal LLMs | Juwan Chung, Sungjune Park, Yeongyun Kim +1 | cs.CV | 2026-09-08 |
| #14 | ReMoMask-2: Latent Retrieval-Augmented Masked Motion Generation | Yiran Wang, Zeyu Zhang, Ling Shao +1 | cs.CV | 2026-09-08 |
| #15 | Human-Centric Image Captioning with Subject-Centered Spatial Understanding | Bozhou Li, Jiahang Zhang, Yue Ding +11 | cs.CV | 2026-09-08 |
| #16 | Dreaming in Flow: Generative Grounding Feedback for Self-Evolving Unified Multimodal Models | Ke Hao, Yuanzhi Liang, Tingxi Chen +5 | cs.CV | 2026-09-08 |
| #17 | Evidence-Aligned Entity Verification for Hallucination Detection in Retrieval-Augmented Generation | Runsong Jia, Zhen Fang, Mengjia Wu +2 | cs.AI | 2026-09-08 |
| #18 | 3DWay: Generalizing Robot Manipulation via 3D Consistent Waypoints | Ziqin Huang, Yingyue Li, Chenyangguang Zhang +6 | cs.RO | 2026-09-08 |
| #19 | OntologyBench: Can Dense Retrieval Satisfy Structured Biomedical Constraints? | Xiao Yu Cindy Zhang, Wyeth Wasserman, Jian Zhu | cs.AI | 2026-09-08 |
| #20 | When Metrics Reward the Worst Translations: Internalizing Cultural Reasoning for Social Media Translation Evaluation | Yiwen Qiu, Linjuan Wu, Dingming Li +7 | cs.CL | 2026-09-08 |
| #21 | VI-Bench: Benchmarking Prompt Inversion from AIGC Videos | Wulin Xie, Rui Zhao, Kecen Li +5 | cs.CV | 2026-09-08 |
| #22 | DroneGround: Open-Vocabulary Drone Payload Characterization Using Synthetic Data and Grounded Vision-Language Models | Ami Pandat, Rajasekhar Punna, Gopika Vinod +1 | cs.CV | 2026-09-07 |
| #23 | Open Tabular Insight Extraction: Where Do We Stand, and Where Should We Go? | Daniel Gomm, Maarten de Rijke, Madelon Hulsebos | cs.IR | 2026-09-07 |
| #24 | AgentIdeaBench: Benchmarking Scientific Ideation in the Agent Era | Yunxiang Mo, Tianshi Zheng, Yisen Gao +7 | cs.AI | 2026-09-07 |
| #25 | Search-to-World: Evaluation of 3D World Delivery from User Request through Web Search | Zixiao Gu, Yabo Chen, Xunzhi Xiang +5 | cs.CV | 2026-09-07 |
| #26 | AstroSpecLM: A Spectrum-Language Model for Evidence-Grounded Astronomical Spectral Analysis | Jinghang Shi, Yanxia Zhang, Ali Luo +2 | astro-ph.IM | 2026-09-07 |
| #27 | Ambient @ EgoProactive 2026 : Proactive Egocentric Assistance with Visually Grounded Supervision | Logesh Kumar Umapathi | cs.CV | 2026-09-07 |
| #28 | CASCADE: A Spatio-Temporal-Causal Reasoning Representation and Dataset for Driving | Jenny Schmalfuss, Despoina Paschalidou, Simon Gerstenecker +2 | cs.CV | 2026-09-07 |
| #29 | Where to Look and What to Use: Retrieve-Localize-Generate for Long-Term Conversational Memory Question Answering | Yifan Wang, Xinkui Lin, Yongxiu Xu +9 | cs.CL | 2026-09-07 |
| #30 | Contextual Observer Grounding: Evaluating Situated Spatial Reasoning in Vision-Language Models | Mimo Shirasaka, Haochen Zhang, Yonatan Bisk | cs.CV | 2026-09-07 |
| #31 | NormViz: A Benchmark and Framework for Grounding Multimodal Reasoning in Global Cultures | Akhila Yerukola, Fabrice Y Harel-Canada, Simran Khanuja +5 | cs.AI | 2026-09-06 |
| #32 | DrugReason: Dynamic Multi-View Reasoning over Knowledge Graph and Language Evidence for Drug Repurposing | Zijie Liu, Hongxuan Li, Zhen Tan +5 | cs.LG | 2026-09-06 |
| #33 | EviMap: Evidence-Grounded Hierarchical Topic Maps for Exploring Unlabeled Corpora | Zhiyin Tan, Changxu Duan | cs.IR | 2026-09-06 |
| #34 | A Computational Implementation of a Goal-Directed Theory of Affect | Bernhard Hilpert, Tamás Szűcs, Joost Broekens +1 | cs.AI | 2026-09-06 |
| #35 | Physico-Geospatial Grounded Scene Interpretation for Mobile Robotics | Nicolas Schuler, Janik Kurtz, Lea Dewald +3 | cs.CV | 2026-09-06 |
| #36 | MARBO: Relational Belief Grounding for LLM Agents in Social Deduction Games | Hwang Yechan, Bae Sangjun, Kim Jeongmo +2 | cs.AI | 2026-09-06 |
| #37 | Separating Capability from Confidence: Grounded Dual-State Calibration for GRPO-Trained Medical Vision-Language Models | Yangyang Xie, Ke Hao, Jiaqi Liu +2 | cs.CV | 2026-09-06 |
| #38 | WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data | Ji Soo Lee, Xilun Chen, Pierce Chuang +5 | cs.CL | 2026-09-04 |
| #39 | Think-Verify-Revise: Neuro-Symbolic Visual Reasoning with Vision-Language Models and Dynamic Logic Tensor Networks | Homayoun Afshari, Pietro Basci, Alessandro Russo +1 | cs.CV | 2026-09-04 |
| #40 | What Matters, When? Diagnosing and Improving Conditional Visual Grounding in Visuomotor Imitation Policies | Vivek Chavan, Pengtao Xie, Yahuan Shi +3 | cs.RO | 2026-09-04 |
| #41 | Towards Neuro-Symbolic Procedural Reasoning for Long-Horizon Vision-Language-Action Manipulation | Vivek Chavan, Yahuan Shi, Oliver Heimann +2 | cs.RO | 2026-09-04 |
| #42 | AI for Computational Design Science: A Responsible Human-AI Framework and Case Study on Short-Form Video Safety Surveillance | Wenli Zhang, Jiaheng Xie, Zhihe Pan +3 | cs.AI | 2026-09-04 |
| #43 | From Vision to Language: Investigating Causal Information Flow in Multimodal Decision-Making | Davide Testa, Hugh Mee Wong, Alessandro Lenci +2 | cs.CL | 2026-09-04 |
| #44 | SciDocBench: A Workflow-Centered Benchmark and Data Pipeline for Scientific Document Understanding | Shenxi Wu, Yuhong Liu, Haosong Zhang +8 | cs.AI | 2026-09-04 |
| #45 | Qlippy: A Retrieval-Augmented GenAI Assistant for Reproducible Quantum Workflows and Experiment Tracking | Mahee Gamage, Vlad Stirbu | quant-ph | 2026-09-04 |
| #46 | Leveraging Low-Level Symbolic Competences for Unsupervised Grounding in Hallucination Detection | Renato Vukovic, Hsien-chin Lin, Carel van Niekerk +5 | cs.CL | 2026-09-04 |
| #47 | From Interaction Traces to Persistent Skills: Online Evolution for Computer-Use Agents | Longtao Hu, Xiao Liang, Linchao Zhu | cs.AI | 2026-09-04 |
| #48 | PRISM-Bench: An Audio-Centric Diagnostic Benchmark for Text-to-Audio-Video Generation | Yuchen Sun, Qian Yang, Jun Wang +4 | cs.MM | 2026-09-04 |
| #49 | When Financial Fine-tuning Fails: A Three-Level Detectability Analysis of Numerical Hallucination in Domain-Adapted Language Models | Xiaodong Li, Peiwei Liu | cs.AI | 2026-09-04 |
| #50 | Diffusion Language Models for Mobile Edge Agentic AI: Foundations, Applications, and Challenges | Chenqi Li, Minghui Min, Dusit Niyato +1 | cs.AI | 2026-09-04 |