PaperScope
LIVE · 2026-09-15 05:40 UTC

answering 11 papers this week · -20% WoW

papers mentioning "answering" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1Corrupt Plans, Clean Traces: Evading Chain-of-Thought Monitoring with Plan InjectionKeertana Chidambaram, Andrew Ilyas, Vasilis Syrgkaniscs.AI2026-09-14
2Verifiable by Construction: Claim-Level Evaluation of Verbatim Citation in Clinical Question AnsweringJiashuo Zhang, Yuling Chen, Yvonne Commodore-Mensah +1cs.CL2026-09-14
3HypoEvolve: Genetic Algorithms Enable Multi-Agent LLMs to Discover Scientific HypothesesJieyuan Liu, Mengzhou Hu, Jefferson Chen +10cs.CL2026-09-14
#4CiteGuard-RAG: A Validation-Centered AI System for Evidence-Grounded Question AnsweringSumit Barua, Guan Hong, Halil Dursunoglu +2cs.CL2026-09-14
#5Navigating Sparse Evidence: Agentic Visual RAG via Explicit Context Selection and ConsolidationYucheng Shen, Lingyong Yan, Jiulong Wu +4cs.AI2026-09-14
#6Don't Send What You Don't Need: Question-Guided Token Pruning as a Privacy Defense for Vision-Language ModelsMd Khalid Syfullah, Alvi Ataur Khalilcs.CV2026-09-14
#7CiteShade: Citation Laundering in Multi-Source Retrieval-Augmented Generation and Its Counterfactual DefenseGuo Fuzhengcs.CR2026-09-14
#8Where to Compute and How to Interact: Operator-Readable Adaptation with Gauge-Aware TransportZixuan Shen, Quanxu Wan, Bingchuan Wang +2cs.LG2026-09-14
#9A Unified Vision-Language Model for PSMA PET/CT Report Generation, Visual Question Answering, and Lesion SegmentationYang Xing, Jiong Wu, Savas Ozdemir +11cs.CV2026-09-14
#10Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQATristan Kirscher, Niklas C. Koser, Soren Pirkcs.AI2026-09-14
#11BVB: Benchmarking Agentic Video Understanding via Programmatic Reconstruction in BlenderYolo Y. Tang, Daiki Shimada, Jiayue Meng +14cs.CV2026-09-14
#12Long-to-Short Video Evidence Reasoning for Grounded Question AnsweringKaiyan Chen, Junbin Xiao, Xun Yangcs.CV2026-09-14
#13SparseTalk - Sparsifying 3D Gaussian Language Fields for Efficient 3D Visual Question AnsweringDavit Soselia, Joseph JaJa, Amitabh Varshneycs.CV2026-09-14
#14Route, Don't Fix: Regime-Dependent Decoding Correction and a Trajectory-Gated Router for Reliable Clinical LLM Answer SelectionZeyu Dong, Benjamin Wang, Joyee W. Jincs.CL2026-09-13
#15Fabrication After Tool Failure: Tool-Augmented Agents Assert Values Their Tools Did Not ReturnArham Sethi, Arsen Kenzhebayev, Saanvi Paturi +3cs.SE2026-09-13
#16Theseus in the Graph: Towards Traceable Multi-Hop Graph NavigationEduin E. Hernandez, Luis F. Garcia, Nurassyl Askar +2cs.CL2026-09-13
#17Selective Tool Use for Agentic Change Visual Question Answering in Remote SensingYakoub Bazi, Mohamad M. Al Rahhal, Mohamed A. Mekhtiche +1cs.CV2026-09-13
#18NeuroActiSep: Detecting Factual Hallucinations from Feed-Forward Neurons in a Single PassAli Derogar Odolou, Reza Nazari, Mostafa Salehics.CL2026-09-13
#19When Tools Get in the Way: The Effect of Unnecessary Tool Availability on LLM AnsweringSaanvi Paturi, Arsen Kenzhebayev, Arham Sethi +3cs.CL2026-09-12
#20T-SMART: Mechanism-Level Attribution for Tool-Augmented Time-Series Question AnsweringIvan Delgado, Himansi Gupta, Bishal Khatri +4cs.LG2026-09-12
#21Semantic Knowledge Technologies: what the Semantic Web lost sight of, and what it never hadAchille Zappacs.AI2026-09-12
#22GraMRAG: Orchestrating Multi-Agent Multi-Step Reasoning via Graph Memory with Reinforcement LearningZhongyu Wangcs.CL2026-09-12
#23UniCAR-RL: Seeing Better before Thinking Deeper in Visual MathematicsYuzhe Li, Hao Yan, Hao Wang +6cs.AI2026-09-12
#24Beyond OCR Accuracy: Text-Centric VQA Under Image Degradation with Modular and End-to-EndRitali Vatsi, Rachapudi Jagadeesh, Shruti Singh Baghel +3cs.CV2026-09-12
#25Realtime-Venus: A full-duplex interaction system with asynchronous delegationRuixiang Zhao, Hualei Wang, Renhe Sun +24cs.CV2026-09-12
#26HyperProve: Answer-Guided Hypergraph Expansion for Multi-Hop Question AnsweringAn Nguyen Phu, Dung Nguyen Quang, Luu Hieu An +3cs.CL2026-09-12
#27Cost Characterization of Vertically Partitioned Federated Knowledge GraphsMd Saikat Islam Khan Bappy, Oshani Seneviratnecs.AI2026-09-12
#28FedV-KGQA in Practice: Design Lessons and an Interactive PrototypeMd Saikat Islam Khan Bappy, Oshani Seneviratnecs.AI2026-09-12
#29Solar IntelligenceJyotsna Singhcs.AI2026-09-12
#30Nuha-Speech: Building General-Purpose Arabic Speech-LLMsYingzhi Wang, Reem Alhazzani, Muhammad Alqurishics.CL2026-09-10
#31The Eloquence submission for Task 2 of the Interspeech 2026 MLC-SLM challengeJordi Luque, Lorenzo Concina, Marco Matassoni +2cs.CL2026-09-10
#32ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMsYizhan Li, Jianxin You, Mengyang Xiong +5cs.RO2026-09-09
#33BodyCam-VQA: Enhanced Body-Worn Camera Video Captioning via Multimodal Reasoning and Probe Question GenerationKarish Gupta, Matthew Alex, Alex Li +6cs.CV2026-09-09
#34Fortunate Recall: Ontology-Driven Memory Lifecycle Management for Persistent Coherence in LLMsAnsuman Mullick, Eray Tüzüncs.AI2026-09-09
#35Why Is Video Still So Expensive? A Survey of Inference-Efficiency Mechanisms in Video and Audiovisual LLMsKillian Steunou, Yannis Tevissen, Mounîm A. El Yacoubics.CV2026-09-09
#36What Should an Agent Forget? Separating What Is Stored from What Is UsedYuhang Li, Yuchen Lics.AI2026-09-09
#37LiteRAG: Cost-Efficient Graph-Based Retrieval-Augmented GenerationDaniel Alejandro Coll Tejeda, Pedro García López, Daniel Barcelona-Ponscs.IR2026-09-09
#38The Answer Path and the Grounding Instruction in LLM Question Answering over Knowledge GraphsArquimedes Canedocs.CL2026-09-09
#39Beyond Surface Imitation: Contrastive Modeling for Reasoning Path Alignment in Multimodal In-Context LearningMingbo Yang, Wenqiang Wang, Zhaolu Kang +4cs.AI2026-09-09
#40From Retrieval to Weights: Parametric Individualization of Small Language Models with Individual Text CorporaChristoph Wigbels, Ali Abusaleh, Markus T. Jansen +2cs.CL2026-09-09
#41Putting Captions to the Test: Evaluating Video Caption Quality through Multiple-Choice Question AnsweringZizhen Wang, Bo Feng, Zhengfeng Lai +5cs.CV2026-09-09
#42Can We Trust Video Hallucination Detectors? VidHalLoc for Evaluating the EvaluatorsXinyu Chen, Adnan Mahmood, Mark Drascs.CV2026-09-09
#43$S^3$-Bench: Evaluating Speech Interaction Models as Scientific Voice AssistantsHeyang Liu, Jiayi Huang, Wenyang Xiao +8cs.CL2026-09-09
#44ROAM: Robust Organization of Atomic Memories for Agents through Semantic RelationsJianjie Zheng, Peng Lai, Sijie Cheng +3cs.CL2026-09-09
#45Which Medical Questions Deserve Rationales? Perturbation-Sensitive Selection for Robust QAYuexin Wu, Dayou Yu, Vasile Ruscs.CL2026-09-09
#46SEA-SpeechBench: A Large-Scale Multitask Benchmark for Speech Understanding Across Southeast AsiaJingyi Liao, Wenyu Zhang, Zhuohan Liu +6cs.CL2026-09-09
#47ContractEval: Query-Conditioned Execution Matching for Procedural Instruction ConformancePraphul Singh, Shanu Kumar, Akshat Agarwal +1cs.AI2026-09-08
#48VANTAGE-Bench: Evaluating the Infrastructure AI Gap in Vision-Language ModelsZaid Pervaiz Bhat, Nimra Nayyar, Arihant Jain +6cs.CV2026-09-08
#49Evaluation of Contextual Understanding in Large Language ModelsSubavarshana Arumugam, Mamta Nallaretnam, Kithuni Wickramasinghe +4cs.CL2026-09-08
#50EgoSIS: From Factorized Visual Ego-Transitions to Motion-Canonical Spatial Evidence for UAV ReasoningJingpu Yang, Fengxian Ji, Mingxuan Cui +4cs.CV2026-09-08

all trends · matching is case-insensitive substring after tokenization