PaperScope
LIVE · 2026-09-03 05:40 UTC

vision 14 papers this week · -35% WoW

papers mentioning "vision" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1SolarWM: Open Data and Scalable Training for Long-Horizon Video World ModelsJunchao Huang, Guian Fang, Shengju Qian +15cs.CV2026-09-02
2PlantC2USeg: Cross-Scale Consistent Pre-Training for Few-Shot Unified Plant Point Cloud SegmentationYu Tian, Xintong Jiang, Jan Franklin Adamowski +2cs.CV2026-09-02
3User Feedback Provides a Unique Signal that LLMs Can not DetectShachar Don-Yehiya, Leshem Choshen, Omri Abendcs.CL2026-09-02
#4MuyBridge: Mobile Human Center-of-Mass Estimation from Monocular Video via Sparse FusionAidan Bradshaw, Marco Giordano, David Rode +8cs.CV2026-09-02
#5Benchmarking RAW and RGB Restoration in Image Signal ProcessorsZihao Lu, Radu Timofte, Marcos V. Condecs.CV2026-09-02
#6Cliff: Learning Process Rewards from the First MistakePeixuan Han, Runhui Wang, Ketan Ramaneti +3cs.LG2026-09-02
#7GDB-Reward: From Evaluation Metrics to Training Rewards for Graphic DesignAdrienne Deganutti, Purvanshi Mehta, Simon Hadfield +1cs.CV2026-09-02
#8AutoCompass: Accurate Visual Localization on Public Maps by Learning from Weak LabelsJavier Tirado-Garín, Alan Savio Paul, Shuai Chen +5cs.CV2026-09-02
#9From Reweighting to Rewriting: Unlocking the Intervention Effects of Influential Samples in Training Data AttributionYuzhang Luo, Chenpeng Wang, Jianhui Chen +1cs.CL2026-09-02
#10Balancing Frequencies and Pixels in Flow MatchingLucas Degeorge, Paul Couairon, Arijit Ghosh +3cs.CV2026-09-02
#11RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Vision-Language ModelsCanjie Liu, Jiawen Kang, Jinbo Wen +1cs.CV2026-09-02
#12Characterizing Text Branch Sensitivity in Medical Vision-Language Segmentation via Evidence DecouplingZiquan Liu, Zhewei Zhu, Xuyang Shics.CV2026-09-02
#13Dimension Dependent Correlation Gap Bounds under Restricted IndependenceArjun Ramachandramath.PR2026-09-02
#14Loom: Weaving Diagnostic Strands into Free-Text Consensus via Embedding-Space ReweightingRon Begleiter, Katya Egert Berg, Gilad Saban +1cs.AI2026-09-02
#15RGB-to-IR image translation for infrared vehicle detection in unseen UAV domainsThijs A. Eker, Ella P. Fokkinga, Jan Erik van Woerden +4cs.CV2026-09-02
#16Learn from Whoever Is Right: Answer-Verified Multi-Teacher Distillation for Multi-Domain LLMsXixiang He, Xingming Li, Baiqi Wu +4cs.LG2026-09-02
#17TrajMind: Chaining Role-Specialized LoRAs for Fast-and-Slow Collective Trajectory Anomaly DiagnosisJiahao Wu, Zhenqun Yang, Chen Jason Zhang +1cs.LG2026-09-02
#18Doppio: A Dataset for Contactless Weight Estimation of Falling ParticlesSimon Kiefhaber, Jan-Martin O. Steitz, Julia Grabinski +5cs.CV2026-09-02
#19ViSAR: Training-Free Adaptive-$k$ Retrieval for Visual Document Question AnsweringAdrien Mialland, Marc Plantevit, Julien Gallois +1cs.IR2026-09-02
#20Adapting a Foundation Model for Lunar Surface Height EstimationPatrick Bauer, Marius Schwinning, Melanie Siegel +2cs.CV2026-09-02
#21CA-OPD: Confidence-Aware On-Policy Distillation for Structured Visual PredictionMenghao Li, Linjie Mu, Yin Wang +4cs.CV2026-09-02
#22MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution ShiftsMatteo Greco, Anudeex Shetty, Andrea Tagarelli +1cs.CL2026-09-02
#23TempoGround: State-Aware Streaming Visual Grounding with Vision-Language ModelsLeqian Ding, Junning Qiu, Manwen Yang +2cs.CV2026-09-02
#24LookStep: Efficient Vision-Language Navigation with Linguistic Foresight and Event Driven MemoryKun-Yang Yu, Yingzhe Li, Hongyu Xu +8cs.CV2026-09-02
#25Towards Zero-Shot Transfer Across Embodiments For Driving VLAsCaio Azevedo, Stefano Sabatini, Sascha Hornauer +1cs.CV2026-09-02
#26YesTrack: Referring Multi-Object Tracking via MLLM-based Yes/No VerificationQuansheng Hu, Qin Sun, Qiansen Dai +4cs.CV2026-09-02
#27If It Moves, Radar Knows: A Physics-Aware Radar Transformer for Class-Agnostic Moving-Object DetectionYinghao Sun, Shuguang Li, Jinliang Shao +1cs.CV2026-09-02
#28Diffusion-Encoding Gaussian Field for Joint k-q dMRI ReconstructionZhibo Chen, Yajuan Huang, Yu Guan +3cs.CV2026-09-02
#29RouteGraph-Mona: Confusion-Aware Routing Fine-Tuning for Mineral Image ClassificationJierui Li, Zhiyuan Qi, Hao Zhu +7cs.CV2026-09-02
#30InfraPatch: Cross-Task Targeted Grayscale Patch Attacks on Infrared-Adapted Vision-Language ModelsChengyin Hu, Dingyi Lu, Jiaju Han +5cs.CV2026-09-02
#31Signal or Noise? Auditing Rotation-Induced Saliency Drift in Medical and Aerial ImagingKhawaja Murad ul Hassan, Mehran Ebrahimics.CV2026-09-02
#32Asymmetric Paired-Annotation Learning for Multi-Structure ULF Pediatric Brain MRI SegmentationHa-Hieu Pham, Dang P. M. Cao, Minh Hoang Pham +4cs.CV2026-09-02
#33LeakageBench: Document-Level Leakage Risk for Redacting Personally Identifiable Information in Document ImagesVishnu Prasad Vijaya Kumar, Santhosh Venkatesh, Ivan P. Yamshchikovcs.CV2026-09-02
#34TAME: Temporal-Aware Mixture-of-Experts for Text-Video RetrievalUicheol Jung, Juyoung Hong, Hojung Kwon +1cs.CV2026-09-02
#35Lightweight Adaptation of General-Purpose VLMs for Multispectral and SAR Image UnderstandingShanji Liu, Kelu Yao, Junxiao Xue +5cs.CV2026-09-02
#36GenCAR: Generative Counterfactual Alignment with Risk-Controlled Selection for Out-of-Distribution RecommendationQianqian Wang, Yunshan Li, Jiawen Zeng +2cs.IR2026-09-02
#37World-Coherent Decoding: Self-Verifying Test-Time Planning for World Action ModelsChuhan Zhang, Seiji Ito, Kenta Hoshino +2cs.CV2026-09-02
#38EmoStance: Response-Side Affective-Orientation Control for Empathetic Response Generation via Emoji Weak SupervisionZiyuan Jin, Yuxuan Ge, Zheng Tiancs.AI2026-09-02
#39Disease Burden over Skin Tone: Decomposing the Dermatology-AI Generalization GapNirajan Kunwor, Sanjaya Poudel, Quoc-Huy Trinh +2cs.CV2026-09-02
#40MeanField Surrogate Modeling for Scalable Runtime Scheduling of Concurrent Heterogeneous AI Inference on Shared GPUsYoussef Ennouri, Soonhoi Hacs.DC2026-09-02
#41Federated LoRA Adaptation of BiomedCLIP Across Four International Chest X-Ray CohortsSanjaya Poudel, Nirajan Kunwor, Manish Dhakal +2cs.LG2026-09-02
#42Monitoring Web Agents Without Internal Signals: Observable Trajectories and Key-Step SupervisionSitong Pan, Yipeng Shen, Yilin Lu +3cs.AI2026-09-02
#43Act More, Decide Less: Skill-Guided Adaptive Action Chunking for Long-Horizon LLM AgentsYanting Yang, Can Jin, Jinman Zhao +6cs.LG2026-09-02
#44Test-Time Logit Prompting for Source-Free Missing Modality AdaptationTaixi Chen, Nancy Guocs.CV2026-09-02
#45SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution TransitionTingyan Wen, Chenqian Yan, Xurui Peng +4cs.CV2026-09-02
#46Detecting Object Hallucinations in Large Vision-Language Models via Cross-Modal Attention Drifts and Mask-Based VerificationXuanbing Wen, Boxu Chen, Le Yang +4cs.CV2026-09-02
#47Who Drives the Probability Game of VLMs? A Temporal Causal Drive Evaluation FrameworkShuyao Xiao, Shengling Wang, Haoyu Niu +4cs.CV2026-09-02
#48On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following RerankersVignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipallics.LG2026-09-01
#49Learning with Volterra Neural Networks: A System Theoretic PerspectiveHaoyu Yun, Hamid Krim, Yufang Baocs.CV2026-09-01
#50Looped Transformers under the Jacobian Lens: Does the Global Workspace Survive Recurrence?Wenlong Wang, Fergal Reidcs.AI2026-09-01

all trends · matching is case-insensitive substring after tokenization