| 1 | TAP-Path: Task-Adaptive Structural and Token Pruning for Efficient and Trustworthy Pathology Foundation Models | Mehedi Hasan, Ashfak Yeafi, Md Khairul Islam | cs.CV | 2026-09-03 |
| 2 | CoFiE: Coarse-to-Fine Evidence Selection for Efficient Streaming Video Understanding | Jing Jiang, Yiran Ling, Ruonan Li +2 | cs.CV | 2026-09-03 |
| 3 | Who Speaks for the Pruned? Visual Token Pruning as Coverage Optimization | Qingchan Zhu, Weihang You, Hanqi Jiang +3 | cs.CV | 2026-09-02 |
| #4 | ShallowStream: Index Shallow then Answer Deep for Streaming Video Understanding | Jitai Hao, Ke Yang, Qiang Huang +1 | cs.CV | 2026-09-02 |
| #5 | S$^2$Prune: Spatially Structured Visual Token Pruning for Multimodal Large Language Models | Yuanyuan Jia, Shunpu Tang, Qianqian Yang | cs.CV | 2026-09-01 |
| #6 | SinkPruner: Sink-Free Visual Token Pruning for Multimodal Large Language Models | Shiyu Li, Zi-Yuan Hu, Shijia Huang +3 | cs.CV | 2026-09-01 |
| #7 | From Saliency to Discriminability: Rank-Preserving Visual Token Pruning for VLM Rerankers | Siyi Liu, Hanjun Yang, Chenchen Zhang +7 | cs.IR | 2026-09-01 |
| #8 | Centering before Pruning: Lightweight Geometry Correction for Diversity-Based Visual Token Pruning in LVLMs | Shunjie Wen, Jaeyeon Lee, Dong-Wan Choi | cs.CV | 2026-08-31 |
| #9 | SemKV: Semantic Mixed-Precision KV Cache Quantization Guided by the Quality Cliff for Long-Context LLM Inference | Daeha Lee, Do-Hyung Kim, Jae-Hong Kim | cs.LG | 2026-08-28 |
| #10 | PACE: A Unified Condense-and-Extract Paradigm for Fast VLM Inference | Junjie Liu, Shengyuan Ye, Xu Chen | cs.CV | 2026-08-27 |
| #11 | Multi-Image Visual Token Pruning in Large Visual Language Models | Rongyang Zhang, Chengqiang Lu, Cong Li +9 | cs.CV | 2026-08-27 |
| #12 | Not All Attention Heads Contribute to Critical Visual Token Selection: Head-Aware Pruning Matters More | Chaofang Ma, Lin Jiang, Carol Jingyi Li +4 | cs.CV | 2026-08-26 |
| #13 | MaST: Motion-aware Sparse Pipeline for Lightweight Object Tracking | Qingmao Wei, Fagui Liu, Dengke Zhang +2 | cs.CV | 2026-08-25 |
| #14 | HAP: Head-Adaptive Visual Token Pruning via Cross-Modal Alignment | Yuanhao Sun, Huawei Ji, Yuan Jin +3 | cs.CV | 2026-08-24 |
| #15 | E2S-Pruner: Progressive Two-Stage Evidence Fusion for Visual Token Pruning in Vision-Language Models | Taoyu Qian, Qi Wang, Daqian Shi +3 | cs.CV | 2026-08-24 |
| #16 | RS$^3$-Prune: Read-Sparse, Store-Sparse Token Pruning for Video Object Segmentation | Avilasha Mandal, Sarvesh Shashikumar | cs.CV | 2026-08-23 |
| #17 | Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models | Zhuoyuan Li, Rui Zhao, Jin Wang +5 | cs.CV | 2026-08-21 |
| #18 | Sparse Token Routing in Efficient Transformers | Sai Krishna Arthanari, JaeHyeong Chang, Chengzhe Sun +1 | cs.CL | 2026-08-21 |
| #19 | Clustering and Token Denoising for Faster and More Robust VLMs | Baptiste Rossigneux, Inna Kucher, Vincent Lorrain +1 | cs.CV | 2026-08-19 |
| #20 | Role-Conditioned Sub-Token Routing for Efficient Vision-Language-Action Policies | Wei Jiang, Wei Wang | cs.LG | 2026-08-19 |
| #21 | SA-GEM: Scale-Adaptive and Geospatial Evidence-Modulated Token Pruning for Efficient Remote Sensing Large Vision-Language Models | Kexin Ma, Jing Xiao, Bowen Xing +2 | cs.CV | 2026-08-15 |
| #22 | CoverPrune: Coverage-Driven Token Pruning for 3D VLMs via Optimal Transport | Peng Ling, Yingda Yin, Lingting Zhu +5 | cs.CV | 2026-08-13 |
| #23 | Putting Registers to Work: Task Registers for Token Pruning in Vision Transformers | Hongsen Cao, Mona Jaber, Shanxin Yuan +1 | cs.CV | 2026-08-11 |
| #24 | When Vision Becomes Text: Visual Token Pruning via Cross-Modal Residual Guidance in VLMs | Congyang Ou, Ruike Song, Yang Zhou +3 | cs.CV | 2026-08-11 |
| #25 | VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling | Yuqi Zhang, Cheng Chen, Yuyu Guo +6 | cs.CV | 2026-08-09 |