PaperScope
LIVE · 2026-09-03 05:40 UTC

token 27 papers this week · +33% WoW

papers mentioning "token" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1Graph Machine: Towards Better Pretraining via EdgesLintai Houcs.LG2026-09-02
2RoGe: Novel View Synthesis via End-to-End Implicit Reconstruction and GenerationXiaolei Lang, Ze Kang, Zehao Huang +1cs.CV2026-09-02
3UE5M3 FP4 Block Scaling for Stable Language Model PretrainingRobert Hu, Carlo Luschi, Paul Balancacs.LG2026-09-02
#4Cliff: Learning Process Rewards from the First MistakePeixuan Han, Runhui Wang, Ketan Ramaneti +3cs.LG2026-09-02
#5EarlyEval: Cheaper Agent Evaluation via Early Outcome PredictionYuling Shi, Zhensu Sun, Junsen Dong +3cs.CL2026-09-02
#6ShallowStream: Index Shallow then Answer Deep for Streaming Video UnderstandingJitai Hao, Ke Yang, Qiang Huang +1cs.CV2026-09-02
#7Language Models Can Control Their Own AttentionNamgyu Ho, Huzama Ahmad, Woosung Koh +3cs.CL2026-09-02
#8RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Vision-Language ModelsCanjie Liu, Jiawen Kang, Jinbo Wen +1cs.CV2026-09-02
#9From Tokens to Semantics: Leveraging Complementary Signals for Hallucination Detection in Black-Box LLMsUrja Pawar, Rajitha Ramanayake, Owen O'Neill +4cs.CL2026-09-02
#10MARS: What Retrieval Signals Are Hidden in Multimodal Large Language Models for Text-Video Retrieval?Uicheol Jung, Juyoung Hong, Geuntaek Lim +1cs.CV2026-09-02
#11Spatially Aware World Action Model via Geometric Latent DiffusionJavier Alejandro Lopetegui Gonzalez, Paul Pacaud, Cordelia Schmidcs.CV2026-09-02
#12Evidence for Shared Routing Geometry and Dynamics in Sparse Mixture-of-ExpertsKirill Labzin, Stepan Kulibaba, Artem Dzhalilov +1cs.LG2026-09-02
#13CA-OPD: Confidence-Aware On-Policy Distillation for Structured Visual PredictionMenghao Li, Linjie Mu, Yin Wang +4cs.CV2026-09-02
#14ProSR: Semantic-Prototype-Guided Discrete Modeling for Physically Consistent SAR Super-ResolutionByoungwoo Kim, Munchurl Kimcs.CV2026-09-02
#15TempoGround: State-Aware Streaming Visual Grounding with Vision-Language ModelsLeqian Ding, Junning Qiu, Manwen Yang +2cs.CV2026-09-02
#16DiffIE: Diffusion-based Open Information ExtractionKonstantin Fedorov, Valentin Malykhcs.CL2026-09-02
#17SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignmentQingyu Meng, Yiwei Zha, Jiahuan Pei +3cs.LG2026-09-02
#18SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task OntologyIhor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2cs.AI2026-09-02
#19Codebook Agent: Amortized Topology Design for LLM Multi-Agent SystemsJinxi Yu, Yubei Li, Eric Hanchen Jiang +6cs.AI2026-09-02
#20TAME: Temporal-Aware Mixture-of-Experts for Text-Video RetrievalUicheol Jung, Juyoung Hong, Hojung Kwon +1cs.CV2026-09-02
#21WeaveMark: Robust and Scalable Multi-bit LLM Watermarking via Coded Payload SpreadingGang-Hyun Park, Ju-Hyeong Lee, Hee-Youl Kwak +1cs.CR2026-09-02
#22A Unified Rate-Distortion Perspective on Vector, Product, and Scalar QuantizationXianghong Fang, Wenlong Mou, Yuan Yuan +2cs.LG2026-09-02
#23XMerge: Cross-Axis Selection and Reconstructive Layer Merging for LLM Depth CompressionJundong Hu, Shekar Ramachandrancs.LG2026-09-02
#24Monitoring Web Agents Without Internal Signals: Observable Trajectories and Key-Step SupervisionSitong Pan, Yipeng Shen, Yilin Lu +3cs.AI2026-09-02
#25The Dynamics of Continuous Mixture Collapse in Language ModelsAli Backourcs.LG2026-09-02
#26GeoStore: Finding Small Storefronts in Large Scenes -- A Fine-Grained POI Localization Benchmark with Global-to-Local Asymmetric MatchingLu Han, Xiting Sun, Hao Wang +4cs.CV2026-09-02
#27Seed-Anchored Budget-Bounded Graph Rendering for Question Answering on Industry-Standard Power-Grid Information and Exchange ModelsJayakumar Manoharan, Yamini Sehgaleess.SY2026-09-02
#28Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone DistillationWenhui Chen, Zhifeng Li, Jie Zhou +5cs.LG2026-09-02
#29Sparse Readout Prism: Explaining Logit-Lens Scores in Features Instead of TokensMatteo He, William F. Shen, Xinchi Qiu +1cs.CL2026-09-01
#30CRISP: Cliff-awaRe Input-adaptive Sparse Prefilling with Structural-Mass-Motivated RoutingHuu Huy Nguyen, Chien Van Nguyen, Franck Dernoncourt +4cs.LG2026-09-01
#31GAPS: Dimension-Level Gates for Conditional Activation SteeringMoghis Fereidouni, Muhammad Umair Haider, Hassan Sajjad +1cs.CL2026-09-01
#32hLLM: Single Pass Decoding for Generative RerankingEmil Laftchiev, Prachi Agrawal, Moe Kayali +7cs.LG2026-09-01
#33How Do Prompt Variations Affect Energy Consumption in On-Device LLMs?Wei Hu, Xiaolong Tu, Dawei Chen +3cs.CL2026-09-01
#34Dictionary-Guided Mutation Operators for Automated HDL RepairMaisha Mastora, Dean Sullivancs.ET2026-09-01
#35ZipTok3D: High-Fidelity 3D Tokenization with Compact Token PrefixesMingda Lin, Weijie Wang, Zeyu Zhang +7cs.CV2026-09-01
#36Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization EvaluationHimil Vasava, Ming Jiangcs.CL2026-09-01
#37Adaptive Critical Token-Aware Retrieval for Repository-Level Code GenerationKefeng Duan, Dewu Zheng, Yanlin Wang +8cs.SE2026-09-01
#38CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses?Damien Sileo, Dimitri Kachlercs.CL2026-09-01
#39Retrieved but not ranked: surface-form bias in structural retrieval, from mathematics to agent trajectoriesNabira Rashid, Manolis Kelliscs.LG2026-09-01
#40Knowledge Distillation During Mid-Training Favors Reasoning over Factual RecallJacqueline He, Howard Yen, Shuyue Stella Li +9cs.CL2026-09-01
#41LatentPress: Context Compression Beyond Text and VisionZhengze Zhou, Hejian Sangcs.LG2026-09-01
#42Parsing the Stream: A Live Trace Model for Long-Horizon Agents and Their ObserversEgor Pakhomov, Erik Nijkampcs.AI2026-09-01
#43HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness?Yuhao Wu, Jingyuan Zhang, Jiajun Shi +16cs.SE2026-09-01
#44TRIAGE: Three-level Routing and Intelligent Agent Guidance for Efficient ExecutionRuocan Weics.LG2026-09-01
#45When Tokenization is Secretly Output SupervisionTanja Baeumel, Josef van Genabith, Simon Ostermanncs.CL2026-09-01
#46Learning Evidence Sufficiency Boundaries for Selective Answering in Grounded Multi-Hop QAHaruto Sato, Yuki Tanaka, Ren Nakamura +2cs.CL2026-09-01
#47Polish ModernBERT: The Long and Short of Polish Language UnderstandingMichał Perełkiewicz, Sławomir Dadas, Rafał Poświata +1cs.CL2026-09-01
#48SMELT: Scaling Laws for Compute-Matched MoE Looped TransformersShaowen Wang, Ge Zhang, Kairong Luo +6cs.LG2026-09-01
#49mzCache: On-Device LLM Memory Management under MultitaskingHongseung Yu, Minsung Kim, Jongseok Park +1cs.OS2026-09-01
#50Reliability Challenges in Diffusion Vision-Language ModelsMd. Atabuzzaman, Chris Thomascs.CV2026-09-01

all trends · matching is case-insensitive substring after tokenization