PaperScope
LIVE · 2026-09-03 05:40 UTC

test-time 16 papers this week · -15% WoW

papers mentioning "test-time" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1Discriminative World Models for Web AgentsKelvin Li, Dhruv Pendharkar, Anish Pahilajani +6cs.AI2026-09-02
2Post-Training Language Models for Gold-Medal Performance in Coding CompetitionsAleksander Ficek, Sean Narenthiran, Mehrzad Samadi +2cs.LG2026-09-02
3Video-Based Palm-Vein Authentication under Challenging ConditionsXiaofeng Yan, Kechen Liu, Abhilash Venkatesh +3cs.CV2026-09-02
#4Rethinking the Teacher-Student Framework for Test-Time AdaptationDamian Sójka, Marc Masana, Bartłomiej Twardowski +1cs.LG2026-09-02
#5DiffIE: Diffusion-based Open Information ExtractionKonstantin Fedorov, Valentin Malykhcs.CL2026-09-02
#6APEx: Distillation of Agent Procedural Experience for Adaptive Deep Research Question AnsweringJie Ding, Rui Sun, Xinyuan Zhang +2cs.AI2026-09-02
#7World-Coherent Decoding: Self-Verifying Test-Time Planning for World Action ModelsChuhan Zhang, Seiji Ito, Kenta Hoshino +2cs.CV2026-09-02
#8CHIME: Credit-Aware Hierarchical Memory Evolution for Long-Horizon Agentic PlanningYongshi Ye, Tian Lan, Feihu Jiang +7cs.AI2026-09-02
#9Test-Time Logit Prompting for Source-Free Missing Modality AdaptationTaixi Chen, Nancy Guocs.CV2026-09-02
#10DESA-TTA: Dynamic EMA and Source Anchoring for Test-Time AdaptationAtif Belal, Lilian Hollard, Marco Pedersoli +1cs.CV2026-09-01
#11TempCloze: Can Video-LLMs Identify the Missing Middle?Wenqi Pei, Henry Hengyuan Zhao, Yilai Liu +4cs.CV2026-09-01
#12GazeRefine: Expert Gaze as a Test-Time Prompt for Training-Free Medical Image SegmentationMohammed Oussama Benyahia, Marouane Tliba, Mohamed Amine Kerkouri +10eess.IV2026-09-01
#13FORGE: Forward-Only Test-Time Adaptation for Integer-Only Vision Models on MicrocontrollersMuhammad Rehan, Haider Ali, Muhammad Ali Munir +1cs.CV2026-09-01
#14A Survey on Self-Improving Test-Time Intelligence: Feedback-Driven Adapting, Learning, and Scaling at InferenceShuaicheng Niu, Guohao Chen, Yaofo Chen +14cs.LG2026-09-01
#15PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in PersianMohammad Hossein Shalchian, Mostafa Amiri, Amir Mahdi Sadeghzadehcs.CL2026-09-01
#16Training-Free Inpainting Across Domains with a Frozen Text-to-Image Diffusion ModelZhenhuan Wang, Fengyi Yuancs.CV2026-09-01
#17Adapting Without Gradients: Affine Statistics Transport and What Its Certificate Can Tell YouSalim Khazem, Ibrahim Mohamed Serouiscs.LG2026-08-31
#18HSRM: Hidden-State Reward Models for Test-Time VerificationXianzhi Li, Xiaodan Zhucs.AI2026-08-31
#19Safin-1: Safety from Within through Memory-Native State EvolutionMing Zhang, Kaisen Yang, Shu Yu +15cs.LG2026-08-31
#20When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language ModelsJiaqi Wei, Xiang Zhang, Yuejin Yang +10cs.CL2026-08-31
#21Augmenting Human Performance with an XR Agent Learning from Online Behavior and BCI EvidenceZiheng Li, Xichen He, Haoyan Chen +10cs.AI2026-08-31
#22Answer Probing-Guided Search for Diverse Solution Exploration of LLMsYi Fang, Que Shen, Chengpeng Li +6cs.AI2026-08-31
#23Rethinking the Test-Time Prompt Tuning Objective from the Perspective of CalibrationJungwon Choi, Hyeonseo Jang, Kibok Lee +1cs.AI2026-08-31
#24NoisEasier: Test-Time Noise Optimization for Text-to-Video GenerationYujiang Pu, Yu Kongcs.CV2026-08-31
#25Reactivating Test-Time Scaling for Plane Geometry Problem SolvingXiaoqiang Kang, Shengen Wu, Maizhen Ning +5cs.CL2026-08-31
#26Towards Continual Test-Time Adaptation of Vision-Language Models in Open-Vocabulary Semantic SegmentationChandler Timm C. Doloriel, Yunbei Zhang, Sarthak Kumar Maharana +5cs.CV2026-08-30
#27Continual Test-Time Adaptation via Entropy Sensitivity-Guidance in Strict Online SettingChandler Timm C. Doloriel, Yunbei Zhang, Muhammad Salman Siddiqui +4cs.CV2026-08-30
#28A Unified Perspective on Conformal Prediction and Wasserstein Distributionally Robust Optimization for Uncertainty QuantificationKehan Long, Yiqi Zhao, Pol Mestres +3math.OC2026-08-30
#29AGM: Achievement-Grounded Memory for Closed-Loop Agents with Frozen VLA PoliciesHongbo Gao, Zeyu Ni, Xin Wen +2cs.RO2026-08-30
#30FuncRoom-Agent: Sequential Feed-Forward 3D Functional Indoor Scene GenerationHao Feng, Zhi Zuo, MingJian Liang +6cs.CV2026-08-30
#31GATE: Reliability-Gated Gaussian Evidence Fusion for Training-Free Test-Time Adaptation of Vision-Language ModelsPedram MohajerAnsari, Amir Salarpour, Run Wang +1cs.CV2026-08-29
#32Test-Time Scaling for Video Diffusion Models via Diagnosis-Guided Candidate RecyclingHangzhou He, Lunhao Duan, Shanshan Zhao +4cs.CV2026-08-29
#33Learning Simple Test-Time Environments for LLM Web AgentsJunxuan Li, Zijun Liu, Ziyi Huang +4cs.CL2026-08-29
#34DARD: Zero-Shot Degradation-Aware Retinex-Guided Diffusion for Low-Light Image EnhancementWenjie Cai, Yuezhe Yang, Jianyang Xia +2cs.CV2026-08-29
#35Locked at the Entrance, Open Inside: Where RLVR Narrows the Solution SpaceQiancheng Zhou, Ruizhe Lics.LG2026-08-29
#36Subtraction-Based Tumor Segmentation and Lesion-Centered pCR Prediction for the MAMA-MIA ChallengeKai Geissler, Raphael Schäfercs.CV2026-08-29
#37Training-Free Hidden-State Refinement for Flow-Matching Image GeneratorsYuanyi Yan, Xinzhe Rao, Canyu Shen +5cs.CV2026-08-29
#38Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine TranslationDi Wu, Sergey Troshin, Christof Monz +2cs.CL2026-08-28
#39Beyond the Answer Key: Robustness Evaluation of Large Language Models for Step-Level Mathematical VerificationFateme Mazdarani, Carlos Toxtlics.AI2026-08-28
#40RECAST: Recent & Context-Aware Sampling for Test-Time Adaptation in Streaming BiosignalsYong-Yeon Jo, Junho Song, Joon-myoung Kwoncs.AI2026-08-28
#41SEPO: Evidence-Grounded Prompt Optimization via Structural EditingXiaoyu Ma, Haoyue Liu, Yiwen Li +4cs.AI2026-08-28
#42AERA: Adaptive Evidence Residual Allocation for Efficient Test-Time ReasoningZiming Wang, Ivor Tsang, Hangwei Qiancs.AI2026-08-28
#43Temporal Memory-Aware Online Test-Time Adaptation on Dynamic GraphsBo Li, Xin Zheng, Ming Jin +2cs.LG2026-08-28
#44CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure ModesYufan Wu, Yinghui He, Zhengyi Hu +4cs.CL2026-08-27
#45TTPO: Test-Time Policy OptimizationAozhe Wang, Zhengxi Lu, Jianze Wang +8cs.CL2026-08-27
#46Hyperspectral Diffusion Equivariant Imaging (HyDiff-EI): A Self-supervised Framework for Hyperspectral Image InpaintingShuo Li, Mike Davies, Mehrdad Yaghoobics.CV2026-08-27
#47Generative Semantic Scene CompletionShi Chen, Weifeng Gecs.CV2026-08-27
#48Dynamical phase selection controls compute scaling in looped transformersGunn Kimcond-mat.dis-nn2026-08-27
#49Prefix Sliding for efficient test-time scalingNiklas Muennighoff, Zhengyang Wang, Zeyi Chen +15cs.CL2026-08-26
#50$R^3$: Training Robots to Reason in Natural Language via Reinforcement LearningLehong Wu, Yuxiao Qu, Zheyuan Hu +4cs.RO2026-08-26

all trends · matching is case-insensitive substring after tokenization