PaperScope
LIVE · 2026-09-30 05:40 UTC

self-distillation 27 papers this week · +250% WoW

papers mentioning "self-distillation" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1LIFT: Layout-In-Future Video Generation under Large Viewpoint Change via On-Policy Self-DistillationShengxiang Ji, Boyang Wang, Haiyang Xu +9cs.CV2026-09-29
2AdviSD: Learning to Advise Frontier LLMs via Targeted Multi-Turn Self-DistillationRishabh Agrawal, Hejie Cui, Shasha Li +2cs.AI2026-09-29
3RS-OPSD: Reliable Privileged On-Policy-Self-Distillation for Ultra-High-Resolution Remote Sensing VQAChengjie Jiang, Yunqi Zhou, Jiafeng Yan +3cs.CV2026-09-29
#4Overcoming Scaling Limits in On-Policy Self-Distillation for LLM ReasoningMd. Ismail Hossain, Humaira Kousar, Isidora Chara Tournics.LG2026-09-29
#5Can Vision-Language Models Stay Helpful When Facing Implicit Risks? Intent-Privilege OPSD for Efficient Safety-Helpfulness AlignmentHaotian Deng, Wenbin Xing, Gang Xu +5cs.CL2026-09-29
#6Improved Distributional Diffusion ModelsTommaso Martorella, Alexandre Galashov, Felix Krause +4cs.CV2026-09-29
#7Train Ahead, Distill Back: Bootstrapping On-Policy Self-Distillation for Large Language ModelsZheng Zhang, Xinyue Tan, Lufei Li +3cs.AI2026-09-29
#8Spatial-OPSD: Self-Improving Spatial Reasoning via Label-Free Self-DistillationZhenyu Liu, Zhangquan Chen, Keyi Chen +4cs.CV2026-09-29
#9Learning from Think-Mode Advantage via On-Policy DistillationWanqi Ren, Jianxiang Wang, Danxuan Liu +2cs.CL2026-09-29
#10Beam Search as Test-Time Self-Distillation via Counterfactual ContextsSu Ee Tan, Xiaotong Ji, Rasul Tutunov +2cs.LG2026-09-29
#11EGSD: Event-Grounded Self-Distillation for Streaming Video UnderstandingYuwei Miao, Xuesheng Zhang, Wenhao Zou +5cs.CV2026-09-29
#12SIPO: Unifying Reinforcement Learning with On-Policy Self-DistillationZhenrui Yue, Huimin Zeng, Yueqi Wang +8cs.AI2026-09-29
#13Know Thyself, Teach Thyself: Internal Information Flow for Selective Self-DistillationRui Wang, Ruijie Wang, Bo Chen +2cs.LG2026-09-29
#14PR-OPD: Privileged Representation On-policy Self-Distillation for Agentic Reinforcement LearningMuyang Li, Jie Yang, Zhengyu Fang +5cs.LG2026-09-29
#15PE-OPSD: Internalizing Prompt Enhancement into Flow-matching Models via On-Policy Self-DistillationMingfeng Lin, Chengfei Cai, Lin Xu +3cs.LG2026-09-29
#16Distill Locally, Schedule Globally: Flow Maps for Few-Step Text-to-SpeechYentl Collin, Evan Dufraisse, Amr Mohamed +3cs.SD2026-09-28
#17On-Policy Self-Distillation for Multi-Turn Image EditingLiangbing Zhao, Le Zhuo, Mohamed Elhoseinycs.CV2026-09-28
#18PIVOT: Pivot-Aware On Policy Self Distillation for Multi-Turn VLM AgentsJiazhou Zhou, Hu Zhou, Yucheng Chen +3cs.CV2026-09-28
#19Rubric-Aware On-Policy Self-Distillation for LLM PersonalizationYilun Qiu, Xiaoyan Zhao, Chengbing Wang +6cs.CL2026-09-28
#20Revisit to Segment: Working Memory Distillation for Reasoning SegmentationCilin Yan, Yilun Qiu, Wanyang Zhang +4cs.CV2026-09-28
#21Can We Trust the Teacher? Decoupled Credit Direction-Magnitude for Self-DistillationYugu Li, Zehong Cao, Peizhen Li +3cs.AI2026-09-28
#22UniOPSD: Unifying Outcome and Hindsight Feedback for Agentic Reinforcement LearningZenghuang Fu, Zhaoyang Li, Qiuyuan Ai +8cs.AI2026-09-28
#23Evidence-Aligned Multimodal On-Policy Self-Distillation for Fine-Grained Visual UnderstandingNanxing Hu, Qiwei Yan, Jinchao Zhang +1cs.CV2026-09-28
#24EOPSA: Efficient On-Policy Self-Distilled Safety AlignmentQirui Liu, Yichen Sun, Yan Wang +5cs.AI2026-09-28
#25OSPD: On-Policy Self-Distillation for Persona-Consistent DialogueRui Xu, Yikai Zhang, Aili Chen +3cs.AI2026-09-28
#26One Rollout Is All You Get: Fully Test-Time Adaptation for GUI AgentsZiqiang Wang, Li Gu, Zhixiang Chi +6cs.LG2026-09-28
#27K-OPSD: Verifiable On-Policy Self-Distillation for Post-Training Vision-Language Models on AEC DrawingsYunfei Bai, Enrico Chionna, Akash Amol +2cs.AI2026-09-28
#28SCOPD: Sparse-Context On-Policy Self-Distillation for Efficient Vision-Language ModelsAhmadreza Jeddi, Enming Zhang, Jasper Gerigk +12cs.CV2026-09-28
#29Fisher-Informed Recalibration for Feedback-Based On-Policy Self-Distillation of LLMsSeohyun Lee, Dong-Jun Han, Seyyedali Hosseinalipour +1cs.LG2026-09-27
#30GroupMask: Layer-Adaptive Group-wise Sparsity for Semi-Structured LLM PruningZhengao Li, Shuoqiu Li, Xiaofang Zhang +7cs.LG2026-09-27
#31Faster Block-Diffusion Serving with Distribution-Free Risk GuaranteesJungseob Lee, Dongyub Jude Lee, Chanjun Park +2cs.CL2026-09-27
#32Grounding Memory Summarization in Utility IntentZhenyu Lei, Mingjia Shi, Xingbo Fu +3cs.CL2026-09-27
#33TTRSD: Test-Time Reinforcement Learning with Self-Distillation for Vision-Language ModelsShuning Wang, Zhiheng Wu, Xun Zhou +8cs.CV2026-09-27
#34Beyond Timestamps: Decision-Aligned On-Policy Distillation for Long-Horizon AgentsMingju Chen, Can Lv, Jinrong Liu +3cs.LG2026-09-27
#35Calibration, Not Answer Selection: Distilling Internal Confidence in Reasoning ModelsYadong Xi, Rongsheng Zhang, Tangjie Lv +2cs.CL2026-09-27
#36Teach Yourself Where to Look: On-Policy Attention Self-Distillation for ReasoningSafaeid Hossain Arib, Rabeya Akter, Ismam Nur Swapnil +3cs.LG2026-09-27
#37SeOPD: Self-Evolving LLMs via Online Policy Distillation from Self-Generated Chain-of-ThoughtXiaoshu Chen, Xiangyu Wong, Sihang Zhou +2cs.AI2026-09-27
#38X-Tree: Tokenizing Reusable Experience for Efficient Agent GeneralizationSitao Cheng, Xunjian Yin, Zhiyuan Sun +4cs.AI2026-09-26
#39IGSD: Environment-Verified Hindsight Self-Distillation for Search AgentsAngqing Jiang, Gaoming Zhang, Chaoqun Zhang +5cs.AI2026-09-26
#40MM-OPD: Towards One More Bottleneck Between Perception and ReasoningJintao Tong, Yujing Lou, Zhanming Shen +6cs.CV2026-09-26
#41Learning from a Thoughtful Teacher: Adaptive On-Policy Self-Distillation for Mathematical ReasoningJiacheng Du, Weiwei Xie, Tianyi Du +3cs.AI2026-09-26
#42Learning an Anchored Prompt Space for Continual Adaptation of Large Language ModelsRongguang Ye, Zhan Zhuang, Yichen Wu +2cs.CL2026-09-26
#43Fewer Tokens, More Self-Teaching: On-Policy Self-Distillation for Extreme Visual Token ReductionJunxian Li, Ruixuan Yang, Tianao Zhang +3cs.CV2026-09-26
#44User Model Extraction via Belief Self-DistillationAli Holmov, Yiran Huang, Kirill Bykov +1cs.LG2026-09-25
#45TISD: On-Policy Self-Distillation with Trajectory InterventionTaeckyung Lee, Rinat Amankos, Jeonghye Kim +3cs.AI2026-09-25
#46Recursive Self-Improvement via On-Policy Distillation for ReasoningShangjian Yin, Zehao Zhao, Kavosh Asadi +7cs.CL2026-09-25
#47From Self-Distillation to Self-Practice: Privileged Information for Multi-Turn AgentsXingyu Su, Abhishek Kumar, Qing Ping +5cs.AI2026-09-24
#48Learn How to Act from Your Own Interactions: On-Policy Self-Distillation for GUI AgentsYan Zhang, Daiqing Wu, Huawen Shen +7cs.AI2026-09-23
#49BAS-OPD: Budget-Aware Selective On-Policy Self-Distillation for Fine-Grained Multimodal PerceptionZihan Chen, Hengguang Zhou, Yuan Kang +5cs.CV2026-09-22
#50What Should a Self-Teacher See? Privileged Context Design for On-Policy Self-DistillationKanghui Tian, Siyuan Liu, Tianxiang Jiang +8cs.LG2026-09-22

all trends · matching is case-insensitive substring after tokenization