PaperScope
LIVE · 2026-09-03 05:40 UTC

distillation 24 papers this week · -29% WoW

papers mentioning "distillation" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1SolarWM: Open Data and Scalable Training for Long-Horizon Video World ModelsJunchao Huang, Guian Fang, Shengju Qian +15cs.CV2026-09-02
2Cliff: Learning Process Rewards from the First MistakePeixuan Han, Runhui Wang, Ketan Ramaneti +3cs.LG2026-09-02
3EarlyEval: Cheaper Agent Evaluation via Early Outcome PredictionYuling Shi, Zhensu Sun, Junsen Dong +3cs.CL2026-09-02
#4Measurement-Driven Sub-Network Selection for On-Premise Retrieval-Augmented Factory AgentsVasileios Rizeakos, Georgios Paisios, Alexandros Machairas +2cs.AI2026-09-02
#5Repo-To-Skill: Distilling GitHub Repositories Into AI4AI SkillsJianlyu Chen, Yuyang Hu, Hongjin Qian +8cs.AI2026-09-02
#6Learn from Whoever Is Right: Answer-Verified Multi-Teacher Distillation for Multi-Domain LLMsXixiang He, Xingming Li, Baiqi Wu +4cs.LG2026-09-02
#7CA-OPD: Confidence-Aware On-Policy Distillation for Structured Visual PredictionMenghao Li, Linjie Mu, Yin Wang +4cs.CV2026-09-02
#8APEx: Distillation of Agent Procedural Experience for Adaptive Deep Research Question AnsweringJie Ding, Rui Sun, Xinyuan Zhang +2cs.AI2026-09-02
#9SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution TransitionTingyan Wen, Chenqian Yan, Xurui Peng +4cs.CV2026-09-02
#10Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone DistillationWenhui Chen, Zhifeng Li, Jie Zhou +5cs.LG2026-09-02
#11Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning NetworkLucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4cs.LG2026-09-01
#12On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following RerankersVignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipallics.LG2026-09-01
#13Cross-Model Distillation of a Human-Pose Foundation Model from Unannotated Infant Video for Markerless 3D Pose EstimationR. James Cotton, Divya Joshi, Colleen Peytoncs.CV2026-09-01
#14hLLM: Single Pass Decoding for Generative RerankingEmil Laftchiev, Prachi Agrawal, Moe Kayali +7cs.LG2026-09-01
#15Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM TeachersGiovanni Bonetta, Matteo Merler, Davide Zago +2cs.AI2026-09-01
#16Knowledge Distillation During Mid-Training Favors Reasoning over Factual RecallJacqueline He, Howard Yen, Shuyue Stella Li +9cs.CL2026-09-01
#17From Rollouts to Recipes: Self-Contained Post-Training for LLMsYifei Li, Lingling Zhang, Muye Huang +3cs.CL2026-09-01
#18Making Prospective Memory SLM-Shaped: Typed Intention Stores for Small-Model AgentsJinqing Zhao, Chengcan Wucs.AI2026-09-01
#19Position Matters: Feature Inversion Attacks in ViT Split Inference with Token Reduction and ShufflingStefano Leggio, Giulio Rossolini, Alessandro Biondics.CR2026-09-01
#20Subliminal Learning as Trait-Direction Drift: A Mechanism and Targeted Control under SFT DistillationZhixuan Liu, Zhichen Dong, Yuyu Fan +2cs.LG2026-09-01
#21ARISE-RL: Agentic Rubric-Grounded Iterative Self-Evolution with Reinforcement LearningFanrui Zhang, Ruixue Ding, Qiang Zhang +13cs.AI2026-09-01
#22ViTAMINS: An Empirical Study of Training Self-Supervised Vision Transformers with Synthetic Hard NegativesNikos Giakoumoglou, Andreas Floros, Kleanthis-Marios Papadopoulos +1cs.CV2026-09-01
#23HELIOS: From midnight to noon, continuous outdoor urban scene relightingHala Djeghim, Nathan Piasco, Luis Roldão +4cs.CV2026-09-01
#24MemoryWalker: Stop Training Agents on Contexts They Never SawZinco J, Xunjie Zhu, Shen Huang +3cs.LG2026-09-01
#25Instella-MoE Technical ReportJiang Liu, Sudhanshu Ranjan, Prakamya Mishra +10cs.CL2026-09-01
#26Solaris: Towards Interfaces That Are Generated, Not CodedYuval Alaluf, Omri Avrahami, Guy Bukchin Leshem +18cs.CV2026-09-01
#27A Closed-Loop Evaluation of Capability Loss and Recovery in Compressed Driving PoliciesAhmad Alfan Alfian Irfan, Nur Ahmad Khatim, Mansur Ariefcs.AI2026-09-01
#28A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 SolverHaobo Ma, Wenlin Zhang, Manuel Israel Cázarescs.CL2026-09-01
#29SciTrue: Reliable Scientific Claim Validation with Frontier and Open Language Models at the NTCIR SciClaimEval TaskQiming Bao, Neşet Özkan Tan, Siyuan Wang +1cs.AI2026-09-01
#30Panda Diplomacy: Foundation Model Pre-training across Particle Imaging Detectors for High Energy and Nuclear PhysicsSamuel Young, César Jesús-Valls, Kazuhiro Teraohep-ex2026-09-01
#31CRAD: Class-wise Reliability-Aware Distillation for Decentralized Heterogeneous Federated LearningBaraa Bilbeisi, Mengchen Fan, Baocheng Geng +1cs.LG2026-08-31
#32Hypotheses-Guided Self Distillation for Continual PersonalizationEunJeong Hwang, Kushan Mitra, Dan Zhang +2cs.AI2026-08-31
#33A Lagrangian View of Flow MatchingPeyman Milanfarcs.CV2026-08-31
#34LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware EngineeringGopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1cs.SE2026-08-31
#35Reconciling Process Supervision with Outcome-Based Credit in Agentic Policy OptimizationJingxiao Yang, Wangjie Gan, Yingxuan Zhuang +3cs.AI2026-08-31
#36Identity-Conditioned Latent Consistency Distillation for Face SynthesisTiago Kienen Chaves, Bernardo Biesseck, David Menottics.CV2026-08-31
#37Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-ImprovementYi Ding, Ruqi Zhangcs.LG2026-08-31
#38Uncertainty-Aware Trajectory Forecasting from Imperfect TrackingStephane Da Silva Martins, Victor Petrovic, Emanuel Aldea +1cs.CV2026-08-31
#39VCAR: Training-Free 3DGS Segmentation via View Completeness and Axis-Aware Boundary RefinementKun Cao, Di Wang, Haibin Zhu +4cs.CV2026-08-31
#40PRACTICE: From Experience to Expertise in Self-Evolving Embodied AgentsZiyi Bai, Siqi Li, Tinglei Huang +1cs.LG2026-08-31
#41Learning from What You Retrieve: Online RL Fine-Tuning for Semantic RetrievalShaowei Wei, Chong Huang, Songtao Fang +3cs.IR2026-08-31
#42Tracing distinguishability through transformer processing with stochastic LayerNormKieran Murphycs.LG2026-08-31
#43Modality Disentangled Learning for Incomplete Multimodal Emotion Recognition: A Primitive Memory Distillation PerspectiveJiaqi Zhang, Zheng Pang, Mengting Li +9cs.CV2026-08-31
#44Stratified Consistency Distillation for Natural Language FormalizationZhichao Hou, Ferhat Erata, Joe Lilien +1cs.CL2026-08-31
#45Aligning Multi-Trajectory Supervision with Policy Optimization for VLA DrivingTian Zhang, Zhuo Huang, Hongrui Ye +3cs.CV2026-08-31
#46Biomechanical 3D Body: Self-Supervised Distillation of Biomechanical Pose from a 3D Body Foundation ModelR. James Cotton, J. D. Peiffer, Lucinda Williamson +2cs.CV2026-08-30
#47Matrix-Game 3.5: Enhancing Real-Time Streaming Interactive World Models with Patch MemoryRunjia Qian, Zile Wang, Jihai Zhang +14cs.CV2026-08-30
#48When History Is Multimodal: Rethinking Context Management for Long-Horizon AgentsJiaqi Su, Cong Pang, Jiawei Hong +4cs.CL2026-08-30
#49Improving Argument Saliency Coverage in Small LLMs for Long Legal Opinion Summarization via Sequence-Level DistillationMohamed Elaraby, Ahmed Elhady, Diane Litmancs.CL2026-08-30
#50Influence-Directed Distillation: Solving the Diversity Bottleneck in Sampled-Token On-Policy DistillationRun Yang, Runpeng Dai, Jie Sun +5cs.CL2026-08-30

all trends · matching is case-insensitive substring after tokenization