| 1 | SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models | Junchao Huang, Guian Fang, Shengju Qian +15 | cs.CV | 2026-09-02 |
| 2 | Cliff: Learning Process Rewards from the First Mistake | Peixuan Han, Runhui Wang, Ketan Ramaneti +3 | cs.LG | 2026-09-02 |
| 3 | EarlyEval: Cheaper Agent Evaluation via Early Outcome Prediction | Yuling Shi, Zhensu Sun, Junsen Dong +3 | cs.CL | 2026-09-02 |
| #4 | Measurement-Driven Sub-Network Selection for On-Premise Retrieval-Augmented Factory Agents | Vasileios Rizeakos, Georgios Paisios, Alexandros Machairas +2 | cs.AI | 2026-09-02 |
| #5 | Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills | Jianlyu Chen, Yuyang Hu, Hongjin Qian +8 | cs.AI | 2026-09-02 |
| #6 | Learn from Whoever Is Right: Answer-Verified Multi-Teacher Distillation for Multi-Domain LLMs | Xixiang He, Xingming Li, Baiqi Wu +4 | cs.LG | 2026-09-02 |
| #7 | CA-OPD: Confidence-Aware On-Policy Distillation for Structured Visual Prediction | Menghao Li, Linjie Mu, Yin Wang +4 | cs.CV | 2026-09-02 |
| #8 | APEx: Distillation of Agent Procedural Experience for Adaptive Deep Research Question Answering | Jie Ding, Rui Sun, Xinyuan Zhang +2 | cs.AI | 2026-09-02 |
| #9 | SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution Transition | Tingyan Wen, Chenqian Yan, Xurui Peng +4 | cs.CV | 2026-09-02 |
| #10 | Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone Distillation | Wenhui Chen, Zhifeng Li, Jie Zhou +5 | cs.LG | 2026-09-02 |
| #11 | Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning Network | Lucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4 | cs.LG | 2026-09-01 |
| #12 | On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following Rerankers | Vignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipalli | cs.LG | 2026-09-01 |
| #13 | Cross-Model Distillation of a Human-Pose Foundation Model from Unannotated Infant Video for Markerless 3D Pose Estimation | R. James Cotton, Divya Joshi, Colleen Peyton | cs.CV | 2026-09-01 |
| #14 | hLLM: Single Pass Decoding for Generative Reranking | Emil Laftchiev, Prachi Agrawal, Moe Kayali +7 | cs.LG | 2026-09-01 |
| #15 | Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Teachers | Giovanni Bonetta, Matteo Merler, Davide Zago +2 | cs.AI | 2026-09-01 |
| #16 | Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall | Jacqueline He, Howard Yen, Shuyue Stella Li +9 | cs.CL | 2026-09-01 |
| #17 | From Rollouts to Recipes: Self-Contained Post-Training for LLMs | Yifei Li, Lingling Zhang, Muye Huang +3 | cs.CL | 2026-09-01 |
| #18 | Making Prospective Memory SLM-Shaped: Typed Intention Stores for Small-Model Agents | Jinqing Zhao, Chengcan Wu | cs.AI | 2026-09-01 |
| #19 | Position Matters: Feature Inversion Attacks in ViT Split Inference with Token Reduction and Shuffling | Stefano Leggio, Giulio Rossolini, Alessandro Biondi | cs.CR | 2026-09-01 |
| #20 | Subliminal Learning as Trait-Direction Drift: A Mechanism and Targeted Control under SFT Distillation | Zhixuan Liu, Zhichen Dong, Yuyu Fan +2 | cs.LG | 2026-09-01 |
| #21 | ARISE-RL: Agentic Rubric-Grounded Iterative Self-Evolution with Reinforcement Learning | Fanrui Zhang, Ruixue Ding, Qiang Zhang +13 | cs.AI | 2026-09-01 |
| #22 | ViTAMINS: An Empirical Study of Training Self-Supervised Vision Transformers with Synthetic Hard Negatives | Nikos Giakoumoglou, Andreas Floros, Kleanthis-Marios Papadopoulos +1 | cs.CV | 2026-09-01 |
| #23 | HELIOS: From midnight to noon, continuous outdoor urban scene relighting | Hala Djeghim, Nathan Piasco, Luis Roldão +4 | cs.CV | 2026-09-01 |
| #24 | MemoryWalker: Stop Training Agents on Contexts They Never Saw | Zinco J, Xunjie Zhu, Shen Huang +3 | cs.LG | 2026-09-01 |
| #25 | Instella-MoE Technical Report | Jiang Liu, Sudhanshu Ranjan, Prakamya Mishra +10 | cs.CL | 2026-09-01 |
| #26 | Solaris: Towards Interfaces That Are Generated, Not Coded | Yuval Alaluf, Omri Avrahami, Guy Bukchin Leshem +18 | cs.CV | 2026-09-01 |
| #27 | A Closed-Loop Evaluation of Capability Loss and Recovery in Compressed Driving Policies | Ahmad Alfan Alfian Irfan, Nur Ahmad Khatim, Mansur Arief | cs.AI | 2026-09-01 |
| #28 | A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 Solver | Haobo Ma, Wenlin Zhang, Manuel Israel Cázares | cs.CL | 2026-09-01 |
| #29 | SciTrue: Reliable Scientific Claim Validation with Frontier and Open Language Models at the NTCIR SciClaimEval Task | Qiming Bao, Neşet Özkan Tan, Siyuan Wang +1 | cs.AI | 2026-09-01 |
| #30 | Panda Diplomacy: Foundation Model Pre-training across Particle Imaging Detectors for High Energy and Nuclear Physics | Samuel Young, César Jesús-Valls, Kazuhiro Terao | hep-ex | 2026-09-01 |
| #31 | CRAD: Class-wise Reliability-Aware Distillation for Decentralized Heterogeneous Federated Learning | Baraa Bilbeisi, Mengchen Fan, Baocheng Geng +1 | cs.LG | 2026-08-31 |
| #32 | Hypotheses-Guided Self Distillation for Continual Personalization | EunJeong Hwang, Kushan Mitra, Dan Zhang +2 | cs.AI | 2026-08-31 |
| #33 | A Lagrangian View of Flow Matching | Peyman Milanfar | cs.CV | 2026-08-31 |
| #34 | LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering | Gopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1 | cs.SE | 2026-08-31 |
| #35 | Reconciling Process Supervision with Outcome-Based Credit in Agentic Policy Optimization | Jingxiao Yang, Wangjie Gan, Yingxuan Zhuang +3 | cs.AI | 2026-08-31 |
| #36 | Identity-Conditioned Latent Consistency Distillation for Face Synthesis | Tiago Kienen Chaves, Bernardo Biesseck, David Menotti | cs.CV | 2026-08-31 |
| #37 | Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement | Yi Ding, Ruqi Zhang | cs.LG | 2026-08-31 |
| #38 | Uncertainty-Aware Trajectory Forecasting from Imperfect Tracking | Stephane Da Silva Martins, Victor Petrovic, Emanuel Aldea +1 | cs.CV | 2026-08-31 |
| #39 | VCAR: Training-Free 3DGS Segmentation via View Completeness and Axis-Aware Boundary Refinement | Kun Cao, Di Wang, Haibin Zhu +4 | cs.CV | 2026-08-31 |
| #40 | PRACTICE: From Experience to Expertise in Self-Evolving Embodied Agents | Ziyi Bai, Siqi Li, Tinglei Huang +1 | cs.LG | 2026-08-31 |
| #41 | Learning from What You Retrieve: Online RL Fine-Tuning for Semantic Retrieval | Shaowei Wei, Chong Huang, Songtao Fang +3 | cs.IR | 2026-08-31 |
| #42 | Tracing distinguishability through transformer processing with stochastic LayerNorm | Kieran Murphy | cs.LG | 2026-08-31 |
| #43 | Modality Disentangled Learning for Incomplete Multimodal Emotion Recognition: A Primitive Memory Distillation Perspective | Jiaqi Zhang, Zheng Pang, Mengting Li +9 | cs.CV | 2026-08-31 |
| #44 | Stratified Consistency Distillation for Natural Language Formalization | Zhichao Hou, Ferhat Erata, Joe Lilien +1 | cs.CL | 2026-08-31 |
| #45 | Aligning Multi-Trajectory Supervision with Policy Optimization for VLA Driving | Tian Zhang, Zhuo Huang, Hongrui Ye +3 | cs.CV | 2026-08-31 |
| #46 | Biomechanical 3D Body: Self-Supervised Distillation of Biomechanical Pose from a 3D Body Foundation Model | R. James Cotton, J. D. Peiffer, Lucinda Williamson +2 | cs.CV | 2026-08-30 |
| #47 | Matrix-Game 3.5: Enhancing Real-Time Streaming Interactive World Models with Patch Memory | Runjia Qian, Zile Wang, Jihai Zhang +14 | cs.CV | 2026-08-30 |
| #48 | When History Is Multimodal: Rethinking Context Management for Long-Horizon Agents | Jiaqi Su, Cong Pang, Jiawei Hong +4 | cs.CL | 2026-08-30 |
| #49 | Improving Argument Saliency Coverage in Small LLMs for Long Legal Opinion Summarization via Sequence-Level Distillation | Mohamed Elaraby, Ahmed Elhady, Diane Litman | cs.CL | 2026-08-30 |
| #50 | Influence-Directed Distillation: Solving the Diversity Bottleneck in Sampled-Token On-Policy Distillation | Run Yang, Runpeng Dai, Jie Sun +5 | cs.CL | 2026-08-30 |