PaperScope
LIVE · 2026-09-18 05:40 UTC

policie 14 papers this week · +88% WoW

papers mentioning "policie" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1Workspace Models: Lightweight Robotic Memory via Saliency-Driven SupervisionNitish Dashora, Douglas Chen, Idan Shenfeld +3cs.RO2026-09-17
2GeoAAC: Geometry-Based Adaptive Action Chunking from Denoising Trajectories in VLA PoliciesXin Chen, Sen Chen, Yujuan Ding +5cs.RO2026-09-17
3Agile-WAM: An Agile Tactile World Action Model for Contact-Rich Robot ControlHanchu Zhou, Brendan Lynch, Raman Goyal +4cs.RO2026-09-17
#4OPTED: On-Policy Fine-Tuning for End-to-End Driving using a Render-Free TeacherDamiano Da Col, Maximilian Igl, Peter Karkus +5cs.RO2026-09-17
#5MILER: Semantic Mid-Level Representation for Sim-to-Real Reinforcement Learning in Unstructured Autonomous DrivingThomas Steinecker, Denis Trescher, Alexander Bienemann +2cs.RO2026-09-17
#6Learning Foresight without Explicit Trajectories for 3D Diffusion PoliciesZhongbo Zhang, Zaibin Zhang, Yifan Wang +3cs.RO2026-09-17
#7UniPolicy: Unified Objective-Specific Policies for Generative Search AdvertisingKun Yao, Yuhang Zhou, Yichi Zhang +6cs.CL2026-09-17
#8INSPECT: Learning Robot View Selection from Assistant UseDi Wen, Kailun Yang, Wenhao Guo +7cs.RO2026-09-17
#9Accelerating Visual Policy Learning with Sampling-Based Model Predictive ControlYilang Liu, Haoxiang You, Qian Wang +2cs.RO2026-09-17
#10Mitigating Retaliatory Algorithmic Collusion in Repeated GamesKarthik Sivachandran, Rohan Palejacs.LG2026-09-17
#11Model-based Bootstrap for Offline Policy Evaluation in Tabular Reinforcement LearningWeiwei Wang, Yuqiang Li, Xianyi Wu +1stat.ML2026-09-17
#12MaskHarness-WAM: Instance-Grounded Harnessing for Long-Horizon Robot ManipulationZitai Huang, Taiyi Su, Jian Zhu +6cs.RO2026-09-17
#13Learning and Transferring Closed-Loop Robot SoftwareSo Kuroki, Yujin Tangcs.RO2026-09-17
#14Improving Cross-embodiment Transfer in Latent Action Models with Action-Similarity SupervisionMaxime Alvarez, Renzo Caballero, Tatsuya Matsushima +2cs.RO2026-09-17
#15UniExo: Unified Multi-Skill Policies for Musculoskeletal Locomotion and Co-Adaptive Exoskeleton ControlYifei Yuan, Jakob Wolf, Ghaith Androwis +1cs.RO2026-09-17
#16Beyond Patch Removal: Persistent Adversarial Effects in Vision-Language-Action PoliciesEnhao Wu, Fusen Guo, Yuxin Cao +3cs.CV2026-09-17
#17A Policy Profile for Croissant: Refusal as a Property of the DatasetAlexander Chernovcs.LG2026-09-17
#18Reach or Solve? Attributing Agentic RL Gains with Checkpoint HandoffsXuan Liu, Jingbin Qiancs.AI2026-09-17
#19Agentic AI Networking for Heterogeneous Unmanned Aerial Systems in Low-Altitude Wireless NetworksNguyen Duc Minh Quang, Chang Liu, Shuangyang Li +1cs.AI2026-09-17
#20GLAMDRING: Gait Learning And Morphology co-Design via Reinforcement LearnING of CPGsAmogh Joshi, Kaushik Roycs.RO2026-09-16
#21Predict Before You Deploy: Offline Prediction of Quantization-Induced Task Degradation for World Action ModelsJiuyi Xu, Jinjia Guo, Meida Chen +2cs.RO2026-09-16
#22Stable Policy LearningHarvey Barnhard, Giacomo Opocher, Rahul Singhecon.EM2026-09-16
#23Improving Offline Goal-Conditioned Reinforcement Learning via Selective Reward StimulationJing Zhangcs.LG2026-09-16
#24From Rollout to Reset: A Graph-Based Harness for Autonomous Long-Horizon Manipulation EvaluationJing Jiang, Yue Yang, Xinkai Jiang +3cs.RO2026-09-16
#25Efficient Nash Equilibrium Computation for Cybersecurity GamesMichael Lanier, David Farmer, Yevgeniy Vorobeychikcs.GT2026-09-16
#26In-Context Robot Learning with VLM AgentsDongzhou Cheng, Taoran Yi, Ye Fang +12cs.CV2026-09-16
#27Dreaming the Sound of Contact: Leveraging Video and Audio Generation for Zero-Shot Force-Aware Manipulation and Data GenerationGuanhua Ji, Tianyu Li, Dayoon Suh +3cs.RO2026-09-16
#28rMuscle: Robotic Muscle Memory for Efficient Vision-Language-Action Model InferenceKaijun Zhou, Zhiyang Li, Le Chen +1cs.RO2026-09-16
#29Compositional Policy Violations: When Step-Level Compliance Fails In Agentic AI WorkflowsAshwini Kurady, Sri Sai Charith Grandhi, Rajesh Gupta +1cs.AI2026-09-16
#30A Convergence Framework for Deep $V$-Learning: Error Propagation and Sharp Action-Gap BoundsYury Kolomeytsevcs.LG2026-09-16
#31CERA-MoA: Co-Evolving Routing Mechanisms with Continually Learning LLM AgentsJiaxuan Jiang, Liyuan He, Zhixuan Fangcs.AI2026-09-16
#32FRAUDSkill: Structured Frozen-Weight Skill Optimization for Audio Anti-Fraud DetectionChengxian Hu, Zhiming Ma, Mingjun Pan +9cs.SD2026-09-16
#33The Uneven Impact of Generative AI on Student Learning: Examining the Roles of Reliance, Evaluation Literacy, and Course Policy in AI-related CoursesLydia Manikonda, Mei Si, Sirajam Munira +2cs.AI2026-09-16
#34VLA-ULAP: Interleaving Cloud VLA Calls with Ultra-Lightweight Local Action Prediction at the EdgeDeyu Cao, Ryuji Oi, Kosuke Matsushima +4cs.RO2026-09-16
#35A Geometric Theory of Decision Boundaries in Structured Markov Decision ProcessesFredy Pokoucs.LG2026-09-16
#36WetRobo: A Reproducible Robot Kit for Coding Agents in Biological LaboratoriesYuna Oikawa, Kei Endo, Takanori Uzawa +5cs.AI2026-09-16
#37Position: It is Time to Virtualize Foundation Models with a Self-evolving Operating System LayerSuparna Bhattacharya, Tarun Kumar, Cong Xu +7cs.AI2026-09-16
#38Autonomy in Check: Governor-Mediated Adaptive Security at the EdgeIjaz Ahmad, Ijaz Ahmad, Flavio Esposito +1cs.CR2026-09-16
#39Visual Compliance via Executable Safety Rule EntailmentJisoo Kim, TaeYoon Kwack, Jinwoo Jang +1cs.AI2026-09-16
#40APGEM: Adaptive Policy-Guided Error Mitigation for Quantum Reinforcement Learning on a Real-World CVRP Case StudyShabir Ahmad Sofi, Bisma Majid, Mir Mohammad Yousufcs.LG2026-09-16
#41Reinforcement Learning for Real-Time Vision-Language-Action PoliciesPerry Dong, Kuo-Han Hung, Dorsa Sadigh +1cs.RO2026-09-16
#42A Comprehensive Review of Generative Physical Artificial IntelligenceSatyam Gaba, Krutiksinh Rana, Siva Sai +2cs.RO2026-09-16
#43Contiguity, Not Importance: Budgeted Repair of Stale KV Caches After Document EditsMingyang Mao, Wyatt Mackey, Xiaomin Lincs.AI2026-09-16
#44When to Call an LLM: A Confidence-Gated Hybrid for Cost-Effective Emotion Recognition in Conversational AISai Babu Udayagiri, Arjun Chouhan, Ravisekhar Kanagala +1cs.AI2026-09-16
#45Do Frontier Models Seek Safety Evidence Before Acting?Omer Tafveezcs.AI2026-09-15
#46Adaptive hybrid coupling with operator inference, the overlapping Schwarz alternating method and reinforcement learningTrishit Mondal, Irina Tezaur, Anthony Grubercs.LG2026-09-15
#47Learning Multi-Humanoid Pickup and Transport via Decentralized Object-Centric ControlBikram Pandit, Mohitvishnu S. Gadde, Aayam Kumar Shrestha +1cs.RO2026-09-15
#48FairCompressAgent: An Agentic Framework for Fairness-Aware Model Compression for FPGA DeploymentYuanbo Guo, Yiyu Shics.AI2026-09-15
#49CALOS: Control-Affine Lyapunov On-manifold Safety Layer for Safe Deep Reinforcement Learning for QuadrotorsFabrizio Cesareo, Sebastiano Mengozzi, Nicola Mimmo +1cs.RO2026-09-15
#50REVERSAL-BENCH: A Reversibility Axis and Reset Oracle for Measuring the Reset-Free RL CliffRiyaaz Shaik, Chandru Venkataramancs.LG2026-09-15

all trends · matching is case-insensitive substring after tokenization