| 1 | Bilevel Coordinated Reflection: A Game-Theoretic Approach to Multi-Agent LLM Systems | Yihang Chen, Yuxiang Chen, Yuxuan Huang +3 | cs.AI | 2026-09-02 |
| 2 | VIPS: Vehicle-Infrastructure Cooperative Planning Benchmark via Pseudo-Simulation | Hoonhee Cho, Jae-Young Kang, Giwon Lee +3 | cs.CV | 2026-09-02 |
| 3 | Codebook Agent: Amortized Topology Design for LLM Multi-Agent Systems | Jinxi Yu, Yubei Li, Eric Hanchen Jiang +6 | cs.AI | 2026-09-02 |
| #4 | RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic Evolution | Zijian Zhao, Sen Li, Xialiang Tong +1 | cs.MA | 2026-09-02 |
| #5 | Examining the Vulnerability of Multi-Agent Medical Systems to Human Interventions for Clinical Reasoning | Benjamin C Liu, Dillon Mehta, Rishi Malhotra +7 | cs.AI | 2026-09-02 |
| #6 | MASkills: Continual Skills Optimization for Multi-Agent LLM Systems | Huaiyuan Yao, Xiaoou Liu, Charles Fleming +2 | cs.AI | 2026-09-02 |
| #7 | Beyond Outcome Gaps: Process-Aware Fairness Diagnosis for LLM-based Multi-Agent Decision Systems | Yiran Zhao, Lu Zhou, Liming Fang +4 | cs.AI | 2026-09-02 |
| #8 | InsightSeg: Reusing Correction Insights for Guideline-Consistent Segmentation | Vanshika Vats, Ashwani Rathee, James Davis | cs.CV | 2026-09-02 |
| #9 | NS-Copilot: An LLM-Driven Agent System for Autonomous Neuroscience Analysis | Wuche Liu, Yiran Qiao, Linlin Hou +4 | cs.CL | 2026-09-02 |
| #10 | Grounded, Compute-Efficient LLM Policy Agents for Energy-Poverty Equity in Physically-Constrained Peer-to-Peer Energy Markets | Kunal Jadhav, Siddhesh More | cs.CL | 2026-09-01 |
| #11 | Epistemic Sybil Resistance: Multiplying AI Agents Without Multiplying Evidence | Marc Bara | cs.AI | 2026-09-01 |
| #12 | Agents That Model Agents: Five Principles Toward a Theory of Mind for 6G Networks | Hatim Chergui, Carolina Fernández-Martínez, Mehdi Bennis +1 | cs.NI | 2026-09-01 |
| #13 | NashDreamer: Model-Based Reinforcement Learning for Zero-Sum Imperfect-Information Games | Tomáš Holeček, Viliam Lisý | cs.LG | 2026-09-01 |
| #14 | GlossoGen: Emergent Language in Complex Multi-Agent LLM Interactions | Elias Stengel-Eskin, Newton Sander, Carlos Bonetti +4 | cs.CL | 2026-09-01 |
| #15 | EDGE: Error Dependency Graph-Guided Multi-Error Attribution in Multi-Agent LLM Systems | Jun Hou, Priya Pitre, Yi Fang +1 | cs.AI | 2026-09-01 |
| #16 | Explore More, Drift Less: Outcome-Only Reinforcement Learning Can Suffice for Long-Horizon Interactive Agents | Liming Pu, Xiaoxia Li, Yifu Liu +2 | cs.LG | 2026-09-01 |
| #17 | Jailbreaking Text-to-Image Models Through Cracks: Navigating Heterogeneous Safety Filters via Multi-Agent Debate | Kaiyan Wen, Shijie Zhang, Lu Yu +1 | cs.AI | 2026-09-01 |
| #18 | Figures as Programs: Recursive Generation of Editable Scientific Figures | Yepeng Liu, Dasen Dai, Chengzhi Liu +7 | cs.AI | 2026-09-01 |
| #19 | Reinforcement Learning Enhanced LLM Agents for Complex Vehicle Routing Problems | Yi Chen, Zikang Yu, Jiahai Wang +3 | cs.AI | 2026-09-01 |
| #20 | RingMoClaw: An Experience-Inspired Multi-Agent Framework for Self-Evolving Research in Remote Sensing | Kaiyue Kang, Qixuan He, Peijin Wang +9 | cs.CV | 2026-09-01 |
| #21 | Compile, Don't Memorize: A Context Compilation Architecture (CCA) for In-Context Learning | Jinhu Qi, Minda Hu, Wentao Zhang +4 | cs.CL | 2026-09-01 |
| #22 | ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything | Yufan Dang, Shu Yao, Bowen Lai +6 | cs.AI | 2026-09-01 |
| #23 | Creative Generation via Multi-Agent Debate: Does Debate Suppress Diversity? | Tien Anh Nguyen, Khanh-Binh Nguyen, Van Dai Do +2 | cs.CL | 2026-09-01 |
| #24 | Control-Data Flow Separation: Stable Prompt Optimization in Multi-Agent LLMs | Wentao Zhang, Syed Shariyar Murtaza, Junaid Ahmad Bhatti +4 | cs.AI | 2026-09-01 |
| #25 | SoK: When Safe Agents Fail Together: The Security of Multi Agent LLM Systems | Rui Yang, Junjie Xu, Zhengyu Liu +4 | cs.CR | 2026-09-01 |
| #26 | GeoPAR: Large-Scale Multi-Agent Combinatorial Optimization with Geometry-Guided Parallel Autoregressive Learning | Wenjian Wu, Zesheng Jia, Jiaying Tang +2 | cs.LG | 2026-09-01 |
| #27 | VoiceLongMemEval: Do Assistants Remember How You Sounded? | Ramit Pahwa, Parivesh Priye, Apoorva Beedu | cs.AI | 2026-09-01 |
| #28 | Independent Reinforcement Learning in Discounted Markov Games | Asrin Efe Yorulmaz, Ugur Aydin, Tamer Basar | cs.GT | 2026-09-01 |
| #29 | SpecMind: Enabling Spectrum Intelligence via Multi-Agent Hybrid Retrieval-Augmented Generation | Songwei Dong, Bingyan Lu, Makayla Kienlen +2 | cs.AI | 2026-08-31 |
| #30 | RestoreBench: Can AI Agents Restore Power Flow Convergence? | Riccardo Mansutti, Andrea Pomarico, Robert Jakob +3 | cs.AI | 2026-08-31 |
| #31 | Delegation Without Trust: An Empirical Gap Analysis of Identity, Authorization, and Runtime Governance in Multi-Agent LLM Systems | Panduranga Sai Varma Dantuluri, Jyotirmoy Sundi | cs.CR | 2026-08-31 |
| #32 | Learning What to Retain: Gated-Memory Routing for Efficient Collaboration in Multi-Agent LLM Systems | Rakibul Hasan Rajib, Mengxing Zheng, Qian Lou | cs.AI | 2026-08-31 |
| #33 | ConvDeck: Conversational Paper-to-Slide Generation via Stage-Specific User Feedback | Tarik Can Ozden, Sachidanand VS, Furkan Horoz +4 | cs.AI | 2026-08-31 |
| #34 | Distributed Implicit Harm: A Compositional Safety Blind Spot in MLLM-Based Video Moderation | Ruotong Wang, Zihao Zhu, Siwei Lyu +2 | cs.CV | 2026-08-31 |
| #35 | Provably Efficient Federated Reinforcement Learning with Linear Function Approximation and Logarithmic Communication Cost | Zihang Liang, Haochen Zhang, Lingzhou Xue | stat.ML | 2026-08-31 |
| #36 | Deploying and Evaluating a Smart-Agriculture Agentic Engine for Full-Season Soybean Farm Operations | Ao Qu, Panagiotis Michelakis, Linyuan Han +8 | cs.AI | 2026-08-31 |
| #37 | DIASENTINEL: An Auditable Multi-Agent System for Guideline-Grounded Diabetes Risk Screening | Yung Wei Shueh, Zhi-Jie Chen, Chia-Hsuan Hsu +9 | cs.CL | 2026-08-31 |
| #38 | A Universal Context-Reuse Layer for Cross-Model KV Sharing | Yi Li, Dongming Jiang, Yi Zhao +1 | cs.LG | 2026-08-31 |
| #39 | TRIPPULSE: Multi-Agent Travel Planning with Review-Grounded Reasoning | Priyanshu Karmakar, Borru Vijay Sai, Shubhojit Mallick +3 | cs.CL | 2026-08-31 |
| #40 | CLIN: an Objective Framework for Evaluating Creativity in Short Persian Literary Text | Mohammad Reza Modarres, Armin Tourajmehr, Yadollah Yaghoobzadeh +1 | cs.CL | 2026-08-31 |
| #41 | SocialReasonBench: A Video-QA Benchmark for Social Reasoning with Counterfactual Narrative Videos | Zheyu Huang, Zijing Shi, Haozhe Luo +4 | cs.CL | 2026-08-31 |
| #42 | HiRS-Agent: A Hierarchical Multi-Agent System for Reliable Long-Horizon Remote Sensing Task Solving | Boyang Mu, Zhiwei Wei, Mugen Peng +1 | cs.AI | 2026-08-31 |
| #43 | SwarmBench: Can Large Language Models Act as Agent Swarm Orchestrators? | Jinshan Gao, Zhuoran Jin, Tianyi Men +2 | cs.CL | 2026-08-31 |
| #44 | CM2: Multimodal Cultural Reasoning via an Integrated Multi-Agent Framework | Qi Li, Zhaojie Kang, Yingjie He +6 | cs.AI | 2026-08-31 |
| #45 | Lies We Can See: Joint Verbal and Non-Verbal Deception by VLM Agents in Embodied Social Interactions | Jaewoo Ahn, Junseo Kim, Hyunseo Kim +4 | cs.CL | 2026-08-31 |
| #46 | Using Grounded Theory for Agent Behavior Analysis at Scale | Zhuoran Lu, Yangyang Yu, Zhuoyan Li +5 | cs.CL | 2026-08-31 |
| #47 | Beyond Consensus: Downward Bias and Role Asymmetry in Multi-Agent LLM Judges for Subjective Evaluation | Minsoo Song, Chanwoo Kim, Sugyeong Eo +1 | cs.CL | 2026-08-31 |
| #48 | PaperBanana-Interact: Scientific Diagram Refinement with Multi-Turn Human Feedback | Xueqing Wu, Ashwin Balasubramanian, Bingxuan Li +7 | cs.CL | 2026-08-31 |
| #49 | FaVOR: LLM-Based Agentic Framework for Factor Mining via Empirical Validation | Hyeonjin Kim, Minseok Kim, Seunghyeon Jung +3 | cs.AI | 2026-08-31 |
| #50 | FRAMEWORKERS: A Dynamic Multi-Agent Framework for AI-Generated Video Production | Zhendong Li, Lei Sun, Letian Shi +8 | cs.AI | 2026-08-30 |