PaperScope
LIVE · 2026-09-03 05:40 UTC

cs.AI Artificial Intelligence · 53,333 papers

人工智能 · daily new submissions

Latestcs.CLcs.LGcs.AIcs.CV

New Papers per Day (30d)

#TitleAuthorsCatDate
1Discriminative World Models for Web AgentsKelvin Li, Dhruv Pendharkar, Anish Pahilajani +6cs.AI2026-09-02
2Towards Trustworthy Autonomous Robots: An Explainable AI-Based Decision FrameworkCagri Temelcs.RO2026-09-02
3Post-Training Language Models for Gold-Medal Performance in Coding CompetitionsAleksander Ficek, Sean Narenthiran, Mehrzad Samadi +2cs.LG2026-09-02
#4AI Contextual Measurement for Recovering Individual and Group-Level Effects: Validation Against Survey Measures and an Occupational ApplicationWenxin Jiang, Xuyang Wang, Yuxiao Wucs.AI2026-09-02
#5Large Language Models (LLMs) for Telecom Root Cause Analysis (RCA): A Structured Reasoning Framework for Evidence-Grounded DiagnosisHao Zhou, Mandar Kulkarni, Hao Chen +3cs.AI2026-09-02
#6frb100-40 After Two Decades: An Optimality Certificate and a Preregistered Search StudyOnur Uğurlucs.DM2026-09-02
#7Dutch Books for Language ModelsIsaiah Andrews, Suproteem Sarkarecon.GN2026-09-02
#8SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety AlignmentQinghua Mao, Wanying Qu, Dadi Guo +8cs.AI2026-09-02
#9From Reweighting to Rewriting: Unlocking the Intervention Effects of Influential Samples in Training Data AttributionYuzhang Luo, Chenpeng Wang, Jianhui Chen +1cs.CL2026-09-02
#10Measurement-Driven Sub-Network Selection for On-Premise Retrieval-Augmented Factory AgentsVasileios Rizeakos, Georgios Paisios, Alexandros Machairas +2cs.AI2026-09-02
#11Untangling the Mechanisms of Misleading Context in Medical Question AnsweringRobin Linzmayer, Noémie Elhadadcs.CL2026-09-02
#12Bilevel Coordinated Reflection: A Game-Theoretic Approach to Multi-Agent LLM SystemsYihang Chen, Yuxiang Chen, Yuxuan Huang +3cs.AI2026-09-02
#13Repo-To-Skill: Distilling GitHub Repositories Into AI4AI SkillsJianlyu Chen, Yuyang Hu, Hongjin Qian +8cs.AI2026-09-02
#14HiPoly: a hierarchical polymer-native AI framework for property prediction and generative designGe Sun, Gervasio Zaldivar, Yuan Tian +5physics.chem-ph2026-09-02
#15Language Models Can Control Their Own AttentionNamgyu Ho, Huzama Ahmad, Woosung Koh +3cs.CL2026-09-02
#16RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Vision-Language ModelsCanjie Liu, Jiawen Kang, Jinbo Wen +1cs.CV2026-09-02
#17Door-in-the-Face Requests and Refusal Behaviour in Large Language ModelsTil Jordancs.AI2026-09-02
#18DKL: Decoupled Knowledge Learning for Instruction-Tuned Language ModelsKushagra Bhushan, Meghanadh Pulivarthi, Sai Krishna Reddy Sathi +7cs.CL2026-09-02
#19From Tokens to Semantics: Leveraging Complementary Signals for Hallucination Detection in Black-Box LLMsUrja Pawar, Rajitha Ramanayake, Owen O'Neill +4cs.CL2026-09-02
#20Loom: Weaving Diagnostic Strands into Free-Text Consensus via Embedding-Space ReweightingRon Begleiter, Katya Egert Berg, Gilad Saban +1cs.AI2026-09-02
#21TaRA: Training-Aware Low-Rank Adaptation InitializationTaehyeon Kim, Eunhyeok Parkcs.CL2026-09-02
#22Automated Vulnerability Injection in Smart Contracts Using Large Language ModelsLuca Migliaccio, Roberto Natella, Naghmeh Ivaki +2cs.SE2026-09-02
#23Collective creativity in hybrid societiesMason Youngblood, Katie Mudd, Manuel Anglada-Tort +4cs.AI2026-09-02
#24Competitive Market Behavior of LLMsPawel Struski, Jakub Swistak, Inez Okulska +1cs.MA2026-09-02
#25ProbeMatchDTI: Probe-Driven Multi-Scale Biochemical Pattern Matching for Drug-Target Interaction PredictionQuan Hao, Mengyue Fan, Zifan Dong +8cs.LG2026-09-02
#26Learn from Whoever Is Right: Answer-Verified Multi-Teacher Distillation for Multi-Domain LLMsXixiang He, Xingming Li, Baiqi Wu +4cs.LG2026-09-02
#27Fine-Grained Anomaly Perception in Wild UGC-Enhanced Images: A Comprehensive Dataset and Difference-Fusion FrameworkYan Zhong, Gefei Chen, Qiufang Ma +4cs.CV2026-09-02
#28Spectral Initialization and Scheduled Graph Smoothness for Uncertain Knowledge Graph CompletionMd Abrar Jahin, Taufikur Rahman Fuad, Jay Pujara +1cs.LG2026-09-02
#29Blending Concepts: Benchmarking Visual Metaphor Generation in Text-to-Image ModelsChuer Chen, Zichen Wang, Yi He +2cs.CV2026-09-02
#30RINSE: Robust Target-Time Normality Estimation for Zero-Shot Graph Anomaly DetectionTaufikur Rahman Fuad, Md Abrar Jahin, Amir Hussaincs.LG2026-09-02
#31ViSAR: Training-Free Adaptive-$k$ Retrieval for Visual Document Question AnsweringAdrien Mialland, Marc Plantevit, Julien Gallois +1cs.IR2026-09-02
#32DeepAffinity: Long-Term Aspect Preference Prediction in eCommerce using Small Language ModelsYotam Eshel, Guy Hadad, Guy Feigenblat +3cs.LG2026-09-02
#33CivBench: A Long-Horizon Benchmark for Tool-Mediated Agents in Civilization VIAustin Tudor David Andrews, Liam Wilkinson, Jamie Heagerty +3cs.AI2026-09-02
#34Addressing Trust in AI Systems through Education: A Didactic PerspectivePierre Haritz, Hendrik Krone, Thomas Liebigcs.CY2026-09-02
#35Scalable Kronecker-Fisher Approximation: Efficient Hessian Analysis for Billion-Parameter Language Models CompressionViacheslav Yusupov, Daria Cherniuk, Evgeny Frolovcs.LG2026-09-02
#36Towards One-for-All Robustness Across a Continuum of Threat LevelsZhichao Hou, Xiaorui Liucs.LG2026-09-02
#37UTP-Bench: Uncertainty-aware Travel Planning BenchmarkEtcharla Revanth Rao, Priyanshu Karmakar, Shubhojit Mallick +3cs.AI2026-09-02
#38Coverage, Not Targeting: A Structural Regime in Multi-Turn Agent Credit AssignmentChenyu Zhou, Qiliang Jiang, Shuning Wu +1cs.LG2026-09-02
#39Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grounded Persuasion in Multi-Turn JailbreakingSiyu Chen, Haoran Wang, Xiaojian Li +3cs.CL2026-09-02
#40Evidence for Shared Routing Geometry and Dynamics in Sparse Mixture-of-ExpertsKirill Labzin, Stepan Kulibaba, Artem Dzhalilov +1cs.LG2026-09-02
#41Contrastive Explanations in Quantitative Bipolar Argumentation FrameworksXiang Yin, Nico Potyka, Antonio Rago +1cs.AI2026-09-02
#42PolERo: Studying Political Evasion in RomanianGabriel Stefan, Sergiu Nisioics.CL2026-09-02
#43MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution ShiftsMatteo Greco, Anudeex Shetty, Andrea Tagarelli +1cs.CL2026-09-02
#44Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale InvarianceSai Niranjan Ramachandran, Suvrit Sracs.LG2026-09-02
#45Diagnosing with Insights: Structured Analysis of Agent Failures via Behavioral AbstractionsJiayi Bi, Yanjie Gao, Yuanmin Xie +4cs.AI2026-09-02
#46NE-R1: Enhancing Named Entity Recognition Model via Reinforcement LearningMeixuan Chen, Hehan Li, Ruizhi Zhao +8cs.CL2026-09-02
#47Towards a Foundational Ontology for Identifying and Resolving Contradictions in Dialogue-based Human-Robot InteractionsMaitreyee Tewari, Michele Persianics.HC2026-09-02
#48Fair Stable Matching: A Nash Social Welfare ApproachParth Desai, Rasheed M, Ganesh Ghalme +1cs.GT2026-09-02
#49Subcellularly Resolved Single-Cell Embedding Learning with Transcriptomic data, Protein Structure and Localization InformationZhen Zhou, Jiachen Li, Yuan Liu +2q-bio.GN2026-09-02
#50AGI Maze Prediction Datasets: A Compact Benchmark for Learning World Dynamics with TransformersAlexey Potapovcs.LG2026-09-02
#51SALA: Semantic-Aware Logical Alignment for Complex Reasoning in In-Context LearningZhao Ji, Wenqing Chen, Zhixuan Chu +4cs.AI2026-09-02
#52ORB-SVM : An Innovative Hybrid Framework for Efficient Brain Tumor Detection from MRI ScansAmirhosein Azarpourcs.CV2026-09-02
#53What Is Worth Representing? Representational Empowerment for Continual Model ConstructionFei Dai, Hanqi Zhou, Alison Gopnik +1cs.LG2026-09-02
#54DiffIE: Diffusion-based Open Information ExtractionKonstantin Fedorov, Valentin Malykhcs.CL2026-09-02
#55Improving Evaluation Realism with Inference-Time Compute and Deployment ScaffoldsAxel Ahlqvist, Richard Guan, Juan-Pablo Rivera +6cs.AI2026-09-02
#56SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignmentQingyu Meng, Yiwei Zha, Jiahuan Pei +3cs.LG2026-09-02
#57SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task OntologyIhor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2cs.AI2026-09-02
#58VoRTeC: Taming Foundation Flow for One-step Real time Video CompressionYichong Xia, Qinhong Wu, Qinhong Wu +3cs.CV2026-09-02
#59RouteGraph-Mona: Confusion-Aware Routing Fine-Tuning for Mineral Image ClassificationJierui Li, Zhiyuan Qi, Hao Zhu +7cs.CV2026-09-02
#60Auditory Illusion Benchmark for Large Audio Language ModelsHayoon Kim, Eunice Hong, Kyogu Leecs.SD2026-09-02
#61Do Large Language Models Capture the Diversity in their Training Data?Youqi Wu, Farzan Farniacs.CL2026-09-02
#62CoMerge: Conflict-Driven Preference Optimization for Multi-Task Model MergingMingjie Zheng, Zihao Chen, Wenqing Chen +4cs.AI2026-09-02
#63PaperCompiler: Faithful Paper-to-Code Generation via Repository-Level Specification CompilationYunhao Liu, Hong Phuc Pham, Jaehong Yooncs.CL2026-09-02
#64CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Traffic Scenario GenerationShucheng Zhang, Yuang Zhang, Bingzhang Wang +3cs.RO2026-09-02
#65Retrosynthesis of Synthetic Media for Explainable AI Provenance ForensicsYijie Lin, Ching-Chun Chang, Isao Echizen +2cs.CR2026-09-02
#66Codebook Agent: Amortized Topology Design for LLM Multi-Agent SystemsJinxi Yu, Yubei Li, Eric Hanchen Jiang +6cs.AI2026-09-02
#67APEx: Distillation of Agent Procedural Experience for Adaptive Deep Research Question AnsweringJie Ding, Rui Sun, Xinyuan Zhang +2cs.AI2026-09-02
#68DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion and Action SpaceSteffen Hagedorn, Aron Distelzweig, Alexandru P. Condurachecs.RO2026-09-02
#69SAUF-Net: Structure--Appearance Representation Learning with Uncertainty Feedback for Semi-Supervised Medical Image SegmentationQin Lu, Zheyang Jing, Yujie Yang +3cs.CV2026-09-02
#70LLM-as-a-Judge Is Not an Oracle: Why Self-Improving Agents Need Deterministic GuardrailsVansh Wahics.AI2026-09-02
#71Task-Level Natural Language Priors as Learning Signals for Low-Resource LLM TrainingJian Gao, Xiao Zhang, Xun Zhu +2cs.AI2026-09-02
#72Propose to Learn, Learn to Propose: Evaluability-Aware Assistance under Bounded RationalityYifan Zhu, Sammie Katt, Samuel Kaskics.AI2026-09-02
#73PGPO: Potential-Guided Policy Optimization for Multi-Turn Agentic TasksYuyao Zheng, Haipeng Sun, Junwei Bao +4cs.AI2026-09-02
#74InfraPatch: Cross-Task Targeted Grayscale Patch Attacks on Infrared-Adapted Vision-Language ModelsChengyin Hu, Dingyi Lu, Jiaju Han +5cs.CV2026-09-02
#75PhoenixNest-Video: Evidence-Grounded Multimodal Agent Framework for Automated Video Interview AssessmentFan Yuxuan, Huang Miaojun, Zhang Haimei +2cs.AI2026-09-02
#76Signal or Noise? Auditing Rotation-Induced Saliency Drift in Medical and Aerial ImagingKhawaja Murad ul Hassan, Mehran Ebrahimics.CV2026-09-02
#77SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizon Task StreamsAo Yan, Xin Zhang, Jiawei Du +1cs.AI2026-09-02
#78PEARL: Path-Entity Aligned Relational Learning with Contextual Subgraphs for Inductive Knowledge Graph CompletionYunchi Yang, Longlong Li, Cunquan Qucs.AI2026-09-02
#79ASCII Attack: Recontextualising Harmful Requests as Artistic Critique in Large Language ModelsDa Cheng Gu, Yifei Dong, Xinghao Yang +2cs.AI2026-09-02
#80SMart: A Multi-source Multi-phase Time Series Representation Transfer FrameworkFang He, Wang-chien Leecs.LG2026-09-02
#81Schrödinger Bridges on Lie Group Manifolds for Probabilistic Intrinsic GenerationShizhe Zhang, Mingyang Zhao, Lei Mastat.ML2026-09-02
#82Examining the Vulnerability of Multi-Agent Medical Systems to Human Interventions for Clinical ReasoningBenjamin C Liu, Dillon Mehta, Rishi Malhotra +7cs.AI2026-09-02
#83FUSE: An Evaluating Framework for Dangerous Capabilities of LLMsZhengyi Jin, Ru Zhang, Xiao Chen +5cs.AI2026-09-02
#84GeoSPRINT: Geometric Redundancy-Aware Step Pruning for Inference in Diffusion TrajectoriesArpita Joshics.LG2026-09-02
#85OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment PredictionJaehoon Jeong, Jay-Yoon Leecs.CL2026-09-02
#86Beyond Modality Harmony: Orthogonal Purification and Topology-Guided MoE for Conflict-Aware Multimodal RecommendationJialin Liu, Zhaorui Zhang, Ray C. C. Cheungcs.IR2026-09-02
#87OmegaUse-SOP: SOP Engineering for Professional Computer Use from Human DemonstrationsYixiong Xiao, Lang An, Hucheng Yang +9cs.HC2026-09-02
#88Online Non-Monotone DR-Submodular Maximization Matching the Offline $0.401$ FactorVaneet Aggarwal, Yiyang Lucs.LG2026-09-02
#89A Power Law in Logarithm's Clothing: On the Scalability of Graph-Based Vector SearchSajad Faghfoor Maghrebi, Navid Eslami, Niv Dayancs.DB2026-09-02
#90EmoStance: Response-Side Affective-Orientation Control for Empathetic Response Generation via Emoji Weak SupervisionZiyuan Jin, Yuxuan Ge, Zheng Tiancs.AI2026-09-02
#91C$^{3}$T: Counterfactual Causal Reasoning for Sentiment Shifts in Social-Media Conversation TreesS M Rafiuddin, Atriya Sencs.CL2026-09-02
#92Beyond Context Windows: Persistent Discovery Context for Data-Centric AgentsJalal Mahmudcs.AI2026-09-02
#93Semantic Signal-Assisted Inspection and Recovery Allocation in Reverse LogisticsJiani He, Dingyan Shang, Yihua Xu +4cs.AI2026-09-02
#94text2ql: Multi-Target Natural Language Querying via a Language-Agnostic Intermediate RepresentationRitesh Kumarcs.CL2026-09-02
#95Disease Burden over Skin Tone: Decomposing the Dermatology-AI Generalization GapNirajan Kunwor, Sanjaya Poudel, Quoc-Huy Trinh +2cs.CV2026-09-02
#96MeanField Surrogate Modeling for Scalable Runtime Scheduling of Concurrent Heterogeneous AI Inference on Shared GPUsYoussef Ennouri, Soonhoi Hacs.DC2026-09-02
#97Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language ModelsHaobo Xu, Sirui Chen, Yuanchen Bei +5cs.CL2026-09-02
#98Git4Data: Database-Native Version Control for AI AgentsHongshen Gou, Zuyu Zhang, Yuze Sun +4cs.DB2026-09-02
#99Federated LoRA Adaptation of BiomedCLIP Across Four International Chest X-Ray CohortsSanjaya Poudel, Nirajan Kunwor, Manish Dhakal +2cs.LG2026-09-02
#100READY or Not: Reliable Enterprise Agent DeploymentVeronica Chatrath, Bryan Zhu, Jingxuan Fan +15cs.AI2026-09-02
#101MASkills: Continual Skills Optimization for Multi-Agent LLM SystemsHuaiyuan Yao, Xiaoou Liu, Charles Fleming +2cs.AI2026-09-02
#102Beyond Outcome Gaps: Process-Aware Fairness Diagnosis for LLM-based Multi-Agent Decision SystemsYiran Zhao, Lu Zhou, Liming Fang +4cs.AI2026-09-02
#103Transfer Safety Awareness for Cross-Modal Safety Drift in Multimodal Large Language ModelsTianqi Xiao, Shiyao Cui, Minghao Zhang +2cs.MM2026-09-02
#104CHIME: Credit-Aware Hierarchical Memory Evolution for Long-Horizon Agentic PlanningYongshi Ye, Tian Lan, Feihu Jiang +7cs.AI2026-09-02
#105ToolGate: An Executable Acceptance Pipeline for Tool-Dependent Scientific Benchmark ConstructionKe Zhang, Yankang Liu, Roya Zandi +1cs.AI2026-09-02
#106MineTRACE: An Evidence-Grounded Interactive Reasoning System for Mineral ProspectivityYiran Zhang, Jinwen Liu, Daniel Su +7cs.AI2026-09-02
#107DocHop: Benchmarking Out-of-domain Multi-hop Reasoning in Information-Dense DocumentsZhuoran Yu, Le Thien Phuc Nguyen, Jaden Park +5cs.AI2026-09-02
#108Monitoring Web Agents Without Internal Signals: Observable Trajectories and Key-Step SupervisionSitong Pan, Yipeng Shen, Yilin Lu +3cs.AI2026-09-02
#109Modeling What Changes: Sparse, Residual World Models for Object-Centric ManipulationParam Thakkar, Parsika Paresh Shah, Manisha Sushant Gotecs.RO2026-09-02
#110HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language ModelsRenjie Xie, Juncheng Yang, Aoting Hu +4cs.AI2026-09-02
#111Seed-Anchored Budget-Bounded Graph Rendering for Question Answering on Industry-Standard Power-Grid Information and Exchange ModelsJayakumar Manoharan, Yamini Sehgaleess.SY2026-09-02
#112InstEditSeg: Instruction-Driven Image Editing for Polyp and Skin Lesion SegmentationZiquan Liu, Zhewei Zhu, Xuyang Shics.CV2026-09-02
#113InsightSeg: Reusing Correction Insights for Guideline-Consistent SegmentationVanshika Vats, Ashwani Rathee, James Daviscs.CV2026-09-02
#114ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent EvaluationsPeiying Zhu, Sidi Changcs.AI2026-09-02
#115When Agents Implement Systems: A Case Study in Defects, Detection, and Evaluation RigorPhanindra Reddy Maddurucs.AI2026-09-02
#116Benchmarking Language Models for Statistical Problem FormulationChen Wang, Junzhe Zhao, Xin Cong +2cs.AI2026-09-02
#117Knowing Is Not Enough: Information Retrievability as a Precondition to Effective LLM OversightXinyu Fu, Narayan Ramasubbu, Dennis Gallettacs.HC2026-09-02
#118Post-Training Ternarization of Qwen3-4B Capability, Effective Bit Budget, Storage Compression, and DeploymentAnirudh Malik, M Sparsh Mehra, Poojith Devancs.AI2026-09-02
#119Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning NetworkLucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4cs.LG2026-09-01
#120On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following RerankersVignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipallics.LG2026-09-01
#121Sparse Readout Prism: Explaining Logit-Lens Scores in Features Instead of TokensMatteo He, William F. Shen, Xinchi Qiu +1cs.CL2026-09-01
#122Looped Transformers under the Jacobian Lens: Does the Global Workspace Survive Recurrence?Wenlong Wang, Fergal Reidcs.AI2026-09-01
#123The Ceiling Is in the Channel: Auditing Learner Gaps and Measurement Frontiers in Clinical PredictionSayeed Shafayet Chowdhury, Nusrat Jahan, Snehasis Mukhopadhyay +2cs.AI2026-09-01
#124Accurate in space, unreliable in time: how LLMs represent national cultural changeYalda Daryani, Miranda Bogen, Madeleine I. G. Daeppcs.CY2026-09-01
#125OutageDiT: A Generative Foundation Model for Power Outage Forecasting and Scenario SimulationYunqin Zhu, Feng Qiu, Yao Xiecs.LG2026-09-01
#126Epistemic Sybil Resistance: Multiplying AI Agents Without Multiplying EvidenceMarc Baracs.AI2026-09-01
#127Thinking effort aligns between humans and reasoning models in abductive reasoningHenry Arthurcs.CL2026-09-01
#128Belief-Calibrated Optimization: An Explicit World Model for Agentic OptimizationYuhan Chen, Zhihua Tian, Mahavir Dabas +7cs.AI2026-09-01
#129The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory AgentsJundong Hu, Shekar Ramachandrancs.AI2026-09-01
#130SSAKG 2.0: An Open-Source Package for Structural Associative Sequence Memory and Context-Based RetrievalPrzemysław Stokłosa, Janusz A. Starzyk, Paweł Raifcs.AI2026-09-01
#131Import What You Need: Learning When and How to Augment EHR Graphs with External KnowledgeChen Chen, Mohsen Nayebi Kerdabadi, Dongjie Wang +2cs.LG2026-09-01
#132Agent Memory Is a Surface for Endogenous Authorization LaunderingTommaso Cerruti, Mika Okamoto, Ansel Kaplan Erolcs.CR2026-09-01
#133Architecting Conversational Data Systems for Stateless LLM APIs: The Hydration Proxy PatternJoseph Axisacs.AI2026-09-01
#134Interpretable Symptom Vectors for Depression in a Large Language ModelFangyi Zhu, Ajay Subramanian, Allison Constant +3cs.CL2026-09-01
#135Zeta-Lite: A Concurrent, Branchable In-Browser SQL Database for Agentic MemoryGene Zhangcs.DB2026-09-01
#136Induction and Inquiry via Probabilistic Reasoning over Language and CodeWasu Top Piriyakulkij, Sam Acquaviva, Cassidy Langenfeld +2cs.AI2026-09-01
#137When Does Information Sharing Improve Decentralized Discovery? Aggregation, Independent Rescue, and Equilibrium SelectionYohei Nakajimacs.AI2026-09-01
#138hLLM: Single Pass Decoding for Generative RerankingEmil Laftchiev, Prachi Agrawal, Moe Kayali +7cs.LG2026-09-01
#139VakyArth: Evaluating Pragmatic Competence in LLMs across Indic LanguagesUsneek Singh, Poorvaja Veera Balaji Kumar, Parth Nanda +4cs.CL2026-09-01
#140Agents That Model Agents: Five Principles Toward a Theory of Mind for 6G NetworksHatim Chergui, Carolina Fernández-Martínez, Mehdi Bennis +1cs.NI2026-09-01
#141Dictionary-Guided Mutation Operators for Automated HDL RepairMaisha Mastora, Dean Sullivancs.ET2026-09-01
#142Swin Meets EfficientNet: Lightweight Architectures for GAN-Based Face ForensicsSejuti Basu, Ashima Sood, Vijay Kumar +1cs.CV2026-09-01
#143When Can a Machine Trust a Statute? A Survival Certificate for Machine-Extracted Legal LogicSurya Sakacs.AI2026-09-01
#144Harness Engineering in LLM Tool Use via Agent-Native Reusable Tool PrimitivesHaibo Jin, Suijin Wang, Xucheng Yu +2cs.SE2026-09-01
#145HEAT: Faster Fully Homomorphic Inference via Approximations-Weights Co-AdaptationAlessandro Zirilli, Davide Marincione, Evgenios M. Kornaropoulos +2cs.CR2026-09-01
#146RecKAN: Kolmogorov-Arnold Networks with a Learnable Recursive Polynomial BasisAmirhosein Azarpourcs.LG2026-09-01
#147Efficient SWE Agent Benchmarking via Trajectory-Aware EvaluationKefeng Duan, Dewu Zheng, Yanlin Wang +7cs.SE2026-09-01
#148Adaptive Critical Token-Aware Retrieval for Repository-Level Code GenerationKefeng Duan, Dewu Zheng, Yanlin Wang +8cs.SE2026-09-01
#149CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses?Damien Sileo, Dimitri Kachlercs.CL2026-09-01
#150The Rise of Verbal Reinforcement LearningKshitij Tayal, Arun Sharma, Genta Indra Winata +2cs.CL2026-09-01
#151Mechanism Design for Alignment and ControlDirk Bergemann, Andrew Koh, Stephen Morrisecon.TH2026-09-01
#152Designing Proactive Thought Partners for WritingChao Zhang, Abe Davis, Chih-Wei Chen +1cs.HC2026-09-01
#153Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMsJingtan Wang, Arun Verma, Xiaoqiang Lin +4cs.CL2026-09-01
#154Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM TeachersGiovanni Bonetta, Matteo Merler, Davide Zago +2cs.AI2026-09-01
#155From Confusion to Clarity: Confusion-Aware Retrieval and Knowledge Injection for Text ClassificationManish Gupta, Chaitanya Giri, Jayasimha Talurcs.CL2026-09-01
#156H3-World: Turning Language Understanding into World ControlDanze Chen, Zeqing Wang, Ziyue Lin +2cs.CV2026-09-01
#157Retrieved but not ranked: surface-form bias in structural retrieval, from mathematics to agent trajectoriesNabira Rashid, Manolis Kelliscs.LG2026-09-01
#158BS: Take the Hint - Interactive Multitracer PET/CT Lesion Segmentation with a Scribble-Conditioned ResEnc U-NetMarven Sherif, Amgad Elmasry, Youssef Ghazal +1cs.CV2026-09-01
#159Can LLMs Discover Scientific Laws in Real and Parallel Worlds?Yiming Huang, Ziche Liu, Zhuohang Wu +11cs.AI2026-09-01
#160A Mathematical Theory of Reusable Neural Bases for Network CompressionBinshuai Wangcs.LG2026-09-01
#161Can LLMs Design Video Coding Tools? A Case Study on Planar ModeYingwen Zhang, Meng Wang, Liqiang He +1cs.MM2026-09-01
#162EvoSCM: Scientific Belief Revision Through Causal Model Evolution and ExperimentationQing Zhao, Haowei Li, Weijian Deng +2cs.AI2026-09-01
#163Relational-Core Graph Analytics Querying graphs at SQL scale, and why the node/edge model is a performance tax, not a truer picture of connected dataGene Zhangcs.DB2026-09-01
#164When Guardrails Look Effective: Construct Validity Failures in LLM Agent Commerce EvaluationPeiying Zhu, Sidi Changcs.AI2026-09-01
#165TempCloze: Can Video-LLMs Identify the Missing Middle?Wenqi Pei, Henry Hengyuan Zhao, Yilai Liu +4cs.CV2026-09-01
#166LatentPress: Context Compression Beyond Text and VisionZhengze Zhou, Hejian Sangcs.LG2026-09-01
#167Public-Sharing Labels and Verbatim Field Egress in an MCP-to-A2A Agent Configuration: A Controlled Multi-Model StudyArpan Kumar Mahapatracs.CR2026-09-01
#168Optimizing Byzantine Node Placement in Decentralized Federated LearningEdoardo Gabrielli, Gabriele Tolomeics.LG2026-09-01
#169Rethinking Learnability in Offline Data-driven OptimizationChao Qian, Chen-Guang Wang, Rong-Xi Tan +1cs.LG2026-09-01
#170GlossoGen: Emergent Language in Complex Multi-Agent LLM InteractionsElias Stengel-Eskin, Newton Sander, Carlos Bonetti +4cs.CL2026-09-01
#171Defense-as-Skill: Evolving Runtime Guard Skill for Skill-Augmented AgentsXiaofang Yang, Ziqi Miao, Dianbo Sui +2cs.CR2026-09-01
#172Harness-of-Harness: Multi-Day Autonomous Software Development with Continual ImprovementHaoyang Yan, Min-le Su, Hangfan Zhang +6cs.AI2026-09-01
#173Parsing the Stream: A Live Trace Model for Long-Horizon Agents and Their ObserversEgor Pakhomov, Erik Nijkampcs.AI2026-09-01
#174When Safety Routing Breaks: Understanding Alignment Fragility under Benign Fine-TuningYitong Guo, Xiaoyi Chen, Siyuan Zhang +2cs.CR2026-09-01
#175Efficiently Estimating Optimal Hyperparameter Scaling Laws through Power-Law Entropy SearchZhiliang Chen, Sebastian Ament, David Eriksson +3cs.LG2026-09-01
#176Learning Sparse Decision Trees via Transformer Variational Auto-EncodersGiacomo Fidone, Alessio Cascione, Riccardo Guidottics.LG2026-09-01
#177Semantic-Guided Multimodal Preprocessing for Vision Transformer-Based Clear Cell Renal Cell Carcinoma GradingFatemeh Javadian, Zhu Chen, Zahra Aminparast +1cs.CV2026-09-01
#178Provably Safe Sim-to-Real TransferTingting Ni, Maryam Kamgarpourcs.LG2026-09-01
#179EdiTikZ: Scientific Figure Editing from Revision TrajectoriesChristian Greisinger, Zhixue Zhao, Steffen Egercs.AI2026-09-01
#180Neuro-Symbolic Geometric Abstraction (NeuSOGA): From Observations to Symbolic Mathematical RepresentationsQingde Li, Qingqi Hong, Zihan Li +1cs.AI2026-09-01
#181Evaluating Multimodal LLMs as Generalist Vision-Language-Action Agents for Drone Control: Commanding, Approaching, Tracking and SearchingJaewoo Park, Minyoung Lee, Sukmin Seo +11cs.RO2026-09-01
#182Measuring consistency via ensemble margin and local prediction variability: Auditing decision systems in the presence of predictive multiplicitySinjini Banerjee, Tim Marrinan, Anand D. Sarwatestat.ML2026-09-01
#183EDGE: Error Dependency Graph-Guided Multi-Error Attribution in Multi-Agent LLM SystemsJun Hou, Priya Pitre, Yi Fang +1cs.AI2026-09-01
#184PopPert: Population-level Joint-Distribution Modeling for Single-Cell Perturbation PredictionHandong Wang, Jiaxin Qi, Haochen Feng +1q-bio.GN2026-09-01
#185SymFold: Synergizing Evolutionary and Structural Priors for Accurate Protein Inverse FoldingHandong Wang, Jiaxin Qi, Baisheng Lai +1cs.AI2026-09-01
#186CHARM: Character Hallucination for Multicultural Role Play BenchmarkSunkyung Han, Nahyeon Park, Gaeun Seo +2cs.CL2026-09-01
#187Scalable Rao-Blackwellized Online Planning for High-Dimensional POMDPsJiho Lee, Nisar Ahmed, Kyle Hollins Wray +1cs.RO2026-09-01
#188Meta-ethics and AI: exploring the novel meta-ethical questions in the era of AIShang Lucs.AI2026-09-01
#189Cheap Verifiers, Large Blind Spots: Measuring the Reliability Cost of Cost-Saving CascadesDushyant Rajputcs.AI2026-09-01
#190Probing Factual Knowledge Transfer with Training Data InterventionsRomina Oji, Marc Braun, Marcel Bollmann +2cs.CL2026-09-01
#191LEAP: Likelihood Elicitation and Aggregation for LLM-based Probabilistic ForecastingYufei Chen, Yiran Zhao, Xiaogang Xu +3cs.AI2026-09-01
#192Bandits in Prod: Hyperparameter Optimization at Inference TimeLouis Abraham, Tuan-Anh Nguyen, Nicolas Devatinecs.LG2026-09-01
#193Automated Event Log Generation from Unstructured Text Using Finetuned LLMsMaximilian Seeth, Gabriel Marques Tavares, Daniel Schustercs.AI2026-09-01
#194MIDR: Enrichment-Augmented Indexing for Multimodal Document RetrievalDebanjan Mahata, Atharva Tendle, Daniel Preotiuc-Pietro +2cs.IR2026-09-01
#195A Composable Evaluation System for Reproducible Omni-Modal Foundation Model EvaluationHodong Lee, Sanghee Park, Dohoon Ryu +4cs.AI2026-09-01
#196GazeRefine: Expert Gaze as a Test-Time Prompt for Training-Free Medical Image SegmentationMohammed Oussama Benyahia, Marouane Tliba, Mohamed Amine Kerkouri +10eess.IV2026-09-01
#197Analog-DB: An Agent-First Analog Integrated Circuit Database, From Blocks to SystemsDanial Noori Zadeh, Mohamed B. Elamiencs.AI2026-09-01
#198HiLRP: Toward One Trustworthy Explanation for Vision Transformer: Conservation-Valid Attribution via Attention PrimitivesSathiyamohan Nishankar, Pubudu Sanjeewani, Asanka Perera +1cs.CV2026-09-01
#199EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA AgentsWei Wang, Wenqiao Zhang, Yutong Lin +14cs.RO2026-09-01
#200Some Emotions Run Deeper: Layer-wise Probing and Causal Intervention in Large Language ModelsTian Fang, Gaël Guibon, Davide Buscaldics.CL2026-09-01

Showing latest 200 of 53,333 · all categories