PaperScope
LIVE · 2026-09-07 05:40 UTC

llm-based 12 papers this week · +8% WoW

papers mentioning "llm-based" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1When LLM Decompilers Recompile More and Preserve LessChang Liu, Edward Raff, Kristopher Micinskics.CR2026-09-04
2The History Is the Detector: Executing CVE Patch History, End-to-EndQiushi Wu, Kevin Eykholt, Youngja Park +4cs.CR2026-09-04
3Beyond Aggregate Scores: Behavioral Correctness Assumptions for Assessing Reference-Based Automatic Evaluation MethodsMaria Mahbub, Ashley Rice, Michael R. Munroe +2cs.AI2026-09-04
#4First Things First: Teaching LLM-Based Agents to Prioritize Must-Haves before Nice-to-HavesTianjie Ju, Xinyue Xu, Wanxuan Sun +4cs.CV2026-09-04
#5TruthInsightBench: An Evidence-Grounded Benchmark for Automated Evaluation of Open-Ended Scientific Discovery AgentsZhibo Yang, Chen Zhang, Yuewei Zhang +1cs.AI2026-09-04
#6Beyond Co-purchase Relation: Evolution of Complementary Recommendations at AllegroAleksandra Osowska-Kurczab, Klaudia Nazarko, Eliška Kosturová +2cs.IR2026-09-04
#7Moral Competence Before Moral Content: Why LLM Agents Lack the Prerequisites for Coherent AlignmentArno Libert, Derck W. E. Prinzhorn, Daan R. Henselmanscs.AI2026-09-04
#8How a Chatbot's Response Style Shapes a Classroom: A Multi-Agent Simulation of Students Consulting AIRin Tamai, Yuya Dancs.HC2026-09-04
#9Better Understanding, Better Fixes? A Study of Hallucination in LLM-based Automated Program RepairXuemeng Cai, Jiakun Liu, Linhan Yang +2cs.SE2026-09-04
#10CoLMIN: LLM-based Multi-Decision Path Negotiation for Cooperative Autonomous DrivingZhe Huang, Zhaoxin Fan, Shuo Wang +3cs.RO2026-09-04
#11DCFA: Dual-view Causal-inspired Attribution for Failure Reasoning in LLM-based Multi-agent SystemsZehao Wang, Lanjun Wang, Shilong Jin +2cs.AI2026-09-04
#12Controlling and Assessing Appropriate Persona Use in LLM-based Dialogue GenerationJongkyung Shin, Inkyu Lee, Chiehyeon Limcs.CL2026-09-04
#13Continual Graph Memory for Adaptive Recommendation under Intent DriftHao Nguyen Ngoc, Tung Nguyen, Nguyen Thi Hanh +2cs.AI2026-09-04
#14CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker DistillationTingyu Song, Mingxin Li, Yanzhao Zhang +5cs.CV2026-09-03
#15LLM4CKD: Large Language Models for Early Stage Chronic Kidney Disease ScreeningMuhammad Ashad Kabir, Sirajam Muniracs.AI2026-09-03
#16Value-Preserving Architectures for Agentic AI SystemsAlessandro Pesare, Tommaso Dolci, Katja Hose +1cs.AI2026-09-03
#17GPS-Bench: A Governance Policy Benchmark for Automating Policy AnalysisLinh Le, Melanie Bui, My Chiffon Nguyen +2cs.AI2026-09-03
#18Accountable AI with Grounded, Faithful, Consistent, Actionable Rationales: A Case Study in Clinical Trial Matching with VERDICTZikai Zhou, Yufei Jin, Yilin Xu +3cs.CL2026-09-03
#19What Else Needs Fixing? Exploring Cost-Effective Test-Time Compute for Revision Propagation in Artifacts Generated Through ConversationDaisuke Kikutacs.CL2026-09-03
#20SWIM: Student Writing Simulation via Proficiency-Conditioned GenerationHeejin Do, Jakub Kontak, Mrinmaya Sachancs.CL2026-09-02
#21Large Language Models (LLMs) for Telecom Root Cause Analysis (RCA): A Structured Reasoning Framework for Evidence-Grounded DiagnosisHao Zhou, Mandar Kulkarni, Hao Chen +3cs.AI2026-09-02
#22SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety AlignmentQinghua Mao, Wanying Qu, Dadi Guo +8cs.AI2026-09-02
#23CodePoisonRAG: Knowledge Poisoning Attacks on Retrieval-Augmented Code GenerationVarun Gadey, Ziad Marey, Alexandra Dmitrienkocs.CR2026-09-02
#24HyperStyler: Low-resource Authorship Style Transfer via Context-aware Style Navigation and HypernetworksJongkyung Shin, Minguk Jeon, Chanwoo Park +1cs.CL2026-09-02
#25Automated Vulnerability Injection in Smart Contracts Using Large Language ModelsLuca Migliaccio, Roberto Natella, Naghmeh Ivaki +2cs.SE2026-09-02
#26When Persona Attributes Improve Population Alignment in Large Language ModelsLeon Fröhling, Jens Rupprecht, Markus Strohmaier +1cs.CL2026-09-02
#27PragAlign: Feedback-Guided Pragmatic Alignment for Controlled Synthetic Dialogue GenerationSmitha Muthya Sudheendra, Jaideep Srivastavacs.CL2026-09-02
#28Improving Health Literacy through Lay Summarization of Radiological Reports: An Evaluation of BioNER and Retrieval-Augmented GenerationEgecan Çelik Evgin, İlknur Karadeniz, Olcay Taner Yıldızcs.CL2026-09-02
#29YesTrack: Referring Multi-Object Tracking via MLLM-based Yes/No VerificationQuansheng Hu, Qin Sun, Qiansen Dai +4cs.CV2026-09-02
#30Privacy-Preserving Topology-Guided Safety for LLM-Based Multi-Agent Systems via Federated Graph LearningJinxi Yu, Eric Hanchen Jiang, Levina Li +6cs.CR2026-09-02
#31RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic EvolutionZijian Zhao, Sen Li, Xialiang Tong +1cs.MA2026-09-02
#32Evidence-Guided Detection, Localization and Explanation for Text-Centric Image ForensicsPeifeng Liu, Bin Li, Qingsong Zhang +3cs.CV2026-09-02
#33MASkills: Continual Skills Optimization for Multi-Agent LLM SystemsHuaiyuan Yao, Xiaoou Liu, Charles Fleming +2cs.AI2026-09-02
#34Compositional Spectral Prompts for LLM-based Online Time Series ForecastingSeungyoon Choi, Hyunchul Kim, Jae-Gil Lee +1cs.LG2026-09-02
#35Beyond Outcome Gaps: Process-Aware Fairness Diagnosis for LLM-based Multi-Agent Decision SystemsYiran Zhao, Lu Zhou, Liming Fang +4cs.AI2026-09-02
#36HyGRAIL: Cost-Aware and Evidence-Grounded Scientific Hypothesis Discovery over Knowledge GraphsYihang Sun, Zhihan Zhu, Zhiyuan Jiang +3cs.CL2026-09-02
#37A Tri-Agent Framework for Evaluating and Aligning Question Clarification Capabilities of Large Language ModelsYikai Zhao, Saurabh Pandey, Pradeep Kumar Misracs.CL2026-09-02
#38Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization EvaluationHimil Vasava, Ming Jiangcs.CL2026-09-01
#39StudentSim: Training LLM-based Student SimulatorsKe Yang, Chenglong Wang, Michel Galley +4cs.CL2026-09-01
#40Can LLMs Design Video Coding Tools? A Case Study on Planar ModeYingwen Zhang, Meng Wang, Liqiang He +1cs.MM2026-09-01
#41Harness-of-Harness: Multi-Day Autonomous Software Development with Continual ImprovementHaoyang Yan, Min-le Su, Hangfan Zhang +6cs.AI2026-09-01
#42RadMatch: Auditable Radiology Report Evaluation via Finding-Level MatchingCharles Corbière, Léo Machado, Aubin Charley +3cs.CV2026-09-01
#43LEAP: Likelihood Elicitation and Aggregation for LLM-based Probabilistic ForecastingYufei Chen, Yiran Zhao, Xiaogang Xu +3cs.AI2026-09-01
#44Bandits in Prod: Hyperparameter Optimization at Inference TimeLouis Abraham, Tuan-Anh Nguyen, Nicolas Devatinecs.LG2026-09-01
#45Measuring the Behavioral Fidelity of Long-Horizon Human Activity SimulationsYi Fei Cheng, Fan Yang, Iremsu Bas +3cs.AI2026-09-01
#46CaRL-EM: Cost-Aware Reinforcement Learning for Entity Matching with LLMsChaohui Guo, Michel Klein, Zhisheng Huangcs.CL2026-09-01
#47Web Price Extraction: State of the Art and an Adaptive Browserless ImplementationEvgeniia Kositsyna, Jorge Lloret-Gazocs.IR2026-09-01
#48Inspicio: Open-Vocabulary, LLM-Based Sense Retrieval for Historical LanguagesMichele Cilettics.CL2026-09-01
#49A Dataset for Modeling Iterative Problem-SolvingFagun Patel, Sang T. Truong, Duc Q. Nguyen +4cs.CL2026-09-01
#50VerNav: Verifier-First Low-Latency Vision-and-Language NavigationZhixin Wang, Chengzheyi Yao, Leyuan Liu +2cs.RO2026-09-01

all trends · matching is case-insensitive substring after tokenization