PaperScope
LIVE · 2026-09-03 05:40 UTC

auditing 15 papers this week · +14% WoW

papers mentioning "auditing" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1The Implications of Linguistic Illegibility for LLM SecurityJames Mickenscs.LG2026-09-02
2Generating Medical Image Counterfactuals using Causal ExplanationsDavid A. Kelly, Tom Yaacov, Nathan Blake +2cs.CV2026-09-02
3Seeing Beyond the Lesion: Disease Recognition from Reactive CNS TissueJan Schnorrenberg, Jan Ernsting, Enrico Küllenberg +3eess.IV2026-09-02
#4CAPTURE: Disentangling Preference Drift from Memory Poisoning in Personalized LLM AgentsS M Asif Hossain, Ruksat Khan Shayoni, Md Kishor Morolcs.LG2026-09-02
#5Signal or Noise? Auditing Rotation-Induced Saliency Drift in Medical and Aerial ImagingKhawaja Murad ul Hassan, Mehran Ebrahimics.CV2026-09-02
#6SoK: Where Do Flow Labels Come From? Auditing Label Provenance in Encrypted Traffic BenchmarksSizhe Huang, Shujie Yangcs.NI2026-09-02
#7Disease Burden over Skin Tone: Decomposing the Dermatology-AI Generalization GapNirajan Kunwor, Sanjaya Poudel, Quoc-Huy Trinh +2cs.CV2026-09-02
#8The Ceiling Is in the Channel: Auditing Learner Gaps and Measurement Frontiers in Clinical PredictionSayeed Shafayet Chowdhury, Nusrat Jahan, Snehasis Mukhopadhyay +2cs.AI2026-09-01
#9Measuring consistency via ensemble margin and local prediction variability: Auditing decision systems in the presence of predictive multiplicitySinjini Banerjee, Tim Marrinan, Anand D. Sarwatestat.ML2026-09-01
#10Who Judges the Judges? A Chinese Safety QA Benchmark for Evaluating LLM Responses and Safety JudgesRui Yang, Shuang Huang, Junhua Liu +7cs.CR2026-09-01
#11Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPOPrakhar Gupta, Vaibhav Guptacs.CL2026-09-01
#12Self-Reports Are Not Verification: Environment-Grounded Auditing of LLM Operators in Evolutionary SearchEnrong Pan, Ryan Zhou, Ting Hucs.AI2026-09-01
#13NeuroPriv: Adversarial Representation Learning for Privacy in Wearable EEG SystemsSarmistha Sarna Gomasta, Bhawana Chhaglani, Prashant Shenoycs.CR2026-08-31
#14Do LLMs Know Your Neighborhood? Auditing LLM Priors for Neighborhood-Level Mobility Prediction and Structural AlignmentSaad Mohammad Abrar, Eesha Kurella, Arnav Dadarya +3cs.LG2026-08-31
#15Sources of Truth: A Multi-Platform, Multilingual Audit of Citations in AI Mental Health Information QueriesPhuong Anh Nguyen, Jill Noorily, Matthew Flathers +7cs.CY2026-08-31
#16Authority Bias in Conversational Search Engines for Academic Paper RecommendationUthman Jinadu, Parsa Ghazvinian, Anjila Budathoki +3cs.AI2026-08-31
#17Beyond Blind Compliance: Benchmarking Task Verification in OCR ReasoningYue Zhou, Yuan Wu, Yi Changcs.CV2026-08-31
#18Auditing Anonymous AI Models: A Four-Stage Protocol for Black-Box Identity VerificationYisen Xics.SE2026-08-31
#19BLOOM-WILT: Logit Tilting for Behaviour Elicitation in Automated LLM AuditingAdrians Skapars, Edoardo Maninocs.AI2026-08-31
#20Faithfulness Is Not Free: Auditing Offline KV-Cache Quantization in Retrieval-Augmented GenerationAtta Ul Asad, Ahsan Bilal, Muhammad Ali +2cs.CL2026-08-31
#21Auditing MCQA Benchmarks through Probability LandscapesMinsoo Song, Chanjun Parkcs.CL2026-08-31
#22On the Recoverability of Private Information Unlearning in Large Language ModelsShicheng Hu, Runzhi Tian, Ziqiao Wang +1cs.LG2026-08-30
#23Auditing Harness Tampering in Self-Improving AgentsXing Wang, Xiaoyi Zhang, Jie Shaocs.CL2026-08-30
#24AgentProv: Auditing Agentic LLM API Providers via Tool-use Policy ProbesXun Wang, Bihe Zhao, Michael Backes +2cs.CR2026-08-30
#25Not Safe for All: Auditing the Dialect Penalty in Text-to-Image Safety PipelinesMinkyu Kim, Juhwan Choi, YoungBin Kimcs.AI2026-08-30
#26A Causal Model for Locating and Unlocking Sandbagging in Model OrganismsHong Kiat Tan, Linh Le, David Williams-Kingcs.LG2026-08-29
#27Bayesian-Optimized Superpixel-GrabCut for Traceable Optic Disc SegmentationShraddha Changune, Vivek Noel Soren, Gautam Das +1cs.CV2026-08-29
#28Auditing and Mitigating Privacy Leakage in Cloud-Edge Collaborative DecodingKejia Zhang, Tianyuan Zou, Zixuan GU +1cs.CR2026-08-29
#29Revisiting the Provable-Auditable Privacy Gap of DP-SGDSaloni Modi, Srivi Balaji, Yusong Zhu +2cs.LG2026-08-28
#30VERA-8B: Evidence-Grounded Audit Risk Reasoning from SEC FilingsMenghan Liu, Elynn Chencs.AI2026-08-28
#31Auditing Generative Audio Calls for Known-Task Audio-LLM EvaluationMengzhe Gengcs.SD2026-08-28
#32Memorization Is Not Extraction: Tight Differential-Privacy Bounds and Audit Blind SpotsXujun Che, Depeng Xu, Shuhan Yuancs.CR2026-08-27
#33Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust PredictionJin Mu, Guanhua Chencs.CL2026-08-27
#34Counterfactual Bias Testing for Application Tracking SystemSai Yashwant, Shruti Bansal, Anurag Dubey +4cs.AI2026-08-27
#35Quantization-Triggered Backdoors in Language Models: Cross-Quantizer Transferability and the Validation--Deployment GapJacopo Dardini, Claudio Stanzione, Giordano Colò +1cs.LG2026-08-27
#36Beyond Execution: Auditing Experimental Fidelity in LLM-Driven Scientific ResearchLezhi Yu, Xiaogang Xu, Yuhua Zhou +2cs.SE2026-08-27
#37SNF-Bench: Separating Static Drift from Natural Flow in Long-Horizon Fixed-Camera Video GenerationMatiur Rahman Minar, Seunghun Oh, Ganghyeon Jeong +1cs.CV2026-08-27
#38Diff Mining: Logit Differences Reveal Finetuning ObjectivesGreg Kocher, Robert West, Clément Dumas +1cs.LG2026-08-26
#39Knowledge-Verified Emergent Deception in LLM Agents Under Conflicting IncentivesZheyuan Liu, Weiliang Zhao, Xiangchi Yuan +3cs.CL2026-08-26
#40How Do LLM Agents Actually Get the Flag? Trace-Level Provenance for Agentic Offensive Security EvaluationKimberly Milner, Minghao Shao, Nanda Rani +8cs.CR2026-08-26
#416.5% of the Neuro-Symbolic Literature Can Be Reproduced from Its Published Artifacts, a Six-Stage Audit Framework and First InstantiationBrandon Colelough, Vladimir Martirosyan, Ishan Tamrakar +6cs.AI2026-08-26
#42ICON Decomposition: Auditing Deep Neural Networks with Multivariate Variance-based Concept-level ExplanationsRoshan Prakash Rane, Marco Simnacher, Manuel Pfeuffer +7cs.LG2026-08-26
#43FRAME: separating sampling variation from representational cause in medical imaging fairnessMahshad Lotfinia, Daniel Truhn, Andreas Maier +1cs.CV2026-08-26
#44MMJailBench: A Factorized Benchmark for Disentangling Multimodal Jailbreak VulnerabilitiesTianshi Wang, Jingsong Wang, Yafei Huang +3cs.CR2026-08-26
#45Training Alignment Auditors via Reinforcement LearningPaul Rosu, Rowan Wangcs.AI2026-08-26
#46CareGraph: An Auditable Hybrid AI Framework for Evidence-Grounded Personalized Longitudinal Health IntelligencePratik Ghawate, Tanvi Patilcs.AI2026-08-25
#47A Geometric Theory of Robust Fairness AuditsBinita Maitycs.LG2026-08-25
#48Right Diagnoses, Decorative Reasoning:A Perturbation Audit of Medical Chain-of-ThoughtMengzhu Xu, Jifan Gao, Xia Jiang +2cs.AI2026-08-25
#49The Invisible Editorial Layer: Formalizing Undisclosed Inference-Time Steering, Probability Placement, and the Attribution Problem in Deployed Language ModelsAugusto Camargocs.AI2026-08-25
#50A Judge Should Know What Changed:Construct Validity for LLM-as-a-Judge EvaluationJianlin Chen, Wenhui Chen, Ziyao Lin +1cs.AI2026-08-25

all trends · matching is case-insensitive substring after tokenization