PaperScope
LIVE · 2026-09-09 05:40 UTC

reliability 12 papers this week · +30% WoW

papers mentioning "reliability" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1EgoSIS: From Factorized Visual Ego-Transitions to Motion-Canonical Spatial Evidence for UAV ReasoningJingpu Yang, Fengxian Ji, Mingxuan Cui +4cs.CV2026-09-08
2Ostrich: Taking Large Strides Through Stiff Contact in Differentiable DynamicsAleš Kučera, Karel Zimmermanncs.RO2026-09-08
3The Rater Ising-Potts Model with LLM-Derived Weights: An Application to Multi-Category Scoring ReliabilityMatthias von Davierstat.AP2026-09-08
#4Benchmark Scores Are Pipeline-Dependent: A Reliability Audit of Cybersecurity LLM BenchmarksAymene Berriche, Cathrine Shalby, Mohannad Alhanahnah +1cs.CR2026-09-08
#5The Unreliable Progress Bar: Can LLM Agents Reliably Report Task Progress Throughout Execution?Boyang Wang, Yunhan Wang, Yalun Wucs.SE2026-09-08
#6Not All Variables Agree: Reliability-Aware Variable-Wise Gradient Surgery for Multivariate Time-Series ForecastingJinwoo Park, Hyeongwon Kang, Pilsung Kangcs.LG2026-09-08
#7CAR-MIL: Counterfactual Attention Regularization for Multiple Instance LearningImane Chraki, Pierre Marza, Stergios Christodoulidis +1cs.CV2026-09-08
#8Miles v0.1: Production-Level Post-TrainingRadixArk, :, Tom Chen +11cs.LG2026-09-08
#9VeriScene: Reconstructing Crime Scenes from Legal Evidence via World-Model AgentKevin Chuanpu Fu, Yongsen Zheng, Zee Kin Yeong +1cs.CV2026-09-08
#10Agentic ML Exploration (A-MLE) for Ads RankingErwin Gao, Vinodh Kumar Sunkara, Jingyi Guan +36cs.AI2026-09-08
#11Boundary Voting Network for Ambiguity-Aware Timestamp-Supervised Action SegmentationRunzhong Zhang, Yueqi Duan, Yang Chen +4cs.CV2026-09-08
#12Dual-Layer Semantic-Spatial Belief Mapping for Aerial Object Goal NavigationJianqiang Xiao, Xiang Deng, Yuexuan Sun +3cs.RO2026-09-08
#13SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering AgentsPujun Zheng, Zixin Shang, Shufan Jiang +5cs.AI2026-09-08
#14Semi-Supervised Learning under Spatially Biased SamplingBright Wiredu Nuakoh, Francky Fouedjio, Stephen Bradshaw +4cs.LG2026-09-07
#15Explainable Temporal Attention-based Defect Detection For Fillet Joints in Real-Time Gas Metal Arc Welding Based on Multi-modal DataMobina Mobaraki, Mahyar Asadi, Klaske Van Heusden +1cs.AI2026-09-07
#16SAFIRE: Safety-Critical Benchmark for Fine-grained Fire and Smoke Understanding in Multimodal LLMsPengfei Li, Naufal Suryanto, Sicheng Zhang +2cs.CV2026-09-07
#17Kalman Delta Networks: Uncertainty-aware Associative MemoryNgoc Bui, Tinglin Huang, Rex Yingcs.LG2026-09-07
#18Understanding the Impact of Model Pruning on Long-Tail Forgetting and Explanation Reliability in Medical ImagingNazish Khalid, Tausifa Jan Saleem, Amal Saqib +2cs.AI2026-09-07
#19When Superpixels Fail on Documents: A Study of Segmentation for LIME ExplanationsQuentin Telnoff, Emanuela Boros, Mickaël Coustaty +3cs.CV2026-09-07
#20Unified Vision-Centric Pedestrian Crossing Action Prediction via Adaptive Patch Projection and Proactive Spatial RectificationYao Tian, Le Yang, Binglu Wangcs.CV2026-09-07
#21Beyond Fluent Generation: A CPU Reliability Benchmark for MCP-Style Tool Calling in Sub-2B Small Language Models for Edge DeploymentAbrar Shahriar Qurat-Ul-Ain Mastoics.CL2026-09-07
#22D3ARC: Time-Critical Distributed Disaster Detection for Asynchronous Cooperative Multi-Robot SystemsNikolaos Koursioumpas, Lina Magoula, Nancy Alonistioti +1cs.RO2026-09-07
#23TAD: Token-Adaptive Contrastive Decoding with Confidence-Guided Gating for Hallucination Mitigation in Large Audio-Language ModelsHeyu Chang, Nianwen Si, Hao Zhang +2cs.SD2026-09-07
#24Robust Decentralized Federated Distillation via Multi-Modality Knowledge CollaborationXiao Ma, Hong Shen, Hui Tian +2cs.LG2026-09-07
#25EmoMed: An Emotionally-Aware Agent for Multimodal Medical Support with Real-Time Information RetrievalIvan Nasonov, Nikita Glazkov, Ivan Makovetskiy +4cs.AI2026-09-07
#26CHILD: Human-in-the-Loop OOD Detection for Safe Clinical DeploymentJinlun Ye, Kaiyue Lu, Runhe Lai +3cs.CV2026-09-07
#27Beyond Task Success: Stage-Wise Reliability of World Model Planning under Sensing DegradationGeonmyeong Lee, Byoung-Tak Zhangcs.RO2026-09-07
#28PCSDiff: Diffusion-Based Bias Correction and Super Resolution Toward Practical Operational Medium-Term Precipitation ForecastYuze Sun, Shiyi Wang, Jiancheng Pan +7cs.LG2026-09-07
#29Characterizing Contention-Induced Reliability Collapse in KV-Cache Timing Side Channels for Multi-Tenant LLM ServingRana Abu Bakarcs.CR2026-09-06
#30SerenAI: State-transition system inspired by text-based world AI modelsElvin Babayev, Artem Sinitsa, Arash Hajisharifi +1cs.AI2026-09-06
#31SAGE: A Hierarchical Framework for Evaluating Interpretive Literary Quality in NarrativesTianyu Wang, Nianjun Zhoucs.CL2026-09-06
#32Reading Decoder Trajectories: Training-Free Counterfactual Query-Trajectory Reliability for Small-Object DetectionZhaoning Shi, Bo Macs.CV2026-09-06
#33Separating Capability from Confidence: Grounded Dual-State Calibration for GRPO-Trained Medical Vision-Language ModelsYangyang Xie, Ke Hao, Jiaqi Liu +2cs.CV2026-09-06
#34Robust Conformal Consensus: Multi-Agent LLM-as-a-Judge Interval Evaluation with Conformal PredictionLihui Liucs.LG2026-09-06
#35ChildGaze: A Benchmark Dataset for Collaborative Behavior Understanding in ChildrenSindhuja Penchala, Saketh Reddy Kontham, Prachi Bhattacharjee +7cs.CV2026-09-06
#36Reliability, validity, and diagnostic evidence for multi-model LLM short-answer scoringChunyi Zhao, Chao Lics.CL2026-09-06
#37Necessary or Sufficient? Evaluating LLM Explanations With Behavioural EvidenceUrja Pawar, Rajitha Ramanayake, Nabeel Kemal +4cs.AI2026-09-04
#38PRICE: A Systematic Study of LLM Adaptation Choices for Bitcoin Price ForecastingMaryam Fakhari, Mehran Safayanics.LG2026-09-04
#39A Verifier-Guided Explainable Reasoning Framework with Gold-Anchored QLoRA, Task-Aware Mixture-of-Experts, and Group-Relative RLVRThi Kim Trang Vo, Nam Tien Le, Thi Kim Nguyet Vo +2cs.CL2026-09-04
#40A Hybrid Predictive Ensemble of Machine Learning and Deep Neural Networks for Early Cardiovascular Disease Risk AssessmentBalaji Venkateswarancs.AI2026-09-04
#41VoxelFix: Post-Hoc Semantic Correction of Completed 3D Voxel MapsSunesh Praveen Raja Sundarasami, Taehyoung Kim, Johannes Scherer +5cs.CV2026-09-04
#42MePo++: Unifying Representation Refinement and Reconciliation for General Continual LearningGuanglong Sun, Kanglei Zhou, Liyuan Wang +6cs.AI2026-09-04
#43TreeFI: Value-Aware Statistical Fault Injection for Deep Neural NetworksNoam Bires, Marcello Traiola, Angeliki Kritikakou +1cs.AR2026-09-04
#44From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical EnvironmentsLinsen Zhu, Mengqing Caics.AI2026-09-04
#45MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language ModelsChangming Xiao, Zhenliang Ni, Jinhui He +2cs.AI2026-09-04
#46LetOccVote: Learning Weakly Supervised 3D Occupancy through ConsensusChi Zhang, Qi Song, Feifei Li +2cs.CV2026-09-04
#47CoLMIN: LLM-based Multi-Decision Path Negotiation for Cooperative Autonomous DrivingZhe Huang, Zhaoxin Fan, Shuo Wang +3cs.RO2026-09-04
#48An Attention-Guided Global and Local Fusion Framework for Lesion-Focused Image ClassificationMst Shafia Tasnima, Md Samaun Elaheea, Tanjim Taharat Aurpab +1cs.CV2026-09-04
#49Diffusion Language Models for Mobile Edge Agentic AI: Foundations, Applications, and ChallengesChenqi Li, Minghui Min, Dusit Niyato +1cs.AI2026-09-04
#50Beyond Code Generation: Reliability, Verification, and Cost Economics in the Agentic Software Development LifecycleHappy Bhatics.SE2026-09-04

all trends · matching is case-insensitive substring after tokenization