PaperScope
LIVE · 2026-09-09 05:40 UTC

assessment 12 papers this week · -32% WoW

papers mentioning "assessment" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1PlannerForge: LLM Agents for Scenario-Based Testing of Motion Planners in Autonomous DrivingYuan Gao, Sebastian Müller, Mattia Piccinini +5cs.AI2026-09-08
2The Rater Ising-Potts Model with LLM-Derived Weights: An Application to Multi-Category Scoring ReliabilityMatthias von Davierstat.AP2026-09-08
3Supervised Cross-Modal Feature Alignment for Zero-Wearable Freezing of Gait Detection in ParkinsonismAryan Singh, Chandan Biswascs.CV2026-09-08
#4From Glance to Scrutiny: Progressive Distortion Reasoning for Fine-Grained Image Quality AssessmentAoting Zhang, Mingze Gao, Dongbao Yang +5cs.CV2026-09-08
#5SAM3-O2D2: Zero-Shot Object Out-of-Distribution Detection by Object Class Prompting of the SAM3-Image ModelLucas Görnhardt, Timo Bartels, Tim Fingscheidtcs.CV2026-09-08
#6CALIPER: Clean Scenes Cannot Rank Physical Inference in Pretrained Visual RepresentationsAman Mehta, Riya Baviskarcs.RO2026-09-08
#7SynthGait-19K: A Physically Grounded Synthetic Video Dataset for Gait Parameter EstimationSoroush Mehraban, Xin Lei Lin, Vida Adeli +5cs.CV2026-09-08
#8VEX-Bench: Benchmarking LLM Agents for Assessing Exploitability of Software Supply Chain VulnerabilitiesJiahao Shi, Edward Tsien, Yifeng Di +10cs.CR2026-09-07
#9SAFER-Activities: A Dataset for Smart Assessment of Fall Events and Routine ActivitiesDiwas Lamsal, Pramod Wickramatilake, Jednipat Moonrinta +2cs.CV2026-09-07
#10Solving the Elastic Wave Equation with Physics-Informed Neural Networks: A Robust and Critical AssessmentDavide Staub, Ben Moseleycs.LG2026-09-07
#11The Role of Uncertainty in Assessing the Fairness of Machine Learning ModelsFrancesca Panero, Ernst C. Wit, Marco Scutaristat.ML2026-09-07
#12Do Large Language Models Know What They Don't Know II? A Fully Behavioral, Non-Cognitive Measure of Epistemic HonestyAli Şenol, H. Russell Bernard, Huan Liucs.AI2026-09-07
#13CodeTD: Topology of Attention Detects Hallucinations in Code LLMsDaria Voronkova, Ilya Trofimov, Anton Dmitriev +3cs.SE2026-09-07
#14Bag of Tricks or Bag of Myths? Reducing Modeling Complexity with Task Knowledge in Explainable Suicide Risk AssessmentShlok Shelat, Shrey Salvi, Souvik Roy +2cs.CL2026-09-07
#15The Profit Alignment Problem: How Profit Mandates Induce Alignment Failures in LLMsEric Socs.AI2026-09-07
#16A radiographic world model for clinical reasoning and evidence generationSuyang Xi, Songtao Hu, Shansong Wang +8cs.AI2026-09-07
#17Privacy Leakage from a Thousand Words: Millipixel Location Recovery from Dot MapsYuntao Du, Tanishq Pauskar, Hao Wang +2cs.CR2026-09-07
#18FinCUABuild: Can Agents Build Reliable Benchmarks for Dynamic Financial Computer Use?Jingpu Yang, Fengxian Ji, Jinri Guo +7cs.AI2026-09-07
#19AFID: A Unified Open Framework for Automated Fingermark Identification, Quality Assessment and Feature ExtractionTim Oblak, Rudolf Haraksim, Peter Peercs.CV2026-09-07
#20BlueprintAgent: Constraint-Triggered Targeted Revisits for Simulation-Ready Generation from Scanned Structural BlueprintsZhouyuan Xu, Chen Yang, Linhao Wang +2cs.CL2026-09-07
#21From Explicit References to Scene Manifolds: Distributional Fidelity and Realism for Radiance Field Quality AssessmentSaeed Mahmoudpour, Gi-Mun Um, Hyon-Gon Choo +1cs.CV2026-09-07
#22CRISP: Corneal Confocal Microscopy Real-Time Image Stitching PipelineQincheng Qiao, Puli Zhang, Jian Zhou +1cs.CV2026-09-07
#23LANTERN: Language Model Assessment on Noisy and Transformed Tasks for Understanding Error and Robustness NuancesVamsi Krishna Kodavali, Rituraj Singhcs.CL2026-09-07
#24Probing the Structure and Dynamics of LLM Value Expression through Value ConflictsKaicheng Zhang, Jingyi Xiao, Renjun Hu +3cs.CL2026-09-07
#25EmoMed: An Emotionally-Aware Agent for Multimodal Medical Support with Real-Time Information RetrievalIvan Nasonov, Nikita Glazkov, Ivan Makovetskiy +4cs.AI2026-09-07
#26EEG-Driven Decoding Framework for Passenger Hazard Perception in Highly Automated VehiclesYingkai Yang, Ashton Yu Xuan Tan, Bowen Li +10cs.AI2026-09-07
#27PTCG: Persona-guided Tree-based Counterargument GenerationEunbeen Son, Yohan Jo, Joonsuk Park +1cs.CL2026-09-07
#28AF-Mamba: Efficient Long-Term Signal Modeling for Early Prediction of Atrial Fibrillation OnsetYongbin Lee, Ki H. Choncs.LG2026-09-07
#29PCSDiff: Diffusion-Based Bias Correction and Super Resolution Toward Practical Operational Medium-Term Precipitation ForecastYuze Sun, Shiyi Wang, Jiancheng Pan +7cs.LG2026-09-07
#30CARDEA: Auditable Reasoning Grounded in Spatial Evidence for End-to-End Coronary Angiography InterpretationJia-Jen Lee, Shih-Yen Hou, Kee Koon Ng +2cs.CV2026-09-07
#31When Speech Meets Lips: Interpretable Audio-Visual Synchronization for L2 Pronunciation AssessmentBowen Yu, Mingyu Huang, Yishen Liu +1cs.CV2026-09-06
#32Simulating the Marginal Green Contribution of AI Modules in a Smart-Agriculture Platform: Evidence from Two Monte Carlo ExperimentsZhaoyang Li, Ruijie Zhang, Zhaoji Sun +1cs.AI2026-09-06
#33Monte Carlo-Based Ex-Ante Assessment of the Green Benefits of an AI-Driven Smart Agriculture Platform in HainanZhaoyang Li, Ruijie Zhang, Zhaoji Sun +1cs.AI2026-09-06
#34SAGE: A Hierarchical Framework for Evaluating Interpretive Literary Quality in NarrativesTianyu Wang, Nianjun Zhoucs.CL2026-09-06
#35Reading Decoder Trajectories: Training-Free Counterfactual Query-Trajectory Reliability for Small-Object DetectionZhaoning Shi, Bo Macs.CV2026-09-06
#36SRD-GUARD: A Defense Framework of LLMs via Semantic Rewriting and Joint Multi-Model Scoring for Latent Intent ExposureQi Wang, Chengcheng Wan, Jiangtao Wangcs.CR2026-09-06
#37Large-Scale Pretraining for Improving Deep Learning-Based Geometric Distortion Correction of Diffusion-Weighted ImagingSaroj Khanal, Yashawant Kumar Yadav, Kritam Bhattarai +12cs.CV2026-09-06
#38Separating Capability from Confidence: Grounded Dual-State Calibration for GRPO-Trained Medical Vision-Language ModelsYangyang Xie, Ke Hao, Jiaqi Liu +2cs.CV2026-09-06
#39Reliability, validity, and diagnostic evidence for multi-model LLM short-answer scoringChunyi Zhao, Chao Lics.CL2026-09-06
#40Who Should Grade My Work? Student Perspectives on Transparent AI-Assisted Writing Assessment in Higher EducationRayed AlGhamdics.AI2026-09-04
#41Can Large Language Models Anticipate Behavioral Responses to Social Policies? A Case of Pension Enrollment Prediction among China's Flexible WorkersYumiao Li, Peixin Liu, Donglin Di +2cs.CL2026-09-04
#42A Hybrid Predictive Ensemble of Machine Learning and Deep Neural Networks for Early Cardiovascular Disease Risk AssessmentBalaji Venkateswarancs.AI2026-09-04
#43A Human-in-the-Loop Framework for AI-Assisted Scoring in Large-Scale Writing AssessmentMaría Eugenia Curi, Germán Capdehourat, Isabel Amigo +4cs.CL2026-09-04
#44How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human-Artificial Agents InteractionsFernanda Mansilla, Aloysius Tok, Bahia Guellaï +2cs.CL2026-09-04
#45ARIA - An Agentic Framework for Autonomous Testing of Infotainment SystemsAntónio Azevedo, Bruno Lima, João Pascoal Fariacs.SE2026-09-04
#46Attention-guided super-resolution of 4D flow MRI in carotid arteriesAli Mokhtari, Dominik Obristphysics.med-ph2026-09-04
#47PRISM-Bench: An Audio-Centric Diagnostic Benchmark for Text-to-Audio-Video GenerationYuchen Sun, Qian Yang, Jun Wang +4cs.MM2026-09-04
#48Building a research-software catalog with a coding agent: from hackathon prototype to public deploymentKazuyoshi Yoshimi, Satoshi Terasaki, Gotai Yamadacs.SE2026-09-04
#49Retinal OCTA Phenotyping with LLM Reporting for Alzheimer's DiseaseProgga Paromita Dutta, Jeba Maliha, Md Rafiul Kabircs.CV2026-09-04
#50Last Translation BenchmarkVilém Zouhar, Niyati Bafna, Mukund Choudhary +241cs.CL2026-09-03

all trends · matching is case-insensitive substring after tokenization