PaperScope
LIVE · 2026-09-09 05:40 UTC

large-scale 13 papers this week · -36% WoW

papers mentioning "large-scale" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1GraphFAS: A Distributed System for Automated Graph Feature Generation and Selection in Industrial Transaction NetworksYice Luo, Yun Zhu, Xi Chen +7cs.LG2026-09-08
2Q2D-Web: A Large-Scale Benchmark for Retrieval in Agentic RAG SystemsMaximilian Schall, Sedigheh Eslami, Markus Krimmel +4cs.IR2026-09-08
3Hyperparameter Scaling Laws Across MoE SparsityChangxin Tian, Kunlong Chen, Jia Liu +3cs.LG2026-09-08
#4MoEMB: Scaling Universal Multimodal Embeddings with Efficient Mixture-of-Experts ModelsXuanming Cui, Shlok Kumar Mishra, Wentao Bao +6cs.LG2026-09-08
#5From Where to How: Continuous 4D Interaction Forecasting from Egocentric VideoQiaohui Chu, Haoyu Zhang, Meng Liu +3cs.CV2026-09-08
#6Flexible Spectral-Normalized Neural Gaussian Process for Dynamic Aperture PredictionYousra El-Bachir, Frederik Van der Veken, Davide di Croce +4physics.acc-ph2026-09-08
#7Limitations of Automated Simulatability: LLM Simulators Can Bypass ExplanationsAntonin Poché, Fanny Jourdan, Nils Feldhus +6cs.CL2026-09-08
#8SignRefine: Adapting Foundational Video Models for Sign Language GenerationAnton Pelykh, Edward Fish, Ozge Mercanoglu Sincan +1cs.CV2026-09-08
#9Environments as Scaffold: Enriching Feedback to Bootstrap Self-Evolving Agents in Long-Horizon TasksHongbang Yuan, Zhuoran Jin, Yixin Caocs.LG2026-09-08
#10LEBGen: An LLM-Enhanced Bayesian Network Framework for Few-Shot Travel Survey Data GenerationZijian Shen, Bin Zhou, Jiguang Wang +2cs.AI2026-09-08
#11Agentic ML Exploration (A-MLE) for Ads RankingErwin Gao, Vinodh Kumar Sunkara, Jingyi Guan +36cs.AI2026-09-08
#123DWay: Generalizing Robot Manipulation via 3D Consistent WaypointsZiqin Huang, Yingyue Li, Chenyangguang Zhang +6cs.RO2026-09-08
#13GPU-Enabled Large-Scale Optimization Using Randomized Linear AlgebraPratik Rathore, Zachary Frangella, Parth Nobel +2cs.LG2026-09-08
#14DriveMotion: A Large-Scale Multi-Source Benchmark for Driver Motion Sequence Modeling and ForecastingYuhang Wang, Chuheng Wei, Jingxin Yang +2cs.CV2026-09-08
#15A Machine Learning Framework for Predicting Restaurant Food Waste to Support Sustainable Food ManagementMd Mehedi Hasan Naeem, Md Ashraful Islam, Moumita Barua +2cs.LG2026-09-08
#16Popular Knowledge Propagates More Errors in LLM Knowledge UpdatingYuji Zhang, Weibing Wang, Cheng Qian +5cs.CL2026-09-08
#17SGD in Multiclass Logistic Regression: Sequential Learning and Scaling LawsKonstantinos Christopher Tsiolis, Denny Wu, Christos Thrampoulidis +1stat.ML2026-09-07
#18SAFIRE: Safety-Critical Benchmark for Fine-grained Fire and Smoke Understanding in Multimodal LLMsPengfei Li, Naufal Suryanto, Sicheng Zhang +2cs.CV2026-09-07
#19LLM Agents as Computational TypologistsChangbing Yang, Christopher Hammerly, Freda Shi +1cs.CL2026-09-07
#20Large-Scale User Behavior Analysis in Multimodal AI-Assisted Manual Task ExecutionRafael Ferreira, Diogo Tavares, Diogo Glória-Silva +2cs.HC2026-09-07
#21SeisBench DAS: A machine learning framework for Distributed Acoustic SensingJannes Münchmeyer, Han Xiao, Frederik Tilmannphysics.geo-ph2026-09-07
#22Qwen-Audio-3.0-ASR Technical ReportChuanmeng Bian, Daren Chen, Peixin Chen +42cs.CL2026-09-07
#23CosmoH2G: A Hand-to-Gripper Transfer Dataset and Baseline Method for Object Manipulation with Complex Spatial MovementsHongxiang Zhao, Mutian Xu, Zeyu Jin +3cs.RO2026-09-07
#24Latent-to-Latent Flow for Volumetric Stochastic SegmentationOmar Todd, Sooha Kim, Raghav Mehta +5cs.CV2026-09-07
#25Revisiting Thinning Methods for Kernel Learning ProblemsBlanca Cano-Camarero, Yago R. Aguado-Carrillo-de-Albornoz, Ángela Fernández-Pascual +1cs.LG2026-09-07
#26SPARROW: Scalable Taxonomy Induction via Structure-Preserving Partitioning and Constraint-Guided MergingYirui Zhang, Yixuan Tang, Yandong Sun +2cs.CL2026-09-07
#27Query-Aware Token Budgeting for Efficient Late-Interaction Visual Document RetrievalPS Rishi, Rajeev Ranjan Dwivedi, Vinod K Kurmics.IR2026-09-07
#28Retrieval-Augmented Multi-Prompt Ensemble for Minor-Grain Breeding Information ExtractionHang Zhao, Jiahao Wangcs.CL2026-09-07
#29Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-TrainingZili Wang, Zhaopeng Qiu, Yuekai Zhang +2cs.LG2026-09-07
#30Beyond Sparse Rewards: A New Benchmark and Structure-Aware Graph Alignment for Micro-Drama UnderstandingYixin Qin, Shi-Zhe Chen, Zhiqi Yu +4cs.AI2026-09-07
#31Single Image to Textured 3D Object Generation in Frequency Domain: From Theory to PipelineQisen Wang, Yifan Zhao, Jia Lics.CV2026-09-07
#32One for All: Generalist Foundation Model for Cross-Sensor Skeleton Representation LearningJeonghyeok Do, Yun Chen, Munchurl Kimcs.CV2026-09-07
#33DPSF-Net: A Dual-Prior Spatial-Frequency Network for Real-World Remote Sensing Image DehazingMei Lu, Shangliang Shao, Shanliang Yaocs.CV2026-09-07
#34Emo-DVS: A Multimodal Benchmark for Privacy-Aware Emotion Recognition with Event CamerasJiaqi Chen, Qinfu Xu, Hao Zhuang +1cs.CV2026-09-07
#35Organization of Valence and Arousal in Vision-Language Representations of Built Environments: Insights from the EMOIS DatasetMadoka Yonekura, Katsunori Kohda, Nobuhiko Muramoto +1cs.CV2026-09-06
#36Generalist Open-World Temporal PerceptionCristian Sminchisescucs.CV2026-09-06
#37AuthBench: A Large-Scale Multilingual Benchmark for Authorship Representation across Genres and LengthsMaoXun Huang, Zhenxing Zhang, Claire Cardiecs.CL2026-09-06
#38A Novel Semantic Manifold Alignment Attack against Embedding-to-Embedding Obfuscation in Privacy-Preserving LLMsSicong Li, Lingfeng Yao, Xingke Yang +7cs.CR2026-09-06
#39Back to the Feature: Zero-Shot 6DoF Pose Estimation via Dense Local FeaturesAli Rafiaei, Michael Greenspancs.CV2026-09-06
#40DianShi-RxnDB: A Large-Scale, Fine-Grained Organic Reaction Data Platform Built via a Fully Automated Pipeline for Researchers and AI AgentsYubin Wang, Xingjian Wei, Jiang Wu +33cs.CL2026-09-06
#41A Grapheme-Aware Indic Tokenizer for Tamil: Large-Scale Training and Intrinsic EvaluationHari Krishnan K, Sudarsun Santhiappancs.CL2026-09-06
#42VidaForge: Open Research Infrastructure for Video Pretraining Data RecipesYan Ma, Jiadi Su, Zhulin Hu +4cs.CV2026-09-06
#43Thinking with Cameras: Active Visual Reasoning via Dynamic Viewpoint Control for Surveillance Video UnderstandingXiao Zhang, Wang Zeng, Sheng Jin +3cs.CV2026-09-06
#44Large-Scale Pretraining for Improving Deep Learning-Based Geometric Distortion Correction of Diffusion-Weighted ImagingSaroj Khanal, Yashawant Kumar Yadav, Kritam Bhattarai +12cs.CV2026-09-06
#45Scaling 3D Generative Priors to Large-Scale Scene Meshes from Multi-View ImagesSangEun Lee, Wonseok Chae, Hoyoung Yoo +3cs.CV2026-09-06
#46Parameterized and Streaming Algorithms for Euclidean Fair $k$-Center ClusteringZeyu Lin, Chaoqi Jia, Longkun Guo +1cs.LG2026-09-06
#47RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?Zhenxuan Fan, Bo Zhang, Yutong Lin +9cs.RO2026-09-04
#48Scalable Detection of Fossil Palynomorphs in Multifocal Digital Microscopy ImagesAbbas Shaikh, Praise Mayor, Patrick Ainlay-Vazquez +7cs.CV2026-09-04
#49Don't Drop Dropout: Optimizing Layer Sparsity for Efficient LLM Training and InferenceMostafa Elhoushi, Alex Pretko, Nolan Dey +6cs.AI2026-09-04
#50Self-Supervised Lexical Representation Learning for Fast, Large-Scale Phylogenetic InferenceTim Wientzekcs.CL2026-09-04

all trends · matching is case-insensitive substring after tokenization