PaperScope
LIVE · 2026-09-03 05:40 UTC

scaling 16 papers this week · -50% WoW

papers mentioning "scaling" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1UE5M3 FP4 Block Scaling for Stable Language Model PretrainingRobert Hu, Carlo Luschi, Paul Balancacs.LG2026-09-02
2Momentum in large-batch training: Polyak enlarges the critical batch size, Nesterov improves data efficiencyJia-Nan Wang, Zixun Huang, Kairui Li +1stat.ML2026-09-02
3Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale InvarianceSai Niranjan Ramachandran, Suvrit Sracs.LG2026-09-02
#4Towards Zero-Shot Transfer Across Embodiments For Driving VLAsCaio Azevedo, Stefano Sabatini, Sascha Hornauer +1cs.CV2026-09-02
#5SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignmentQingyu Meng, Yiwei Zha, Jiahuan Pei +3cs.LG2026-09-02
#6RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic EvolutionZijian Zhao, Sen Li, Xialiang Tong +1cs.MA2026-09-02
#7Recursive Value Learning for Long-Horizon Offline Goal-Conditioned RLHyeonseong Jeon, Youngwoon Leecs.LG2026-09-02
#8FUSE: An Evaluating Framework for Dangerous Capabilities of LLMsZhengyi Jin, Ru Zhang, Xiao Chen +5cs.AI2026-09-02
#9World-Coherent Decoding: Self-Verifying Test-Time Planning for World Action ModelsChuhan Zhang, Seiji Ito, Kenta Hoshino +2cs.CV2026-09-02
#10A Power Law in Logarithm's Clothing: On the Scalability of Graph-Based Vector SearchSajad Faghfoor Maghrebi, Navid Eslami, Niv Dayancs.DB2026-09-02
#11Modeling What Changes: Sparse, Residual World Models for Object-Centric ManipulationParam Thakkar, Parsika Paresh Shah, Manisha Sushant Gotecs.RO2026-09-02
#12OR-Transformer: Scaling Real-Time Decision-Making to 1,000 ItemsShuze Daniel Liu, David Simchi-Levi, Claire Chen +2cs.LG2026-09-01
#13RAFT-DVC: Resolution-Aware Machine Learning-Based Digital Volume CorrelationZixiang Tong, Lehu Bu, Jin Yangcs.CV2026-09-01
#14Generative Diffusion Surrogates with Analytical Variance SchedulePatrick Reichherzer, Gianluca Gregori, David N. Hosking +1cs.LG2026-09-01
#15Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMsJingtan Wang, Arun Verma, Xiaoqiang Lin +4cs.CL2026-09-01
#16Gradient-Update Mismatch: Rethinking Conflict-Free Training of Physics-Informed Neural NetworksJing Xiao, Xinhai Chen, Qinglin Wang +5cs.LG2026-09-01
#17BS: Take the Hint - Interactive Multitracer PET/CT Lesion Segmentation with a Scribble-Conditioned ResEnc U-NetMarven Sherif, Amgad Elmasry, Youssef Ghazal +1cs.CV2026-09-01
#18TempCloze: Can Video-LLMs Identify the Missing Middle?Wenqi Pei, Henry Hengyuan Zhao, Yilai Liu +4cs.CV2026-09-01
#19Efficiently Estimating Optimal Hyperparameter Scaling Laws through Power-Law Entropy SearchZhiliang Chen, Sebastian Ament, David Eriksson +3cs.LG2026-09-01
#20MegaStyle++: Scaling Image Style Space through Hierarchical Style DefinitionJunyao Gao, Sibo Liu, Jiaxing Li +4cs.CV2026-09-01
#21SMELT: Scaling Laws for Compute-Matched MoE Looped TransformersShaowen Wang, Ge Zhang, Kairong Luo +6cs.LG2026-09-01
#22Some Emotions Run Deeper: Layer-wise Probing and Causal Intervention in Large Language ModelsTian Fang, Gaël Guibon, Davide Buscaldics.CL2026-09-01
#23From Base Rollouts to RL Reasoning: A Budgeted Search PerspectiveWenhe Sun, Cunxiang Wang, Zijun Yao +1cs.CL2026-09-01
#24From Language to Behavior: Scaling Sequence Transformers for Industrial Recommendation Ranking with Rec-Native DesignsJie Chen, Xiangqian Yu, Yanchao Lian +9cs.IR2026-09-01
#25Physics-Driven Independent Pair Generation for Iterative Self-Supervised Low-Dose CT DenoisingXianlei Han, Shaoyu Wang, Jiancheng Fang +2cs.CV2026-09-01
#26A Survey on Self-Improving Test-Time Intelligence: Feedback-Driven Adapting, Learning, and Scaling at InferenceShuaicheng Niu, Guohao Chen, Yaofo Chen +14cs.LG2026-09-01
#27Accelerating Reinforcement Learning via MPC Solver-Gradient Guidance for Weights-varying MPCBaha Zarrouki, Arslan Thobani, Jasper Hoffmann +6cs.RO2026-09-01
#28From Truncation to Commitment: Persistent Context in Uniform Discrete DiffusionSatoshi Hayakawacs.LG2026-09-01
#29Mind the Rift: Cross-Scale Coupling Mismatch for AI-Generated Video DetectionSiyu Li, Jin Yang, Weiheng Liangcs.CV2026-09-01
#30Teaching Vision-Language Models to Use the Scale They Are Given: Label-Free Equivariance Training for Metric Physical ReasoningKaizhen Tan, Yang Feng, Heqing Du +3cs.CV2026-09-01
#31ViTAL-X: Video-Text Alignment with Cross-Modal Temporal EditsSethuraman T, Savya Khosla, Onkar Kishor Susladkar +6cs.CV2026-09-01
#32HBQ: Hierarchical Scaling Block Quantization with Hardware-Efficiency-Aware Design for Accurate LLM InferenceChun-Ting Chen, Dongmin Han, Hangyeol Mun +6cs.LG2026-08-31
#33DynaNDE: Dynamic Near-Data Expert Scheduling for Batched MoE InferenceXiaoyang Lu, Belthangady Akash Vi Narayana Pai, Xian-He Suncs.AR2026-08-31
#34Exact Global MCMC with Denoising DiffusionMitch Hillstat.ML2026-08-31
#35ZimaBlue: Evolving Generalizable World Action Models through Scalable Video Pre-trainingXionghao Wu, Yijun Yang, Shiyang Zhou +17cs.CV2026-08-31
#36Scaling Large Reasoning Models beyond Human Supervision: A Path toward SuperintelligenceZhiqin Yang, Jingwen Fu, Yuhan Liu +16cs.AI2026-08-31
#37Improving Information Extraction with Learned QueriesOmar Sharif, Soroush Vosoughi, Nikhil Singhcs.CL2026-08-31
#38Faster Than Flash: Exploiting Attention Sparsity for Efficient Long-Context DecodingZhigeng Liu, Zhiyuan Ning, Ruixiao Li +5cs.LG2026-08-31
#39TrainSDC: Characterizing and Mitigating Silent Data Corruption in Large Language Model TrainingZhipeng Xia, Haotian Xu, Siyu Yun +4cs.LG2026-08-31
#40Liquid Gated AttentionYiheng Jiang, Yuanbo Xu, Yongjian Yangcs.LG2026-08-31
#41MedAgent-R1: Faithfulness-Aware Reinforcement Learning for Evidence-Grounded Medical ReasoningJiangwang Chen, Chenghao Zhang, Hengxing Caics.AI2026-08-31
#42TuringLLM: Efficiently Scaling Foundation Models Toward Physical AIYuheng Zhang, Yizhao Wang, Da Zhu +19cs.AI2026-08-31
#43Designing an Auditable LLM-Supported Workflow for Qualitative Thematic AnalysisNadia Jul Jeldtoft, Tariq Yousefcs.AI2026-08-31
#44From Feature Interaction to Feature Transport - A Unified Block for Scalable Recommendation ModelsZichen Luo, Jiachen Guo, Keming Gu +1cs.IR2026-08-31
#45From Final Artifacts to Trajectories: Retrospective Process Supervision for Evidence-Grounded Long-Form GenerationJunjie Huang, Jiarui Qin, Di Yin +4cs.CL2026-08-31
#46From Metaheuristics to Exact Methods: A CP-SAT Approach for Multi-Objective Healthcare Workforce SchedulingVipul Patel, Anirudh Deodhar, Dagnachew Birrucs.AI2026-08-31
#47Real-Time Scene-Adaptive Tone Mapping for High-Dynamic Range Object DetectionGongzhe Li, Linwei Qiu, Peibei Cao +3cs.CV2026-08-31
#48When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language ModelsJiaqi Wei, Xiang Zhang, Yuejin Yang +10cs.CL2026-08-31
#49RSLM: Training-Free Vector Quantization for Approximate Nearest Neighbor SearchRastislav Lenhardt, Teodora Dobos, Thomas Vecchiato +2cs.LG2026-08-31
#50MCSeg: Pre-training and Fine-tuning Volumetric Pyramid Transformer for Multi-modal Cardiac Image SegmentationZhiyu Ye, Hairong Zheng, Tong Zhangcs.CV2026-08-31

all trends · matching is case-insensitive substring after tokenization