PaperScope
LIVE · 2026-09-09 05:40 UTC

gradient 14 papers this week · -6% WoW

papers mentioning "gradient" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1Learning Length-Extrapolatable Recurrent ModelsHanwen Jiangcs.LG2026-09-08
2Silver Rate Is (Almost) Optimal for Gradient Descent AccelerationYuhan Ye, Kaizhao Liumath.OC2026-09-08
3ThinkPrior: Zero-Rollout Difficulty Priors for Cold-Start Prompt Selection in RLVRTommy Sha, Skylar Zhai, Siqi Zhaocs.LG2026-09-08
#4Deposon: An Auditable, Conservation-Guaranteed, Game-Theoretically Tested Scattering Layer over LLM Reasoning PathsQihao Yuancs.AI2026-09-08
#5SeGDeP: Semantic- and Geometric-Aware Decoupled Prompts for Reasoning SegmentationLinnan Zhao, Xu Liu, Lingling Li +3cs.CV2026-09-08
#6Ostrich: Taking Large Strides Through Stiff Contact in Differentiable DynamicsAleš Kučera, Karel Zimmermanncs.RO2026-09-08
#7Eliciting Weak-to-Strong Generalization with On-Policy Reverse DistillationYoungrok Park, Sangmin Bae, Hojung Jung +6cs.LG2026-09-08
#8AXS-Net: Interpretable Deep Unfolding for Hyperspectral Image Denoising via Spectral Basis Unmixing and Structured Noise RefinementZiyi Guan, Jianping Zhang, Zheng Yangcs.CV2026-09-08
#9Suan: Rectifying Direct Preference Safety Alignment in Large Language ModelsOleksandr Cherednichenko, Roman Klypacs.LG2026-09-08
#10Why shared attention vectors fail: a case for outcome-indexed tuningLenard Domecs.LG2026-09-08
#11AgentGrad: Intervention-guided Prompt Optimization for Multi Agent SystemsJaewon Chu, Jinwoo Seo, Jaewon Cho +4cs.AI2026-09-08
#12Not All Variables Agree: Reliability-Aware Variable-Wise Gradient Surgery for Multivariate Time-Series ForecastingJinwoo Park, Hyeongwon Kang, Pilsung Kangcs.LG2026-09-08
#13The Exact Time-Uniform Rate Frontier for Stochastic Gradient Descent on Smooth Convex ObjectivesRuijie Li, Kang Chen, Tianyu Wangmath.OC2026-09-08
#14Equivariance Breaks the Learning RateAndrei Manolache, Mathias Niepertcs.LG2026-09-08
#15How to Make the Gradient Mapping Small for Constrained Stochastic Min-Max Problems and BeyondAhmet Alacaoglumath.OC2026-09-08
#16Geometry-Aware Bayesian Parameter-Efficient Fine-Tuning on the Stiefel Manifold via Stein Variational Gradient DescentQuang-Duy Tran, Trung Le, Bao Duong +2cs.LG2026-09-08
#17Adaptively Incorporating Directional Hints into Zeroth-Order OptimizationAlexander Ryabchenko, Jian Qian, Wenlong Moucs.LG2026-09-08
#18zScore-N: A Neural Network for On-Chain Wallet Reputation ScoringGirish G N, Ashutosh Sahoo, Akshay SP +2cs.AI2026-09-08
#19Speed Limit for Information Acquisition in Stochastic Learning DynamicsShuta Kobayashi, Andreas Dechantcond-mat.stat-mech2026-09-08
#20DRIFT: Removing Diffusion Watermarks by Deflecting the Generative TrajectoryRui Bao, Zheng Gao, Xiaoyu Li +3cs.CR2026-09-08
#21A Better Spur Should Start From Each ObjectiveShanwen Mao, Hao Zhang, Guangtao nie +4cs.AI2026-09-08
#22A Transformer-Based Delta Expression Encoder for Psilocybin Transcriptional Response: Architecture, Representations, and Biological ValidationSai Jayakumarq-bio.GN2026-09-08
#23When Metrics Reward the Worst Translations: Internalizing Cultural Reasoning for Social Media Translation EvaluationYiwen Qiu, Linjuan Wu, Dingming Li +7cs.CL2026-09-08
#24Topology-induced Operators Reveal Complementary Graph Representations without TrainingMeng Qin, Jinqiang Cui, Hongwei Zheng +2cs.LG2026-09-08
#25GPU-Enabled Large-Scale Optimization Using Randomized Linear AlgebraPratik Rathore, Zachary Frangella, Parth Nobel +2cs.LG2026-09-08
#26Sparse Data Augmentation for Optimization with Provable GuaranteesBehrooz Tahmasebi, Melanie Webercs.LG2026-09-08
#27A Machine Learning Framework for Predicting Restaurant Food Waste to Support Sustainable Food ManagementMd Mehedi Hasan Naeem, Md Ashraful Islam, Moumita Barua +2cs.LG2026-09-08
#28A Gradient-based yet Spike-Timing-Dependent Solution to the Feedback Learning Problem in Neural MicrocircuitsXiangnan Zhang, Jingxin Liu, Ranqi Lu +6cs.NE2026-09-08
#29TaskGuard: Task-Conditioned Restoration Utility for Risk-Aware Object DetectionVung Phamcs.CV2026-09-07
#30Support Topology and Gradient Mixing in Sinkhorn LayersDylan Fordecs.AI2026-09-07
#31SGD in Multiclass Logistic Regression: Sequential Learning and Scaling LawsKonstantinos Christopher Tsiolis, Denny Wu, Christos Thrampoulidis +1stat.ML2026-09-07
#32Latent-MoE: Domain-Aware Mixture-of-Experts for PDEs with Multi-Regime PhysicsHanwen Wang, Paris Perdikariscs.LG2026-09-07
#33Understanding the Impact of Model Pruning on Long-Tail Forgetting and Explanation Reliability in Medical ImagingNazish Khalid, Tausifa Jan Saleem, Amal Saqib +2cs.AI2026-09-07
#34A Theoretical Analysis of Generalization Dynamics in Neural Networks under Gradient Descent with Weight DecayYuqing Wang, Ioannis G. Kevrekidis, Mikhail Belkincs.LG2026-09-07
#35Local gradient neural operatorBaiming Zhang, Jinsong Tang, Ying Xu +2cs.LG2026-09-07
#36Scalability Analysis of Distributed Kolmogorov-Arnold Network Training on High-Performance Computing SystemsGuangneng Chen, David Garcia Selfa, Pablo Quesada Barriusocs.DC2026-09-07
#37Emergent Charging Coordination in Electric Delivery FleetsJavier Vales-Alonso, Juan J. Alcarazcs.LG2026-09-07
#38MpSub: A Momentum $p$-Dimensional Subspace Trust-Region Method for Derivative-Free Fine-Tuning of Large Language ModelsYuyang Wang, Haoyu Yao, Pengcheng Xiecs.LG2026-09-07
#39Translation of Black-Box Clinical Prediction Models into Standalone Transparent Nomograms: Temporal External Validation in Heart TransplantationHenry Pigot, Paulo J. G. Lisboa, Sandra Ortega-Martorell +3cs.LG2026-09-07
#40Beyond the Matrix Sign: Quadratic Spectral DescentQiaozhe Zhang, Jun Sun, Yingzhuang Liucs.LG2026-09-07
#41Human mutation field reveals an equilibrium-like structure with irreversible circulationIsabella Caranzano, Daniel Maria Busiello, Stefano Priorelli +2q-bio.GN2026-09-07
#42TASTE: Throughput-Aware Batch Size Tuning for On-Device Edge LearningAvik Bhatnagar, Federico Nicolas Peccia, Oliver Bringmanncs.LG2026-09-07
#43A Systematic Analysis of Automatic Differentiation versus Discretization-based Constraints for Physics-Informed PDE SolversXing Guo, Hongwei Tang, Zewei Meng +3math.NA2026-09-07
#44Impact of canny edge detection preprocessing on performance of machine learning models for Parkinson's disease classificationSameer Bhat, Piotr Szczukocs.LG2026-09-07
#45Parallelism Strategy Chaining for Fast Training ConvergenceMinchul Kang, Changyong Shin, Younghun Go +4cs.LG2026-09-07
#46Robust Decentralized Federated Distillation via Multi-Modality Knowledge CollaborationXiao Ma, Hong Shen, Hui Tian +2cs.LG2026-09-07
#47PhysMAS: Physics-Grounded Multi-Agent Synthesis of Compositional 4D GaussiansJiang Qin, Chunji Lv, Yangguang Wei +6cs.AI2026-09-07
#48Mind the Approximation: Fisher-Weighted SVD Compression for ViTsMoritz Thoma, Maximilian Groezinger, Maximilian Forstenhäusler +7cs.CV2026-09-07
#49Stable-MM-R1: Anchoring Multimodal Reasoning Dynamics via Entropy-Guided StratificationYimeng Ye, Shuang Chen, Wenxuan Huang +8cs.LG2026-09-07
#50Flow3D-OPD: Multi-Teacher On-Policy Distillation for 3D Geometry Generation with Flow-Matching Diffusion TransformerZhiwei Ning, Zhen Zhou, Puhua Jiang +7cs.CV2026-09-07

all trends · matching is case-insensitive substring after tokenization