PaperScope
LIVE · 2026-09-03 05:40 UTC

inference 23 papers this week · -52% WoW

papers mentioning "inference" in title/abstract · 30d window

Latestcs.CLcs.LGcs.AIcs.CV

Mentions per Day (30d)

Latest Papers

#TitleAuthorsCatDate
1SolarWM: Open Data and Scalable Training for Long-Horizon Video World ModelsJunchao Huang, Guian Fang, Shengju Qian +15cs.CV2026-09-02
2UE5M3 FP4 Block Scaling for Stable Language Model PretrainingRobert Hu, Carlo Luschi, Paul Balancacs.LG2026-09-02
3HyperStyler: Low-resource Authorship Style Transfer via Context-aware Style Navigation and HypernetworksJongkyung Shin, Minguk Jeon, Chanwoo Park +1cs.CL2026-09-02
#4Language Models Can Control Their Own AttentionNamgyu Ho, Huzama Ahmad, Woosung Koh +3cs.CL2026-09-02
#5LoRA-TSD: Tangent-Space Spectral Descent for LoRA via Muon-Style UpdatesDmitrii Andriianov, Andrey Veprikov, Aleksandr Beznosikovcs.LG2026-09-02
#6A Top-Down Framework for Metric-Scale Athlete Localization from Single Broadcast FramesThanh-Khoi Nguyen, Hoang-Phuc Nguyen, Linh-Huynh +1cs.CV2026-09-02
#7GaLe: memory-efficient Global Approximate and Local Exact featuresAlberto Ancilotto, Elisabetta Farellacs.CV2026-09-02
#8H3DNAS: Hardware-Aware ONNX-Native 3D Point Cloud Model CompressionAnchit Mulye, Rhythm Baghel, Sujay Kumar Ingle +1cs.LG2026-09-02
#9Loom: Weaving Diagnostic Strands into Free-Text Consensus via Embedding-Space ReweightingRon Begleiter, Katya Egert Berg, Gilad Saban +1cs.AI2026-09-02
#10Online Reinforcement Learning in the Met Office Unified Model through Distributed Model-Agent CouplingPritthijit Nath, Sebastian Schemm, Peter Haynes +2cs.LG2026-09-02
#11SR-Edit: Region-Aware Image Editing via Self-RefinementAndong Wang, Zehua Chen, Yuxuan Jiang +1cs.CV2026-09-02
#12Learning to Track from Privileged Target AppearancesXin Chen, Jiao Xu, Dong Wang +2cs.CV2026-09-02
#13Towards One-for-All Robustness Across a Continuum of Threat LevelsZhichao Hou, Xiaorui Liucs.LG2026-09-02
#14When Decodability Is Not Enough: Logical Validity Representations, Behavioral Dissociation, and Causal Tests in Language ModelsSmitha Muthya Sudheendra, Jaideep Srivastavacs.CL2026-09-02
#15CA-OPD: Confidence-Aware On-Policy Distillation for Structured Visual PredictionMenghao Li, Linjie Mu, Yin Wang +4cs.CV2026-09-02
#16Structured-Prior-Guided Diffusion Inpainting with Physical Consistency for Traffic Sign AugmentationLuo Li, Chongchong Huang, Jun Jia +4cs.CV2026-09-02
#17DiffIE: Diffusion-based Open Information ExtractionKonstantin Fedorov, Valentin Malykhcs.CL2026-09-02
#18Improving Evaluation Realism with Inference-Time Compute and Deployment ScaffoldsAxel Ahlqvist, Richard Guan, Juan-Pablo Rivera +6cs.AI2026-09-02
#19SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task OntologyIhor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2cs.AI2026-09-02
#20Retrosynthesis of Synthetic Media for Explainable AI Provenance ForensicsYijie Lin, Ching-Chun Chang, Isao Echizen +2cs.CR2026-09-02
#21Codebook Agent: Amortized Topology Design for LLM Multi-Agent SystemsJinxi Yu, Yubei Li, Eric Hanchen Jiang +6cs.AI2026-09-02
#22RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic EvolutionZijian Zhao, Sen Li, Xialiang Tong +1cs.MA2026-09-02
#23Propose to Learn, Learn to Propose: Evaluability-Aware Assistance under Bounded RationalityYifan Zhu, Sammie Katt, Samuel Kaskics.AI2026-09-02
#24Hardware-Accelerated Instance Segmentation for Resource-Constrained Space Robotics with Criticality AnalysisSiddhant Shete, Hilmi Dogu Kücüker, Udo Frese +1cs.RO2026-09-02
#25FuDU: A Fuzzy Dual-dimensional Uncertainty Framework for Streaming Active Learning in Industrial Defect DetectionZhaoyang Wang, Haiyong Chen, Binyi Su +1cs.CV2026-09-02
#26Quantum MeanFlow: single-shot generative sampling on NISQ hardwareAshish Joshi, Eshaan Mistry, Takahiko Koyamaquant-ph2026-09-02
#27GeoSPRINT: Geometric Redundancy-Aware Step Pruning for Inference in Diffusion TrajectoriesArpita Joshics.LG2026-09-02
#28OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment PredictionJaehoon Jeong, Jay-Yoon Leecs.CL2026-09-02
#29Exact Limits of Random Projections for Preserving Geometry: Distance Recovery, Nearest-Neighbor Rankings, and Covariance Shape in Gaussian ModelsPiyush Saocs.LG2026-09-02
#30HyperMC: Multi-Fidelity Hyperparameter Tuning for Stochastic Gradient MCMCMing Tan, Xiyun Jiaostat.ML2026-09-02
#31text2ql: Multi-Target Natural Language Querying via a Language-Agnostic Intermediate RepresentationRitesh Kumarcs.CL2026-09-02
#32MeanField Surrogate Modeling for Scalable Runtime Scheduling of Concurrent Heterogeneous AI Inference on Shared GPUsYoussef Ennouri, Soonhoi Hacs.DC2026-09-02
#33Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language ModelsHaobo Xu, Sirui Chen, Yuanchen Bei +5cs.CL2026-09-02
#34IDEEA: training-free Input-Dependent stEEring via Activation cluster matchingZheng Wang, Muchen Li, Renjie Liao +1cs.CL2026-09-02
#35Rendering-in-the-Loop: An Execution-Driven Agent for Interactive Web DevelopmentYilong Guo, Hanqi Chen, Zixiao Ye +3cs.CV2026-09-02
#36XMerge: Cross-Axis Selection and Reconstructive Layer Merging for LLM Depth CompressionJundong Hu, Shekar Ramachandrancs.LG2026-09-02
#37CHIME: Credit-Aware Hierarchical Memory Evolution for Long-Horizon Agentic PlanningYongshi Ye, Tian Lan, Feihu Jiang +7cs.AI2026-09-02
#38DynG-Diff: A State-Aware Dynamic Guidance Diffusion Framework for Probabilistic Time Series ForecastingZhente Zhang, Zhengwei Ni, Wei Fancs.LG2026-09-02
#39Privacy Washing: Detecting Internal Contradictions in Privacy PoliciesThomas Brackincs.CY2026-09-02
#40SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution TransitionTingyan Wen, Chenqian Yan, Xurui Peng +4cs.CV2026-09-02
#41HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language ModelsRenjie Xie, Juncheng Yang, Aoting Hu +4cs.AI2026-09-02
#42GeoStore: Finding Small Storefronts in Large Scenes -- A Fine-Grained POI Localization Benchmark with Global-to-Local Asymmetric MatchingLu Han, Xiting Sun, Hao Wang +4cs.CV2026-09-02
#43Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone DistillationWenhui Chen, Zhifeng Li, Jie Zhou +5cs.LG2026-09-02
#44InstEditSeg: Instruction-Driven Image Editing for Polyp and Skin Lesion SegmentationZiquan Liu, Zhewei Zhu, Xuyang Shics.CV2026-09-02
#45Linear Fusion MultiDiffusion for Fast Training-Free Spherical Panorama GenerationAkio Hayakawa, Yusuke Mukuta, Tatsuya Haradacs.CV2026-09-02
#46ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent EvaluationsPeiying Zhu, Sidi Changcs.AI2026-09-02
#47Post-Training Ternarization of Qwen3-4B Capability, Effective Bit Budget, Storage Compression, and DeploymentAnirudh Malik, M Sparsh Mehra, Poojith Devancs.AI2026-09-02
#48Network-Aware Forecasting on Wireless Access PointsNiloo Bahadori, Swadhin Pradhan, Peiman Aminics.NI2026-09-02
#49CRISP: Cliff-awaRe Input-adaptive Sparse Prefilling with Structural-Mass-Motivated RoutingHuu Huy Nguyen, Chien Van Nguyen, Franck Dernoncourt +4cs.LG2026-09-01
#50Grounded, Compute-Efficient LLM Policy Agents for Energy-Poverty Equity in Physically-Constrained Peer-to-Peer Energy MarketsKunal Jadhav, Siddhesh Morecs.CL2026-09-01

all trends · matching is case-insensitive substring after tokenization