PaperScope
LIVE · 2026-09-03 05:40 UTC

cs.CL Computation & Language · 24,331 papers

NLP 与大模型 · daily new submissions

Latestcs.CLcs.LGcs.AIcs.CV

New Papers per Day (30d)

#TitleAuthorsCatDate
1User Feedback Provides a Unique Signal that LLMs Can not DetectShachar Don-Yehiya, Leshem Choshen, Omri Abendcs.CL2026-09-02
2Post-Training Language Models for Gold-Medal Performance in Coding CompetitionsAleksander Ficek, Sean Narenthiran, Mehrzad Samadi +2cs.LG2026-09-02
3Dutch Books for Language ModelsIsaiah Andrews, Suproteem Sarkarecon.GN2026-09-02
#4DiscoSign: Discourse-Aware Text to Sign Language Gloss TranslationVasileios Baltatzis, Mert Inan, Connor Gillis +4cs.CL2026-09-02
#5EarlyEval: Cheaper Agent Evaluation via Early Outcome PredictionYuling Shi, Zhensu Sun, Junsen Dong +3cs.CL2026-09-02
#6ShallowStream: Index Shallow then Answer Deep for Streaming Video UnderstandingJitai Hao, Ke Yang, Qiang Huang +1cs.CV2026-09-02
#7HyperStyler: Low-resource Authorship Style Transfer via Context-aware Style Navigation and HypernetworksJongkyung Shin, Minguk Jeon, Chanwoo Park +1cs.CL2026-09-02
#8From Reweighting to Rewriting: Unlocking the Intervention Effects of Influential Samples in Training Data AttributionYuzhang Luo, Chenpeng Wang, Jianhui Chen +1cs.CL2026-09-02
#9Untangling the Mechanisms of Misleading Context in Medical Question AnsweringRobin Linzmayer, Noémie Elhadadcs.CL2026-09-02
#10Repo-To-Skill: Distilling GitHub Repositories Into AI4AI SkillsJianlyu Chen, Yuyang Hu, Hongjin Qian +8cs.AI2026-09-02
#11Incremental Pooled LLM Evaluation for Cost-Effective Retrieval Model SelectionMax Nelson, Hanoz Bhathena, Aviral Joshi +1cs.IR2026-09-02
#12Language Models Can Control Their Own AttentionNamgyu Ho, Huzama Ahmad, Woosung Koh +3cs.CL2026-09-02
#13Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR BasesBernard Muller, László Tóth, LaVonne Robertscs.CL2026-09-02
#14CORAL: An LLM-Native Harness for Production Recommender SystemsMuhammad Rafay Azhar, Yuhang Zhou, Gilbert Jiang +7cs.CL2026-09-02
#15Door-in-the-Face Requests and Refusal Behaviour in Large Language ModelsTil Jordancs.AI2026-09-02
#16Trace as State: Reasoning Traces as Conditional States for Long-Context TransformersXu Zou, Jie Tangcs.CL2026-09-02
#17DKL: Decoupled Knowledge Learning for Instruction-Tuned Language ModelsKushagra Bhushan, Meghanadh Pulivarthi, Sai Krishna Reddy Sathi +7cs.CL2026-09-02
#18From Tokens to Semantics: Leveraging Complementary Signals for Hallucination Detection in Black-Box LLMsUrja Pawar, Rajitha Ramanayake, Owen O'Neill +4cs.CL2026-09-02
#19oHC: Orthogonal Hyper-Connections on SO(4) via QuaternionsHaoqiang Guo, Xuyi Chen, Bo Ke +5cs.CL2026-09-02
#20WinoQueer-NL: Assessing Bias in Dutch Language Models toward LGBTQ+ IdentitiesJiska Beuk, Gerasimos Spanakiscs.CL2026-09-02
#21Loom: Weaving Diagnostic Strands into Free-Text Consensus via Embedding-Space ReweightingRon Begleiter, Katya Egert Berg, Gilad Saban +1cs.AI2026-09-02
#22TaRA: Training-Aware Low-Rank Adaptation InitializationTaehyeon Kim, Eunhyeok Parkcs.CL2026-09-02
#23Scalable Direction-Following TTS via Voice Impression-Guided Pseudo Triplet ConstructionKenichi Fujita, Yusuke Ijimacs.SD2026-09-02
#24Predictors of Loneliness in Older Adults Using Multimodal Analysis of Speech and LanguageVinmay Khandode, Sai Karthik Kosuri, Neil K. R. Sehgal +6cs.CL2026-09-02
#25When Persona Attributes Improve Population Alignment in Large Language ModelsLeon Fröhling, Jens Rupprecht, Markus Strohmaier +1cs.CL2026-09-02
#26Debias-SparseGPT: Bias-Aware Pruning for Large Language ModelsIrina Proskurina, Guillaume Metzler, Antoine Gourru +1cs.CL2026-09-02
#27ViSAR: Training-Free Adaptive-$k$ Retrieval for Visual Document Question AnsweringAdrien Mialland, Marc Plantevit, Julien Gallois +1cs.IR2026-09-02
#28How LLMs Build Fictional Worlds: Setting and Narrative Space in AI-Generated Creative StorytellingKatrin Rohrbacher, Björn Nieth, Emmanuelle Salin +2cs.CL2026-09-02
#29PragAlign: Feedback-Guided Pragmatic Alignment for Controlled Synthetic Dialogue GenerationSmitha Muthya Sudheendra, Jaideep Srivastavacs.CL2026-09-02
#30Learning to Fuse LLMs with Ontology Rankers for Rare-Disease DiagnosisZhaoyang Jiang, Zhizhong Fu, Yunsoo Kim +5cs.CL2026-09-02
#31Scalable Kronecker-Fisher Approximation: Efficient Hessian Analysis for Billion-Parameter Language Models CompressionViacheslav Yusupov, Daria Cherniuk, Evgeny Frolovcs.LG2026-09-02
#32When Decodability Is Not Enough: Logical Validity Representations, Behavioral Dissociation, and Causal Tests in Language ModelsSmitha Muthya Sudheendra, Jaideep Srivastavacs.CL2026-09-02
#33UTP-Bench: Uncertainty-aware Travel Planning BenchmarkEtcharla Revanth Rao, Priyanshu Karmakar, Shubhojit Mallick +3cs.AI2026-09-02
#34Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grounded Persuasion in Multi-Turn JailbreakingSiyu Chen, Haoran Wang, Xiaojian Li +3cs.CL2026-09-02
#35Improving Health Literacy through Lay Summarization of Radiological Reports: An Evaluation of BioNER and Retrieval-Augmented GenerationEgecan Çelik Evgin, İlknur Karadeniz, Olcay Taner Yıldızcs.CL2026-09-02
#36PolERo: Studying Political Evasion in RomanianGabriel Stefan, Sergiu Nisioics.CL2026-09-02
#37MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution ShiftsMatteo Greco, Anudeex Shetty, Andrea Tagarelli +1cs.CL2026-09-02
#38NE-R1: Enhancing Named Entity Recognition Model via Reinforcement LearningMeixuan Chen, Hehan Li, Ruizhi Zhao +8cs.CL2026-09-02
#39SonicCaps: Large-Scale Diverse and Fine-Grained Captioning for Improved Audio-RetrievalZineb Lahrichi, Marc Ferras, Gaël Richard +1cs.SD2026-09-02
#40SALA: Semantic-Aware Logical Alignment for Complex Reasoning in In-Context LearningZhao Ji, Wenqing Chen, Zhixuan Chu +4cs.AI2026-09-02
#41Counter-GEO-Bench: Evaluating Defenses Against Information-Distorting Generative Engine OptimizationBing Zheng, Zongyao Zhao, Wenming Yangcs.IR2026-09-02
#42DiffIE: Diffusion-based Open Information ExtractionKonstantin Fedorov, Valentin Malykhcs.CL2026-09-02
#43Efficient GUI Agents: A Systems Survey of Observation, Memory, Action, and Runtime OptimizationBizhe Bai, Jiakang Yuan, Hongming Wu +8cs.CL2026-09-02
#44Improving Evaluation Realism with Inference-Time Compute and Deployment ScaffoldsAxel Ahlqvist, Richard Guan, Juan-Pablo Rivera +6cs.AI2026-09-02
#45SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task OntologyIhor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2cs.AI2026-09-02
#46Entangled Representations Amplify Collateral Damage in UnlearningEvžen Wybitul, Tim G. J. Rudner, Christian Schroeder de Wittcs.LG2026-09-02
#47Do Large Language Models Capture the Diversity in their Training Data?Youqi Wu, Farzan Farniacs.CL2026-09-02
#48CoMerge: Conflict-Driven Preference Optimization for Multi-Task Model MergingMingjie Zheng, Zihao Chen, Wenqing Chen +4cs.AI2026-09-02
#49PaperCompiler: Faithful Paper-to-Code Generation via Repository-Level Specification CompilationYunhao Liu, Hong Phuc Pham, Jaehong Yooncs.CL2026-09-02
#50From Detection to Characterization: A Large-Scale Study of Ragebait on Japanese XZhiyang Qi, Kazuhiro Ito, Jinghui Chen +5cs.SI2026-09-02
#51APEx: Distillation of Agent Procedural Experience for Adaptive Deep Research Question AnsweringJie Ding, Rui Sun, Xinyuan Zhang +2cs.AI2026-09-02
#52RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic EvolutionZijian Zhao, Sen Li, Xialiang Tong +1cs.MA2026-09-02
#53LeakageBench: Document-Level Leakage Risk for Redacting Personally Identifiable Information in Document ImagesVishnu Prasad Vijaya Kumar, Santhosh Venkatesh, Ivan P. Yamshchikovcs.CV2026-09-02
#54Breadth Beats Depth: Improving GCG-Based Jailbreak Optimization with Breadth-Oriented Suffix SearchShiliang Xiao, Jingsong Wei, Yuzhi Liang +3cs.CL2026-09-02
#55Do Cantonese-Adapted Language Models Better Predict Cantonese Reading? A Cross-Model Eye-Tracking EvaluationZiqi Zhang, Emmanuele Chersoni, Mohammad Momeniancs.CL2026-09-02
#56OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment PredictionJaehoon Jeong, Jay-Yoon Leecs.CL2026-09-02
#57A Layered Taxonomy for Chinese Learner Grammatical Error AnnotationMengyang Qiu, Jungyeul Parkcs.CL2026-09-02
#58EmoStance: Response-Side Affective-Orientation Control for Empathetic Response Generation via Emoji Weak SupervisionZiyuan Jin, Yuxuan Ge, Zheng Tiancs.AI2026-09-02
#59C$^{3}$T: Counterfactual Causal Reasoning for Sentiment Shifts in Social-Media Conversation TreesS M Rafiuddin, Atriya Sencs.CL2026-09-02
#60AI agents reshape consensus formation in human groupsLin Chen, Ziyi Liu, Xia Hu +1cs.CL2026-09-02
#61text2ql: Multi-Target Natural Language Querying via a Language-Agnostic Intermediate RepresentationRitesh Kumarcs.CL2026-09-02
#62Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language ModelsHaobo Xu, Sirui Chen, Yuanchen Bei +5cs.CL2026-09-02
#63MASkills: Continual Skills Optimization for Multi-Agent LLM SystemsHuaiyuan Yao, Xiaoou Liu, Charles Fleming +2cs.AI2026-09-02
#64Selective Knowledge Edit Reversal via Gated Singular Vector ShrinkageWeifeng Jiang, Ruirui Chen, Qianren Mao +3cs.CL2026-09-02
#65IDEEA: training-free Input-Dependent stEEring via Activation cluster matchingZheng Wang, Muchen Li, Renjie Liao +1cs.CL2026-09-02
#66XMerge: Cross-Axis Selection and Reconstructive Layer Merging for LLM Depth CompressionJundong Hu, Shekar Ramachandrancs.LG2026-09-02
#67Transfer Safety Awareness for Cross-Modal Safety Drift in Multimodal Large Language ModelsTianqi Xiao, Shiyao Cui, Minghao Zhang +2cs.MM2026-09-02
#68HyGRAIL: Cost-Aware and Evidence-Grounded Scientific Hypothesis Discovery over Knowledge GraphsYihang Sun, Zhihan Zhu, Zhiyuan Jiang +3cs.CL2026-09-02
#69Privacy Washing: Detecting Internal Contradictions in Privacy PoliciesThomas Brackincs.CY2026-09-02
#70A Tri-Agent Framework for Evaluating and Aligning Question Clarification Capabilities of Large Language ModelsYikai Zhao, Saurabh Pandey, Pradeep Kumar Misracs.CL2026-09-02
#71The Dynamics of Continuous Mixture Collapse in Language ModelsAli Backourcs.LG2026-09-02
#72How Output Format Confounds Data Quality and Capability in Instruction TuningChengguang Gan, Hanjun Wei, Yunhao Liang +3cs.CL2026-09-02
#73Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone DistillationWenhui Chen, Zhifeng Li, Jie Zhou +5cs.LG2026-09-02
#74NS-Copilot: An LLM-Driven Agent System for Autonomous Neuroscience AnalysisWuche Liu, Yiran Qiao, Linlin Hou +4cs.CL2026-09-02
#75Sparse Readout Prism: Explaining Logit-Lens Scores in Features Instead of TokensMatteo He, William F. Shen, Xinchi Qiu +1cs.CL2026-09-01
#76CRISP: Cliff-awaRe Input-adaptive Sparse Prefilling with Structural-Mass-Motivated RoutingHuu Huy Nguyen, Chien Van Nguyen, Franck Dernoncourt +4cs.LG2026-09-01
#77Grounded, Compute-Efficient LLM Policy Agents for Energy-Poverty Equity in Physically-Constrained Peer-to-Peer Energy MarketsKunal Jadhav, Siddhesh Morecs.CL2026-09-01
#78Accurate in space, unreliable in time: how LLMs represent national cultural changeYalda Daryani, Miranda Bogen, Madeleine I. G. Daeppcs.CY2026-09-01
#79GAPS: Dimension-Level Gates for Conditional Activation SteeringMoghis Fereidouni, Muhammad Umair Haider, Hassan Sajjad +1cs.CL2026-09-01
#80Thinking effort aligns between humans and reasoning models in abductive reasoningHenry Arthurcs.CL2026-09-01
#81ExecRetrieval: Measuring the Functional-Correctness Gap in Code-Embedding RetrievalAaryan Kapoor, Md Abdullah Al Hafiz Khancs.SE2026-09-01
#82The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory AgentsJundong Hu, Shekar Ramachandrancs.AI2026-09-01
#83Cite or Decline: A Strict Course-Grounded Chatbot for STEM Lecture VideosS M Masrur Ahmed, Jaspal Subhlokcs.CL2026-09-01
#84Candidate Generation and Definition-Guided Verification for Sentence-Level Depression Symptom RecognitionWeiming Li, Catarina Barata, Miguel Constante +1cs.CL2026-09-01
#85Interpretable Symptom Vectors for Depression in a Large Language ModelFangyi Zhu, Ajay Subramanian, Allison Constant +3cs.CL2026-09-01
#86AVERT: Audio-Verified Adjudication for Spoken Dialogue State TrackingChunggi Lee, Hanspeter Pfistercs.CL2026-09-01
#87TalkFa: A Unified Benchmark for Farsi Dialogue Generation and UnderstandingNeda Jamshidi, Kamyar Zeinalipour, Fahimeh Akbari +3cs.CL2026-09-01
#88How Do Prompt Variations Affect Energy Consumption in On-Device LLMs?Wei Hu, Xiaolong Tu, Dawei Chen +3cs.CL2026-09-01
#89Disentangling Statistical Preemption from Entrenchment in Language Models' Avoidance of OvergeneralizationYixuan Wang, Freda Shi, Kanishka Misracs.CL2026-09-01
#90VakyArth: Evaluating Pragmatic Competence in LLMs across Indic LanguagesUsneek Singh, Poorvaja Veera Balaji Kumar, Parth Nanda +4cs.CL2026-09-01
#91MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal ModelsTawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5cs.CL2026-09-01
#92When Can a Machine Trust a Statute? A Survival Certificate for Machine-Extracted Legal LogicSurya Sakacs.AI2026-09-01
#93SpeakPay: Domain-Adaptive LoRA Fine-Tuning of Whisper for Low-Resource Nepali Financial Speech RecognitionBiraj Subedics.CL2026-09-01
#94Harness Engineering in LLM Tool Use via Agent-Native Reusable Tool PrimitivesHaibo Jin, Suijin Wang, Xucheng Yu +2cs.SE2026-09-01
#95Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization EvaluationHimil Vasava, Ming Jiangcs.CL2026-09-01
#96Efficient SWE Agent Benchmarking via Trajectory-Aware EvaluationKefeng Duan, Dewu Zheng, Yanlin Wang +7cs.SE2026-09-01
#97Adaptive Critical Token-Aware Retrieval for Repository-Level Code GenerationKefeng Duan, Dewu Zheng, Yanlin Wang +8cs.SE2026-09-01
#98CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses?Damien Sileo, Dimitri Kachlercs.CL2026-09-01
#99The Rise of Verbal Reinforcement LearningKshitij Tayal, Arun Sharma, Genta Indra Winata +2cs.CL2026-09-01
#100StudentSim: Training LLM-based Student SimulatorsKe Yang, Chenglong Wang, Michel Galley +4cs.CL2026-09-01
#101Designing Proactive Thought Partners for WritingChao Zhang, Abe Davis, Chih-Wei Chen +1cs.HC2026-09-01
#102The Structure of Quantization Damage in LLMs: Why the Next Bit Should Be Spent GloballyJundong Hu, Shekar Ramachandrancs.LG2026-09-01
#103Closing Cost-Quality Gap in Document VLMs: Difficulty-Aware Data Curation and Quality-Adjusted Deployment EconomicsMaksim Evdokimov, Matvey Ivanov, Dmitrii Tsiupin +3cs.CL2026-09-01
#104Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMsJingtan Wang, Arun Verma, Xiaoqiang Lin +4cs.CL2026-09-01
#105From Production Traffic to Post-Training: Building a Self-Hosted LLM That Covers the Corporate Request MixOlga Tsymboi, Dmitrii Stoianov, Ramil Latypov +11cs.CL2026-09-01
#106Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM TeachersGiovanni Bonetta, Matteo Merler, Davide Zago +2cs.AI2026-09-01
#107From Confusion to Clarity: Confusion-Aware Retrieval and Knowledge Injection for Text ClassificationManish Gupta, Chaitanya Giri, Jayasimha Talurcs.CL2026-09-01
#108A systematic Approach to constructing a Chance-and-Risk Matrix for Semiconductor Supply ChainsEma Salkić, Alexander Fichtl, Philipp Ulrich +3cs.CL2026-09-01
#109SDARE-Bench: Evaluating Large Language Models on Conversational Stigma Detection and Response in Dyadic and Group DialogueStephanie Fong, Yiwen Jiang, Zimu Wang +12cs.CL2026-09-01
#110Knowledge Distillation During Mid-Training Favors Reasoning over Factual RecallJacqueline He, Howard Yen, Shuyue Stella Li +9cs.CL2026-09-01
#111GlossoGen: Emergent Language in Complex Multi-Agent LLM InteractionsElias Stengel-Eskin, Newton Sander, Carlos Bonetti +4cs.CL2026-09-01
#112AutoConcept: Training-Free Concept-Guided Reranking for Metadata-Available Composed Image RetrievalTianyu Wang, Tianjiao Wucs.IR2026-09-01
#113HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness?Yuhao Wu, Jingyuan Zhang, Jiajun Shi +16cs.SE2026-09-01
#114Citing Less Critically: LLMs Reshape the Rhetoric and Reach of Scientific CitationYixuan Liu, Lin Chen, Zhuoqi Liu +2cs.DL2026-09-01
#115From Rollouts to Recipes: Self-Contained Post-Training for LLMsYifei Li, Lingling Zhang, Muye Huang +3cs.CL2026-09-01
#116EdiTikZ: Scientific Figure Editing from Revision TrajectoriesChristian Greisinger, Zhixue Zhao, Steffen Egercs.AI2026-09-01
#117When Tokenization is Secretly Output SupervisionTanja Baeumel, Josef van Genabith, Simon Ostermanncs.CL2026-09-01
#118Learning Evidence Sufficiency Boundaries for Selective Answering in Grounded Multi-Hop QAHaruto Sato, Yuki Tanaka, Ren Nakamura +2cs.CL2026-09-01
#119InSight: A Benchmark for Agentic Claim Verification in Interactive VisualizationsMaeve Hutchinson, Syed Mahbubul Huq, Mohammad Albinhassan +3cs.CL2026-09-01
#120Polish ModernBERT: The Long and Short of Polish Language UnderstandingMichał Perełkiewicz, Sławomir Dadas, Rafał Poświata +1cs.CL2026-09-01
#121IntroConformal: Conformal Factuality Guarantees for Large Vision-Language Models via Introspective SignalsMd. Atabuzzaman, Christian Alexander, Chris Thomascs.CV2026-09-01
#122Behaviorally Effective LoRA Writes Are Sparse and StructuredHaruto Sato, Yuki Tanaka, Ren Nakamura +2cs.CL2026-09-01
#123How Correct Is Your Answer? A Semantic Correctness Framework for Open QA EvaluationElitsa Yotkova, Violeta Kastreva, Petar Velkov +4cs.CL2026-09-01
#124Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QANishant Mishra, Ameen Abu-Hanna, Iacer Calixtocs.CL2026-09-01
#125Separating Syntax from Language: A Mechanistic Account of Translation in Multilingual LLMsMikhail Sonkin, Tanja Baeumel, Daniil Gurgurov +2cs.CL2026-09-01
#126Where the Verifier Fails: A Category-Level Audit of Reward Signals in RLVREsther Xincs.CL2026-09-01
#127CHARM: Character Hallucination for Multicultural Role Play BenchmarkSunkyung Han, Nahyeon Park, Gaeun Seo +2cs.CL2026-09-01
#128Probing Factual Knowledge Transfer with Training Data InterventionsRomina Oji, Marc Braun, Marcel Bollmann +2cs.CL2026-09-01
#129VerTox: Verifiable Reward-Guided Corpus Poisoning Against Neural Ranking ModelsZhiqi Huang, Vivek Datla, Zhichao Xu +3cs.CL2026-09-01
#130Exploring Sparse Autoencoders in Text-Based Causal Confounding AdjustmentMian Zhong, Katherine A. Keith, Anjalie Fieldcs.CL2026-09-01
#131Reliability Challenges in Diffusion Vision-Language ModelsMd. Atabuzzaman, Chris Thomascs.CV2026-09-01
#132MIDR: Enrichment-Augmented Indexing for Multimodal Document RetrievalDebanjan Mahata, Atharva Tendle, Daniel Preotiuc-Pietro +2cs.IR2026-09-01
#133Explore Before Committing: Hypothesis-Guided Search for Deep Research AgentsRuochen Zhou, Zhengyu Chen, Luan Zhang +3cs.CL2026-09-01
#134Some Emotions Run Deeper: Layer-wise Probing and Causal Intervention in Large Language ModelsTian Fang, Gaël Guibon, Davide Buscaldics.CL2026-09-01
#135From Base Rollouts to RL Reasoning: A Budgeted Search PerspectiveWenhe Sun, Cunxiang Wang, Zijun Yao +1cs.CL2026-09-01
#136What Does an Agentic Software Engineering Benchmark Measure? Profiling Task Demands and Agent Behaviour Beyond What Category Labels RevealRadin Shayanfar, Keheliya Gallaba, Ahmed E. Hassancs.SE2026-09-01
#137Ready to Speak: Aligning LLMs for TTS-Friendly Text GenerationThibaut Thonet, Jos Rozen, Laurent Besaciercs.CL2026-09-01
#138Post-Training Science for Supervised Fine-TuningCharles O'Neill, Mudith Jayasekara, Harry Partridgecs.LG2026-09-01
#139Towards AI-Assisted Clinical Trial Matching: Practical Considerations, Multicenter Evaluation, and Real-World DeploymentYin Fang, Qiao Jin, Shubo Tian +24cs.CL2026-09-01
#140FinLifeBench: Exhaustive Life-Event History and Financial-State Reconstruction from Longitudinal Banking DialogueHangyeul Lee, Juyoung Oh, Jaeyong Ko +5cs.AI2026-09-01
#141CaRL-EM: Cost-Aware Reinforcement Learning for Entity Matching with LLMsChaohui Guo, Michel Klein, Zhisheng Huangcs.CL2026-09-01
#142PersuaRL: Reinforcement Learning-Driven Multi-Expert Selection for Persuasive Dialogue Generation in InsuranceRohan Kirti, Akash Ghosh, Aryan Vats +5cs.CL2026-09-01
#143LLMPEDIA: Browsing, Verifying, and Comparing the Parametric Encyclopedic Knowledge of LLMsMuhammed Saeed, Simon Razniewskics.CL2026-09-01
#144Subword Segmental BabyLMs: Learning to Tokenise for Sample-Efficient PretrainingFrancois Meyercs.CL2026-09-01
#145On the Design Fundamentals of Pixel Text Representation LearningChaohao Yuan, Ruifeng Yuan, Zhuoxu Huang +4cs.CV2026-09-01
#146Does task decomposition improve automatic NLG evaluation?Sebastian Steindl, Nikos Voskarides, Alberto Gasparin +1cs.CL2026-09-01
#147Overfitting Mitigation via Singular Value Decomposition in Minimum Bayes Risk DecodingRiza Setiawan Soetedjo, Yusuke Sakai, Hidetaka Kamigaito +2cs.CL2026-09-01
#148Latent Recurrent Thoughts: Recurrent Refinement of Proposed Latents for Reasoning with Frozen LLMsZhaoliang Chen, Jie Fucs.AI2026-09-01
#149EDRAC: Benchmarking Arabic Dialect Reading ComprehensionNoor Abo Mokh, Kirill Chirkunov, Teresa Lynn +15cs.CL2026-09-01
#150ClinTraceBench: Source-Verifiable Longitudinal Clinical Reasoning over EHR-Derived DialoguesHuimin Wang, Zhengyi Zhao, Yutian Zhaocs.CL2026-09-01
#151Hints Help But Do They Teach? Evaluating Skills Transfer in Code GenerationWill Badrcs.SE2026-09-01
#152When Modality Gap Reduction Fails: Prediction-Level Hubness in CLIPShota Sato, Hajime Kiyama, Tosho Hirasawa +1cs.CL2026-09-01
#153Beyond Magnitude: Contrastive Routing for Modular Mixture-of-ExpertsNikolaos Xiros, Dimitrios Damianos, Maria-Eleni Zoumpoulidi +3cs.CL2026-09-01
#154StateSwap: Probing Support-Elimination Hidden States in Multiple-Choice QuestionsChao Gao, Haijiang Liu, Qiyuan Li +3cs.CL2026-09-01
#155Post-hoc Alignment of LLM-judges to Human Judgment DistributionSebastian Steindl, Nikos Voskarides, Alberto Gasparin +1cs.CL2026-09-01
#156OUTLETS: Output-Length Prediction from Speculative Decoding BackbonesWeihuang Wen, Yingying Liu, Yichuan Liu +5cs.CL2026-09-01
#157WorldBench: Culturally Grounded Benchmark for Multilingual AgentsLeonardo Ranaldi, Sherrie Shen, Jushi Kai +1cs.AI2026-09-01
#158Lagged Coupling: Internal Representations Become Readable Before They Become CausalXining Xuncs.CL2026-09-01
#159PCoMoE: Shifting MoE Inference from Monolithic Expert Selection to Fine-Grained Path CompositionZiyan Gan, Fangxin Liu, Chenyang Guan +10cs.CL2026-09-01
#160Phrase-Localized Language-Contrastive Guidance: Training-Free Localized Accent Control for Code-Switching Text-to-SpeechChe Hyun Lee, Sangkwon Park, Donghun Kang +4cs.CL2026-09-01
#161SinkPruner: Sink-Free Visual Token Pruning for Multimodal Large Language ModelsShiyu Li, Zi-Yuan Hu, Shijia Huang +3cs.CV2026-09-01
#162Right Frame, Wrong Rule: Cultural Cues Expose the Financial Knowledge Gap They Were Meant to CloseRania Elbadry, Ahmed Heakl, Saeed Almheiri +12cs.CL2026-09-01
#163Inspicio: Open-Vocabulary, LLM-Based Sense Retrieval for Historical LanguagesMichele Cilettics.CL2026-09-01
#164Disclosure-Gated User Simulation for Companion-Agent EvaluationYao Liu, Yu Hecs.CL2026-09-01
#165PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in PersianMohammad Hossein Shalchian, Mostafa Amiri, Amir Mahdi Sadeghzadehcs.CL2026-09-01
#166Calibration is the Bottleneck: An Action-Class Diagnostic of Multi-Turn Tool-CallingKangjia Zhao, Jiajun Li, Haozhan Shen +8cs.CL2026-09-01
#167From Terminology to Diagrams: Visual-Instruction Generation for Scientific Diagram UnderstandingRaul Ortega, José Manuel Gómez-Pérezcs.CV2026-09-01
#168A Dataset for Modeling Iterative Problem-SolvingFagun Patel, Sang T. Truong, Duc Q. Nguyen +4cs.CL2026-09-01
#169DualStake: Dual-Path Confidence Calibration in Deep Research AgentsYinuo Xu, Yuwei Liang, Jianjie Cheng +4cs.CL2026-09-01
#170Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPOPrakhar Gupta, Vaibhav Guptacs.CL2026-09-01
#171VIBE-Bench: Evaluating Personalized Large Language Models When Profiles Don't Mean PreferencesYiwen Jiang, Yang Deng, Stephanie Fong +9cs.AI2026-09-01
#172RPCBench: A Benchmark for Proactive Premise Critique in LLM-based RecommendationZhongru Chen, Yuan Wu, Yi Changcs.AI2026-09-01
#173Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization AsymmetryShengfang Zhai, Leo Marchyok, Yuling Shi +4cs.CL2026-09-01
#174The Visual Insensitivity Gap: Diagnosing When Vision-Language Models Fail to Use Visual EvidenceGenpei Zhangcs.CV2026-09-01
#175MemoryWalker: Stop Training Agents on Contexts They Never SawZinco J, Xunjie Zhu, Shen Huang +3cs.LG2026-09-01
#176Verifiable Disaster Storylines and Causal Knowledge Graphs: A Citation-Grounded Pipeline from Heterogeneous Humanitarian SourcesIvan Decostanzi, Michele Ronco, Sergio Consoli +8cs.AI2026-09-01
#177Staged Linguistic Seeding: Grounded Query Expansion for Verified-Unit QA in AI Contact CentersHyeonseop Yoon, Jeong-Eun Parkcs.CL2026-09-01
#178Replacing Training with Memory: Listwise Selection for Text-to-SQLYeonseok Jeong, Soyoung Yoon, Seongjun Lee +1cs.SE2026-09-01
#179Dense Process Supervision for Search Agents via Fact Utility EstimationRongzhi Zhu, Xiangyu Liu, Yi Liu +7cs.CL2026-09-01
#180TWIX: a Two-Stage Approach for End-To-End Named Entity Recognition and Relation ExtractionMarco Martinelli, Laura Menottics.CL2026-09-01
#181Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use AgentsHaoyang Chen, Yi Liu, Jianzhi Shao +3cs.AI2026-09-01
#182Ctrl-F-Resist. Practices, Challenges, and Technical Needs of Civil Society Organizations Monitoring the Far-Right OnlineElisabeth Steffen, Helena Mihaljevićcs.HC2026-09-01
#183TEIDAN: A Multilingual Multiparty Dialogue CorpusTaiga Mori, Koji Inoue, Mikey Elmers +2cs.CL2026-09-01
#184SFAD: Speculative Factuality-Aware DecodingGuanqiao Chen, Di Wang, Lijie Hucs.CL2026-09-01
#185Instella-MoE Technical ReportJiang Liu, Sudhanshu Ranjan, Prakamya Mishra +10cs.CL2026-09-01
#186When Features Become Instances: Inverted Contrastive Learning for Unsupervised Feature SelectionUtsab Ghosh, Roshni Chakrabortycs.AI2026-09-01
#187A Unified Mechanistic Analysis of Knowledge- and Safety-Based RefusalsYuri Son, Seunghee Kim, Hyuhng Joon Kim +1cs.CL2026-09-01
#188Compile, Don't Memorize: A Context Compilation Architecture (CCA) for In-Context LearningJinhu Qi, Minda Hu, Wentao Zhang +4cs.CL2026-09-01
#189Joint Training Is Not Enough: Conditioned Cross-Granularity Training for Multimodal Document UnderstandingChengguang Gan, Yunhao Liang, Hanjun Wei +2cs.CL2026-09-01
#190How Do Language Models Choose Between Context and Memory?Benjamin Shih, John Winnicki, Arianna Caocs.LG2026-09-01
#191Measuring Optimal Transport in Transformer DepthAlexandre Quemycs.CL2026-09-01
#192Can Large Language Models Forecast What Researchers Study Next?Fenghai Li, Zihan Tang, Haofei Yu +2cs.CL2026-09-01
#193ChatDev 2.0: A No-Code Multi-Agent Platform for Developing EverythingYufan Dang, Shu Yao, Bowen Lai +6cs.AI2026-09-01
#194Ranked by the Matcher: A Reproducibility Audit of Knowledge Graph Extraction from Threat ReportsSafayat Bin Hakim, Houbing Herbert Songcs.CR2026-09-01
#195Controllable Image Captioning with Prompt-Conditioned Scene RewardsJongyeop Hyun, Taeyoung Kim, Hyounghun Kimcs.CV2026-09-01
#196A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 SolverHaobo Ma, Wenlin Zhang, Manuel Israel Cázarescs.CL2026-09-01
#197Value Over Language Model: Detecting Original Contribution in WritingVibhhu Sharma, Thorsten Joachims, Sarah Deancs.AI2026-09-01
#198SCoNE: Selective Context-aware Neuron Editing for Robust Retrieval-Augmented GenerationChaewon Kim, Seo Yeon Parkcs.CL2026-09-01
#199Visual Framing for News Stance Detection via Image GenerationDahyun Lee, Jiyoung Han, Kunwoo Parkcs.CL2026-09-01
#200Creative Generation via Multi-Agent Debate: Does Debate Suppress Diversity?Tien Anh Nguyen, Khanh-Binh Nguyen, Van Dai Do +2cs.CL2026-09-01

Showing latest 200 of 24,331 · all categories