Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,721 to 9,780 of 11,278
Beyond Prompt Engineering: A Systematic Analysis of Prompt Lexical Sensitivity and Its Impacts on Quality
Qipeng Xie, Zi Liang, Jiafei Wu +6
cs.CLcs.AIarXiv:2608.20349v12026Inhibitory Attention for Clinical Long-Context Reasoning: Characterizing and Mitigating Lost-in-the-Middle Effects in EHR Processing
Sanjay Basu
cs.CLcs.AIarXiv:2608.20348v12026When Vocabulary Comprehension Fails Clinical Reasoning: Evaluating Therapy Bots' Safety Risks for Generation Alpha
Manisha Mehta, Virendra Mehta
cs.CLcs.AIcs.CYarXiv:2608.20345v12026Who Do Language Models Think Is Competent? A Mechanistic Analysis of Occupational Bias
Keren Fuentes, Aaron Mueller
cs.CLcs.AIcs.CYarXiv:2608.20347v12026Super-NaturalInstructions: Generalization via Declarative Instructions on 1600+ NLP Tasks
Yizhong Wang, Swaroop Mishra, Pegah Alipoormolabashi +37
cs.CLcs.AIarXiv:2204.07705v32022Personalized Privacy Control in LLMs via Attention Head Intervention
Junseok Kim, Nakyeong Yang, Kyomin Jung
cs.AIcs.CLcs.LGarXiv:2608.21209v12026Enhancing LLMs in Predictive Political QA with Semi-Structured Data
Yinan Liu, Zihan Zhou, Zichun Jin +3
cs.AIcs.CLcs.IRarXiv:2608.21218v12026Meshed-Memory Transformer for Image Captioning
Marcella Cornia, Matteo Stefanini, Lorenzo Baraldi +1
cs.CVcs.CLarXiv:1912.08226v22019Generalization through Memorization: Nearest Neighbor Language Models
Urvashi Khandelwal, Omer Levy, Dan Jurafsky +2
cs.CLarXiv:1911.00172v22019TreeWY: Speculative Verification for Gated DeltaNet Hybrids
Sneha Murthy Ghantasala
cs.AIcs.CLcs.DCarXiv:2608.20961v12026Calibrating Criterion Revision in LLM Agents: Failure Modes and a Trace-Anchored Protocol
Guodong Xu
cs.AIcs.CLarXiv:2608.20729v12026Why2Speak: Faithful Reasoning for Abstaining Action Policies
Shreya Mendi, Brinnae Bent
cs.AIcs.CLarXiv:2608.20670v12026CamemBERT: a Tasty French Language Model
Louis Martin, Benjamin Muller, Pedro Javier Ortiz Suárez +5
cs.CLarXiv:1911.03894v32019Can LLM Already Serve as A Database Interface? A BIg Bench for Large-Scale Database Grounded Text-to-SQLs
Jinyang Li, Binyuan Hui, Ge Qu +15
cs.CLarXiv:2305.03111v32023Universal Adversarial Triggers for Attacking and Analyzing NLP
Eric Wallace, Shi Feng, Nikhil Kandpal +2
cs.CLcs.LGarXiv:1908.07125v32019Reasoning with Language Model is Planning with World Model
Shibo Hao, Yi Gu, Haodi Ma +4
cs.CLcs.AIcs.LGarXiv:2305.14992v22023Long Short-Term Memory Based Recurrent Neural Network Architectures for Large Vocabulary Speech Recognition
Haşim Sak, Andrew Senior, Françoise Beaufays
cs.NEcs.CLcs.LGarXiv:1402.1128v12014SimPO: Simple Preference Optimization with a Reference-Free Reward
Yu Meng, Mengzhou Xia, Danqi Chen
cs.CLcs.LGarXiv:2405.14734v32024Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models
Yue Zhang, Yafu Li, Leyang Cui +13
cs.CLcs.AIcs.CYarXiv:2309.01219v32023Auditable by Construction: An Ontology-Driven Framework for Trustworthy LLM Analytics in Enterprise Finance
Sergiy Lunyakin
cs.AIcs.CEcs.CLarXiv:2608.20661v12026Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their Own Computation
Emilio Ferrara
cs.AIcs.CLarXiv:2608.20569v12026It's Not Just Size That Matters: Small Language Models Are Also Few-Shot Learners
Timo Schick, Hinrich Schütze
cs.CLcs.AIcs.LGarXiv:2009.07118v22020P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks
Xiao Liu, Kaixuan Ji, Yicheng Fu +4
cs.CLarXiv:2110.07602v32021Contrastive Learning of Medical Visual Representations from Paired Images and Text
Yuhao Zhang, Hang Jiang, Yasuhide Miura +2
cs.CVcs.CLcs.LGarXiv:2010.00747v22020QANet: Combining Local Convolution with Global Self-Attention for Reading Comprehension
Adams Wei Yu, David Dohan, Minh-Thang Luong +4
cs.CLcs.AIcs.LGarXiv:1804.09541v12018BERTweet: A pre-trained language model for English Tweets
Dat Quoc Nguyen, Thanh Vu, Anh Tuan Nguyen
cs.CLcs.LGarXiv:2005.10200v22020Large Language Models Cannot Self-Correct Reasoning Yet
Jie Huang, Xinyun Chen, Swaroop Mishra +4
cs.CLcs.AIarXiv:2310.01798v22023A Generalist Agent
Scott Reed, Konrad Zolna, Emilio Parisotto +17
cs.AIcs.CLcs.LGarXiv:2205.06175v32022When Retrieval Fails Before It Begins: Structurally Indirect Prerequisite Eviction as a Retention Failure in Agentic Memory
Minkyu Song
cs.AIcs.CLcs.LGarXiv:2608.20400v12026A Survey on In-context Learning
Qingxiu Dong, Lei Li, Damai Dai +11
cs.CLcs.AIarXiv:2301.00234v62022XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale
Arun Babu, Changhan Wang, Andros Tjandra +10
cs.CLcs.SDeess.ASarXiv:2111.09296v32021A Hierarchical Latent Variable Encoder-Decoder Model for Generating Dialogues
Iulian Vlad Serban, Alessandro Sordoni, Ryan Lowe +4
cs.CLcs.AIcs.LGarXiv:1605.06069v32016Large Language Models Can Be Easily Distracted by Irrelevant Context
Freda Shi, Xinyun Chen, Kanishka Misra +5
cs.CLcs.AIarXiv:2302.00093v32023SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models
Potsawee Manakul, Adian Liusie, Mark J. F. Gales
cs.CLarXiv:2303.08896v32023Did Aristotle Use a Laptop? A Question Answering Benchmark with Implicit Reasoning Strategies
Mor Geva, Daniel Khashabi, Elad Segal +3
cs.CLarXiv:2101.02235v12021An Explanation of In-context Learning as Implicit Bayesian Inference
Sang Michael Xie, Aditi Raghunathan, Percy Liang +1
cs.CLcs.LGarXiv:2111.02080v62021Visualizing and Understanding Recurrent Networks
Andrej Karpathy, Justin Johnson, Li Fei-Fei
cs.LGcs.CLcs.NEarXiv:1506.02078v22015Towards Understanding the Robustness of Sparse Autoencoders
Ahson Saiyed, Sabrina Sadiekh, Chirag Agarwal
cs.LGcs.AIcs.CLarXiv:2604.18756v12026Hadith computational science in the age of large language models: a critical narrative review
Md. Ashraful Haque, Riasat Islam
cs.CLcs.AIarXiv:2608.20364v12026DetectGPT: Zero-Shot Machine-Generated Text Detection using Probability Curvature
Eric Mitchell, Yoonho Lee, Alexander Khazatsky +2
cs.CLcs.AIarXiv:2301.11305v22023Neural Responding Machine for Short-Text Conversation
Lifeng Shang, Zhengdong Lu, Hang Li
cs.CLcs.AIcs.NEarXiv:1503.02364v22015AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at scale
Minbyul Jeong, Chanwoong Yoon
cs.CLcs.AIarXiv:2608.20634v12026MelGAN: Generative Adversarial Networks for Conditional Waveform Synthesis
Kundan Kumar, Rithesh Kumar, Thibault de Boissiere +6
eess.AScs.CLcs.LGarXiv:1910.06711v32019Recipes for building an open-domain chatbot
Stephen Roller, Emily Dinan, Naman Goyal +9
cs.CLcs.AIarXiv:2004.13637v22020Unsupervised Machine Translation Using Monolingual Corpora Only
Guillaume Lample, Alexis Conneau, Ludovic Denoyer +1
cs.CLcs.AIarXiv:1711.00043v22017A Network-based End-to-End Trainable Task-oriented Dialogue System
Tsung-Hsien Wen, David Vandyke, Nikola Mrksic +5
cs.CLcs.AIcs.NEarXiv:1604.04562v32016CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers
Wenyi Hong, Ming Ding, Wendi Zheng +2
cs.CVcs.CLcs.LGarXiv:2205.15868v12022Editing Models with Task Arithmetic
Gabriel Ilharco, Marco Tulio Ribeiro, Mitchell Wortsman +4
cs.LGcs.CLcs.CVarXiv:2212.04089v32022Regularizing and Optimizing LSTM Language Models
Stephen Merity, Nitish Shirish Keskar, Richard Socher
cs.CLcs.LGcs.NEarXiv:1708.02182v12017Mass-Editing Memory in a Transformer
Kevin Meng, Arnab Sen Sharma, Alex Andonian +2
cs.CLcs.LGarXiv:2210.07229v22022Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
Mohammed Safi Ur Rahman Khan, Sanjay Suryanarayanan, Tushar Anand +1
cs.CVcs.CLarXiv:2604.21523v12026Massively Multilingual Sentence Embeddings for Zero-Shot Cross-Lingual Transfer and Beyond
Mikel Artetxe, Holger Schwenk
cs.CLcs.AIcs.LGarXiv:1812.10464v22018XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization
Junjie Hu, Sebastian Ruder, Aditya Siddhant +3
cs.CLcs.LGarXiv:2003.11080v52020Long Short-Term Memory-Networks for Machine Reading
Jianpeng Cheng, Li Dong, Mirella Lapata
cs.CLcs.NEarXiv:1601.06733v72016Improving Robustness of Tabular Retrieval via Representational Stability
Kushal Raj Bhandari, Adarsh Singh, Jianxi Gao +2
cs.CLcs.AIcs.IRarXiv:2604.24040v22026Stabilizing Efficient Reasoning with Step-Level Advantage Selection
Han Wang, Xiaodong Yu, Jialian Wu +4
cs.CLcs.LGarXiv:2604.24003v12026ALFRED: A Benchmark for Interpreting Grounded Instructions for Everyday Tasks
Mohit Shridhar, Jesse Thomason, Daniel Gordon +5
cs.CVcs.AIcs.CLarXiv:1912.01734v22019Retrieval Augmentation Reduces Hallucination in Conversation
Kurt Shuster, Spencer Poff, Moya Chen +2
cs.CLcs.AIarXiv:2104.07567v12021Preferences of a Voice-First Nation: Large-Scale Pairwise Evaluation and Preference Analysis for TTS in Indian Languages
Srija Anand, Ashwin Sankar, Ishvinder Sethi +10
cs.CLarXiv:2604.21481v22026Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling
Zhen Zhang, Changyi Yang, Zijie Xia +11
cs.CLarXiv:2604.27039v22026