Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,721 to 9,780 of 11,278

  1. Beyond Prompt Engineering: A Systematic Analysis of Prompt Lexical Sensitivity and Its Impacts on Quality

    Qipeng Xie, Zi Liang, Jiafei Wu +6

    cs.CLcs.AIarXiv:2608.20349v12026
  2. Inhibitory Attention for Clinical Long-Context Reasoning: Characterizing and Mitigating Lost-in-the-Middle Effects in EHR Processing

    Sanjay Basu

    cs.CLcs.AIarXiv:2608.20348v12026
  3. When Vocabulary Comprehension Fails Clinical Reasoning: Evaluating Therapy Bots' Safety Risks for Generation Alpha

    Manisha Mehta, Virendra Mehta

    cs.CLcs.AIcs.CYarXiv:2608.20345v12026
  4. Who Do Language Models Think Is Competent? A Mechanistic Analysis of Occupational Bias

    Keren Fuentes, Aaron Mueller

    cs.CLcs.AIcs.CYarXiv:2608.20347v12026
  5. Super-NaturalInstructions: Generalization via Declarative Instructions on 1600+ NLP Tasks

    Yizhong Wang, Swaroop Mishra, Pegah Alipoormolabashi +37

    cs.CLcs.AIarXiv:2204.07705v32022
  6. Personalized Privacy Control in LLMs via Attention Head Intervention

    Junseok Kim, Nakyeong Yang, Kyomin Jung

    cs.AIcs.CLcs.LGarXiv:2608.21209v12026
  7. Enhancing LLMs in Predictive Political QA with Semi-Structured Data

    Yinan Liu, Zihan Zhou, Zichun Jin +3

    cs.AIcs.CLcs.IRarXiv:2608.21218v12026
  8. Meshed-Memory Transformer for Image Captioning

    Marcella Cornia, Matteo Stefanini, Lorenzo Baraldi +1

    cs.CVcs.CLarXiv:1912.08226v22019
  9. Generalization through Memorization: Nearest Neighbor Language Models

    Urvashi Khandelwal, Omer Levy, Dan Jurafsky +2

    cs.CLarXiv:1911.00172v22019
  10. TreeWY: Speculative Verification for Gated DeltaNet Hybrids

    Sneha Murthy Ghantasala

    cs.AIcs.CLcs.DCarXiv:2608.20961v12026
  11. Calibrating Criterion Revision in LLM Agents: Failure Modes and a Trace-Anchored Protocol

    Guodong Xu

    cs.AIcs.CLarXiv:2608.20729v12026
  12. Why2Speak: Faithful Reasoning for Abstaining Action Policies

    Shreya Mendi, Brinnae Bent

    cs.AIcs.CLarXiv:2608.20670v12026
  13. CamemBERT: a Tasty French Language Model

    Louis Martin, Benjamin Muller, Pedro Javier Ortiz Suárez +5

    cs.CLarXiv:1911.03894v32019
  14. Can LLM Already Serve as A Database Interface? A BIg Bench for Large-Scale Database Grounded Text-to-SQLs

    Jinyang Li, Binyuan Hui, Ge Qu +15

    cs.CLarXiv:2305.03111v32023
  15. Universal Adversarial Triggers for Attacking and Analyzing NLP

    Eric Wallace, Shi Feng, Nikhil Kandpal +2

    cs.CLcs.LGarXiv:1908.07125v32019
  16. Reasoning with Language Model is Planning with World Model

    Shibo Hao, Yi Gu, Haodi Ma +4

    cs.CLcs.AIcs.LGarXiv:2305.14992v22023
  17. Long Short-Term Memory Based Recurrent Neural Network Architectures for Large Vocabulary Speech Recognition

    Haşim Sak, Andrew Senior, Françoise Beaufays

    cs.NEcs.CLcs.LGarXiv:1402.1128v12014
  18. SimPO: Simple Preference Optimization with a Reference-Free Reward

    Yu Meng, Mengzhou Xia, Danqi Chen

    cs.CLcs.LGarXiv:2405.14734v32024
  19. Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models

    Yue Zhang, Yafu Li, Leyang Cui +13

    cs.CLcs.AIcs.CYarXiv:2309.01219v32023
  20. Auditable by Construction: An Ontology-Driven Framework for Trustworthy LLM Analytics in Enterprise Finance

    Sergiy Lunyakin

    cs.AIcs.CEcs.CLarXiv:2608.20661v12026
  21. Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their Own Computation

    Emilio Ferrara

    cs.AIcs.CLarXiv:2608.20569v12026
  22. It's Not Just Size That Matters: Small Language Models Are Also Few-Shot Learners

    Timo Schick, Hinrich Schütze

    cs.CLcs.AIcs.LGarXiv:2009.07118v22020
  23. P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks

    Xiao Liu, Kaixuan Ji, Yicheng Fu +4

    cs.CLarXiv:2110.07602v32021
  24. Contrastive Learning of Medical Visual Representations from Paired Images and Text

    Yuhao Zhang, Hang Jiang, Yasuhide Miura +2

    cs.CVcs.CLcs.LGarXiv:2010.00747v22020
  25. QANet: Combining Local Convolution with Global Self-Attention for Reading Comprehension

    Adams Wei Yu, David Dohan, Minh-Thang Luong +4

    cs.CLcs.AIcs.LGarXiv:1804.09541v12018
  26. BERTweet: A pre-trained language model for English Tweets

    Dat Quoc Nguyen, Thanh Vu, Anh Tuan Nguyen

    cs.CLcs.LGarXiv:2005.10200v22020
  27. Large Language Models Cannot Self-Correct Reasoning Yet

    Jie Huang, Xinyun Chen, Swaroop Mishra +4

    cs.CLcs.AIarXiv:2310.01798v22023
  28. A Generalist Agent

    Scott Reed, Konrad Zolna, Emilio Parisotto +17

    cs.AIcs.CLcs.LGarXiv:2205.06175v32022
  29. When Retrieval Fails Before It Begins: Structurally Indirect Prerequisite Eviction as a Retention Failure in Agentic Memory

    Minkyu Song

    cs.AIcs.CLcs.LGarXiv:2608.20400v12026
  30. A Survey on In-context Learning

    Qingxiu Dong, Lei Li, Damai Dai +11

    cs.CLcs.AIarXiv:2301.00234v62022
  31. XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale

    Arun Babu, Changhan Wang, Andros Tjandra +10

    cs.CLcs.SDeess.ASarXiv:2111.09296v32021
  32. A Hierarchical Latent Variable Encoder-Decoder Model for Generating Dialogues

    Iulian Vlad Serban, Alessandro Sordoni, Ryan Lowe +4

    cs.CLcs.AIcs.LGarXiv:1605.06069v32016
  33. Large Language Models Can Be Easily Distracted by Irrelevant Context

    Freda Shi, Xinyun Chen, Kanishka Misra +5

    cs.CLcs.AIarXiv:2302.00093v32023
  34. SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models

    Potsawee Manakul, Adian Liusie, Mark J. F. Gales

    cs.CLarXiv:2303.08896v32023
  35. Did Aristotle Use a Laptop? A Question Answering Benchmark with Implicit Reasoning Strategies

    Mor Geva, Daniel Khashabi, Elad Segal +3

    cs.CLarXiv:2101.02235v12021
  36. An Explanation of In-context Learning as Implicit Bayesian Inference

    Sang Michael Xie, Aditi Raghunathan, Percy Liang +1

    cs.CLcs.LGarXiv:2111.02080v62021
  37. Visualizing and Understanding Recurrent Networks

    Andrej Karpathy, Justin Johnson, Li Fei-Fei

    cs.LGcs.CLcs.NEarXiv:1506.02078v22015
  38. Towards Understanding the Robustness of Sparse Autoencoders

    Ahson Saiyed, Sabrina Sadiekh, Chirag Agarwal

    cs.LGcs.AIcs.CLarXiv:2604.18756v12026
  39. Hadith computational science in the age of large language models: a critical narrative review

    Md. Ashraful Haque, Riasat Islam

    cs.CLcs.AIarXiv:2608.20364v12026
  40. DetectGPT: Zero-Shot Machine-Generated Text Detection using Probability Curvature

    Eric Mitchell, Yoonho Lee, Alexander Khazatsky +2

    cs.CLcs.AIarXiv:2301.11305v22023
  41. Neural Responding Machine for Short-Text Conversation

    Lifeng Shang, Zhengdong Lu, Hang Li

    cs.CLcs.AIcs.NEarXiv:1503.02364v22015
  42. AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at scale

    Minbyul Jeong, Chanwoong Yoon

    cs.CLcs.AIarXiv:2608.20634v12026
  43. MelGAN: Generative Adversarial Networks for Conditional Waveform Synthesis

    Kundan Kumar, Rithesh Kumar, Thibault de Boissiere +6

    eess.AScs.CLcs.LGarXiv:1910.06711v32019
  44. Recipes for building an open-domain chatbot

    Stephen Roller, Emily Dinan, Naman Goyal +9

    cs.CLcs.AIarXiv:2004.13637v22020
  45. Unsupervised Machine Translation Using Monolingual Corpora Only

    Guillaume Lample, Alexis Conneau, Ludovic Denoyer +1

    cs.CLcs.AIarXiv:1711.00043v22017
  46. A Network-based End-to-End Trainable Task-oriented Dialogue System

    Tsung-Hsien Wen, David Vandyke, Nikola Mrksic +5

    cs.CLcs.AIcs.NEarXiv:1604.04562v32016
  47. CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers

    Wenyi Hong, Ming Ding, Wendi Zheng +2

    cs.CVcs.CLcs.LGarXiv:2205.15868v12022
  48. Editing Models with Task Arithmetic

    Gabriel Ilharco, Marco Tulio Ribeiro, Mitchell Wortsman +4

    cs.LGcs.CLcs.CVarXiv:2212.04089v32022
  49. Regularizing and Optimizing LSTM Language Models

    Stephen Merity, Nitish Shirish Keskar, Richard Socher

    cs.CLcs.LGcs.NEarXiv:1708.02182v12017
  50. Mass-Editing Memory in a Transformer

    Kevin Meng, Arnab Sen Sharma, Alex Andonian +2

    cs.CLcs.LGarXiv:2210.07229v22022
  51. Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models

    Mohammed Safi Ur Rahman Khan, Sanjay Suryanarayanan, Tushar Anand +1

    cs.CVcs.CLarXiv:2604.21523v12026
  52. Massively Multilingual Sentence Embeddings for Zero-Shot Cross-Lingual Transfer and Beyond

    Mikel Artetxe, Holger Schwenk

    cs.CLcs.AIcs.LGarXiv:1812.10464v22018
  53. XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

    Junjie Hu, Sebastian Ruder, Aditya Siddhant +3

    cs.CLcs.LGarXiv:2003.11080v52020
  54. Long Short-Term Memory-Networks for Machine Reading

    Jianpeng Cheng, Li Dong, Mirella Lapata

    cs.CLcs.NEarXiv:1601.06733v72016
  55. Improving Robustness of Tabular Retrieval via Representational Stability

    Kushal Raj Bhandari, Adarsh Singh, Jianxi Gao +2

    cs.CLcs.AIcs.IRarXiv:2604.24040v22026
  56. Stabilizing Efficient Reasoning with Step-Level Advantage Selection

    Han Wang, Xiaodong Yu, Jialian Wu +4

    cs.CLcs.LGarXiv:2604.24003v12026
  57. ALFRED: A Benchmark for Interpreting Grounded Instructions for Everyday Tasks

    Mohit Shridhar, Jesse Thomason, Daniel Gordon +5

    cs.CVcs.AIcs.CLarXiv:1912.01734v22019
  58. Retrieval Augmentation Reduces Hallucination in Conversation

    Kurt Shuster, Spencer Poff, Moya Chen +2

    cs.CLcs.AIarXiv:2104.07567v12021
  59. Preferences of a Voice-First Nation: Large-Scale Pairwise Evaluation and Preference Analysis for TTS in Indian Languages

    Srija Anand, Ashwin Sankar, Ishvinder Sethi +10

    cs.CLarXiv:2604.21481v22026
  60. Length Value Model: Scalable Value Pretraining for Token-Level Length Modeling

    Zhen Zhang, Changyi Yang, Zijie Xia +11

    cs.CLarXiv:2604.27039v22026