Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,981 to 5,040 of 11,259
Evolutionary Computation in the Era of Large Language Model: Survey and Roadmap
Xingyu Wu, Sheng-hao Wu, Jibin Wu +2
cs.NEcs.AIcs.CLarXiv:2401.10034v32024Unsupervised Evaluation of Interactive Dialog with DialoGPT
Shikib Mehri, Maxine Eskenazi
cs.CLcs.AIcs.HCarXiv:2006.12719v12020Sentiment and Sarcasm Classification with Multitask Learning
Navonil Majumder, Soujanya Poria, Haiyun Peng +3
cs.CLarXiv:1901.08014v22019ProPILE: Probing Privacy Leakage in Large Language Models
Siwon Kim, Sangdoo Yun, Hwaran Lee +3
cs.CRcs.CLarXiv:2307.01881v12023A Review on Language Models as Knowledge Bases
Badr AlKhamissi, Millicent Li, Asli Celikyilmaz +2
cs.CLcs.AIarXiv:2204.06031v12022FlowTransformer: A Transformer Framework for Flow-based Network Intrusion Detection Systems
Liam Daly Manocchio, Siamak Layeghy, Wai Weng Lo +3
cs.CRcs.AIcs.CLarXiv:2304.14746v12023aNMM: Ranking Short Answer Texts with Attention-Based Neural Matching Model
Liu Yang, Qingyao Ai, Jiafeng Guo +1
cs.IRcs.CLarXiv:1801.01641v22018Let's Think Dot by Dot: Hidden Computation in Transformer Language Models
Jacob Pfau, William Merrill, Samuel R. Bowman
cs.CLcs.AIarXiv:2404.15758v12024CaRL-EM: Cost-Aware Reinforcement Learning for Entity Matching with LLMs
Chaohui Guo, Michel Klein, Zhisheng Huang
cs.CLarXiv:2609.01195v12026On the Dimensionality of Word Embedding
Zi Yin, Yuanyuan Shen
cs.LGcs.CLstat.MLarXiv:1812.04224v12018Learning Joint Multilingual Sentence Representations with Neural Machine Translation
Holger Schwenk, Matthijs Douze
cs.CLarXiv:1704.04154v22017Knowledge Graph Reasoning with Relational Digraph
Yongqi Zhang, Quanming Yao
cs.AIcs.CLarXiv:2108.06040v22021Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
Mikayel Samvelyan, Sharath Chandra Raparthy, Andrei Lupu +9
cs.CLcs.AIcs.LGarXiv:2402.16822v32024Is ChatGPT a Good Sentiment Analyzer? A Preliminary Study
Zengzhi Wang, Qiming Xie, Yi Feng +3
cs.CLcs.AIarXiv:2304.04339v22023NL2Bash: A Corpus and Semantic Parser for Natural Language Interface to the Linux Operating System
Xi Victoria Lin, Chenglong Wang, Luke Zettlemoyer +1
cs.CLcs.SEarXiv:1802.08979v22018Repeat After Me: Transformers are Better than State Space Models at Copying
Samy Jelassi, David Brandfonbrener, Sham M. Kakade +1
cs.LGcs.AIcs.CLarXiv:2402.01032v22024Few-shot classification in Named Entity Recognition Task
Alexander Fritzler, Varvara Logacheva, Maksim Kretov
cs.CLcs.LGstat.MLarXiv:1812.06158v12018Text-to-Text Pre-Training for Data-to-Text Tasks
Mihir Kale, Abhinav Rastogi
cs.CLarXiv:2005.10433v32020Re-evaluating Evaluation in Text Summarization
Manik Bhandari, Pranav Gour, Atabak Ashfaq +2
cs.CLcs.IRcs.LGarXiv:2010.07100v12020Cross-lingual Contextualized Topic Models with Zero-shot Learning
Federico Bianchi, Silvia Terragni, Dirk Hovy +2
cs.CLarXiv:2004.07737v22020WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models
Liwei Jiang, Kavel Rao, Seungju Han +8
cs.CLarXiv:2406.18510v12024Style Transformer: Unpaired Text Style Transfer without Disentangled Latent Representation
Ning Dai, Jianze Liang, Xipeng Qiu +1
cs.CLarXiv:1905.05621v32019Comparing Code Explanations Created by Students and Large Language Models
Juho Leinonen, Paul Denny, Stephen MacNeil +5
cs.CYcs.AIcs.CLarXiv:2304.03938v12023SpEx: Multi-Scale Time Domain Speaker Extraction Network
Chenglin Xu, Wei Rao, Eng Siong Chng +1
eess.AScs.CLcs.SDarXiv:2004.08326v12020Best-Worst Scaling More Reliable than Rating Scales: A Case Study on Sentiment Intensity Annotation
Svetlana Kiritchenko, Saif M. Mohammad
cs.CLarXiv:1712.01765v12017Language-Driven Representation Learning for Robotics
Siddharth Karamcheti, Suraj Nair, Annie S. Chen +4
cs.ROcs.AIcs.CLarXiv:2302.12766v12023Conducting Stylistic Analysis of Paintings through an Art-History Agent
Marc S. Walton, Astrid Harth
cs.CVcs.AIcs.CLarXiv:2608.29644v12026Measuring Association Between Labels and Free-Text Rationales
Sarah Wiegreffe, Ana Marasović, Noah A. Smith
cs.CLarXiv:2010.12762v42020SODA: Million-scale Dialogue Distillation with Social Commonsense Contextualization
Hyunwoo Kim, Jack Hessel, Liwei Jiang +9
cs.CLarXiv:2212.10465v32022Self-Adaptive In-Context Learning: An Information Compression Perspective for In-Context Example Selection and Ordering
Zhiyong Wu, Yaoxiang Wang, Jiacheng Ye +1
cs.CLcs.AIarXiv:2212.10375v22022Beyond Word Importance: Contextual Decomposition to Extract Interactions from LSTMs
W. James Murdoch, Peter J. Liu, Bin Yu
cs.CLcs.LGstat.MLarXiv:1801.05453v22018Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
Jun Yan, Vikas Yadav, Shiyang Li +6
cs.CLcs.CRcs.LGarXiv:2307.16888v32023Position Information in Transformers: An Overview
Philipp Dufter, Martin Schmitt, Hinrich Schütze
cs.CLcs.AIarXiv:2102.11090v22021The BigScience ROOTS Corpus: A 1.6TB Composite Multilingual Dataset
Hugo Laurençon, Lucile Saulnier, Thomas Wang +51
cs.CLcs.AIarXiv:2303.03915v12023Rationalization: A Neural Machine Translation Approach to Generating Natural Language Explanations
Upol Ehsan, Brent Harrison, Larry Chan +1
cs.AIcs.CLcs.HCarXiv:1702.07826v22017Improved Relation Classification by Deep Recurrent Neural Networks with Data Augmentation
Yan Xu, Ran Jia, Lili Mou +4
cs.CLcs.LGarXiv:1601.03651v22016The Bottom-up Evolution of Representations in the Transformer: A Study with Machine Translation and Language Modeling Objectives
Elena Voita, Rico Sennrich, Ivan Titov
cs.CLarXiv:1909.01380v12019The elephant in the interpretability room: Why use attention as explanation when we have saliency methods?
Jasmijn Bastings, Katja Filippova
cs.CLarXiv:2010.05607v12020Recurrent Memory Transformer
Aydar Bulatov, Yuri Kuratov, Mikhail S. Burtsev
cs.CLcs.LGarXiv:2207.06881v22022A Uniform Approach to Analogies, Synonyms, Antonyms, and Associations
Peter D. Turney
cs.CLcs.IRcs.LGarXiv:0809.0124v12008Efficient Character-level Document Classification by Combining Convolution and Recurrent Layers
Yijun Xiao, Kyunghyun Cho
cs.CLarXiv:1602.00367v12016Can Large Language Models Infer Causation from Correlation?
Zhijing Jin, Jiarui Liu, Zhiheng Lyu +5
cs.CLcs.AIcs.LGarXiv:2306.05836v32023Social Biases through the Text-to-Image Generation Lens
Ranjita Naik, Besmira Nushi
cs.CYcs.AIcs.CLarXiv:2304.06034v12023Simple Entity-Centric Questions Challenge Dense Retrievers
Christopher Sciavolino, Zexuan Zhong, Jinhyuk Lee +1
cs.CLcs.IRarXiv:2109.08535v32021ReACC: A Retrieval-Augmented Code Completion Framework
Shuai Lu, Nan Duan, Hojae Han +3
cs.SEcs.AIcs.CLarXiv:2203.07722v12022Cross-Lingual Alignment of Contextual Word Embeddings, with Applications to Zero-shot Dependency Parsing
Tal Schuster, Ori Ram, Regina Barzilay +1
cs.CLcs.LGarXiv:1902.09492v22019Chargrid: Towards Understanding 2D Documents
Anoop Raveendra Katti, Christian Reisswig, Cordula Guder +4
cs.CLcs.CVcs.LGarXiv:1809.08799v12018Understanding World or Predicting Future? A Comprehensive Survey of World Models
Jingtao Ding, Yunke Zhang, Yu Shang +12
cs.CLcs.AIcs.LGarXiv:2411.14499v42024Understanding Hidden Memories of Recurrent Neural Networks
Yao Ming, Shaozu Cao, Ruixiang Zhang +4
cs.CLcs.AIarXiv:1710.10777v12017Iteratively Learning Embeddings and Rules for Knowledge Graph Reasoning
Wen Zhang, Bibek Paudel, Liang Wang +5
cs.AIcs.CLarXiv:1903.08948v12019Multimodal Language Analysis with Recurrent Multistage Fusion
Paul Pu Liang, Ziyin Liu, Amir Zadeh +1
cs.LGcs.AIcs.CLarXiv:1808.03920v12018What Happens To BERT Embeddings During Fine-tuning?
Amil Merchant, Elahe Rahimtoroghi, Ellie Pavlick +1
cs.CLarXiv:2004.14448v12020Do LLMs exhibit human-like response biases? A case study in survey design
Lindia Tjuatja, Valerie Chen, Sherry Tongshuang Wu +2
cs.CLarXiv:2311.04076v52023Learning from Dialogue after Deployment: Feed Yourself, Chatbot!
Braden Hancock, Antoine Bordes, Pierre-Emmanuel Mazaré +1
cs.CLcs.AIcs.HCarXiv:1901.05415v42019BLIVA: A Simple Multimodal LLM for Better Handling of Text-Rich Visual Questions
Wenbo Hu, Yifan Xu, Yi Li +3
cs.CVcs.AIcs.CLarXiv:2308.09936v32023Zero-shot User Intent Detection via Capsule Neural Networks
Congying Xia, Chenwei Zhang, Xiaohui Yan +2
cs.CLcs.AIarXiv:1809.00385v12018Representing Schema Structure with Graph Neural Networks for Text-to-SQL Parsing
Ben Bogin, Matt Gardner, Jonathan Berant
cs.CLarXiv:1905.06241v22019Learning to Describe Differences Between Pairs of Similar Images
Harsh Jhamtani, Taylor Berg-Kirkpatrick
cs.CLcs.CVarXiv:1808.10584v12018G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model
Jiahui Gao, Renjie Pi, Jipeng Zhang +8
cs.CLarXiv:2312.11370v22023Rethinking Benchmark and Contamination for Language Models with Rephrased Samples
Shuo Yang, Wei-Lin Chiang, Lianmin Zheng +2
cs.CLcs.AIarXiv:2311.04850v22023