Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,241 to 6,300 of 11,332
An analysis of incorporating an external language model into a sequence-to-sequence model
Anjuli Kannan, Yonghui Wu, Patrick Nguyen +3
eess.AScs.AIcs.CLarXiv:1712.01996v12017Secrets of RLHF in Large Language Models Part I: PPO
Rui Zheng, Shihan Dou, Songyang Gao +24
cs.CLcs.AIcs.LGarXiv:2307.04964v22023Testing of Detection Tools for AI-Generated Text
Debora Weber-Wulff, Alla Anohina-Naumeca, Sonja Bjelobaba +5
cs.CLcs.AIcs.CYarXiv:2306.15666v22023BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks
Kai Zhang, Rong Zhou, Eashan Adhikarla +20
cs.CLcs.AIarXiv:2305.17100v42023Does Localization Inform Editing? Surprising Differences in Causality-Based Localization vs. Knowledge Editing in Language Models
Peter Hase, Mohit Bansal, Been Kim +1
cs.LGcs.AIcs.CLarXiv:2301.04213v22023The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics
Sebastian Gehrmann, Tosin Adewumi, Karmanya Aggarwal +53
cs.CLcs.AIcs.LGarXiv:2102.01672v32021Incremental Knowledge Base Construction Using DeepDive
Jaeho Shin, Sen Wu, Feiran Wang +3
cs.DBcs.CLcs.LGarXiv:1502.00731v42015Query2doc: Query Expansion with Large Language Models
Liang Wang, Nan Yang, Furu Wei
cs.IRcs.CLarXiv:2303.07678v22023Any-to-Any Generation via Composable Diffusion
Zineng Tang, Ziyi Yang, Chenguang Zhu +2
cs.CVcs.CLcs.LGarXiv:2305.11846v12023Transformers without Tears: Improving the Normalization of Self-Attention
Toan Q. Nguyen, Julian Salazar
cs.CLcs.LGstat.MLarXiv:1910.05895v22019DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models
Licheng Wen, Daocheng Fu, Xin Li +7
cs.ROcs.CLarXiv:2309.16292v32023In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering
Sheng Liu, Haotian Ye, Lei Xing +1
cs.LGcs.AIcs.CLarXiv:2311.06668v32023The IIT Bombay English-Hindi Parallel Corpus
Anoop Kunchukuttan, Pratik Mehta, Pushpak Bhattacharyya
cs.CLarXiv:1710.02855v22017C3: Zero-shot Text-to-SQL with ChatGPT
Xuemei Dong, Chao Zhang, Yuhang Ge +5
cs.CLcs.AIarXiv:2307.07306v12023Text Classification via Large Language Models
Xiaofei Sun, Xiaoya Li, Jiwei Li +4
cs.CLarXiv:2305.08377v32023Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks
Erfan Shayegani, Md Abdullah Al Mamun, Yu Fu +3
cs.CLcs.CRcs.LGarXiv:2310.10844v12023Problems With Evaluation of Word Embeddings Using Word Similarity Tasks
Manaal Faruqui, Yulia Tsvetkov, Pushpendre Rastogi +1
cs.CLarXiv:1605.02276v32016TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks
Frank F. Xu, Yufan Song, Boxuan Li +18
cs.CLarXiv:2412.14161v32024Retrieving Relations, Detecting Fallacies: A RAG Approach to Political Debate Analysis
Deborah Dore, Greta Damo, Elena Cabrio +1
cs.AIcs.CLarXiv:2608.27471v12026Learning Natural Language Inference using Bidirectional LSTM model and Inner-Attention
Yang Liu, Chengjie Sun, Lei Lin +1
cs.CLarXiv:1605.09090v12016CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text
Koustuv Sinha, Shagun Sodhani, Jin Dong +2
cs.LGcs.CLcs.LOarXiv:1908.06177v22019On Second Thought, Let's Not Think Step by Step! Bias and Toxicity in Zero-Shot Reasoning
Omar Shaikh, Hongxin Zhang, William Held +2
cs.CLarXiv:2212.08061v22022DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models
Sam Ade Jacobs, Masahiro Tanaka, Chengming Zhang +4
cs.LGcs.CLcs.DCarXiv:2309.14509v22023Selective Question Answering under Domain Shift
Amita Kamath, Robin Jia, Percy Liang
cs.CLcs.LGarXiv:2006.09462v12020A Diagnostic Study of Explainability Techniques for Text Classification
Pepa Atanasova, Jakob Grue Simonsen, Christina Lioma +1
cs.CLcs.LGarXiv:2009.13295v12020Multi-view Knowledge Graph Embedding for Entity Alignment
Qingheng Zhang, Zequn Sun, Wei Hu +3
cs.AIcs.CLcs.LGarXiv:1906.02390v12019Table-to-text Generation by Structure-aware Seq2seq Learning
Tianyu Liu, Kexiang Wang, Lei Sha +2
cs.CLcs.AIarXiv:1711.09724v12017OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
Zhuofeng Li, Dongfu Jiang, Xueguang Ma +7
cs.IRcs.AIcs.CLarXiv:2603.20278v12026Efficient Reasoning on the Edge
Yelysei Bondarenko, Thomas Hehn, Rob Hesselink +15
cs.LGcs.CLarXiv:2603.16867v22026daVinci-Env: Open SWE Environment Synthesis at Scale
Dayuan Fu, Shenyu Wu, Yunze Wu +11
cs.SEcs.AIcs.CLarXiv:2603.13023v22026Large language models can accurately predict searcher preferences
Paul Thomas, Seth Spielman, Nick Craswell +1
cs.IRcs.AIcs.CLarXiv:2309.10621v32023Cross-Recurrence Quantification Analysis of Categorical and Continuous Time Series: an R package
Moreno I. Coco, Rick Dale
cs.CLstat.AParXiv:1310.0201v22013Evolution of Semantic Similarity -- A Survey
Dhivya Chandrasekaran, Vijay Mago
cs.CLcs.IRarXiv:2004.13820v22020PlotQA: Reasoning over Scientific Plots
Nitesh Methani, Pritha Ganguly, Mitesh M. Khapra +1
cs.CVcs.AIcs.CLarXiv:1909.00997v32019Insertion Transformer: Flexible Sequence Generation via Insertion Operations
Mitchell Stern, William Chan, Jamie Kiros +1
cs.CLcs.LGstat.MLarXiv:1902.03249v12019Multi-hop Reading Comprehension through Question Decomposition and Rescoring
Sewon Min, Victor Zhong, Luke Zettlemoyer +1
cs.CLcs.AIarXiv:1906.02916v22019The Voice Conversion Challenge 2018: Promoting Development of Parallel and Nonparallel Methods
Jaime Lorenzo-Trueba, Junichi Yamagishi, Tomoki Toda +4
eess.AScs.CLcs.SDarXiv:1804.04262v12018Unsupervised Domain Clusters in Pretrained Language Models
Roee Aharoni, Yoav Goldberg
cs.CLarXiv:2004.02105v22020Universal Language Model Fine-tuning for Text Classification
Jeremy Howard, Sebastian Ruder
cs.CLcs.LGstat.MLarXiv:1801.06146v52018Guiding Pretraining in Reinforcement Learning with Large Language Models
Yuqing Du, Olivia Watkins, Zihan Wang +5
cs.LGcs.AIcs.CLarXiv:2302.06692v22023Language Modeling Is Compression
Grégoire Delétang, Anian Ruoss, Paul-Ambroise Duquenne +9
cs.LGcs.AIcs.CLarXiv:2309.10668v22023Direct speech-to-speech translation with a sequence-to-sequence model
Ye Jia, Ron J. Weiss, Fadi Biadsy +4
cs.CLcs.LGcs.SDarXiv:1904.06037v22019Blind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledge
Zhuoshi Pan, Junru Lu, Yan Qian +3
cs.CLarXiv:2608.28478v12026DiffusionBERT: Improving Generative Masked Language Models with Diffusion Models
Zhengfu He, Tianxiang Sun, Kuanning Wang +2
cs.CLcs.AIcs.LGarXiv:2211.15029v22022Multilingual Constituency Parsing with Self-Attention and Pre-Training
Nikita Kitaev, Steven Cao, Dan Klein
cs.CLarXiv:1812.11760v22018TLDR: Extreme Summarization of Scientific Documents
Isabel Cachola, Kyle Lo, Arman Cohan +1
cs.CLarXiv:2004.15011v32020Zero-Resource Translation with Multi-Lingual Neural Machine Translation
Orhan Firat, Baskaran Sankaran, Yaser Al-Onaizan +2
cs.CLarXiv:1606.04164v12016Reformulating Unsupervised Style Transfer as Paraphrase Generation
Kalpesh Krishna, John Wieting, Mohit Iyyer
cs.CLarXiv:2010.05700v12020MDFEND: Multi-domain Fake News Detection
Qiong Nan, Juan Cao, Yongchun Zhu +2
cs.CLcs.AIcs.SIarXiv:2201.00987v12022Hate Speech Detection and Racial Bias Mitigation in Social Media based on BERT model
Marzieh Mozafari, Reza Farahbakhsh, Noel Crespi
cs.SIcs.CLcs.IRarXiv:2008.06460v22020One-Shot Relational Learning for Knowledge Graphs
Wenhan Xiong, Mo Yu, Shiyu Chang +2
cs.CLarXiv:1808.09040v12018Training Software Engineering Agents and Verifiers with SWE-Gym
Jiayi Pan, Xingyao Wang, Graham Neubig +4
cs.SEcs.CLarXiv:2412.21139v22024Double Graph Based Reasoning for Document-level Relation Extraction
Shuang Zeng, Runxin Xu, Baobao Chang +1
cs.CLcs.AIcs.LGarXiv:2009.13752v12020WASSA-2017 Shared Task on Emotion Intensity
Saif M. Mohammad, Felipe Bravo-Marquez
cs.CLarXiv:1708.03700v12017LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
Yukang Chen, Shengju Qian, Haotian Tang +4
cs.CLcs.AIcs.LGarXiv:2309.12307v32023Unsupervised Commonsense Question Answering with Self-Talk
Vered Shwartz, Peter West, Ronan Le Bras +2
cs.CLarXiv:2004.05483v22020Contextualized Perturbation for Textual Adversarial Attack
Dianqi Li, Yizhe Zhang, Hao Peng +4
cs.CLarXiv:2009.07502v22020Zero-Shot Entity Linking by Reading Entity Descriptions
Lajanugen Logeswaran, Ming-Wei Chang, Kenton Lee +3
cs.CLcs.LGarXiv:1906.07348v12019GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot
Aohan Zeng, Zhengxiao Du, Mingdao Liu +5
cs.CLcs.SDeess.ASarXiv:2412.02612v12024The Science of Detecting LLM-Generated Texts
Ruixiang Tang, Yu-Neng Chuang, Xia Hu
cs.CLcs.AIarXiv:2303.07205v32023