Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,901 to 6,960 of 11,218
WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition
Binbin Zhang, Hang Lv, Pengcheng Guo +9
cs.SDcs.CLarXiv:2110.03370v52021Low-Resource Languages Jailbreak GPT-4
Zheng-Xin Yong, Cristina Menghini, Stephen H. Bach
cs.CLcs.AIcs.CRarXiv:2310.02446v22023CEDR: Contextualized Embeddings for Document Ranking
Sean MacAvaney, Andrew Yates, Arman Cohan +1
cs.IRcs.CLarXiv:1904.07094v32019Neural Question Generation from Text: A Preliminary Study
Qingyu Zhou, Nan Yang, Furu Wei +3
cs.CLarXiv:1704.01792v32017UniT: Multimodal Multitask Learning with a Unified Transformer
Ronghang Hu, Amanpreet Singh
cs.CVcs.CLarXiv:2102.10772v32021On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey
Lin Long, Rui Wang, Ruixuan Xiao +4
cs.CLarXiv:2406.15126v12024Better & Faster Large Language Models via Multi-token Prediction
Fabian Gloeckle, Badr Youbi Idrissi, Baptiste Rozière +2
cs.CLarXiv:2404.19737v12024When Does Pretraining Help? Assessing Self-Supervised Learning for Law and the CaseHOLD Dataset
Lucia Zheng, Neel Guha, Brandon R. Anderson +2
cs.CLarXiv:2104.08671v32021CUAD: An Expert-Annotated NLP Dataset for Legal Contract Review
Dan Hendrycks, Collin Burns, Anya Chen +1
cs.CLcs.LGarXiv:2103.06268v22021When and Why are Pre-trained Word Embeddings Useful for Neural Machine Translation?
Ye Qi, Devendra Singh Sachan, Matthieu Felix +2
cs.CLarXiv:1804.06323v22018Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts
Jian Xie, Kai Zhang, Jiangjie Chen +2
cs.CLcs.AIarXiv:2305.13300v42023Jointly Multiple Events Extraction via Attention-based Graph Information Aggregation
Xiao Liu, Zhunchen Luo, Heyan Huang
cs.CLarXiv:1809.09078v22018Topical-Chat: Towards Knowledge-Grounded Open-Domain Conversations
Karthik Gopalakrishnan, Behnam Hedayatnia, Qinlang Chen +5
cs.CLcs.AIarXiv:2308.11995v12023QuestEval: Summarization Asks for Fact-based Evaluation
Thomas Scialom, Paul-Alexis Dray, Patrick Gallinari +4
cs.CLarXiv:2103.12693v22021AISHELL-2: Transforming Mandarin ASR Research Into Industrial Scale
Jiayu Du, Xingyu Na, Xuechen Liu +1
cs.CLarXiv:1808.10583v22018TVR: A Large-Scale Dataset for Video-Subtitle Moment Retrieval
Jie Lei, Licheng Yu, Tamara L. Berg +1
cs.CVcs.CLcs.IRarXiv:2001.09099v22020Improving Sign Language Translation with Monolingual Data by Sign Back-Translation
Hao Zhou, Wengang Zhou, Weizhen Qi +2
cs.CVcs.CLarXiv:2105.12397v12021Large Language Model as Attributed Training Data Generator: A Tale of Diversity and Bias
Yue Yu, Yuchen Zhuang, Jieyu Zhang +5
cs.CLcs.AIcs.LGarXiv:2306.15895v22023English Conversational Telephone Speech Recognition by Humans and Machines
George Saon, Gakuto Kurata, Tom Sercu +9
cs.CLarXiv:1703.02136v12017Echoes of power: Language effects and power differences in social interaction
Cristian Danescu-Niculescu-Mizil, Lillian Lee, Bo Pang +1
cs.SIcs.CLphysics.soc-pharXiv:1112.3670v32011Fighting an Infodemic: COVID-19 Fake News Dataset
Parth Patwa, Shivam Sharma, Srinivas Pykl +6
cs.CLcs.IRcs.SIarXiv:2011.03327v42020A StrongREJECT for Empty Jailbreaks
Alexandra Souly, Qingyuan Lu, Dillon Bowen +8
cs.LGcs.CLcs.CRarXiv:2402.10260v22024Towards Learning a Generic Agent for Vision-and-Language Navigation via Pre-training
Weituo Hao, Chunyuan Li, Xiujun Li +2
cs.CVcs.CLcs.LGarXiv:2002.10638v22020Structured Chain-of-Thought Prompting for Code Generation
Jia Li, Ge Li, Yongmin Li +1
cs.SEcs.CLarXiv:2305.06599v32023Recursively Summarizing Books with Human Feedback
Jeff Wu, Long Ouyang, Daniel M. Ziegler +4
cs.CLcs.AIcs.LGarXiv:2109.10862v22021Grid Long Short-Term Memory
Nal Kalchbrenner, Ivo Danihelka, Alex Graves
cs.NEcs.CLcs.LGarXiv:1507.01526v32015DeClarE: Debunking Fake News and False Claims using Evidence-Aware Deep Learning
Kashyap Popat, Subhabrata Mukherjee, Andrew Yates +1
cs.CLcs.LGarXiv:1809.06416v12018Yin and Yang: Balancing and Answering Binary Visual Questions
Peng Zhang, Yash Goyal, Douglas Summers-Stay +2
cs.CLcs.CVcs.LGarXiv:1511.05099v52015A Unified Generative Framework for Aspect-Based Sentiment Analysis
Hang Yan, Junqi Dai, Tuo ji +2
cs.CLarXiv:2106.04300v12021A Unified Generative Framework for Various NER Subtasks
Hang Yan, Tao Gui, Junqi Dai +3
cs.CLarXiv:2106.01223v12021From Word to Sense Embeddings: A Survey on Vector Representations of Meaning
Jose Camacho-Collados, Mohammad Taher Pilehvar
cs.CLcs.AIarXiv:1805.04032v32018SemEval 2017 Task 10: ScienceIE - Extracting Keyphrases and Relations from Scientific Publications
Isabelle Augenstein, Mrinal Das, Sebastian Riedel +2
cs.CLcs.AIstat.MLarXiv:1704.02853v32017Query2box: Reasoning over Knowledge Graphs in Vector Space using Box Embeddings
Hongyu Ren, Weihua Hu, Jure Leskovec
cs.LGcs.CLstat.MLarXiv:2002.05969v22020Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data
Jingyang Ou, Shen Nie, Kaiwen Xue +4
cs.LGcs.CLarXiv:2406.03736v42024TAPEX: Table Pre-training via Learning a Neural SQL Executor
Qian Liu, Bei Chen, Jiaqi Guo +4
cs.CLcs.AIarXiv:2107.07653v32021Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools
Varun Magesh, Faiz Surani, Matthew Dahl +3
cs.CLcs.CYarXiv:2405.20362v12024Unsupervised Learning of Disentangled and Interpretable Representations from Sequential Data
Wei-Ning Hsu, Yu Zhang, James Glass
cs.LGcs.CLcs.SDarXiv:1709.07902v12017Disentangled Non-Local Neural Networks
Minghao Yin, Zhuliang Yao, Yue Cao +4
cs.CVcs.CLcs.LGarXiv:2006.06668v22020Beyond Goldfish Memory: Long-Term Open-Domain Conversation
Jing Xu, Arthur Szlam, Jason Weston
cs.CLcs.AIarXiv:2107.07567v12021Compressing BERT: Studying the Effects of Weight Pruning on Transfer Learning
Mitchell A. Gordon, Kevin Duh, Nicholas Andrews
cs.CLarXiv:2002.08307v22020LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens
Yiran Ding, Li Lyna Zhang, Chengruidong Zhang +5
cs.CLarXiv:2402.13753v12024Extracting Accurate Materials Data from Research Papers with Conversational Language Models and Prompt Engineering
Maciej P. Polak, Dane Morgan
cs.CLcond-mat.mtrl-sciarXiv:2303.05352v32023Deep Reinforcement Learning for Mention-Ranking Coreference Models
Kevin Clark, Christopher D. Manning
cs.CLarXiv:1609.08667v32016Learning a Neural Semantic Parser from User Feedback
Srinivasan Iyer, Ioannis Konstas, Alvin Cheung +2
cs.CLarXiv:1704.08760v12017SemEval-2017 Task 8: RumourEval: Determining rumour veracity and support for rumours
Leon Derczynski, Kalina Bontcheva, Maria Liakata +3
cs.CLcs.AIarXiv:1704.05972v12017UltraFeedback: Boosting Language Models with Scaled AI Feedback
Ganqu Cui, Lifan Yuan, Ning Ding +9
cs.CLcs.AIcs.LGarXiv:2310.01377v22023LoRA Learns Less and Forgets Less
Dan Biderman, Jacob Portes, Jose Javier Gonzalez Ortiz +9
cs.LGcs.AIcs.CLarXiv:2405.09673v22024CERT: Contrastive Self-supervised Learning for Language Understanding
Hongchao Fang, Sicheng Wang, Meng Zhou +2
cs.CLcs.LGstat.MLarXiv:2005.12766v22020CAIL2018: A Large-Scale Legal Dataset for Judgment Prediction
Chaojun Xiao, Haoxi Zhong, Zhipeng Guo +8
cs.CLarXiv:1807.02478v12018Analysis of Named Entity Recognition and Linking for Tweets
Leon Derczynski, Diana Maynard, Giuseppe Rizzo +5
cs.CLarXiv:1410.7182v12014Personalize Segment Anything Model with One Shot
Renrui Zhang, Zhengkai Jiang, Ziyu Guo +6
cs.CVcs.AIcs.CLarXiv:2305.03048v22023Humans or LLMs as the Judge? A Study on Judgement Biases
Guiming Hardy Chen, Shunian Chen, Ziche Liu +2
cs.CLarXiv:2402.10669v52024Document Embedding with Paragraph Vectors
Andrew M. Dai, Christopher Olah, Quoc V. Le
cs.CLcs.AIcs.LGarXiv:1507.07998v12015Achieving Open Vocabulary Neural Machine Translation with Hybrid Word-Character Models
Minh-Thang Luong, Christopher D. Manning
cs.CLcs.LGarXiv:1604.00788v22016Evaluating Explainable AI: Which Algorithmic Explanations Help Users Predict Model Behavior?
Peter Hase, Mohit Bansal
cs.CLcs.AIcs.LGarXiv:2005.01831v12020One-step and Two-step Classification for Abusive Language Detection on Twitter
Ji Ho Park, Pascale Fung
cs.CLarXiv:1706.01206v12017TimeLMs: Diachronic Language Models from Twitter
Daniel Loureiro, Francesco Barbieri, Leonardo Neves +2
cs.CLcs.AIarXiv:2202.03829v22022KUISAIL at SemEval-2020 Task 12: BERT-CNN for Offensive Speech Identification in Social Media
Ali Safaya, Moutasem Abdullatif, Deniz Yuret
cs.CLarXiv:2007.13184v12020Document-Level Event Argument Extraction by Conditional Generation
Sha Li, Heng Ji, Jiawei Han
cs.CLarXiv:2104.05919v12021A Multi-Framework Comparison of Outline Stages in Long-Form Generation with LLMs
Yifan Song
cs.CLcs.AIarXiv:2608.26177v12026