Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,901 to 6,960 of 11,218

  1. WenetSpeech: A 10000+ Hours Multi-domain Mandarin Corpus for Speech Recognition

    Binbin Zhang, Hang Lv, Pengcheng Guo +9

    cs.SDcs.CLarXiv:2110.03370v52021
  2. Low-Resource Languages Jailbreak GPT-4

    Zheng-Xin Yong, Cristina Menghini, Stephen H. Bach

    cs.CLcs.AIcs.CRarXiv:2310.02446v22023
  3. CEDR: Contextualized Embeddings for Document Ranking

    Sean MacAvaney, Andrew Yates, Arman Cohan +1

    cs.IRcs.CLarXiv:1904.07094v32019
  4. Neural Question Generation from Text: A Preliminary Study

    Qingyu Zhou, Nan Yang, Furu Wei +3

    cs.CLarXiv:1704.01792v32017
  5. UniT: Multimodal Multitask Learning with a Unified Transformer

    Ronghang Hu, Amanpreet Singh

    cs.CVcs.CLarXiv:2102.10772v32021
  6. On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey

    Lin Long, Rui Wang, Ruixuan Xiao +4

    cs.CLarXiv:2406.15126v12024
  7. Better & Faster Large Language Models via Multi-token Prediction

    Fabian Gloeckle, Badr Youbi Idrissi, Baptiste Rozière +2

    cs.CLarXiv:2404.19737v12024
  8. When Does Pretraining Help? Assessing Self-Supervised Learning for Law and the CaseHOLD Dataset

    Lucia Zheng, Neel Guha, Brandon R. Anderson +2

    cs.CLarXiv:2104.08671v32021
  9. CUAD: An Expert-Annotated NLP Dataset for Legal Contract Review

    Dan Hendrycks, Collin Burns, Anya Chen +1

    cs.CLcs.LGarXiv:2103.06268v22021
  10. When and Why are Pre-trained Word Embeddings Useful for Neural Machine Translation?

    Ye Qi, Devendra Singh Sachan, Matthieu Felix +2

    cs.CLarXiv:1804.06323v22018
  11. Adaptive Chameleon or Stubborn Sloth: Revealing the Behavior of Large Language Models in Knowledge Conflicts

    Jian Xie, Kai Zhang, Jiangjie Chen +2

    cs.CLcs.AIarXiv:2305.13300v42023
  12. Jointly Multiple Events Extraction via Attention-based Graph Information Aggregation

    Xiao Liu, Zhunchen Luo, Heyan Huang

    cs.CLarXiv:1809.09078v22018
  13. Topical-Chat: Towards Knowledge-Grounded Open-Domain Conversations

    Karthik Gopalakrishnan, Behnam Hedayatnia, Qinlang Chen +5

    cs.CLcs.AIarXiv:2308.11995v12023
  14. QuestEval: Summarization Asks for Fact-based Evaluation

    Thomas Scialom, Paul-Alexis Dray, Patrick Gallinari +4

    cs.CLarXiv:2103.12693v22021
  15. AISHELL-2: Transforming Mandarin ASR Research Into Industrial Scale

    Jiayu Du, Xingyu Na, Xuechen Liu +1

    cs.CLarXiv:1808.10583v22018
  16. TVR: A Large-Scale Dataset for Video-Subtitle Moment Retrieval

    Jie Lei, Licheng Yu, Tamara L. Berg +1

    cs.CVcs.CLcs.IRarXiv:2001.09099v22020
  17. Improving Sign Language Translation with Monolingual Data by Sign Back-Translation

    Hao Zhou, Wengang Zhou, Weizhen Qi +2

    cs.CVcs.CLarXiv:2105.12397v12021
  18. Large Language Model as Attributed Training Data Generator: A Tale of Diversity and Bias

    Yue Yu, Yuchen Zhuang, Jieyu Zhang +5

    cs.CLcs.AIcs.LGarXiv:2306.15895v22023
  19. English Conversational Telephone Speech Recognition by Humans and Machines

    George Saon, Gakuto Kurata, Tom Sercu +9

    cs.CLarXiv:1703.02136v12017
  20. Echoes of power: Language effects and power differences in social interaction

    Cristian Danescu-Niculescu-Mizil, Lillian Lee, Bo Pang +1

    cs.SIcs.CLphysics.soc-pharXiv:1112.3670v32011
  21. Fighting an Infodemic: COVID-19 Fake News Dataset

    Parth Patwa, Shivam Sharma, Srinivas Pykl +6

    cs.CLcs.IRcs.SIarXiv:2011.03327v42020
  22. A StrongREJECT for Empty Jailbreaks

    Alexandra Souly, Qingyuan Lu, Dillon Bowen +8

    cs.LGcs.CLcs.CRarXiv:2402.10260v22024
  23. Towards Learning a Generic Agent for Vision-and-Language Navigation via Pre-training

    Weituo Hao, Chunyuan Li, Xiujun Li +2

    cs.CVcs.CLcs.LGarXiv:2002.10638v22020
  24. Structured Chain-of-Thought Prompting for Code Generation

    Jia Li, Ge Li, Yongmin Li +1

    cs.SEcs.CLarXiv:2305.06599v32023
  25. Recursively Summarizing Books with Human Feedback

    Jeff Wu, Long Ouyang, Daniel M. Ziegler +4

    cs.CLcs.AIcs.LGarXiv:2109.10862v22021
  26. Grid Long Short-Term Memory

    Nal Kalchbrenner, Ivo Danihelka, Alex Graves

    cs.NEcs.CLcs.LGarXiv:1507.01526v32015
  27. DeClarE: Debunking Fake News and False Claims using Evidence-Aware Deep Learning

    Kashyap Popat, Subhabrata Mukherjee, Andrew Yates +1

    cs.CLcs.LGarXiv:1809.06416v12018
  28. Yin and Yang: Balancing and Answering Binary Visual Questions

    Peng Zhang, Yash Goyal, Douglas Summers-Stay +2

    cs.CLcs.CVcs.LGarXiv:1511.05099v52015
  29. A Unified Generative Framework for Aspect-Based Sentiment Analysis

    Hang Yan, Junqi Dai, Tuo ji +2

    cs.CLarXiv:2106.04300v12021
  30. A Unified Generative Framework for Various NER Subtasks

    Hang Yan, Tao Gui, Junqi Dai +3

    cs.CLarXiv:2106.01223v12021
  31. From Word to Sense Embeddings: A Survey on Vector Representations of Meaning

    Jose Camacho-Collados, Mohammad Taher Pilehvar

    cs.CLcs.AIarXiv:1805.04032v32018
  32. SemEval 2017 Task 10: ScienceIE - Extracting Keyphrases and Relations from Scientific Publications

    Isabelle Augenstein, Mrinal Das, Sebastian Riedel +2

    cs.CLcs.AIstat.MLarXiv:1704.02853v32017
  33. Query2box: Reasoning over Knowledge Graphs in Vector Space using Box Embeddings

    Hongyu Ren, Weihua Hu, Jure Leskovec

    cs.LGcs.CLstat.MLarXiv:2002.05969v22020
  34. Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data

    Jingyang Ou, Shen Nie, Kaiwen Xue +4

    cs.LGcs.CLarXiv:2406.03736v42024
  35. TAPEX: Table Pre-training via Learning a Neural SQL Executor

    Qian Liu, Bei Chen, Jiaqi Guo +4

    cs.CLcs.AIarXiv:2107.07653v32021
  36. Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools

    Varun Magesh, Faiz Surani, Matthew Dahl +3

    cs.CLcs.CYarXiv:2405.20362v12024
  37. Unsupervised Learning of Disentangled and Interpretable Representations from Sequential Data

    Wei-Ning Hsu, Yu Zhang, James Glass

    cs.LGcs.CLcs.SDarXiv:1709.07902v12017
  38. Disentangled Non-Local Neural Networks

    Minghao Yin, Zhuliang Yao, Yue Cao +4

    cs.CVcs.CLcs.LGarXiv:2006.06668v22020
  39. Beyond Goldfish Memory: Long-Term Open-Domain Conversation

    Jing Xu, Arthur Szlam, Jason Weston

    cs.CLcs.AIarXiv:2107.07567v12021
  40. Compressing BERT: Studying the Effects of Weight Pruning on Transfer Learning

    Mitchell A. Gordon, Kevin Duh, Nicholas Andrews

    cs.CLarXiv:2002.08307v22020
  41. LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens

    Yiran Ding, Li Lyna Zhang, Chengruidong Zhang +5

    cs.CLarXiv:2402.13753v12024
  42. Extracting Accurate Materials Data from Research Papers with Conversational Language Models and Prompt Engineering

    Maciej P. Polak, Dane Morgan

    cs.CLcond-mat.mtrl-sciarXiv:2303.05352v32023
  43. Deep Reinforcement Learning for Mention-Ranking Coreference Models

    Kevin Clark, Christopher D. Manning

    cs.CLarXiv:1609.08667v32016
  44. Learning a Neural Semantic Parser from User Feedback

    Srinivasan Iyer, Ioannis Konstas, Alvin Cheung +2

    cs.CLarXiv:1704.08760v12017
  45. SemEval-2017 Task 8: RumourEval: Determining rumour veracity and support for rumours

    Leon Derczynski, Kalina Bontcheva, Maria Liakata +3

    cs.CLcs.AIarXiv:1704.05972v12017
  46. UltraFeedback: Boosting Language Models with Scaled AI Feedback

    Ganqu Cui, Lifan Yuan, Ning Ding +9

    cs.CLcs.AIcs.LGarXiv:2310.01377v22023
  47. LoRA Learns Less and Forgets Less

    Dan Biderman, Jacob Portes, Jose Javier Gonzalez Ortiz +9

    cs.LGcs.AIcs.CLarXiv:2405.09673v22024
  48. CERT: Contrastive Self-supervised Learning for Language Understanding

    Hongchao Fang, Sicheng Wang, Meng Zhou +2

    cs.CLcs.LGstat.MLarXiv:2005.12766v22020
  49. CAIL2018: A Large-Scale Legal Dataset for Judgment Prediction

    Chaojun Xiao, Haoxi Zhong, Zhipeng Guo +8

    cs.CLarXiv:1807.02478v12018
  50. Analysis of Named Entity Recognition and Linking for Tweets

    Leon Derczynski, Diana Maynard, Giuseppe Rizzo +5

    cs.CLarXiv:1410.7182v12014
  51. Personalize Segment Anything Model with One Shot

    Renrui Zhang, Zhengkai Jiang, Ziyu Guo +6

    cs.CVcs.AIcs.CLarXiv:2305.03048v22023
  52. Humans or LLMs as the Judge? A Study on Judgement Biases

    Guiming Hardy Chen, Shunian Chen, Ziche Liu +2

    cs.CLarXiv:2402.10669v52024
  53. Document Embedding with Paragraph Vectors

    Andrew M. Dai, Christopher Olah, Quoc V. Le

    cs.CLcs.AIcs.LGarXiv:1507.07998v12015
  54. Achieving Open Vocabulary Neural Machine Translation with Hybrid Word-Character Models

    Minh-Thang Luong, Christopher D. Manning

    cs.CLcs.LGarXiv:1604.00788v22016
  55. Evaluating Explainable AI: Which Algorithmic Explanations Help Users Predict Model Behavior?

    Peter Hase, Mohit Bansal

    cs.CLcs.AIcs.LGarXiv:2005.01831v12020
  56. One-step and Two-step Classification for Abusive Language Detection on Twitter

    Ji Ho Park, Pascale Fung

    cs.CLarXiv:1706.01206v12017
  57. TimeLMs: Diachronic Language Models from Twitter

    Daniel Loureiro, Francesco Barbieri, Leonardo Neves +2

    cs.CLcs.AIarXiv:2202.03829v22022
  58. KUISAIL at SemEval-2020 Task 12: BERT-CNN for Offensive Speech Identification in Social Media

    Ali Safaya, Moutasem Abdullatif, Deniz Yuret

    cs.CLarXiv:2007.13184v12020
  59. Document-Level Event Argument Extraction by Conditional Generation

    Sha Li, Heng Ji, Jiawei Han

    cs.CLarXiv:2104.05919v12021
  60. A Multi-Framework Comparison of Outline Stages in Long-Form Generation with LLMs

    Yifan Song

    cs.CLcs.AIarXiv:2608.26177v12026