Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,661 to 6,720 of 11,232

  1. Reward Design with Language Models

    Minae Kwon, Sang Michael Xie, Kalesha Bullard +1

    cs.LGcs.AIcs.CLarXiv:2303.00001v12023
  2. Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language Models

    Myra Cheng, Esin Durmus, Dan Jurafsky

    cs.CLcs.AIcs.CYarXiv:2305.18189v12023
  3. Information-Theoretic Probing with Minimum Description Length

    Elena Voita, Ivan Titov

    cs.CLarXiv:2003.12298v12020
  4. CodeS: Towards Building Open-source Language Models for Text-to-SQL

    Haoyang Li, Jing Zhang, Hanbing Liu +7

    cs.CLcs.DBarXiv:2402.16347v12024
  5. GPT4Tools: Teaching Large Language Model to Use Tools via Self-instruction

    Rui Yang, Lin Song, Yanwei Li +4

    cs.CVcs.CLarXiv:2305.18752v12023
  6. BERTje: A Dutch BERT Model

    Wietse de Vries, Andreas van Cranenburgh, Arianna Bisazza +3

    cs.CLarXiv:1912.09582v12019
  7. Lessons from Natural Language Inference in the Clinical Domain

    Alexey Romanov, Chaitanya Shivade

    cs.CLarXiv:1808.06752v22018
  8. BanglaBERT: Language Model Pretraining and Benchmarks for Low-Resource Language Understanding Evaluation in Bangla

    Abhik Bhattacharjee, Tahmid Hasan, Wasi Uddin Ahmad +5

    cs.CLarXiv:2101.00204v42021
  9. Position-Aware Tagging for Aspect Sentiment Triplet Extraction

    Lu Xu, Hao Li, Wei Lu +1

    cs.CLarXiv:2010.02609v32020
  10. LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked

    Mansi Phute, Alec Helbling, Matthew Hull +4

    cs.CLcs.AIarXiv:2308.07308v42023
  11. Automatic Detection of Cyberbullying in Social Media Text

    Cynthia Van Hee, Gilles Jacobs, Chris Emmery +6

    cs.CLcs.CYcs.SIarXiv:1801.05617v12018
  12. HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models

    Bernal Jiménez Gutiérrez, Yiheng Shu, Yu Gu +2

    cs.CLcs.AIarXiv:2405.14831v32024
  13. Multi-Source Neural Translation

    Barret Zoph, Kevin Knight

    cs.CLarXiv:1601.00710v12016
  14. Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking

    Eric Zelikman, Georges Harik, Yijia Shao +3

    cs.CLcs.AIcs.LGarXiv:2403.09629v22024
  15. What Does it Mean for a Language Model to Preserve Privacy?

    Hannah Brown, Katherine Lee, Fatemehsadat Mireshghallah +2

    stat.MLcs.CLcs.LGarXiv:2202.05520v22022
  16. BRIO: Bringing Order to Abstractive Summarization

    Yixin Liu, Pengfei Liu, Dragomir Radev +1

    cs.CLarXiv:2203.16804v12022
  17. Selective Annotation Makes Language Models Better Few-Shot Learners

    Hongjin Su, Jungo Kasai, Chen Henry Wu +8

    cs.CLarXiv:2209.01975v12022
  18. Improved Code Summarization via a Graph Neural Network

    Alexander LeClair, Sakib Haque, Lingfei Wu +1

    cs.SEcs.CLarXiv:2004.02843v22020
  19. Counterfactual Samples Synthesizing for Robust Visual Question Answering

    Long Chen, Xin Yan, Jun Xiao +3

    cs.CVcs.CLcs.MMarXiv:2003.06576v12020
  20. Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models

    Zhen Lin, Shubhendu Trivedi, Jimeng Sun

    cs.CLcs.LGstat.MLarXiv:2305.19187v32023
  21. fairseq S2T: Fast Speech-to-Text Modeling with fairseq

    Changhan Wang, Yun Tang, Xutai Ma +4

    cs.CLeess.ASarXiv:2010.05171v22020
  22. Federated Learning for Emoji Prediction in a Mobile Keyboard

    Swaroop Ramaswamy, Rajiv Mathews, Kanishka Rao +1

    cs.CLcs.LGarXiv:1906.04329v12019
  23. Image Question Answering using Convolutional Neural Network with Dynamic Parameter Prediction

    Hyeonwoo Noh, Paul Hongsuck Seo, Bohyung Han

    cs.CVcs.CLcs.LGarXiv:1511.05756v12015
  24. Gradient-based Adversarial Attacks against Text Transformers

    Chuan Guo, Alexandre Sablayrolles, Hervé Jégou +1

    cs.CLcs.AIcs.CRarXiv:2104.13733v12021
  25. AFlow: Automating Agentic Workflow Generation

    Jiayi Zhang, Jinyu Xiang, Zhaoyang Yu +11

    cs.AIcs.CLcs.LGarXiv:2410.10762v42024
  26. Nearest Neighbor Machine Translation

    Urvashi Khandelwal, Angela Fan, Dan Jurafsky +2

    cs.CLarXiv:2010.00710v22020
  27. SPoC: Search-based Pseudocode to Code

    Sumith Kulal, Panupong Pasupat, Kartik Chandra +4

    cs.LGcs.CLcs.PLarXiv:1906.04908v12019
  28. MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark

    S Sakshi, Utkarsh Tyagi, Sonal Kumar +6

    eess.AScs.AIcs.CLarXiv:2410.19168v12024
  29. Large Language Model Unlearning

    Yuanshun Yao, Xiaojun Xu, Yang Liu

    cs.CLcs.AIcs.LGarXiv:2310.10683v22023
  30. MRQA 2019 Shared Task: Evaluating Generalization in Reading Comprehension

    Adam Fisch, Alon Talmor, Robin Jia +3

    cs.CLarXiv:1910.09753v22019
  31. Training Tips for the Transformer Model

    Martin Popel, Ondřej Bojar

    cs.CLarXiv:1804.00247v22018
  32. Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models

    Alex Tamkin, Miles Brundage, Jack Clark +1

    cs.CLcs.LGarXiv:2102.02503v12021
  33. A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation

    Junyoung Chung, Kyunghyun Cho, Yoshua Bengio

    cs.CLcs.LGarXiv:1603.06147v42016
  34. Simple Baseline for Visual Question Answering

    Bolei Zhou, Yuandong Tian, Sainbayar Sukhbaatar +2

    cs.CVcs.CLarXiv:1512.02167v22015
  35. Smart Reply: Automated Response Suggestion for Email

    Anjuli Kannan, Karol Kurach, Sujith Ravi +8

    cs.CLarXiv:1606.04870v12016
  36. Joint Learning of the Embedding of Words and Entities for Named Entity Disambiguation

    Ikuya Yamada, Hiroyuki Shindo, Hideaki Takeda +1

    cs.CLarXiv:1601.01343v42016
  37. Causal Inference in Natural Language Processing: Estimation, Prediction, Interpretation and Beyond

    Amir Feder, Katherine A. Keith, Emaad Manzoor +10

    cs.CLcs.LGarXiv:2109.00725v22021
  38. Evaluating the Logical Reasoning Ability of ChatGPT and GPT-4

    Hanmeng Liu, Ruoxi Ning, Zhiyang Teng +3

    cs.CLcs.AIarXiv:2304.03439v32023
  39. Pre-Trained Language Models for Interactive Decision-Making

    Shuang Li, Xavier Puig, Chris Paxton +11

    cs.LGcs.CLarXiv:2202.01771v42022
  40. Certifying LLM Safety against Adversarial Prompting

    Aounon Kumar, Chirag Agarwal, Suraj Srinivas +3

    cs.CLcs.AIcs.CRarXiv:2309.02705v42023
  41. Learning General Purpose Distributed Sentence Representations via Large Scale Multi-task Learning

    Sandeep Subramanian, Adam Trischler, Yoshua Bengio +1

    cs.CLarXiv:1804.00079v12018
  42. Data-to-Text Generation with Content Selection and Planning

    Ratish Puduppully, Li Dong, Mirella Lapata

    cs.CLarXiv:1809.00582v22018
  43. LST: Ladder Side-Tuning for Parameter and Memory Efficient Transfer Learning

    Yi-Lin Sung, Jaemin Cho, Mohit Bansal

    cs.CLcs.AIcs.CVarXiv:2206.06522v22022
  44. Scaling Up Vision-Language Pre-training for Image Captioning

    Xiaowei Hu, Zhe Gan, Jianfeng Wang +4

    cs.CVcs.CLarXiv:2111.12233v22021
  45. MMKG: Multi-Modal Knowledge Graphs

    Ye Liu, Hui Li, Alberto Garcia-Duran +3

    cs.AIcs.CLarXiv:1903.05485v12019
  46. Emerging Cross-lingual Structure in Pretrained Language Models

    Shijie Wu, Alexis Conneau, Haoran Li +2

    cs.CLarXiv:1911.01464v32019
  47. Large Language Model Guided Tree-of-Thought

    Jieyi Long

    cs.AIcs.CLcs.CVarXiv:2305.08291v12023
  48. Hybrid Code Networks: practical and efficient end-to-end dialog control with supervised and reinforcement learning

    Jason D. Williams, Kavosh Asadi, Geoffrey Zweig

    cs.AIcs.CLarXiv:1702.03274v22017
  49. cosFormer: Rethinking Softmax in Attention

    Zhen Qin, Weixuan Sun, Hui Deng +6

    cs.CLarXiv:2202.08791v12022
  50. A Contrastive Framework for Neural Text Generation

    Yixuan Su, Tian Lan, Yan Wang +3

    cs.CLarXiv:2202.06417v32022
  51. Text2Event: Controllable Sequence-to-Structure Generation for End-to-end Event Extraction

    Yaojie Lu, Hongyu Lin, Jin Xu +6

    cs.CLarXiv:2106.09232v12021
  52. Listen and Translate: A Proof of Concept for End-to-End Speech-to-Text Translation

    Alexandre Berard, Olivier Pietquin, Christophe Servan +1

    cs.CLarXiv:1612.01744v12016
  53. Want To Reduce Labeling Cost? GPT-3 Can Help

    Shuohang Wang, Yang Liu, Yichong Xu +2

    cs.CLcs.AIarXiv:2108.13487v12021
  54. Neural Rating Regression with Abstractive Tips Generation for Recommendation

    Piji Li, Zihao Wang, Zhaochun Ren +2

    cs.CLcs.AIcs.IRarXiv:1708.00154v12017
  55. LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models

    Kaichen Zhang, Bo Li, Peiyuan Zhang +8

    cs.CLcs.CVarXiv:2407.12772v22024
  56. Neural News Recommendation with Attentive Multi-View Learning

    Chuhan Wu, Fangzhao Wu, Mingxiao An +3

    cs.CLcs.IRcs.LGarXiv:1907.05576v12019
  57. AMMUS : A Survey of Transformer-based Pretrained Models in Natural Language Processing

    Katikapalli Subramanyam Kalyan, Ajit Rajasekharan, Sivanesan Sangeetha

    cs.CLarXiv:2108.05542v22021
  58. Black is to Criminal as Caucasian is to Police: Detecting and Removing Multiclass Bias in Word Embeddings

    Thomas Manzini, Yao Chong Lim, Yulia Tsvetkov +1

    cs.CLcs.LGstat.MLarXiv:1904.04047v32019
  59. FANG: Leveraging Social Context for Fake News Detection Using Graph Representation

    Van-Hoang Nguyen, Kazunari Sugiyama, Preslav Nakov +1

    cs.SIcs.CLcs.IRarXiv:2008.07939v22020
  60. Hello, It's GPT-2 -- How Can I Help You? Towards the Use of Pretrained Language Models for Task-Oriented Dialogue Systems

    Paweł Budzianowski, Ivan Vulić

    cs.CLarXiv:1907.05774v22019