Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,661 to 6,720 of 11,232
Reward Design with Language Models
Minae Kwon, Sang Michael Xie, Kalesha Bullard +1
cs.LGcs.AIcs.CLarXiv:2303.00001v12023Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language Models
Myra Cheng, Esin Durmus, Dan Jurafsky
cs.CLcs.AIcs.CYarXiv:2305.18189v12023Information-Theoretic Probing with Minimum Description Length
Elena Voita, Ivan Titov
cs.CLarXiv:2003.12298v12020CodeS: Towards Building Open-source Language Models for Text-to-SQL
Haoyang Li, Jing Zhang, Hanbing Liu +7
cs.CLcs.DBarXiv:2402.16347v12024GPT4Tools: Teaching Large Language Model to Use Tools via Self-instruction
Rui Yang, Lin Song, Yanwei Li +4
cs.CVcs.CLarXiv:2305.18752v12023BERTje: A Dutch BERT Model
Wietse de Vries, Andreas van Cranenburgh, Arianna Bisazza +3
cs.CLarXiv:1912.09582v12019Lessons from Natural Language Inference in the Clinical Domain
Alexey Romanov, Chaitanya Shivade
cs.CLarXiv:1808.06752v22018BanglaBERT: Language Model Pretraining and Benchmarks for Low-Resource Language Understanding Evaluation in Bangla
Abhik Bhattacharjee, Tahmid Hasan, Wasi Uddin Ahmad +5
cs.CLarXiv:2101.00204v42021Position-Aware Tagging for Aspect Sentiment Triplet Extraction
Lu Xu, Hao Li, Wei Lu +1
cs.CLarXiv:2010.02609v32020LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked
Mansi Phute, Alec Helbling, Matthew Hull +4
cs.CLcs.AIarXiv:2308.07308v42023Automatic Detection of Cyberbullying in Social Media Text
Cynthia Van Hee, Gilles Jacobs, Chris Emmery +6
cs.CLcs.CYcs.SIarXiv:1801.05617v12018HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models
Bernal Jiménez Gutiérrez, Yiheng Shu, Yu Gu +2
cs.CLcs.AIarXiv:2405.14831v32024Multi-Source Neural Translation
Barret Zoph, Kevin Knight
cs.CLarXiv:1601.00710v12016Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
Eric Zelikman, Georges Harik, Yijia Shao +3
cs.CLcs.AIcs.LGarXiv:2403.09629v22024What Does it Mean for a Language Model to Preserve Privacy?
Hannah Brown, Katherine Lee, Fatemehsadat Mireshghallah +2
stat.MLcs.CLcs.LGarXiv:2202.05520v22022BRIO: Bringing Order to Abstractive Summarization
Yixin Liu, Pengfei Liu, Dragomir Radev +1
cs.CLarXiv:2203.16804v12022Selective Annotation Makes Language Models Better Few-Shot Learners
Hongjin Su, Jungo Kasai, Chen Henry Wu +8
cs.CLarXiv:2209.01975v12022Improved Code Summarization via a Graph Neural Network
Alexander LeClair, Sakib Haque, Lingfei Wu +1
cs.SEcs.CLarXiv:2004.02843v22020Counterfactual Samples Synthesizing for Robust Visual Question Answering
Long Chen, Xin Yan, Jun Xiao +3
cs.CVcs.CLcs.MMarXiv:2003.06576v12020Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models
Zhen Lin, Shubhendu Trivedi, Jimeng Sun
cs.CLcs.LGstat.MLarXiv:2305.19187v32023fairseq S2T: Fast Speech-to-Text Modeling with fairseq
Changhan Wang, Yun Tang, Xutai Ma +4
cs.CLeess.ASarXiv:2010.05171v22020Federated Learning for Emoji Prediction in a Mobile Keyboard
Swaroop Ramaswamy, Rajiv Mathews, Kanishka Rao +1
cs.CLcs.LGarXiv:1906.04329v12019Image Question Answering using Convolutional Neural Network with Dynamic Parameter Prediction
Hyeonwoo Noh, Paul Hongsuck Seo, Bohyung Han
cs.CVcs.CLcs.LGarXiv:1511.05756v12015Gradient-based Adversarial Attacks against Text Transformers
Chuan Guo, Alexandre Sablayrolles, Hervé Jégou +1
cs.CLcs.AIcs.CRarXiv:2104.13733v12021AFlow: Automating Agentic Workflow Generation
Jiayi Zhang, Jinyu Xiang, Zhaoyang Yu +11
cs.AIcs.CLcs.LGarXiv:2410.10762v42024Nearest Neighbor Machine Translation
Urvashi Khandelwal, Angela Fan, Dan Jurafsky +2
cs.CLarXiv:2010.00710v22020SPoC: Search-based Pseudocode to Code
Sumith Kulal, Panupong Pasupat, Kartik Chandra +4
cs.LGcs.CLcs.PLarXiv:1906.04908v12019MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark
S Sakshi, Utkarsh Tyagi, Sonal Kumar +6
eess.AScs.AIcs.CLarXiv:2410.19168v12024Large Language Model Unlearning
Yuanshun Yao, Xiaojun Xu, Yang Liu
cs.CLcs.AIcs.LGarXiv:2310.10683v22023MRQA 2019 Shared Task: Evaluating Generalization in Reading Comprehension
Adam Fisch, Alon Talmor, Robin Jia +3
cs.CLarXiv:1910.09753v22019Training Tips for the Transformer Model
Martin Popel, Ondřej Bojar
cs.CLarXiv:1804.00247v22018Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models
Alex Tamkin, Miles Brundage, Jack Clark +1
cs.CLcs.LGarXiv:2102.02503v12021A Character-Level Decoder without Explicit Segmentation for Neural Machine Translation
Junyoung Chung, Kyunghyun Cho, Yoshua Bengio
cs.CLcs.LGarXiv:1603.06147v42016Simple Baseline for Visual Question Answering
Bolei Zhou, Yuandong Tian, Sainbayar Sukhbaatar +2
cs.CVcs.CLarXiv:1512.02167v22015Smart Reply: Automated Response Suggestion for Email
Anjuli Kannan, Karol Kurach, Sujith Ravi +8
cs.CLarXiv:1606.04870v12016Joint Learning of the Embedding of Words and Entities for Named Entity Disambiguation
Ikuya Yamada, Hiroyuki Shindo, Hideaki Takeda +1
cs.CLarXiv:1601.01343v42016Causal Inference in Natural Language Processing: Estimation, Prediction, Interpretation and Beyond
Amir Feder, Katherine A. Keith, Emaad Manzoor +10
cs.CLcs.LGarXiv:2109.00725v22021Evaluating the Logical Reasoning Ability of ChatGPT and GPT-4
Hanmeng Liu, Ruoxi Ning, Zhiyang Teng +3
cs.CLcs.AIarXiv:2304.03439v32023Pre-Trained Language Models for Interactive Decision-Making
Shuang Li, Xavier Puig, Chris Paxton +11
cs.LGcs.CLarXiv:2202.01771v42022Certifying LLM Safety against Adversarial Prompting
Aounon Kumar, Chirag Agarwal, Suraj Srinivas +3
cs.CLcs.AIcs.CRarXiv:2309.02705v42023Learning General Purpose Distributed Sentence Representations via Large Scale Multi-task Learning
Sandeep Subramanian, Adam Trischler, Yoshua Bengio +1
cs.CLarXiv:1804.00079v12018Data-to-Text Generation with Content Selection and Planning
Ratish Puduppully, Li Dong, Mirella Lapata
cs.CLarXiv:1809.00582v22018LST: Ladder Side-Tuning for Parameter and Memory Efficient Transfer Learning
Yi-Lin Sung, Jaemin Cho, Mohit Bansal
cs.CLcs.AIcs.CVarXiv:2206.06522v22022Scaling Up Vision-Language Pre-training for Image Captioning
Xiaowei Hu, Zhe Gan, Jianfeng Wang +4
cs.CVcs.CLarXiv:2111.12233v22021MMKG: Multi-Modal Knowledge Graphs
Ye Liu, Hui Li, Alberto Garcia-Duran +3
cs.AIcs.CLarXiv:1903.05485v12019Emerging Cross-lingual Structure in Pretrained Language Models
Shijie Wu, Alexis Conneau, Haoran Li +2
cs.CLarXiv:1911.01464v32019Large Language Model Guided Tree-of-Thought
Jieyi Long
cs.AIcs.CLcs.CVarXiv:2305.08291v12023Hybrid Code Networks: practical and efficient end-to-end dialog control with supervised and reinforcement learning
Jason D. Williams, Kavosh Asadi, Geoffrey Zweig
cs.AIcs.CLarXiv:1702.03274v22017cosFormer: Rethinking Softmax in Attention
Zhen Qin, Weixuan Sun, Hui Deng +6
cs.CLarXiv:2202.08791v12022A Contrastive Framework for Neural Text Generation
Yixuan Su, Tian Lan, Yan Wang +3
cs.CLarXiv:2202.06417v32022Text2Event: Controllable Sequence-to-Structure Generation for End-to-end Event Extraction
Yaojie Lu, Hongyu Lin, Jin Xu +6
cs.CLarXiv:2106.09232v12021Listen and Translate: A Proof of Concept for End-to-End Speech-to-Text Translation
Alexandre Berard, Olivier Pietquin, Christophe Servan +1
cs.CLarXiv:1612.01744v12016Want To Reduce Labeling Cost? GPT-3 Can Help
Shuohang Wang, Yang Liu, Yichong Xu +2
cs.CLcs.AIarXiv:2108.13487v12021Neural Rating Regression with Abstractive Tips Generation for Recommendation
Piji Li, Zihao Wang, Zhaochun Ren +2
cs.CLcs.AIcs.IRarXiv:1708.00154v12017LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
Kaichen Zhang, Bo Li, Peiyuan Zhang +8
cs.CLcs.CVarXiv:2407.12772v22024Neural News Recommendation with Attentive Multi-View Learning
Chuhan Wu, Fangzhao Wu, Mingxiao An +3
cs.CLcs.IRcs.LGarXiv:1907.05576v12019AMMUS : A Survey of Transformer-based Pretrained Models in Natural Language Processing
Katikapalli Subramanyam Kalyan, Ajit Rajasekharan, Sivanesan Sangeetha
cs.CLarXiv:2108.05542v22021Black is to Criminal as Caucasian is to Police: Detecting and Removing Multiclass Bias in Word Embeddings
Thomas Manzini, Yao Chong Lim, Yulia Tsvetkov +1
cs.CLcs.LGstat.MLarXiv:1904.04047v32019FANG: Leveraging Social Context for Fake News Detection Using Graph Representation
Van-Hoang Nguyen, Kazunari Sugiyama, Preslav Nakov +1
cs.SIcs.CLcs.IRarXiv:2008.07939v22020Hello, It's GPT-2 -- How Can I Help You? Towards the Use of Pretrained Language Models for Task-Oriented Dialogue Systems
Paweł Budzianowski, Ivan Vulić
cs.CLarXiv:1907.05774v22019