Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,361 to 6,420 of 11,259
Large Language Models as General Pattern Machines
Suvir Mirchandani, Fei Xia, Pete Florence +6
cs.AIcs.CLcs.ROarXiv:2307.04721v22023Masked Language Modeling and the Distributional Hypothesis: Order Word Matters Pre-training for Little
Koustuv Sinha, Robin Jia, Dieuwke Hupkes +3
cs.CLcs.LGarXiv:2104.06644v22021RobBERT: a Dutch RoBERTa-based Language Model
Pieter Delobelle, Thomas Winters, Bettina Berendt
cs.CLcs.LGarXiv:2001.06286v22020Vulnerability Detection with Code Language Models: How Far Are We?
Yangruibo Ding, Yanjun Fu, Omniyyah Ibrahim +6
cs.SEcs.CLarXiv:2403.18624v22024Generating Factoid Questions With Recurrent Neural Networks: The 30M Factoid Question-Answer Corpus
Iulian Vlad Serban, Alberto García-Durán, Caglar Gulcehre +4
cs.CLcs.AIcs.LGarXiv:1603.06807v22016Efficient softmax approximation for GPUs
Edouard Grave, Armand Joulin, Moustapha Cissé +2
cs.CLcs.LGarXiv:1609.04309v32016Improving CLIP Training with Language Rewrites
Lijie Fan, Dilip Krishnan, Phillip Isola +2
cs.CVcs.CLcs.LGarXiv:2305.20088v22023EmotionLines: An Emotion Corpus of Multi-Party Conversations
Sheng-Yeh Chen, Chao-Chun Hsu, Chuan-Chun Kuo +3
cs.CLarXiv:1802.08379v22018mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections
Chenliang Li, Haiyang Xu, Junfeng Tian +12
cs.CLcs.CVarXiv:2205.12005v22022Training Millions of Personalized Dialogue Agents
Pierre-Emmanuel Mazaré, Samuel Humeau, Martin Raison +1
cs.CLarXiv:1809.01984v12018Revisiting Self-Training for Neural Sequence Generation
Junxian He, Jiatao Gu, Jiajun Shen +1
cs.LGcs.CLstat.MLarXiv:1909.13788v32019ScienceWorld: Is your Agent Smarter than a 5th Grader?
Ruoyao Wang, Peter Jansen, Marc-Alexandre Côté +1
cs.CLcs.AIarXiv:2203.07540v22022PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction
Long Xing, Qidong Huang, Xiaoyi Dong +8
cs.CVcs.CLarXiv:2410.17247v22024Compositional Vector Space Models for Knowledge Base Completion
Arvind Neelakantan, Benjamin Roth, Andrew McCallum
cs.CLstat.MLarXiv:1504.06662v22015Conversational AI: The Science Behind the Alexa Prize
Ashwin Ram, Rohit Prasad, Chandra Khatri +15
cs.AIcs.CLcs.CYarXiv:1801.03604v12018Improved Transition-Based Parsing by Modeling Characters instead of Words with LSTMs
Miguel Ballesteros, Chris Dyer, Noah A. Smith
cs.CLarXiv:1508.00657v22015Measuring Attribution in Natural Language Generation Models
Hannah Rashkin, Vitaly Nikolaev, Matthew Lamm +7
cs.CLarXiv:2112.12870v22021VisionZip: Longer is Better but Not Necessary in Vision Language Models
Senqiao Yang, Yukang Chen, Zhuotao Tian +4
cs.CVcs.AIcs.CLarXiv:2412.04467v22024Image Captioning with Deep Bidirectional LSTMs
Cheng Wang, Haojin Yang, Christian Bartz +1
cs.CVcs.CLcs.MMarXiv:1604.00790v32016Self-Evaluation Guided Beam Search for Reasoning
Yuxi Xie, Kenji Kawaguchi, Yiran Zhao +4
cs.CLcs.AIcs.LGarXiv:2305.00633v32023On the Practical Computational Power of Finite Precision RNNs for Language Recognition
Gail Weiss, Yoav Goldberg, Eran Yahav
cs.LGcs.CLstat.MLarXiv:1805.04908v12018Muppet: Massive Multi-task Representations with Pre-Finetuning
Armen Aghajanyan, Anchit Gupta, Akshat Shrivastava +3
cs.CLcs.LGarXiv:2101.11038v12021Toward Multilingual Neural Machine Translation with Universal Encoder and Decoder
Thanh-Le Ha, Jan Niehues, Alexander Waibel
cs.CLarXiv:1611.04798v12016Zero-Shot Video Question Answering via Frozen Bidirectional Language Models
Antoine Yang, Antoine Miech, Josef Sivic +2
cs.CVcs.CLcs.LGarXiv:2206.08155v22022Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation
Abdelrhman Werby, Chenguang Huang, Martin Büchner +2
cs.ROcs.AIcs.CLarXiv:2403.17846v22024VisualGPT: Data-efficient Adaptation of Pretrained Language Models for Image Captioning
Jun Chen, Han Guo, Kai Yi +2
cs.CVcs.AIcs.CLarXiv:2102.10407v52021MobileLLM: Optimizing Sub-billion Parameter Language Models for On-Device Use Cases
Zechun Liu, Changsheng Zhao, Forrest Iandola +9
cs.LGcs.AIcs.CLarXiv:2402.14905v22024SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language Processing
Junyi Ao, Rui Wang, Long Zhou +11
eess.AScs.CLcs.LGarXiv:2110.07205v32021HuaTuo: Tuning LLaMA Model with Chinese Medical Knowledge
Haochun Wang, Chi Liu, Nuwa Xi +4
cs.CLarXiv:2304.06975v12023Portuguese Named Entity Recognition using BERT-CRF
Fábio Souza, Rodrigo Nogueira, Roberto Lotufo
cs.CLcs.IRcs.LGarXiv:1909.10649v22019ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings
Shibo Hao, Tianyang Liu, Zhen Wang +1
cs.CLcs.LGarXiv:2305.11554v42023The Geometry of Semantic Space: A Continuous Geometric Framework for the Transformer Architecture
Zhihua Liang
cond-mat.dis-nncs.CLcs.LGarXiv:2607.17146v12026Decision support from financial disclosures with deep neural networks and transfer learning
Mathias Kraus, Stefan Feuerriegel
cs.CLarXiv:1710.03954v12017Are Large Pre-Trained Language Models Leaking Your Personal Information?
Jie Huang, Hanyin Shao, Kevin Chen-Chuan Chang
cs.CLcs.AIcs.CRarXiv:2205.12628v22022Mind the Gap: Assessing Temporal Generalization in Neural Language Models
Angeliki Lazaridou, Adhiguna Kuncoro, Elena Gribovskaya +11
cs.CLcs.AIarXiv:2102.01951v22021Question Answering on Freebase via Relation Extraction and Textual Evidence
Kun Xu, Siva Reddy, Yansong Feng +2
cs.CLarXiv:1603.00957v32016Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity
Cunxiang Wang, Xiaoze Liu, Yuanhao Yue +13
cs.CLarXiv:2310.07521v32023Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs
Oded Ovadia, Menachem Brief, Moshik Mishaeli +1
cs.AIcs.CLcs.LGarXiv:2312.05934v32023PIXIU: A Large Language Model, Instruction Data and Evaluation Benchmark for Finance
Qianqian Xie, Weiguang Han, Xiao Zhang +4
cs.CLcs.AIarXiv:2306.05443v12023Debating with More Persuasive LLMs Leads to More Truthful Answers
Akbir Khan, John Hughes, Dan Valentine +7
cs.AIcs.CLarXiv:2402.06782v42024Has Machine Translation Achieved Human Parity? A Case for Document-level Evaluation
Samuel Läubli, Rico Sennrich, Martin Volk
cs.CLarXiv:1808.07048v12018Syntax-Aware Aspect Level Sentiment Classification with Graph Attention Networks
Binxuan Huang, Kathleen M. Carley
cs.CLarXiv:1909.02606v12019Semantic Relation Classification via Convolutional Neural Networks with Simple Negative Sampling
Kun Xu, Yansong Feng, Songfang Huang +1
cs.CLcs.LGarXiv:1506.07650v12015Seamless: Multilingual Expressive and Streaming Speech Translation
Seamless Communication, Loïc Barrault, Yu-An Chung +62
cs.CLcs.SDeess.ASarXiv:2312.05187v12023Unsupervised Speech Recognition
Alexei Baevski, Wei-Ning Hsu, Alexis Conneau +1
cs.CLcs.SDeess.ASarXiv:2105.11084v32021Two Tales of Persona in LLMs: A Survey of Role-Playing and Personalization
Yu-Min Tseng, Yu-Chao Huang, Teng-Yun Hsiao +4
cs.CLarXiv:2406.01171v32024Jailbreak Attacks and Defenses Against Large Language Models: A Survey
Sibo Yi, Yule Liu, Zhen Sun +5
cs.CRcs.AIcs.CLarXiv:2407.04295v22024Pretraining Language Models with Human Preferences
Tomasz Korbak, Kejian Shi, Angelica Chen +5
cs.CLcs.LGarXiv:2302.08582v22023LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
Yuqi Zhu, Xiaohan Wang, Jing Chen +6
cs.CLcs.AIcs.DBarXiv:2305.13168v42023"What is Relevant in a Text Document?": An Interpretable Machine Learning Approach
Leila Arras, Franziska Horn, Grégoire Montavon +2
cs.CLcs.IRcs.LGarXiv:1612.07843v12016MUREL: Multimodal Relational Reasoning for Visual Question Answering
Remi Cadene, Hedi Ben-younes, Matthieu Cord +1
cs.CVcs.AIcs.CLarXiv:1902.09487v12019MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
Ge Bai, Jie Liu, Xingyuan Bu +8
cs.CLcs.AIarXiv:2402.14762v32024Unit Test Case Generation with Transformers and Focal Context
Michele Tufano, Dawn Drain, Alexey Svyatkovskiy +2
cs.SEcs.CLcs.LGarXiv:2009.05617v22020Discourse-Aware Neural Extractive Text Summarization
Jiacheng Xu, Zhe Gan, Yu Cheng +1
cs.CLarXiv:1910.14142v22019Is Reinforcement Learning (Not) for Natural Language Processing: Benchmarks, Baselines, and Building Blocks for Natural Language Policy Optimization
Rajkumar Ramamurthy, Prithviraj Ammanabrolu, Kianté Brantley +5
cs.CLcs.LGarXiv:2210.01241v32022Heterogeneous Graph Neural Networks for Extractive Document Summarization
Danqing Wang, Pengfei Liu, Yining Zheng +2
cs.CLarXiv:2004.12393v12020Open Sesame: Getting Inside BERT's Linguistic Knowledge
Yongjie Lin, Yi Chern Tan, Robert Frank
cs.CLarXiv:1906.01698v12019MathPrompter: Mathematical Reasoning using Large Language Models
Shima Imani, Liang Du, Harsh Shrivastava
cs.CLcs.AIarXiv:2303.05398v12023Self-Attention Attribution: Interpreting Information Interactions Inside Transformer
Yaru Hao, Li Dong, Furu Wei +1
cs.CLarXiv:2004.11207v22020emoji2vec: Learning Emoji Representations from their Description
Ben Eisner, Tim Rocktäschel, Isabelle Augenstein +2
cs.CLarXiv:1609.08359v22016