Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,361 to 6,420 of 11,259

  1. Large Language Models as General Pattern Machines

    Suvir Mirchandani, Fei Xia, Pete Florence +6

    cs.AIcs.CLcs.ROarXiv:2307.04721v22023
  2. Masked Language Modeling and the Distributional Hypothesis: Order Word Matters Pre-training for Little

    Koustuv Sinha, Robin Jia, Dieuwke Hupkes +3

    cs.CLcs.LGarXiv:2104.06644v22021
  3. RobBERT: a Dutch RoBERTa-based Language Model

    Pieter Delobelle, Thomas Winters, Bettina Berendt

    cs.CLcs.LGarXiv:2001.06286v22020
  4. Vulnerability Detection with Code Language Models: How Far Are We?

    Yangruibo Ding, Yanjun Fu, Omniyyah Ibrahim +6

    cs.SEcs.CLarXiv:2403.18624v22024
  5. Generating Factoid Questions With Recurrent Neural Networks: The 30M Factoid Question-Answer Corpus

    Iulian Vlad Serban, Alberto García-Durán, Caglar Gulcehre +4

    cs.CLcs.AIcs.LGarXiv:1603.06807v22016
  6. Efficient softmax approximation for GPUs

    Edouard Grave, Armand Joulin, Moustapha Cissé +2

    cs.CLcs.LGarXiv:1609.04309v32016
  7. Improving CLIP Training with Language Rewrites

    Lijie Fan, Dilip Krishnan, Phillip Isola +2

    cs.CVcs.CLcs.LGarXiv:2305.20088v22023
  8. EmotionLines: An Emotion Corpus of Multi-Party Conversations

    Sheng-Yeh Chen, Chao-Chun Hsu, Chuan-Chun Kuo +3

    cs.CLarXiv:1802.08379v22018
  9. mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections

    Chenliang Li, Haiyang Xu, Junfeng Tian +12

    cs.CLcs.CVarXiv:2205.12005v22022
  10. Training Millions of Personalized Dialogue Agents

    Pierre-Emmanuel Mazaré, Samuel Humeau, Martin Raison +1

    cs.CLarXiv:1809.01984v12018
  11. Revisiting Self-Training for Neural Sequence Generation

    Junxian He, Jiatao Gu, Jiajun Shen +1

    cs.LGcs.CLstat.MLarXiv:1909.13788v32019
  12. ScienceWorld: Is your Agent Smarter than a 5th Grader?

    Ruoyao Wang, Peter Jansen, Marc-Alexandre Côté +1

    cs.CLcs.AIarXiv:2203.07540v22022
  13. PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction

    Long Xing, Qidong Huang, Xiaoyi Dong +8

    cs.CVcs.CLarXiv:2410.17247v22024
  14. Compositional Vector Space Models for Knowledge Base Completion

    Arvind Neelakantan, Benjamin Roth, Andrew McCallum

    cs.CLstat.MLarXiv:1504.06662v22015
  15. Conversational AI: The Science Behind the Alexa Prize

    Ashwin Ram, Rohit Prasad, Chandra Khatri +15

    cs.AIcs.CLcs.CYarXiv:1801.03604v12018
  16. Improved Transition-Based Parsing by Modeling Characters instead of Words with LSTMs

    Miguel Ballesteros, Chris Dyer, Noah A. Smith

    cs.CLarXiv:1508.00657v22015
  17. Measuring Attribution in Natural Language Generation Models

    Hannah Rashkin, Vitaly Nikolaev, Matthew Lamm +7

    cs.CLarXiv:2112.12870v22021
  18. VisionZip: Longer is Better but Not Necessary in Vision Language Models

    Senqiao Yang, Yukang Chen, Zhuotao Tian +4

    cs.CVcs.AIcs.CLarXiv:2412.04467v22024
  19. Image Captioning with Deep Bidirectional LSTMs

    Cheng Wang, Haojin Yang, Christian Bartz +1

    cs.CVcs.CLcs.MMarXiv:1604.00790v32016
  20. Self-Evaluation Guided Beam Search for Reasoning

    Yuxi Xie, Kenji Kawaguchi, Yiran Zhao +4

    cs.CLcs.AIcs.LGarXiv:2305.00633v32023
  21. On the Practical Computational Power of Finite Precision RNNs for Language Recognition

    Gail Weiss, Yoav Goldberg, Eran Yahav

    cs.LGcs.CLstat.MLarXiv:1805.04908v12018
  22. Muppet: Massive Multi-task Representations with Pre-Finetuning

    Armen Aghajanyan, Anchit Gupta, Akshat Shrivastava +3

    cs.CLcs.LGarXiv:2101.11038v12021
  23. Toward Multilingual Neural Machine Translation with Universal Encoder and Decoder

    Thanh-Le Ha, Jan Niehues, Alexander Waibel

    cs.CLarXiv:1611.04798v12016
  24. Zero-Shot Video Question Answering via Frozen Bidirectional Language Models

    Antoine Yang, Antoine Miech, Josef Sivic +2

    cs.CVcs.CLcs.LGarXiv:2206.08155v22022
  25. Hierarchical Open-Vocabulary 3D Scene Graphs for Language-Grounded Robot Navigation

    Abdelrhman Werby, Chenguang Huang, Martin Büchner +2

    cs.ROcs.AIcs.CLarXiv:2403.17846v22024
  26. VisualGPT: Data-efficient Adaptation of Pretrained Language Models for Image Captioning

    Jun Chen, Han Guo, Kai Yi +2

    cs.CVcs.AIcs.CLarXiv:2102.10407v52021
  27. MobileLLM: Optimizing Sub-billion Parameter Language Models for On-Device Use Cases

    Zechun Liu, Changsheng Zhao, Forrest Iandola +9

    cs.LGcs.AIcs.CLarXiv:2402.14905v22024
  28. SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language Processing

    Junyi Ao, Rui Wang, Long Zhou +11

    eess.AScs.CLcs.LGarXiv:2110.07205v32021
  29. HuaTuo: Tuning LLaMA Model with Chinese Medical Knowledge

    Haochun Wang, Chi Liu, Nuwa Xi +4

    cs.CLarXiv:2304.06975v12023
  30. Portuguese Named Entity Recognition using BERT-CRF

    Fábio Souza, Rodrigo Nogueira, Roberto Lotufo

    cs.CLcs.IRcs.LGarXiv:1909.10649v22019
  31. ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings

    Shibo Hao, Tianyang Liu, Zhen Wang +1

    cs.CLcs.LGarXiv:2305.11554v42023
  32. The Geometry of Semantic Space: A Continuous Geometric Framework for the Transformer Architecture

    Zhihua Liang

    cond-mat.dis-nncs.CLcs.LGarXiv:2607.17146v12026
  33. Decision support from financial disclosures with deep neural networks and transfer learning

    Mathias Kraus, Stefan Feuerriegel

    cs.CLarXiv:1710.03954v12017
  34. Are Large Pre-Trained Language Models Leaking Your Personal Information?

    Jie Huang, Hanyin Shao, Kevin Chen-Chuan Chang

    cs.CLcs.AIcs.CRarXiv:2205.12628v22022
  35. Mind the Gap: Assessing Temporal Generalization in Neural Language Models

    Angeliki Lazaridou, Adhiguna Kuncoro, Elena Gribovskaya +11

    cs.CLcs.AIarXiv:2102.01951v22021
  36. Question Answering on Freebase via Relation Extraction and Textual Evidence

    Kun Xu, Siva Reddy, Yansong Feng +2

    cs.CLarXiv:1603.00957v32016
  37. Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity

    Cunxiang Wang, Xiaoze Liu, Yuanhao Yue +13

    cs.CLarXiv:2310.07521v32023
  38. Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs

    Oded Ovadia, Menachem Brief, Moshik Mishaeli +1

    cs.AIcs.CLcs.LGarXiv:2312.05934v32023
  39. PIXIU: A Large Language Model, Instruction Data and Evaluation Benchmark for Finance

    Qianqian Xie, Weiguang Han, Xiao Zhang +4

    cs.CLcs.AIarXiv:2306.05443v12023
  40. Debating with More Persuasive LLMs Leads to More Truthful Answers

    Akbir Khan, John Hughes, Dan Valentine +7

    cs.AIcs.CLarXiv:2402.06782v42024
  41. Has Machine Translation Achieved Human Parity? A Case for Document-level Evaluation

    Samuel Läubli, Rico Sennrich, Martin Volk

    cs.CLarXiv:1808.07048v12018
  42. Syntax-Aware Aspect Level Sentiment Classification with Graph Attention Networks

    Binxuan Huang, Kathleen M. Carley

    cs.CLarXiv:1909.02606v12019
  43. Semantic Relation Classification via Convolutional Neural Networks with Simple Negative Sampling

    Kun Xu, Yansong Feng, Songfang Huang +1

    cs.CLcs.LGarXiv:1506.07650v12015
  44. Seamless: Multilingual Expressive and Streaming Speech Translation

    Seamless Communication, Loïc Barrault, Yu-An Chung +62

    cs.CLcs.SDeess.ASarXiv:2312.05187v12023
  45. Unsupervised Speech Recognition

    Alexei Baevski, Wei-Ning Hsu, Alexis Conneau +1

    cs.CLcs.SDeess.ASarXiv:2105.11084v32021
  46. Two Tales of Persona in LLMs: A Survey of Role-Playing and Personalization

    Yu-Min Tseng, Yu-Chao Huang, Teng-Yun Hsiao +4

    cs.CLarXiv:2406.01171v32024
  47. Jailbreak Attacks and Defenses Against Large Language Models: A Survey

    Sibo Yi, Yule Liu, Zhen Sun +5

    cs.CRcs.AIcs.CLarXiv:2407.04295v22024
  48. Pretraining Language Models with Human Preferences

    Tomasz Korbak, Kejian Shi, Angelica Chen +5

    cs.CLcs.LGarXiv:2302.08582v22023
  49. LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities

    Yuqi Zhu, Xiaohan Wang, Jing Chen +6

    cs.CLcs.AIcs.DBarXiv:2305.13168v42023
  50. "What is Relevant in a Text Document?": An Interpretable Machine Learning Approach

    Leila Arras, Franziska Horn, Grégoire Montavon +2

    cs.CLcs.IRcs.LGarXiv:1612.07843v12016
  51. MUREL: Multimodal Relational Reasoning for Visual Question Answering

    Remi Cadene, Hedi Ben-younes, Matthieu Cord +1

    cs.CVcs.AIcs.CLarXiv:1902.09487v12019
  52. MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues

    Ge Bai, Jie Liu, Xingyuan Bu +8

    cs.CLcs.AIarXiv:2402.14762v32024
  53. Unit Test Case Generation with Transformers and Focal Context

    Michele Tufano, Dawn Drain, Alexey Svyatkovskiy +2

    cs.SEcs.CLcs.LGarXiv:2009.05617v22020
  54. Discourse-Aware Neural Extractive Text Summarization

    Jiacheng Xu, Zhe Gan, Yu Cheng +1

    cs.CLarXiv:1910.14142v22019
  55. Is Reinforcement Learning (Not) for Natural Language Processing: Benchmarks, Baselines, and Building Blocks for Natural Language Policy Optimization

    Rajkumar Ramamurthy, Prithviraj Ammanabrolu, Kianté Brantley +5

    cs.CLcs.LGarXiv:2210.01241v32022
  56. Heterogeneous Graph Neural Networks for Extractive Document Summarization

    Danqing Wang, Pengfei Liu, Yining Zheng +2

    cs.CLarXiv:2004.12393v12020
  57. Open Sesame: Getting Inside BERT's Linguistic Knowledge

    Yongjie Lin, Yi Chern Tan, Robert Frank

    cs.CLarXiv:1906.01698v12019
  58. MathPrompter: Mathematical Reasoning using Large Language Models

    Shima Imani, Liang Du, Harsh Shrivastava

    cs.CLcs.AIarXiv:2303.05398v12023
  59. Self-Attention Attribution: Interpreting Information Interactions Inside Transformer

    Yaru Hao, Li Dong, Furu Wei +1

    cs.CLarXiv:2004.11207v22020
  60. emoji2vec: Learning Emoji Representations from their Description

    Ben Eisner, Tim Rocktäschel, Isabelle Augenstein +2

    cs.CLarXiv:1609.08359v22016