Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,541 to 6,600 of 11,242

  1. Neural AMR: Sequence-to-Sequence Models for Parsing and Generation

    Ioannis Konstas, Srinivasan Iyer, Mark Yatskar +2

    cs.CLarXiv:1704.08381v32017
  2. Structural Scaffolds for Citation Intent Classification in Scientific Publications

    Arman Cohan, Waleed Ammar, Madeleine van Zuylen +1

    cs.CLarXiv:1904.01608v22019
  3. DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation

    Mojtaba Valipour, Mehdi Rezagholizadeh, Ivan Kobyzev +1

    cs.CLcs.LGarXiv:2210.07558v22022
  4. mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models

    Jiabo Ye, Haiyang Xu, Haowei Liu +6

    cs.CVcs.AIcs.CLarXiv:2408.04840v22024
  5. Interpreting and improving natural-language processing (in machines) with natural language-processing (in the brain)

    Mariya Toneva, Leila Wehbe

    cs.CLcs.AIcs.LGarXiv:1905.11833v42019
  6. Towards Best Practices of Activation Patching in Language Models: Metrics and Methods

    Fred Zhang, Neel Nanda

    cs.LGcs.AIcs.CLarXiv:2309.16042v22023
  7. JudgeBench: A Benchmark for Evaluating LLM-based Judges

    Sijun Tan, Siyuan Zhuang, Kyle Montgomery +5

    cs.AIcs.CLcs.LGarXiv:2410.12784v22024
  8. DREAM: A Challenge Dataset and Models for Dialogue-Based Reading Comprehension

    Kai Sun, Dian Yu, Jianshu Chen +3

    cs.CLarXiv:1902.00164v12019
  9. StyleGAN-NADA: CLIP-Guided Domain Adaptation of Image Generators

    Rinon Gal, Or Patashnik, Haggai Maron +2

    cs.CVcs.CLcs.GRarXiv:2108.00946v22021
  10. Deep Semantic Role Labeling with Self-Attention

    Zhixing Tan, Mingxuan Wang, Jun Xie +2

    cs.CLarXiv:1712.01586v12017
  11. How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition

    Guanting Dong, Hongyi Yuan, Keming Lu +7

    cs.CLcs.AIcs.LGarXiv:2310.05492v42023
  12. Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding

    Heming Xia, Zhe Yang, Qingxiu Dong +6

    cs.CLarXiv:2401.07851v32024
  13. Object Relational Graph with Teacher-Recommended Learning for Video Captioning

    Ziqi Zhang, Yaya Shi, Chunfeng Yuan +4

    cs.CVcs.CLarXiv:2002.11566v12020
  14. CoType: Joint Extraction of Typed Entities and Relations with Knowledge Bases

    Xiang Ren, Zeqiu Wu, Wenqi He +5

    cs.CLcs.LGarXiv:1610.08763v22016
  15. Multilingual Models for Compositional Distributed Semantics

    Karl Moritz Hermann, Phil Blunsom

    cs.CLarXiv:1404.4641v12014
  16. Building Cooperative Embodied Agents Modularly with Large Language Models

    Hongxin Zhang, Weihua Du, Jiaming Shan +5

    cs.AIcs.CLcs.CVarXiv:2307.02485v22023
  17. Hierarchical Transformers for Multi-Document Summarization

    Yang Liu, Mirella Lapata

    cs.CLcs.AIarXiv:1905.13164v12019
  18. Roget's Thesaurus and Semantic Similarity

    Mario Jarmasz, Stan Szpakowicz

    cs.CLarXiv:1204.0245v12012
  19. ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving

    Zhibin Gou, Zhihong Shao, Yeyun Gong +5

    cs.CLcs.AIarXiv:2309.17452v42023
  20. Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph

    Jiashuo Sun, Chengjin Xu, Lumingyuan Tang +6

    cs.CLarXiv:2307.07697v62023
  21. Thinking Fast and Slow in Large Language Models

    Thilo Hagendorff, Sarah Fabi, Michal Kosinski

    cs.CLcs.AIcs.LGarXiv:2212.05206v22022
  22. Can ChatGPT Understand Too? A Comparative Study on ChatGPT and Fine-tuned BERT

    Qihuang Zhong, Liang Ding, Juhua Liu +2

    cs.CLarXiv:2302.10198v22023
  23. Cross-Lingual Transfer Learning for Multilingual Task Oriented Dialog

    Sebastian Schuster, Sonal Gupta, Rushin Shah +1

    cs.CLarXiv:1810.13327v22018
  24. A New Generation of Perspective API: Efficient Multilingual Character-level Transformers

    Alyssa Lees, Vinh Q. Tran, Yi Tay +4

    cs.CLcs.AIcs.CYarXiv:2202.11176v12022
  25. Demystifying Prompts in Language Models via Perplexity Estimation

    Hila Gonen, Srini Iyer, Terra Blevins +2

    cs.CLarXiv:2212.04037v22022
  26. Understanding the Difficulty of Training Transformers

    Liyuan Liu, Xiaodong Liu, Jianfeng Gao +2

    cs.LGcs.CLstat.MLarXiv:2004.08249v32020
  27. Mem2Seq: Effectively Incorporating Knowledge Bases into End-to-End Task-Oriented Dialog Systems

    Andrea Madotto, Chien-Sheng Wu, Pascale Fung

    cs.CLarXiv:1804.08217v32018
  28. Show Your Work: Improved Reporting of Experimental Results

    Jesse Dodge, Suchin Gururangan, Dallas Card +2

    cs.LGcs.CLstat.MEarXiv:1909.03004v12019
  29. MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries

    Yixuan Tang, Yi Yang

    cs.CLarXiv:2401.15391v12024
  30. Deep Voice 3: Scaling Text-to-Speech with Convolutional Sequence Learning

    Wei Ping, Kainan Peng, Andrew Gibiansky +5

    cs.SDcs.AIcs.CLarXiv:1710.07654v32017
  31. Multilingual is not enough: BERT for Finnish

    Antti Virtanen, Jenna Kanerva, Rami Ilo +5

    cs.CLarXiv:1912.07076v12019
  32. Evaluating Large Language Models: A Comprehensive Survey

    Zishan Guo, Renren Jin, Chuang Liu +8

    cs.CLcs.AIarXiv:2310.19736v32023
  33. LLM Lies: Hallucinations are not Bugs, but Features as Adversarial Examples

    Jia-Yu Yao, Kun-Peng Ning, Zhen-Hui Liu +3

    cs.CLcs.AIarXiv:2310.01469v32023
  34. A meta-analysis of state-of-the-art electoral prediction from Twitter data

    Daniel Gayo-Avello

    cs.SIcs.CLcs.CYarXiv:1206.5851v12012
  35. Improved Neural Relation Detection for Knowledge Base Question Answering

    Mo Yu, Wenpeng Yin, Kazi Saidul Hasan +3

    cs.CLcs.AIcs.NEarXiv:1704.06194v22017
  36. ManiGAN: Text-Guided Image Manipulation

    Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz +1

    cs.CVcs.CLcs.LGarXiv:1912.06203v22019
  37. Poly-encoders: Transformer Architectures and Pre-training Strategies for Fast and Accurate Multi-sentence Scoring

    Samuel Humeau, Kurt Shuster, Marie-Anne Lachaux +1

    cs.CLcs.AIarXiv:1905.01969v42019
  38. CCMatrix: Mining Billions of High-Quality Parallel Sentences on the WEB

    Holger Schwenk, Guillaume Wenzek, Sergey Edunov +2

    cs.CLarXiv:1911.04944v22019
  39. Tool Learning with Large Language Models: A Survey

    Changle Qu, Sunhao Dai, Xiaochi Wei +5

    cs.CLcs.AIarXiv:2405.17935v32024
  40. BertGCN: Transductive Text Classification by Combining GCN and BERT

    Yuxiao Lin, Yuxian Meng, Xiaofei Sun +4

    cs.CLarXiv:2105.05727v42021
  41. Self-Monitoring Navigation Agent via Auxiliary Progress Estimation

    Chih-Yao Ma, Jiasen Lu, Zuxuan Wu +4

    cs.AIcs.CLcs.CVarXiv:1901.03035v12019
  42. A Benchmarking Study of Embedding-based Entity Alignment for Knowledge Graphs

    Zequn Sun, Qingheng Zhang, Wei Hu +4

    cs.CLcs.AIcs.DBarXiv:2003.07743v22020
  43. What's "up" with vision-language models? Investigating their struggle with spatial reasoning

    Amita Kamath, Jack Hessel, Kai-Wei Chang

    cs.CLcs.CVcs.LGarXiv:2310.19785v12023
  44. Very Deep Convolutional Networks for Text Classification

    Alexis Conneau, Holger Schwenk, Loïc Barrault +1

    cs.CLcs.LGcs.NEarXiv:1606.01781v22016
  45. A Fast Unified Model for Parsing and Sentence Understanding

    Samuel R. Bowman, Jon Gauthier, Abhinav Rastogi +3

    cs.CLarXiv:1603.06021v32016
  46. KBGAN: Adversarial Learning for Knowledge Graph Embeddings

    Liwei Cai, William Yang Wang

    cs.CLcs.AIarXiv:1711.04071v32017
  47. Context-Aware Neural Machine Translation Learns Anaphora Resolution

    Elena Voita, Pavel Serdyukov, Rico Sennrich +1

    cs.CLarXiv:1805.10163v12018
  48. Efficient Training of Language Models to Fill in the Middle

    Mohammad Bavarian, Heewoo Jun, Nikolas Tezak +4

    cs.CLarXiv:2207.14255v12022
  49. A Joint Model of Language and Perception for Grounded Attribute Learning

    Cynthia Matuszek, Nicholas FitzGerald, Luke Zettlemoyer +2

    cs.CLcs.LGcs.ROarXiv:1206.6423v12012
  50. Call Attention to Rumors: Deep Attention Based Recurrent Neural Networks for Early Rumor Detection

    Tong Chen, Lin Wu, Xue Li +3

    cs.CLcs.SIarXiv:1704.05973v12017
  51. Sentiment Analysis in the News

    Alexandra Balahur, Ralf Steinberger, Mijail Kabadjov +5

    cs.CLarXiv:1309.6202v12013
  52. Controllable Abstractive Summarization

    Angela Fan, David Grangier, Michael Auli

    cs.CLarXiv:1711.05217v22017
  53. Rethinking Machine Unlearning for Large Language Models

    Sijia Liu, Yuanshun Yao, Jinghan Jia +11

    cs.LGcs.CLarXiv:2402.08787v62024
  54. Sharp Nearby, Fuzzy Far Away: How Neural Language Models Use Context

    Urvashi Khandelwal, He He, Peng Qi +1

    cs.CLarXiv:1805.04623v12018
  55. Estimating the Prevalence of Deception in Online Review Communities

    Myle Ott, Claire Cardie, Jeff Hancock

    cs.SIcs.CLcs.CYarXiv:1204.2804v12012
  56. Corpus Creation for Sentiment Analysis in Code-Mixed Tamil-English Text

    Bharathi Raja Chakravarthi, Vigneshwaran Muralidaran, Ruba Priyadharshini +1

    cs.CLarXiv:2006.00206v12020
  57. FacTool: Factuality Detection in Generative AI -- A Tool Augmented Framework for Multi-Task and Multi-Domain Scenarios

    I-Chun Chern, Steffi Chern, Shiqi Chen +6

    cs.CLcs.AIarXiv:2307.13528v22023
  58. Supervised Multimodal Bitransformers for Classifying Images and Text

    Douwe Kiela, Suvrat Bhooshan, Hamed Firooz +2

    cs.CLcs.CVcs.LGarXiv:1909.02950v22019
  59. Translation between Molecules and Natural Language

    Carl Edwards, Tuan Lai, Kevin Ros +3

    cs.CLcs.AIarXiv:2204.11817v32022
  60. QAFactEval: Improved QA-Based Factual Consistency Evaluation for Summarization

    Alexander R. Fabbri, Chien-Sheng Wu, Wenhao Liu +1

    cs.CLarXiv:2112.08542v22021