Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,541 to 6,600 of 11,242
Neural AMR: Sequence-to-Sequence Models for Parsing and Generation
Ioannis Konstas, Srinivasan Iyer, Mark Yatskar +2
cs.CLarXiv:1704.08381v32017Structural Scaffolds for Citation Intent Classification in Scientific Publications
Arman Cohan, Waleed Ammar, Madeleine van Zuylen +1
cs.CLarXiv:1904.01608v22019DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation
Mojtaba Valipour, Mehdi Rezagholizadeh, Ivan Kobyzev +1
cs.CLcs.LGarXiv:2210.07558v22022mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models
Jiabo Ye, Haiyang Xu, Haowei Liu +6
cs.CVcs.AIcs.CLarXiv:2408.04840v22024Interpreting and improving natural-language processing (in machines) with natural language-processing (in the brain)
Mariya Toneva, Leila Wehbe
cs.CLcs.AIcs.LGarXiv:1905.11833v42019Towards Best Practices of Activation Patching in Language Models: Metrics and Methods
Fred Zhang, Neel Nanda
cs.LGcs.AIcs.CLarXiv:2309.16042v22023JudgeBench: A Benchmark for Evaluating LLM-based Judges
Sijun Tan, Siyuan Zhuang, Kyle Montgomery +5
cs.AIcs.CLcs.LGarXiv:2410.12784v22024DREAM: A Challenge Dataset and Models for Dialogue-Based Reading Comprehension
Kai Sun, Dian Yu, Jianshu Chen +3
cs.CLarXiv:1902.00164v12019StyleGAN-NADA: CLIP-Guided Domain Adaptation of Image Generators
Rinon Gal, Or Patashnik, Haggai Maron +2
cs.CVcs.CLcs.GRarXiv:2108.00946v22021Deep Semantic Role Labeling with Self-Attention
Zhixing Tan, Mingxuan Wang, Jun Xie +2
cs.CLarXiv:1712.01586v12017How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
Guanting Dong, Hongyi Yuan, Keming Lu +7
cs.CLcs.AIcs.LGarXiv:2310.05492v42023Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding
Heming Xia, Zhe Yang, Qingxiu Dong +6
cs.CLarXiv:2401.07851v32024Object Relational Graph with Teacher-Recommended Learning for Video Captioning
Ziqi Zhang, Yaya Shi, Chunfeng Yuan +4
cs.CVcs.CLarXiv:2002.11566v12020CoType: Joint Extraction of Typed Entities and Relations with Knowledge Bases
Xiang Ren, Zeqiu Wu, Wenqi He +5
cs.CLcs.LGarXiv:1610.08763v22016Multilingual Models for Compositional Distributed Semantics
Karl Moritz Hermann, Phil Blunsom
cs.CLarXiv:1404.4641v12014Building Cooperative Embodied Agents Modularly with Large Language Models
Hongxin Zhang, Weihua Du, Jiaming Shan +5
cs.AIcs.CLcs.CVarXiv:2307.02485v22023Hierarchical Transformers for Multi-Document Summarization
Yang Liu, Mirella Lapata
cs.CLcs.AIarXiv:1905.13164v12019Roget's Thesaurus and Semantic Similarity
Mario Jarmasz, Stan Szpakowicz
cs.CLarXiv:1204.0245v12012ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
Zhibin Gou, Zhihong Shao, Yeyun Gong +5
cs.CLcs.AIarXiv:2309.17452v42023Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
Jiashuo Sun, Chengjin Xu, Lumingyuan Tang +6
cs.CLarXiv:2307.07697v62023Thinking Fast and Slow in Large Language Models
Thilo Hagendorff, Sarah Fabi, Michal Kosinski
cs.CLcs.AIcs.LGarXiv:2212.05206v22022Can ChatGPT Understand Too? A Comparative Study on ChatGPT and Fine-tuned BERT
Qihuang Zhong, Liang Ding, Juhua Liu +2
cs.CLarXiv:2302.10198v22023Cross-Lingual Transfer Learning for Multilingual Task Oriented Dialog
Sebastian Schuster, Sonal Gupta, Rushin Shah +1
cs.CLarXiv:1810.13327v22018A New Generation of Perspective API: Efficient Multilingual Character-level Transformers
Alyssa Lees, Vinh Q. Tran, Yi Tay +4
cs.CLcs.AIcs.CYarXiv:2202.11176v12022Demystifying Prompts in Language Models via Perplexity Estimation
Hila Gonen, Srini Iyer, Terra Blevins +2
cs.CLarXiv:2212.04037v22022Understanding the Difficulty of Training Transformers
Liyuan Liu, Xiaodong Liu, Jianfeng Gao +2
cs.LGcs.CLstat.MLarXiv:2004.08249v32020Mem2Seq: Effectively Incorporating Knowledge Bases into End-to-End Task-Oriented Dialog Systems
Andrea Madotto, Chien-Sheng Wu, Pascale Fung
cs.CLarXiv:1804.08217v32018Show Your Work: Improved Reporting of Experimental Results
Jesse Dodge, Suchin Gururangan, Dallas Card +2
cs.LGcs.CLstat.MEarXiv:1909.03004v12019MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries
Yixuan Tang, Yi Yang
cs.CLarXiv:2401.15391v12024Deep Voice 3: Scaling Text-to-Speech with Convolutional Sequence Learning
Wei Ping, Kainan Peng, Andrew Gibiansky +5
cs.SDcs.AIcs.CLarXiv:1710.07654v32017Multilingual is not enough: BERT for Finnish
Antti Virtanen, Jenna Kanerva, Rami Ilo +5
cs.CLarXiv:1912.07076v12019Evaluating Large Language Models: A Comprehensive Survey
Zishan Guo, Renren Jin, Chuang Liu +8
cs.CLcs.AIarXiv:2310.19736v32023LLM Lies: Hallucinations are not Bugs, but Features as Adversarial Examples
Jia-Yu Yao, Kun-Peng Ning, Zhen-Hui Liu +3
cs.CLcs.AIarXiv:2310.01469v32023A meta-analysis of state-of-the-art electoral prediction from Twitter data
Daniel Gayo-Avello
cs.SIcs.CLcs.CYarXiv:1206.5851v12012Improved Neural Relation Detection for Knowledge Base Question Answering
Mo Yu, Wenpeng Yin, Kazi Saidul Hasan +3
cs.CLcs.AIcs.NEarXiv:1704.06194v22017ManiGAN: Text-Guided Image Manipulation
Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz +1
cs.CVcs.CLcs.LGarXiv:1912.06203v22019Poly-encoders: Transformer Architectures and Pre-training Strategies for Fast and Accurate Multi-sentence Scoring
Samuel Humeau, Kurt Shuster, Marie-Anne Lachaux +1
cs.CLcs.AIarXiv:1905.01969v42019CCMatrix: Mining Billions of High-Quality Parallel Sentences on the WEB
Holger Schwenk, Guillaume Wenzek, Sergey Edunov +2
cs.CLarXiv:1911.04944v22019Tool Learning with Large Language Models: A Survey
Changle Qu, Sunhao Dai, Xiaochi Wei +5
cs.CLcs.AIarXiv:2405.17935v32024BertGCN: Transductive Text Classification by Combining GCN and BERT
Yuxiao Lin, Yuxian Meng, Xiaofei Sun +4
cs.CLarXiv:2105.05727v42021Self-Monitoring Navigation Agent via Auxiliary Progress Estimation
Chih-Yao Ma, Jiasen Lu, Zuxuan Wu +4
cs.AIcs.CLcs.CVarXiv:1901.03035v12019A Benchmarking Study of Embedding-based Entity Alignment for Knowledge Graphs
Zequn Sun, Qingheng Zhang, Wei Hu +4
cs.CLcs.AIcs.DBarXiv:2003.07743v22020What's "up" with vision-language models? Investigating their struggle with spatial reasoning
Amita Kamath, Jack Hessel, Kai-Wei Chang
cs.CLcs.CVcs.LGarXiv:2310.19785v12023Very Deep Convolutional Networks for Text Classification
Alexis Conneau, Holger Schwenk, Loïc Barrault +1
cs.CLcs.LGcs.NEarXiv:1606.01781v22016A Fast Unified Model for Parsing and Sentence Understanding
Samuel R. Bowman, Jon Gauthier, Abhinav Rastogi +3
cs.CLarXiv:1603.06021v32016KBGAN: Adversarial Learning for Knowledge Graph Embeddings
Liwei Cai, William Yang Wang
cs.CLcs.AIarXiv:1711.04071v32017Context-Aware Neural Machine Translation Learns Anaphora Resolution
Elena Voita, Pavel Serdyukov, Rico Sennrich +1
cs.CLarXiv:1805.10163v12018Efficient Training of Language Models to Fill in the Middle
Mohammad Bavarian, Heewoo Jun, Nikolas Tezak +4
cs.CLarXiv:2207.14255v12022A Joint Model of Language and Perception for Grounded Attribute Learning
Cynthia Matuszek, Nicholas FitzGerald, Luke Zettlemoyer +2
cs.CLcs.LGcs.ROarXiv:1206.6423v12012Call Attention to Rumors: Deep Attention Based Recurrent Neural Networks for Early Rumor Detection
Tong Chen, Lin Wu, Xue Li +3
cs.CLcs.SIarXiv:1704.05973v12017Sentiment Analysis in the News
Alexandra Balahur, Ralf Steinberger, Mijail Kabadjov +5
cs.CLarXiv:1309.6202v12013Controllable Abstractive Summarization
Angela Fan, David Grangier, Michael Auli
cs.CLarXiv:1711.05217v22017Rethinking Machine Unlearning for Large Language Models
Sijia Liu, Yuanshun Yao, Jinghan Jia +11
cs.LGcs.CLarXiv:2402.08787v62024Sharp Nearby, Fuzzy Far Away: How Neural Language Models Use Context
Urvashi Khandelwal, He He, Peng Qi +1
cs.CLarXiv:1805.04623v12018Estimating the Prevalence of Deception in Online Review Communities
Myle Ott, Claire Cardie, Jeff Hancock
cs.SIcs.CLcs.CYarXiv:1204.2804v12012Corpus Creation for Sentiment Analysis in Code-Mixed Tamil-English Text
Bharathi Raja Chakravarthi, Vigneshwaran Muralidaran, Ruba Priyadharshini +1
cs.CLarXiv:2006.00206v12020FacTool: Factuality Detection in Generative AI -- A Tool Augmented Framework for Multi-Task and Multi-Domain Scenarios
I-Chun Chern, Steffi Chern, Shiqi Chen +6
cs.CLcs.AIarXiv:2307.13528v22023Supervised Multimodal Bitransformers for Classifying Images and Text
Douwe Kiela, Suvrat Bhooshan, Hamed Firooz +2
cs.CLcs.CVcs.LGarXiv:1909.02950v22019Translation between Molecules and Natural Language
Carl Edwards, Tuan Lai, Kevin Ros +3
cs.CLcs.AIarXiv:2204.11817v32022QAFactEval: Improved QA-Based Factual Consistency Evaluation for Summarization
Alexander R. Fabbri, Chien-Sheng Wu, Wenhao Liu +1
cs.CLarXiv:2112.08542v22021