Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,961 to 7,020 of 11,213
Persuasion for Good: Towards a Personalized Persuasive Dialogue System for Social Good
Xuewei Wang, Weiyan Shi, Richard Kim +4
cs.CLcs.AIcs.CYarXiv:1906.06725v22019Multimodal Sentiment Analysis using Hierarchical Fusion with Context Modeling
N. Majumder, D. Hazarika, A. Gelbukh +2
cs.CLcs.CVarXiv:1806.06228v12018End-to-End Task-Completion Neural Dialogue Systems
Xiujun Li, Yun-Nung Chen, Lihong Li +2
cs.CLcs.AIarXiv:1703.01008v42017Why RAGs Hallucinate: Penalty-Aware Evaluation of Retrieval-Augmented Generation Systems with Knowledge-Gap Canaries
Alden Do Rosario, Hussein Younes, Felipe Pires
cs.CLcs.AIarXiv:2608.26385v12026HuatuoGPT, towards Taming Language Model to Be a Doctor
Hongbo Zhang, Junying Chen, Feng Jiang +10
cs.CLcs.AIarXiv:2305.15075v12023Human heuristics for AI-generated language are flawed
Maurice Jakesch, Jeffrey Hancock, Mor Naaman
cs.CLcs.AIcs.CYarXiv:2206.07271v42022A Survey on Natural Language Processing for Fake News Detection
Ray Oshikawa, Jing Qian, William Yang Wang
cs.CLcs.AIarXiv:1811.00770v22018HateCheck: Functional Tests for Hate Speech Detection Models
Paul Röttger, Bertram Vidgen, Dong Nguyen +3
cs.CLarXiv:2012.15606v22020Parameter-efficient Multi-task Fine-tuning for Transformers via Shared Hypernetworks
Rabeeh Karimi Mahabadi, Sebastian Ruder, Mostafa Dehghani +1
cs.CLarXiv:2106.04489v12021Whitening Sentence Representations for Better Semantics and Faster Retrieval
Jianlin Su, Jiarun Cao, Weijie Liu +1
cs.CLcs.AIcs.LGarXiv:2103.15316v12021Learning from History: Modeling Temporal Knowledge Graphs with Sequential Copy-Generation Networks
Cunchao Zhu, Muhao Chen, Changjun Fan +2
cs.AIcs.CLcs.LGarXiv:2012.08492v22020Long Range Language Modeling via Gated State Spaces
Harsh Mehta, Ankit Gupta, Ashok Cutkosky +1
cs.LGcs.CLarXiv:2206.13947v32022FinBERT: A Pretrained Language Model for Financial Communications
Yi Yang, Mark Christopher Siy UY, Allen Huang
cs.CLarXiv:2006.08097v22020Explaining Recurrent Neural Network Predictions in Sentiment Analysis
Leila Arras, Grégoire Montavon, Klaus-Robert Müller +1
cs.CLcs.AIcs.NEarXiv:1706.07206v22017From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
Ming Li, Yong Zhang, Zhitao Li +6
cs.CLarXiv:2308.12032v52023Document-Level Relation Extraction with Adaptive Thresholding and Localized Context Pooling
Wenxuan Zhou, Kevin Huang, Tengyu Ma +1
cs.CLarXiv:2010.11304v32020Can language models learn from explanations in context?
Andrew K. Lampinen, Ishita Dasgupta, Stephanie C. Y. Chan +6
cs.CLcs.AIcs.LGarXiv:2204.02329v420223D-VLA: A 3D Vision-Language-Action Generative World Model
Haoyu Zhen, Xiaowen Qiu, Peihao Chen +5
cs.CVcs.AIcs.CLarXiv:2403.09631v12024Language2Pose: Natural Language Grounded Pose Forecasting
Chaitanya Ahuja, Louis-Philippe Morency
cs.CVcs.CLarXiv:1907.01108v22019Latent Hatred: A Benchmark for Understanding Implicit Hate Speech
Mai ElSherief, Caleb Ziems, David Muchlinski +4
cs.CLcs.SIarXiv:2109.05322v12021Towards a Unified Multi-Dimensional Evaluator for Text Generation
Ming Zhong, Yang Liu, Da Yin +6
cs.CLarXiv:2210.07197v12022Parameter-Efficient Fine-Tuning Methods for Pretrained Language Models: A Critical Review and Assessment
Lingling Xu, Haoran Xie, Si-Zhao Joe Qin +2
cs.CLarXiv:2312.12148v12023Towards better decoding and language model integration in sequence to sequence models
Jan Chorowski, Navdeep Jaitly
cs.NEcs.CLcs.LGarXiv:1612.02695v12016pix2code: Generating Code from a Graphical User Interface Screenshot
Tony Beltramelli
cs.LGcs.AIcs.CLarXiv:1705.07962v22017RAFT: Adapting Language Model to Domain Specific RAG
Tianjun Zhang, Shishir G. Patil, Naman Jain +4
cs.CLcs.AIarXiv:2403.10131v22024Towards End-to-End Speech Recognition with Deep Convolutional Neural Networks
Ying Zhang, Mohammad Pezeshki, Philemon Brakel +3
cs.CLcs.LGstat.MLarXiv:1701.02720v12017SCIT: Testing Causal Cache Carriers in Latent Chain-of-Thought Models
Yi Ding, Lijun Huang, Menglin Yang
cs.CLarXiv:2608.27265v12026Information Leakage in Embedding Models
Congzheng Song, Ananth Raghunathan
cs.LGcs.CLcs.CRarXiv:2004.00053v22020Prediction of Prediction (PoP): Inter-Layer Activation Fusion for Single-Pass Hallucination Detection in Large Language Models
Himal Badu
cs.CLarXiv:2608.27165v12026Reducing Gender Bias in Abusive Language Detection
Ji Ho Park, Jamin Shin, Pascale Fung
cs.CLarXiv:1808.07231v12018BTS-AgentBench: A Deterministic, Replayable Pipeline from Read-Only Telemetry Logs to Agent Benchmarks
Jeong-Yoon Kim
cs.CLcs.SEarXiv:2608.27334v12026Prompting GPT-3 To Be Reliable
Chenglei Si, Zhe Gan, Zhengyuan Yang +4
cs.CLarXiv:2210.09150v22022Benchmarking Clinical Decision Pathway Adherence in Large Language Models
Nuo Chen, Xinyang Jiang, Zilong Wang +5
cs.CLarXiv:2608.26592v12026Difference-in-Differences on a Censored Rating Scale Can Manufacture an Effect: Evidence from a Pre-Registered LLM-Judge Audit
Shuyi Fan, Boyuan Deng, Mengyu Xu +3
cs.CLcs.AIcs.CYarXiv:2608.27309v12026Few-shot Learning with Multilingual Language Models
Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe +18
cs.CLcs.AIarXiv:2112.10668v32021Investigating Capsule Networks with Dynamic Routing for Text Classification
Wei Zhao, Jianbo Ye, Min Yang +3
cs.CLcs.AIarXiv:1804.00538v42018KinyaEmbed: Contrastive Sentence Embeddings for Kinyarwanda via Multi-Stage Curriculum Training
Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre
cs.CLarXiv:2608.26941v12026TabuLM: Morphology-Aware Tabular Pre-training for Low-Resource Languages
Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre
cs.CLarXiv:2608.26923v12026Towards Expert Financial QA via Self-Improving RAG
Junjie Xiong, Shawheen Ghezavat, Aum Hirpara
cs.CLarXiv:2608.26706v12026Neural Machine Translation for Low-Resource Languages: A Survey
Surangika Ranathunga, En-Shiun Annie Lee, Marjana Prifti Skenduli +3
cs.CLcs.AIarXiv:2106.15115v12021Negated and Misprimed Probes for Pretrained Language Models: Birds Can Talk, But Cannot Fly
Nora Kassner, Hinrich Schütze
cs.CLarXiv:1911.03343v32019Generalized Decoding for Pixel, Image, and Language
Xueyan Zou, Zi-Yi Dou, Jianwei Yang +11
cs.CVcs.CLarXiv:2212.11270v12022Naive Prompt Optimization: Rethinking the Need for Complex Prompt Search
Yuan Chang, Xiaoqi Chen
cs.AIcs.CLarXiv:2608.27266v12026Recursive Neural Conditional Random Fields for Aspect-based Sentiment Analysis
Wenya Wang, Sinno Jialin Pan, Daniel Dahlmeier +1
cs.CLcs.IRcs.LGarXiv:1603.06679v32016Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts
Yan Zeng, Xinsong Zhang, Hang Li
cs.CLcs.CVarXiv:2111.08276v32021Adapting Language Models to Compress Contexts
Alexis Chevalier, Alexander Wettig, Anirudh Ajith +1
cs.CLarXiv:2305.14788v22023GraphGPT: Graph Instruction Tuning for Large Language Models
Jiabin Tang, Yuhao Yang, Wei Wei +5
cs.CLcs.AIarXiv:2310.13023v32023Cross-Lingual Ability of Multilingual BERT: An Empirical Study
Karthikeyan K, Zihan Wang, Stephen Mayhew +1
cs.CLcs.AIcs.LGarXiv:1912.07840v22019Long-context LLMs Struggle with Long In-context Learning
Tianle Li, Ge Zhang, Quy Duc Do +2
cs.CLcs.AIarXiv:2404.02060v32024Language Understanding for Text-based Games Using Deep Reinforcement Learning
Karthik Narasimhan, Tejas Kulkarni, Regina Barzilay
cs.CLcs.AIarXiv:1506.08941v22015Image Retrieval on Real-life Images with Pre-trained Vision-and-Language Models
Zheyuan Liu, Cristian Rodriguez-Opazo, Damien Teney +1
cs.CVcs.CLcs.IRarXiv:2108.04024v12021Breaking NLI Systems with Sentences that Require Simple Lexical Inferences
Max Glockner, Vered Shwartz, Yoav Goldberg
cs.CLarXiv:1805.02266v12018Towards an Automatic Turing Test: Learning to Evaluate Dialogue Responses
Ryan Lowe, Michael Noseworthy, Iulian V. Serban +3
cs.CLcs.AIcs.LGarXiv:1708.07149v22017On Evaluating Adversarial Robustness of Large Vision-Language Models
Yunqing Zhao, Tianyu Pang, Chao Du +4
cs.CVcs.CLcs.CRarXiv:2305.16934v22023Large Language Models for Education: A Survey and Outlook
Shen Wang, Tianlong Xu, Hang Li +5
cs.CLcs.AIarXiv:2403.18105v22024Investigating the Influence of Prompt and Response Languages on LLM Content Generation
Thi Thanh Nhan Nguyen, Mai Khoi Tieu, Michael A. Riegler +2
cs.CLcs.AIarXiv:2608.26186v12026A Deeper Look into Sarcastic Tweets Using Deep Convolutional Neural Networks
Soujanya Poria, Erik Cambria, Devamanyu Hazarika +1
cs.CLarXiv:1610.08815v22016VideoAgent: Long-form Video Understanding with Large Language Model as Agent
Xiaohan Wang, Yuhui Zhang, Orr Zohar +1
cs.CVcs.AIcs.CLarXiv:2403.10517v12024Applying Deep Learning to Answer Selection: A Study and An Open Task
Minwei Feng, Bing Xiang, Michael R. Glass +2
cs.CLcs.LGarXiv:1508.01585v22015A Survey on Mixture of Experts in Large Language Models
Weilin Cai, Juyong Jiang, Fan Wang +3
cs.LGcs.CLarXiv:2407.06204v32024