Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,801 to 4,860 of 11,259
Do-Not-Answer: A Dataset for Evaluating Safeguards in LLMs
Yuxia Wang, Haonan Li, Xudong Han +2
cs.CLarXiv:2308.13387v22023InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Yuxing Long, Wenzhe Cai, Hongcheng Wang +2
cs.ROcs.AIcs.CLarXiv:2406.04882v12024On Identifiability in Transformers
Gino Brunner, Yang Liu, Damián Pascual +3
cs.CLcs.LGarXiv:1908.04211v42019Towards Sub-Word Level Compositions for Sentiment Analysis of Hindi-English Code Mixed Text
Ameya Prabhu, Aditya Joshi, Manish Shrivastava +1
cs.CLarXiv:1611.00472v12016Interaction Embeddings for Prediction and Explanation in Knowledge Graphs
Wen Zhang, Bibek Paudel, Wei Zhang +2
cs.AIcs.CLarXiv:1903.04750v12019Unified Demonstration Retriever for In-Context Learning
Xiaonan Li, Kai Lv, Hang Yan +6
cs.CLarXiv:2305.04320v22023Scalable Topical Phrase Mining from Text Corpora
Ahmed El-Kishky, Yanglei Song, Chi Wang +2
cs.CLcs.IRcs.LGarXiv:1406.6312v22014Do Large Language Models Capture the Diversity in their Training Data?
Youqi Wu, Farzan Farnia
cs.CLcs.AIcs.LGarXiv:2609.02275v12026CLIFF: Contrastive Learning for Improving Faithfulness and Factuality in Abstractive Summarization
Shuyang Cao, Lu Wang
cs.CLarXiv:2109.09209v12021MoEL: Mixture of Empathetic Listeners
Zhaojiang Lin, Andrea Madotto, Jamin Shin +2
cs.CLarXiv:1908.07687v12019Enhancing Financial Sentiment Analysis via Retrieval Augmented Large Language Models
Boyu Zhang, Hongyang Yang, Tianyu Zhou +2
cs.CLq-fin.STq-fin.TRarXiv:2310.04027v22023Multilingual Alignment of Contextual Word Representations
Steven Cao, Nikita Kitaev, Dan Klein
cs.CLcs.LGarXiv:2002.03518v22020LM vs LM: Detecting Factual Errors via Cross Examination
Roi Cohen, May Hamri, Mor Geva +1
cs.CLarXiv:2305.13281v12023Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language Models
Haobo Xu, Sirui Chen, Yuanchen Bei +5
cs.CLcs.AIarXiv:2609.02108v12026Toxicity Detection: Does Context Really Matter?
John Pavlopoulos, Jeffrey Sorensen, Lucas Dixon +2
cs.CLarXiv:2006.00998v12020How LLMs Build Fictional Worlds: Setting and Narrative Space in AI-Generated Creative Storytelling
Katrin Rohrbacher, Björn Nieth, Emmanuelle Salin +2
cs.CLarXiv:2609.02482v12026Multi-task Learning for Multi-modal Emotion Recognition and Sentiment Analysis
Md Shad Akhtar, Dushyant Singh Chauhan, Deepanway Ghosal +3
cs.CLarXiv:1905.05812v12019ConveRT: Efficient and Accurate Conversational Representations from Transformers
Matthew Henderson, Iñigo Casanueva, Nikola Mrkšić +3
cs.CLarXiv:1911.03688v22019AgentCF: Collaborative Learning with Autonomous Language Agents for Recommender Systems
Junjie Zhang, Yupeng Hou, Ruobing Xie +5
cs.IRcs.CLarXiv:2310.09233v12023Multi-Label Classification of Patient Notes a Case Study on ICD Code Assignment
Tal Baumel, Jumana Nassour-Kassis, Raphael Cohen +2
cs.CLcs.AIarXiv:1709.09587v32017Don't Say That! Making Inconsistent Dialogue Unlikely with Unlikelihood Training
Margaret Li, Stephen Roller, Ilia Kulikov +4
cs.CLarXiv:1911.03860v22019Improving Health Literacy through Lay Summarization of Radiological Reports: An Evaluation of BioNER and Retrieval-Augmented Generation
Egecan Çelik Evgin, İlknur Karadeniz, Olcay Taner Yıldız
cs.CLarXiv:2609.02396v12026SWE-bench Multimodal: Do AI Systems Generalize to Visual Software Domains?
John Yang, Carlos E. Jimenez, Alex L. Zhang +10
cs.CLcs.AIcs.SEarXiv:2410.03859v12024Do Cantonese-Adapted Language Models Better Predict Cantonese Reading? A Cross-Model Eye-Tracking Evaluation
Ziqi Zhang, Emmanuele Chersoni, Mohammad Momenian
cs.CLarXiv:2609.02163v12026BillSum: A Corpus for Automatic Summarization of US Legislation
Anastassia Kornilova, Vlad Eidelman
cs.CLarXiv:1910.00523v22019"I'm sorry to hear that": Finding New Biases in Language Models with a Holistic Descriptor Dataset
Eric Michael Smith, Melissa Hall, Melanie Kambadur +2
cs.CLcs.CYarXiv:2205.09209v22022Enabling Language Models to Fill in the Blanks
Chris Donahue, Mina Lee, Percy Liang
cs.CLcs.AIcs.LGarXiv:2005.05339v22020RnG-KBQA: Generation Augmented Iterative Ranking for Knowledge Base Question Answering
Xi Ye, Semih Yavuz, Kazuma Hashimoto +2
cs.CLarXiv:2109.08678v22021Jointly Discovering Visual Objects and Spoken Words from Raw Sensory Input
David Harwath, Adrià Recasens, Dídac Surís +3
cs.CVcs.CLcs.SDarXiv:1804.01452v12018ToolACE: Winning the Points of LLM Function Calling
Weiwen Liu, Xu Huang, Xingshan Zeng +24
cs.LGcs.AIcs.CLarXiv:2409.00920v22024MuSR: Testing the Limits of Chain-of-thought with Multistep Soft Reasoning
Zayne Sprague, Xi Ye, Kaj Bostrom +2
cs.CLarXiv:2310.16049v22023Entangled Representations Amplify Collateral Damage in Unlearning
Evžen Wybitul, Tim G. J. Rudner, Christian Schroeder de Witt
cs.LGcs.CLarXiv:2609.02285v12026Case-based Reasoning for Natural Language Queries over Knowledge Bases
Rajarshi Das, Manzil Zaheer, Dung Thai +6
cs.CLcs.AIcs.LGarXiv:2104.08762v22021Proactive Human-Machine Conversation with Explicit Conversation Goals
Wenquan Wu, Zhen Guo, Xiangyang Zhou +4
cs.CLarXiv:1906.05572v22019Distinguish Confusing Law Articles for Legal Judgment Prediction
Nuo Xu, Pinghui Wang, Long Chen +3
cs.CLcs.AIarXiv:2004.02557v32020Does Prompt Formatting Have Any Impact on LLM Performance?
Jia He, Mukund Rungta, David Koleczek +3
cs.CLcs.LGarXiv:2411.10541v12024A Survey on Complex Knowledge Base Question Answering: Methods, Challenges and Solutions
Yunshi Lan, Gaole He, Jinhao Jiang +3
cs.CLarXiv:2105.11644v12021Towards Continual Knowledge Learning of Language Models
Joel Jang, Seonghyeon Ye, Sohee Yang +5
cs.CLcs.LGarXiv:2110.03215v42021Generative Adversarial Transformers
Drew A. Hudson, C. Lawrence Zitnick
cs.CVcs.AIcs.CLarXiv:2103.01209v42021Intermediate-Task Transfer Learning with Pretrained Models for Natural Language Understanding: When and Why Does It Work?
Yada Pruksachatkun, Jason Phang, Haokun Liu +6
cs.CLarXiv:2005.00628v22020Alpha-CLIP: A CLIP Model Focusing on Wherever You Want
Zeyi Sun, Ye Fang, Tong Wu +6
cs.CVcs.AIcs.CLarXiv:2312.03818v22023CGMH: Constrained Sentence Generation by Metropolis-Hastings Sampling
Ning Miao, Hao Zhou, Lili Mou +2
cs.CLcs.AIcs.LGarXiv:1811.10996v12018How do World Models and Policies Compose in LLM Agents? A Joint Spectral and Behavioral Account
Ruize Xu, Xiao Yu, Yujin Tang +2
cs.LGcs.AIcs.CLarXiv:2608.30067v12026GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities
Sreyan Ghosh, Sonal Kumar, Ashish Seth +6
cs.SDcs.AIcs.CLarXiv:2406.11768v12024Chinese CLIP: Contrastive Vision-Language Pretraining in Chinese
An Yang, Junshu Pan, Junyang Lin +4
cs.CVcs.CLarXiv:2211.01335v32022UniChart: A Universal Vision-language Pretrained Model for Chart Comprehension and Reasoning
Ahmed Masry, Parsa Kavehzadeh, Xuan Long Do +2
cs.CLarXiv:2305.14761v32023Generative and Discriminative Text Classification with Recurrent Neural Networks
Dani Yogatama, Chris Dyer, Wang Ling +1
stat.MLcs.CLcs.LGarXiv:1703.01898v22017ICD Coding from Clinical Text Using Multi-Filter Residual Convolutional Neural Network
Fei Li, Hong Yu
cs.CLcs.LGarXiv:1912.00862v12019Debias-SparseGPT: Bias-Aware Pruning for Large Language Models
Irina Proskurina, Guillaume Metzler, Antoine Gourru +1
cs.CLarXiv:2609.02496v12026How Can We Accelerate Progress Towards Human-like Linguistic Generalization?
Tal Linzen
cs.CLarXiv:2005.00955v12020EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers
Qingyan Guo, Rui Wang, Junliang Guo +6
cs.CLcs.AIarXiv:2309.08532v32023Train What You Deploy: Closing the MLP Reachability Gap in Low-Rank Clone Distillation
Wenhui Chen, Zhifeng Li, Jie Zhou +5
cs.LGcs.CLarXiv:2609.02006v12026Unpaired Sentiment-to-Sentiment Translation: A Cycled Reinforcement Learning Approach
Jingjing Xu, Xu Sun, Qi Zeng +4
cs.CLarXiv:1805.05181v22018Portuguese Word Embeddings: Evaluating on Word Analogies and Natural Language Tasks
Nathan Hartmann, Erick Fonseca, Christopher Shulby +3
cs.CLarXiv:1708.06025v12017How to Index Item IDs for Recommendation Foundation Models
Wenyue Hua, Shuyuan Xu, Yingqiang Ge +1
cs.IRcs.AIcs.CLarXiv:2305.06569v62023CrossNER: Evaluating Cross-Domain Named Entity Recognition
Zihan Liu, Yan Xu, Tiezheng Yu +5
cs.CLcs.AIarXiv:2012.04373v22020MusicBERT: Symbolic Music Understanding with Large-Scale Pre-Training
Mingliang Zeng, Xu Tan, Rui Wang +3
cs.SDcs.CLcs.IRarXiv:2106.05630v12021Dynamically Fused Graph Network for Multi-hop Reasoning
Yunxuan Xiao, Yanru Qu, Lin Qiu +4
cs.CLarXiv:1905.06933v32019MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution Shifts
Matteo Greco, Anudeex Shetty, Andrea Tagarelli +1
cs.CLcs.AIcs.CYarXiv:2609.02379v12026QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language Models
Yuhui Xu, Lingxi Xie, Xiaotao Gu +6
cs.LGcs.CLarXiv:2309.14717v22023