Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
7,021 to 7,080 of 11,248
Towards End-to-End Speech Recognition with Deep Convolutional Neural Networks
Ying Zhang, Mohammad Pezeshki, Philemon Brakel +3
cs.CLcs.LGstat.MLarXiv:1701.02720v12017SCIT: Testing Causal Cache Carriers in Latent Chain-of-Thought Models
Yi Ding, Lijun Huang, Menglin Yang
cs.CLarXiv:2608.27265v12026Information Leakage in Embedding Models
Congzheng Song, Ananth Raghunathan
cs.LGcs.CLcs.CRarXiv:2004.00053v22020Prediction of Prediction (PoP): Inter-Layer Activation Fusion for Single-Pass Hallucination Detection in Large Language Models
Himal Badu
cs.CLarXiv:2608.27165v12026Reducing Gender Bias in Abusive Language Detection
Ji Ho Park, Jamin Shin, Pascale Fung
cs.CLarXiv:1808.07231v12018BTS-AgentBench: A Deterministic, Replayable Pipeline from Read-Only Telemetry Logs to Agent Benchmarks
Jeong-Yoon Kim
cs.CLcs.SEarXiv:2608.27334v12026Prompting GPT-3 To Be Reliable
Chenglei Si, Zhe Gan, Zhengyuan Yang +4
cs.CLarXiv:2210.09150v22022Benchmarking Clinical Decision Pathway Adherence in Large Language Models
Nuo Chen, Xinyang Jiang, Zilong Wang +5
cs.CLarXiv:2608.26592v12026Difference-in-Differences on a Censored Rating Scale Can Manufacture an Effect: Evidence from a Pre-Registered LLM-Judge Audit
Shuyi Fan, Boyuan Deng, Mengyu Xu +3
cs.CLcs.AIcs.CYarXiv:2608.27309v12026Few-shot Learning with Multilingual Language Models
Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe +18
cs.CLcs.AIarXiv:2112.10668v32021Investigating Capsule Networks with Dynamic Routing for Text Classification
Wei Zhao, Jianbo Ye, Min Yang +3
cs.CLcs.AIarXiv:1804.00538v42018KinyaEmbed: Contrastive Sentence Embeddings for Kinyarwanda via Multi-Stage Curriculum Training
Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre
cs.CLarXiv:2608.26941v12026TabuLM: Morphology-Aware Tabular Pre-training for Low-Resource Languages
Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre
cs.CLarXiv:2608.26923v12026Towards Expert Financial QA via Self-Improving RAG
Junjie Xiong, Shawheen Ghezavat, Aum Hirpara
cs.CLarXiv:2608.26706v12026Neural Machine Translation for Low-Resource Languages: A Survey
Surangika Ranathunga, En-Shiun Annie Lee, Marjana Prifti Skenduli +3
cs.CLcs.AIarXiv:2106.15115v12021Negated and Misprimed Probes for Pretrained Language Models: Birds Can Talk, But Cannot Fly
Nora Kassner, Hinrich Schütze
cs.CLarXiv:1911.03343v32019Generalized Decoding for Pixel, Image, and Language
Xueyan Zou, Zi-Yi Dou, Jianwei Yang +11
cs.CVcs.CLarXiv:2212.11270v12022Naive Prompt Optimization: Rethinking the Need for Complex Prompt Search
Yuan Chang, Xiaoqi Chen
cs.AIcs.CLarXiv:2608.27266v12026Recursive Neural Conditional Random Fields for Aspect-based Sentiment Analysis
Wenya Wang, Sinno Jialin Pan, Daniel Dahlmeier +1
cs.CLcs.IRcs.LGarXiv:1603.06679v32016Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts
Yan Zeng, Xinsong Zhang, Hang Li
cs.CLcs.CVarXiv:2111.08276v32021Adapting Language Models to Compress Contexts
Alexis Chevalier, Alexander Wettig, Anirudh Ajith +1
cs.CLarXiv:2305.14788v22023GraphGPT: Graph Instruction Tuning for Large Language Models
Jiabin Tang, Yuhao Yang, Wei Wei +5
cs.CLcs.AIarXiv:2310.13023v32023Cross-Lingual Ability of Multilingual BERT: An Empirical Study
Karthikeyan K, Zihan Wang, Stephen Mayhew +1
cs.CLcs.AIcs.LGarXiv:1912.07840v22019Long-context LLMs Struggle with Long In-context Learning
Tianle Li, Ge Zhang, Quy Duc Do +2
cs.CLcs.AIarXiv:2404.02060v32024Language Understanding for Text-based Games Using Deep Reinforcement Learning
Karthik Narasimhan, Tejas Kulkarni, Regina Barzilay
cs.CLcs.AIarXiv:1506.08941v22015Image Retrieval on Real-life Images with Pre-trained Vision-and-Language Models
Zheyuan Liu, Cristian Rodriguez-Opazo, Damien Teney +1
cs.CVcs.CLcs.IRarXiv:2108.04024v12021Breaking NLI Systems with Sentences that Require Simple Lexical Inferences
Max Glockner, Vered Shwartz, Yoav Goldberg
cs.CLarXiv:1805.02266v12018Towards an Automatic Turing Test: Learning to Evaluate Dialogue Responses
Ryan Lowe, Michael Noseworthy, Iulian V. Serban +3
cs.CLcs.AIcs.LGarXiv:1708.07149v22017On Evaluating Adversarial Robustness of Large Vision-Language Models
Yunqing Zhao, Tianyu Pang, Chao Du +4
cs.CVcs.CLcs.CRarXiv:2305.16934v22023Large Language Models for Education: A Survey and Outlook
Shen Wang, Tianlong Xu, Hang Li +5
cs.CLcs.AIarXiv:2403.18105v22024Investigating the Influence of Prompt and Response Languages on LLM Content Generation
Thi Thanh Nhan Nguyen, Mai Khoi Tieu, Michael A. Riegler +2
cs.CLcs.AIarXiv:2608.26186v12026A Deeper Look into Sarcastic Tweets Using Deep Convolutional Neural Networks
Soujanya Poria, Erik Cambria, Devamanyu Hazarika +1
cs.CLarXiv:1610.08815v22016VideoAgent: Long-form Video Understanding with Large Language Model as Agent
Xiaohan Wang, Yuhui Zhang, Orr Zohar +1
cs.CVcs.AIcs.CLarXiv:2403.10517v12024Applying Deep Learning to Answer Selection: A Study and An Open Task
Minwei Feng, Bing Xiang, Michael R. Glass +2
cs.CLcs.LGarXiv:1508.01585v22015A Survey on Mixture of Experts in Large Language Models
Weilin Cai, Juyong Jiang, Fan Wang +3
cs.LGcs.CLarXiv:2407.06204v32024Entity-Relation Extraction as Multi-Turn Question Answering
Xiaoya Li, Fan Yin, Zijun Sun +6
cs.CLarXiv:1905.05529v62019InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model
Xiaoyi Dong, Pan Zhang, Yuhang Zang +20
cs.CVcs.CLarXiv:2401.16420v12024Comparing Chunking and Embedding Strategies for Turkish RAG Systems
Mustafa Sertaç Türkel, Fatma Nur Korkmaz, Ahmet Tuğrul Bayrak
cs.CLcs.AIarXiv:2608.26192v12026BERTology Meets Biology: Interpreting Attention in Protein Language Models
Jesse Vig, Ali Madani, Lav R. Varshney +3
cs.CLcs.LGq-bio.BMarXiv:2006.15222v32020Vowel Signs Are Not Letters: A Pre-tokenization Ceiling on Multilingual Tokenizer Fertility
Sajal Regmi, Siddhartha Pudasaini, Chetan Phakami Pun
cs.CLcs.LGarXiv:2608.26449v12026emotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation
Ziyang Ma, Zhisheng Zheng, Jiaxin Ye +4
cs.CLcs.HCcs.MMarXiv:2312.15185v12023Preference Ranking Optimization for Human Alignment
Feifan Song, Bowen Yu, Minghao Li +4
cs.CLcs.AIarXiv:2306.17492v22023DyNet: The Dynamic Neural Network Toolkit
Graham Neubig, Chris Dyer, Yoav Goldberg +22
stat.MLcs.CLcs.MSarXiv:1701.03980v12017Unifying Detection and Adaptation in Task-Free Continual Learning
Dezheng Han, Anbang Zhang, Zhihao Zhu +1
cs.LGcs.CLarXiv:2608.27070v12026A Computational Approach to Understanding Empathy Expressed in Text-Based Mental Health Support
Ashish Sharma, Adam S. Miner, David C. Atkins +1
cs.CLcs.SIarXiv:2009.08441v12020Faithful to the Original: Fact Aware Neural Abstractive Summarization
Ziqiang Cao, Furu Wei, Wenjie Li +1
cs.IRcs.CLarXiv:1711.04434v12017Symbolic Knowledge Distillation: from General Language Models to Commonsense Models
Peter West, Chandra Bhagavatula, Jack Hessel +6
cs.CLarXiv:2110.07178v22021Recommendation as Instruction Following: A Large Language Model Empowered Recommendation Approach
Junjie Zhang, Ruobing Xie, Yupeng Hou +3
cs.IRcs.CLarXiv:2305.07001v12023Generating Images with Multimodal Language Models
Jing Yu Koh, Daniel Fried, Ruslan Salakhutdinov
cs.CLcs.CVcs.LGarXiv:2305.17216v32023Scaling phoneme-based TTS augmentation for ASR: A unified pipeline and controlled study
Zhen Wang, TianRui Wu, RongQi Han +2
cs.CLarXiv:2608.26697v12026Meta-Learning Where to Allocate Experts: Task-Conditioned Layer-Wise Compression for MoEs
Rongfeng Wang, Shichao Weng, Zhiqiang Wang +4
cs.CLarXiv:2608.26650v12026SPT: Skills as Pre-Training Data for Agentic Language Models
Yufei Sun, Yudong Li, Yiming Cheng
cs.CLarXiv:2608.26563v12026Language in a Bottle: Language Model Guided Concept Bottlenecks for Interpretable Image Classification
Yue Yang, Artemis Panagopoulou, Shenghao Zhou +3
cs.CVcs.CLarXiv:2211.11158v22022Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature
Guangsheng Bao, Yanbin Zhao, Zhiyang Teng +2
cs.CLarXiv:2310.05130v32023Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Prediction
Jin Mu, Guanhua Chen
cs.CLcs.AIarXiv:2608.27397v12026Automatic Description Generation from Images: A Survey of Models, Datasets, and Evaluation Measures
Raffaella Bernardi, Ruket Cakici, Desmond Elliott +6
cs.CLcs.CVarXiv:1601.03896v22016SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents
Xuhui Zhou, Hao Zhu, Leena Mathur +8
cs.AIcs.CLcs.LGarXiv:2310.11667v22023Data Distributional Properties Drive Emergent In-Context Learning in Transformers
Stephanie C. Y. Chan, Adam Santoro, Andrew K. Lampinen +5
cs.LGcs.AIcs.CLarXiv:2205.05055v62022BERT has a Mouth, and It Must Speak: BERT as a Markov Random Field Language Model
Alex Wang, Kyunghyun Cho
cs.CLcs.LGarXiv:1902.04094v22019QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
Albert Tseng, Jerry Chee, Qingyao Sun +2
cs.LGcs.AIcs.CLarXiv:2402.04396v22024