Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

7,021 to 7,080 of 11,248

  1. Towards End-to-End Speech Recognition with Deep Convolutional Neural Networks

    Ying Zhang, Mohammad Pezeshki, Philemon Brakel +3

    cs.CLcs.LGstat.MLarXiv:1701.02720v12017
  2. SCIT: Testing Causal Cache Carriers in Latent Chain-of-Thought Models

    Yi Ding, Lijun Huang, Menglin Yang

    cs.CLarXiv:2608.27265v12026
  3. Information Leakage in Embedding Models

    Congzheng Song, Ananth Raghunathan

    cs.LGcs.CLcs.CRarXiv:2004.00053v22020
  4. Prediction of Prediction (PoP): Inter-Layer Activation Fusion for Single-Pass Hallucination Detection in Large Language Models

    Himal Badu

    cs.CLarXiv:2608.27165v12026
  5. Reducing Gender Bias in Abusive Language Detection

    Ji Ho Park, Jamin Shin, Pascale Fung

    cs.CLarXiv:1808.07231v12018
  6. BTS-AgentBench: A Deterministic, Replayable Pipeline from Read-Only Telemetry Logs to Agent Benchmarks

    Jeong-Yoon Kim

    cs.CLcs.SEarXiv:2608.27334v12026
  7. Prompting GPT-3 To Be Reliable

    Chenglei Si, Zhe Gan, Zhengyuan Yang +4

    cs.CLarXiv:2210.09150v22022
  8. Benchmarking Clinical Decision Pathway Adherence in Large Language Models

    Nuo Chen, Xinyang Jiang, Zilong Wang +5

    cs.CLarXiv:2608.26592v12026
  9. Difference-in-Differences on a Censored Rating Scale Can Manufacture an Effect: Evidence from a Pre-Registered LLM-Judge Audit

    Shuyi Fan, Boyuan Deng, Mengyu Xu +3

    cs.CLcs.AIcs.CYarXiv:2608.27309v12026
  10. Few-shot Learning with Multilingual Language Models

    Xi Victoria Lin, Todor Mihaylov, Mikel Artetxe +18

    cs.CLcs.AIarXiv:2112.10668v32021
  11. Investigating Capsule Networks with Dynamic Routing for Text Classification

    Wei Zhao, Jianbo Ye, Min Yang +3

    cs.CLcs.AIarXiv:1804.00538v42018
  12. KinyaEmbed: Contrastive Sentence Embeddings for Kinyarwanda via Multi-Stage Curriculum Training

    Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre

    cs.CLarXiv:2608.26941v12026
  13. TabuLM: Morphology-Aware Tabular Pre-training for Low-Resource Languages

    Ireddi Rakshitha, Devavarapu Yashwanth, Ntakirutimana Pierre

    cs.CLarXiv:2608.26923v12026
  14. Towards Expert Financial QA via Self-Improving RAG

    Junjie Xiong, Shawheen Ghezavat, Aum Hirpara

    cs.CLarXiv:2608.26706v12026
  15. Neural Machine Translation for Low-Resource Languages: A Survey

    Surangika Ranathunga, En-Shiun Annie Lee, Marjana Prifti Skenduli +3

    cs.CLcs.AIarXiv:2106.15115v12021
  16. Negated and Misprimed Probes for Pretrained Language Models: Birds Can Talk, But Cannot Fly

    Nora Kassner, Hinrich Schütze

    cs.CLarXiv:1911.03343v32019
  17. Generalized Decoding for Pixel, Image, and Language

    Xueyan Zou, Zi-Yi Dou, Jianwei Yang +11

    cs.CVcs.CLarXiv:2212.11270v12022
  18. Naive Prompt Optimization: Rethinking the Need for Complex Prompt Search

    Yuan Chang, Xiaoqi Chen

    cs.AIcs.CLarXiv:2608.27266v12026
  19. Recursive Neural Conditional Random Fields for Aspect-based Sentiment Analysis

    Wenya Wang, Sinno Jialin Pan, Daniel Dahlmeier +1

    cs.CLcs.IRcs.LGarXiv:1603.06679v32016
  20. Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts

    Yan Zeng, Xinsong Zhang, Hang Li

    cs.CLcs.CVarXiv:2111.08276v32021
  21. Adapting Language Models to Compress Contexts

    Alexis Chevalier, Alexander Wettig, Anirudh Ajith +1

    cs.CLarXiv:2305.14788v22023
  22. GraphGPT: Graph Instruction Tuning for Large Language Models

    Jiabin Tang, Yuhao Yang, Wei Wei +5

    cs.CLcs.AIarXiv:2310.13023v32023
  23. Cross-Lingual Ability of Multilingual BERT: An Empirical Study

    Karthikeyan K, Zihan Wang, Stephen Mayhew +1

    cs.CLcs.AIcs.LGarXiv:1912.07840v22019
  24. Long-context LLMs Struggle with Long In-context Learning

    Tianle Li, Ge Zhang, Quy Duc Do +2

    cs.CLcs.AIarXiv:2404.02060v32024
  25. Language Understanding for Text-based Games Using Deep Reinforcement Learning

    Karthik Narasimhan, Tejas Kulkarni, Regina Barzilay

    cs.CLcs.AIarXiv:1506.08941v22015
  26. Image Retrieval on Real-life Images with Pre-trained Vision-and-Language Models

    Zheyuan Liu, Cristian Rodriguez-Opazo, Damien Teney +1

    cs.CVcs.CLcs.IRarXiv:2108.04024v12021
  27. Breaking NLI Systems with Sentences that Require Simple Lexical Inferences

    Max Glockner, Vered Shwartz, Yoav Goldberg

    cs.CLarXiv:1805.02266v12018
  28. Towards an Automatic Turing Test: Learning to Evaluate Dialogue Responses

    Ryan Lowe, Michael Noseworthy, Iulian V. Serban +3

    cs.CLcs.AIcs.LGarXiv:1708.07149v22017
  29. On Evaluating Adversarial Robustness of Large Vision-Language Models

    Yunqing Zhao, Tianyu Pang, Chao Du +4

    cs.CVcs.CLcs.CRarXiv:2305.16934v22023
  30. Large Language Models for Education: A Survey and Outlook

    Shen Wang, Tianlong Xu, Hang Li +5

    cs.CLcs.AIarXiv:2403.18105v22024
  31. Investigating the Influence of Prompt and Response Languages on LLM Content Generation

    Thi Thanh Nhan Nguyen, Mai Khoi Tieu, Michael A. Riegler +2

    cs.CLcs.AIarXiv:2608.26186v12026
  32. A Deeper Look into Sarcastic Tweets Using Deep Convolutional Neural Networks

    Soujanya Poria, Erik Cambria, Devamanyu Hazarika +1

    cs.CLarXiv:1610.08815v22016
  33. VideoAgent: Long-form Video Understanding with Large Language Model as Agent

    Xiaohan Wang, Yuhui Zhang, Orr Zohar +1

    cs.CVcs.AIcs.CLarXiv:2403.10517v12024
  34. Applying Deep Learning to Answer Selection: A Study and An Open Task

    Minwei Feng, Bing Xiang, Michael R. Glass +2

    cs.CLcs.LGarXiv:1508.01585v22015
  35. A Survey on Mixture of Experts in Large Language Models

    Weilin Cai, Juyong Jiang, Fan Wang +3

    cs.LGcs.CLarXiv:2407.06204v32024
  36. Entity-Relation Extraction as Multi-Turn Question Answering

    Xiaoya Li, Fan Yin, Zijun Sun +6

    cs.CLarXiv:1905.05529v62019
  37. InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model

    Xiaoyi Dong, Pan Zhang, Yuhang Zang +20

    cs.CVcs.CLarXiv:2401.16420v12024
  38. Comparing Chunking and Embedding Strategies for Turkish RAG Systems

    Mustafa Sertaç Türkel, Fatma Nur Korkmaz, Ahmet Tuğrul Bayrak

    cs.CLcs.AIarXiv:2608.26192v12026
  39. BERTology Meets Biology: Interpreting Attention in Protein Language Models

    Jesse Vig, Ali Madani, Lav R. Varshney +3

    cs.CLcs.LGq-bio.BMarXiv:2006.15222v32020
  40. Vowel Signs Are Not Letters: A Pre-tokenization Ceiling on Multilingual Tokenizer Fertility

    Sajal Regmi, Siddhartha Pudasaini, Chetan Phakami Pun

    cs.CLcs.LGarXiv:2608.26449v12026
  41. emotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation

    Ziyang Ma, Zhisheng Zheng, Jiaxin Ye +4

    cs.CLcs.HCcs.MMarXiv:2312.15185v12023
  42. Preference Ranking Optimization for Human Alignment

    Feifan Song, Bowen Yu, Minghao Li +4

    cs.CLcs.AIarXiv:2306.17492v22023
  43. DyNet: The Dynamic Neural Network Toolkit

    Graham Neubig, Chris Dyer, Yoav Goldberg +22

    stat.MLcs.CLcs.MSarXiv:1701.03980v12017
  44. Unifying Detection and Adaptation in Task-Free Continual Learning

    Dezheng Han, Anbang Zhang, Zhihao Zhu +1

    cs.LGcs.CLarXiv:2608.27070v12026
  45. A Computational Approach to Understanding Empathy Expressed in Text-Based Mental Health Support

    Ashish Sharma, Adam S. Miner, David C. Atkins +1

    cs.CLcs.SIarXiv:2009.08441v12020
  46. Faithful to the Original: Fact Aware Neural Abstractive Summarization

    Ziqiang Cao, Furu Wei, Wenjie Li +1

    cs.IRcs.CLarXiv:1711.04434v12017
  47. Symbolic Knowledge Distillation: from General Language Models to Commonsense Models

    Peter West, Chandra Bhagavatula, Jack Hessel +6

    cs.CLarXiv:2110.07178v22021
  48. Recommendation as Instruction Following: A Large Language Model Empowered Recommendation Approach

    Junjie Zhang, Ruobing Xie, Yupeng Hou +3

    cs.IRcs.CLarXiv:2305.07001v12023
  49. Generating Images with Multimodal Language Models

    Jing Yu Koh, Daniel Fried, Ruslan Salakhutdinov

    cs.CLcs.CVcs.LGarXiv:2305.17216v32023
  50. Scaling phoneme-based TTS augmentation for ASR: A unified pipeline and controlled study

    Zhen Wang, TianRui Wu, RongQi Han +2

    cs.CLarXiv:2608.26697v12026
  51. Meta-Learning Where to Allocate Experts: Task-Conditioned Layer-Wise Compression for MoEs

    Rongfeng Wang, Shichao Weng, Zhiqiang Wang +4

    cs.CLarXiv:2608.26650v12026
  52. SPT: Skills as Pre-Training Data for Agentic Language Models

    Yufei Sun, Yudong Li, Yiming Cheng

    cs.CLarXiv:2608.26563v12026
  53. Language in a Bottle: Language Model Guided Concept Bottlenecks for Interpretable Image Classification

    Yue Yang, Artemis Panagopoulou, Shenghao Zhou +3

    cs.CVcs.CLarXiv:2211.11158v22022
  54. Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature

    Guangsheng Bao, Yanbin Zhao, Zhiyang Teng +2

    cs.CLarXiv:2310.05130v32023
  55. Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Prediction

    Jin Mu, Guanhua Chen

    cs.CLcs.AIarXiv:2608.27397v12026
  56. Automatic Description Generation from Images: A Survey of Models, Datasets, and Evaluation Measures

    Raffaella Bernardi, Ruket Cakici, Desmond Elliott +6

    cs.CLcs.CVarXiv:1601.03896v22016
  57. SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents

    Xuhui Zhou, Hao Zhu, Leena Mathur +8

    cs.AIcs.CLcs.LGarXiv:2310.11667v22023
  58. Data Distributional Properties Drive Emergent In-Context Learning in Transformers

    Stephanie C. Y. Chan, Adam Santoro, Andrew K. Lampinen +5

    cs.LGcs.AIcs.CLarXiv:2205.05055v62022
  59. BERT has a Mouth, and It Must Speak: BERT as a Markov Random Field Language Model

    Alex Wang, Kyunghyun Cho

    cs.CLcs.LGarXiv:1902.04094v22019
  60. QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks

    Albert Tseng, Jerry Chee, Qingyao Sun +2

    cs.LGcs.AIcs.CLarXiv:2402.04396v22024