Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,161 to 2,220 of 11,259

  1. On Epistemic Diversity in Large Language Models

    Elisabeth Kirsten, Nicole Krämer, Muhammad Bilal Zafar

    cs.CLarXiv:2609.04835v12026
  2. Open Sesame! Universal Black Box Jailbreaking of Large Language Models

    Raz Lapid, Ron Langberg, Moshe Sipper

    cs.CLcs.CVcs.NEarXiv:2309.01446v42023
  3. Task-Oriented Dialogue as Dataflow Synthesis

    Semantic Machines, Jacob Andreas, John Bufe +43

    cs.CLarXiv:2009.11423v32020
  4. Controlling and Assessing Appropriate Persona Use in LLM-based Dialogue Generation

    Jongkyung Shin, Inkyu Lee, Chiehyeon Lim

    cs.CLarXiv:2609.04676v12026
  5. MedDialogRubrics: A Comprehensive Benchmark and Evaluation Framework for Multi-turn Medical Consultations in Large Language Models

    Lecheng Gong, Weimin Fang, Ting Yang +9

    cs.CLcs.HCarXiv:2601.03023v22026
  6. Generating Constructive Feedback on Stories via Reinforcement Learning

    Maja Stahl, Timon Ziegenbein, Henning Wachsmuth

    cs.CLarXiv:2609.04824v12026
  7. If beam search is the answer, what was the question?

    Clara Meister, Tim Vieira, Ryan Cotterell

    cs.CLarXiv:2010.02650v22020
  8. Learning to Self-Verify Makes Language Models Better Reasoners

    Yuxin Chen, Yu Wang, Yi Zhang +9

    cs.CLcs.AIarXiv:2602.07594v12026
  9. A Systematic Comparison of Multilingual Interpretability Methods Reveals Anisotropy-Driven Failures

    Oskar Holmström, Marcel Bollmann, Marco Kuhlmann

    cs.CLarXiv:2609.04819v12026
  10. A Pre-training Based Personalized Dialogue Generation Model with Persona-sparse Data

    Yinhe Zheng, Rongsheng Zhang, Xiaoxi Mao +1

    cs.CLcs.AIcs.LGarXiv:1911.04700v12019
  11. Vectorizing Classical Tamil: Representation Learning for Verse-Commentary Pairs

    Amrit Gopinath, Sangeetha Sivanesan

    cs.CLarXiv:2609.04755v12026
  12. Prompt-Learning for Fine-Grained Entity Typing

    Ning Ding, Yulin Chen, Xu Han +6

    cs.CLcs.AIarXiv:2108.10604v12021
  13. How Do Language Models Represent and Use Phonological Information for Allomorph Selection?

    Sangwoo Kim, Sangah Lee

    cs.CLarXiv:2609.04708v12026
  14. Ask the Right Questions: Active Question Reformulation with Reinforcement Learning

    Christian Buck, Jannis Bulian, Massimiliano Ciaramita +4

    cs.CLcs.AIarXiv:1705.07830v32017
  15. Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation

    Minsang Kim, Seung Jun Baek

    cs.CLcs.AIcs.LGarXiv:2603.13260v12026
  16. Choosing the Right Language Mode at Inference Time for Multilingual Reliability

    Ekata Mitra, Ameeta Agrawal

    cs.CLarXiv:2609.04653v12026
  17. Self-Play Only Evolves When Self-Synthetic Pipeline Ensures Learnable Information Gain

    Wei Liu, Siya Qi, Yali Du +1

    cs.LGcs.AIcs.CLarXiv:2603.02218v22026
  18. Text summarization via global structure awareness

    Jiaquan Zhang, Chaoning Zhang, Shuxu Chen +9

    cs.CLcs.AIarXiv:2602.09821v22026
  19. ConsensusBench: Benchmark of Consensus Nodes for LLM Reasoning via Outcome Reward Densifying

    Shi-Qi Yan, Chao-Hong Tan, Qian Chen +3

    cs.CLarXiv:2609.04648v12026
  20. FinCARDS: Card-Based Analyst Reranking for Financial Document Question Answering

    Yixi Zhou, Fan Zhang, Yu Chen +3

    cs.IRcs.AIcs.CLarXiv:2601.06992v22026
  21. CAGE: Coherence-Aware Graph Encoding for Retrieval-Augmented Generation

    Tong Qi, Jingyu Wu, Youbing Yin +3

    cs.CLcs.IRarXiv:2609.04647v12026
  22. All Circuits Lead to Rome: Rethinking Functional Anisotropy in Circuit and Sheaf Discovery for LLMs

    Xi Chen, Mingyu Jin, Jingcheng Niu +7

    cs.CLarXiv:2605.12671v12026
  23. Evaluating Long-Horizon Memory for Multi-Party Collaborative Dialogues

    Chuanrui Hu, Tong Li, Xingze Gao +8

    cs.CLcs.AIarXiv:2602.01313v32026
  24. Can We Predict Before Executing Machine Learning Agents?

    Jingsheng Zheng, Jintian Zhang, Yujie Luo +5

    cs.CLcs.AIcs.LGarXiv:2601.05930v22026
  25. From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents

    Niu Lian, Yuting Wang, Hanshu Yao +5

    cs.CVcs.AIcs.CLarXiv:2603.01455v32026
  26. Interactively Picking Real-World Objects with Unconstrained Spoken Language Instructions

    Jun Hatori, Yuta Kikuchi, Sosuke Kobayashi +5

    cs.ROcs.CLarXiv:1710.06280v22017
  27. TALON: Confidence-Aware Speculative Decoding with Adaptive Token Trees

    Tianyu Liu, Qitan Lv, Yuhao Shen +2

    cs.CLarXiv:2601.07353v12026
  28. BackdoorAgent: A Unified Framework for Backdoor Attacks on LLM-based Agents

    Yunhao Feng, Yige Li, Yutao Wu +6

    cs.AIcs.CLarXiv:2601.04566v22026
  29. Retrieval as Generation: A Unified Framework with Self-Triggered Information Planning

    Bo Li, Mingda Wang, Gexiang Fang +2

    cs.CLcs.AIarXiv:2604.11407v22026
  30. Adversarial Multi-Criteria Learning for Chinese Word Segmentation

    Xinchi Chen, Zhan Shi, Xipeng Qiu +1

    cs.CLarXiv:1704.07556v12017
  31. Strong Baselines for Neural Semi-supervised Learning under Domain Shift

    Sebastian Ruder, Barbara Plank

    cs.CLcs.LGstat.MLarXiv:1804.09530v12018
  32. Depth-Recurrent Attention Mixtures: Giving Latent Reasoning the Attention it Deserves

    Jonas Knupp, Jan Hendrik Metzen, Jeremias Bohn +2

    cs.AIcs.CLcs.LGarXiv:2601.21582v12026
  33. Thought-Retriever: Don't Just Retrieve Raw Data, Retrieve Thoughts for Memory-Augmented Agentic Systems

    Tao Feng, Pengrui Han, Guanyu Lin +2

    cs.CLcs.IRarXiv:2604.12231v12026
  34. Entities as Experts: Sparse Memory Access with Entity Supervision

    Thibault Févry, Livio Baldini Soares, Nicholas FitzGerald +2

    cs.CLcs.LGarXiv:2004.07202v22020
  35. A Verifier-Guided Explainable Reasoning Framework with Gold-Anchored QLoRA, Task-Aware Mixture-of-Experts, and Group-Relative RLVR

    Thi Kim Trang Vo, Nam Tien Le, Thi Kim Nguyet Vo +2

    cs.CLcs.AIcs.LGarXiv:2609.05221v12026
  36. CharacterBERT: Reconciling ELMo and BERT for Word-Level Open-Vocabulary Representations From Characters

    Hicham El Boukkouri, Olivier Ferret, Thomas Lavergne +3

    cs.CLarXiv:2010.10392v32020
  37. The Shape of Beliefs: Geometry, Dynamics, and Interventions along Representation Manifolds of Language Models' Posteriors

    Raphaël Sarfati, Eric Bigelow, Daniel Wurgaft +6

    cs.CLarXiv:2602.02315v22026
  38. The Good, The Bad, and The Greedy: Evaluation of LLMs Should Not Ignore Non-Determinism

    Yifan Song, Guoyin Wang, Sujian Li +1

    cs.CLcs.AIarXiv:2407.10457v12024
  39. RC-GRPO: Reward-Conditioned Group Relative Policy Optimization for Multi-Turn Tool Calling Agents

    Haitian Zhong, Jixiu Zhai, Lei Song +3

    cs.AIcs.CLarXiv:2602.03025v12026
  40. BioMegatron: Larger Biomedical Domain Language Model

    Hoo-Chang Shin, Yang Zhang, Evelina Bakhturina +4

    cs.CLarXiv:2010.06060v22020
  41. Triplets Better Than Pairs: Towards Stable and Effective Self-Play Fine-Tuning for LLMs

    Yibo Wang, Hai-Long Sun, Qing-Guo Chen +4

    cs.CLcs.LGarXiv:2601.08198v12026
  42. Multimodal Multi-Agent Empowered Legal Judgment Prediction

    Zhaolu Kang, Junhao Gong, Qingxi Chen +7

    cs.CLcs.AIcs.CYarXiv:2601.12815v52026
  43. Towards Leaving No Indic Language Behind: Building Monolingual Corpora, Benchmark and Models for Indic Languages

    Sumanth Doddapaneni, Rahul Aralikatte, Gowtham Ramesh +4

    cs.CLarXiv:2212.05409v32022
  44. Improving Natural Language Inference Using External Knowledge in the Science Questions Domain

    Xiaoyan Wang, Pavan Kapanipathi, Ryan Musa +8

    cs.AIcs.CLcs.LGarXiv:1809.05724v22018
  45. A Structured Debate-Mixture-of-Agents Framework for Complex Clinical Diagnostic Decision Support

    Chang Xia, Leilei Ouyang, Huimin Wang +2

    cs.CLcs.AIarXiv:2609.05069v12026
  46. An Analysis of Neural Language Modeling at Multiple Scales

    Stephen Merity, Nitish Shirish Keskar, Richard Socher

    cs.CLcs.AIcs.NEarXiv:1803.08240v12018
  47. Are We Done with MMLU?

    Aryo Pradipta Gema, Joshua Ong Jun Leang, Giwon Hong +13

    cs.CLcs.AIarXiv:2406.04127v32024
  48. A Human-in-the-Loop Framework for AI-Assisted Scoring in Large-Scale Writing Assessment

    María Eugenia Curi, Germán Capdehourat, Isabel Amigo +4

    cs.CLcs.AIarXiv:2609.05143v12026
  49. MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

    Xiaoyu Wen, Zhida He, Han Qi +7

    cs.AIcs.CLcs.LGarXiv:2602.01539v22026
  50. COLD: A Benchmark for Chinese Offensive Language Detection

    Jiawen Deng, Jingyan Zhou, Hao Sun +4

    cs.CLcs.AIarXiv:2201.06025v22022
  51. OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents

    Yulin Hu, Zimo Long, Jiahe Guo +5

    cs.CLcs.AIarXiv:2601.13722v12026
  52. Finding Universal Grammatical Relations in Multilingual BERT

    Ethan A. Chi, John Hewitt, Christopher D. Manning

    cs.CLcs.LGarXiv:2005.04511v22020
  53. Improving Reasoning Capabilities in Small Models through Mixture-of-Layers Distillation with Stepwise Attention on Key Information

    Yao Chen, Jiawei Sheng, Wenyuan Zhang +1

    cs.CLarXiv:2604.15701v12026
  54. ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation

    Jiarui Jin, Haoyu Wang, Xingliang Wu +9

    cs.CLarXiv:2602.04279v32026
  55. How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human-Artificial Agents Interactions

    Fernanda Mansilla, Aloysius Tok, Bahia Guellaï +2

    cs.CLcs.AIarXiv:2609.05037v12026
  56. Evaluating Factuality in Generation with Dependency-level Entailment

    Tanya Goyal, Greg Durrett

    cs.CLarXiv:2010.05478v22020
  57. Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?

    Pengxiang Li, Dilxat Muhtar, Tianlong Chen +2

    cs.CLcs.AIarXiv:2602.23225v22026
  58. Look-Ahead-Bench: a Standardized Benchmark of Look-ahead Bias in Point-in-Time LLMs for Finance

    Mostapha Benhenda

    cs.AIcs.CLcs.LGarXiv:2601.13770v12026
  59. Sentence Embedding Alignment for Lifelong Relation Extraction

    Hong Wang, Wenhan Xiong, Mo Yu +3

    cs.CLarXiv:1903.02588v32019
  60. Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs

    Abhay Sheshadri, Aidan Ewart, Phillip Guo +8

    cs.LGcs.AIcs.CLarXiv:2407.15549v32024