Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,001 to 9,060 of 11,332

  1. HateXplain: A Benchmark Dataset for Explainable Hate Speech Detection

    Binny Mathew, Punyajoy Saha, Seid Muhie Yimam +3

    cs.CLcs.AIcs.SIarXiv:2012.10289v22020
  2. AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces

    Sungho Park, Wonjoong Kim, Rongyuan Tan +10

    cs.AIcs.CLcs.LGarXiv:2608.23041v12026
  3. Learning Modality-Specific Representations with Self-Supervised Multi-Task Learning for Multimodal Sentiment Analysis

    Wenmeng Yu, Hua Xu, Ziqi Yuan +1

    cs.CLarXiv:2102.04830v12021
  4. TRACE: A Self-Evolving Skill Bank for Consistent, Limit-Aware LLM Agents

    Wenhao Wu, Menghao Zhang, Xin Wang +3

    cs.CLcs.AIarXiv:2608.22793v12026
  5. The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies

    Chenxu Wang, Chaozhuo Li, Songyang Liu +10

    cs.CLarXiv:2602.09877v22026
  6. When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning

    Leheng Sheng, Yongtao Zhang, Wenchang Ma +6

    cs.CLcs.AIarXiv:2602.10560v12026
  7. CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data

    Guillaume Wenzek, Marie-Anne Lachaux, Alexis Conneau +4

    cs.CLcs.IRcs.LGarXiv:1911.00359v22019
  8. MiniCPM-SALA: Hybridizing Sparse and Linear Attention for Efficient Long-Context Modeling

    MiniCPM Team, Wenhao An, Yingfa Chen +44

    cs.CLcs.AIcs.LGarXiv:2602.11761v22026
  9. Privasis: Synthesizing the Largest "Public" Private Dataset from Scratch

    Hyunwoo Kim, Niloofar Mireshghallah, Michael Duan +11

    cs.CLcs.AIarXiv:2602.03183v12026
  10. InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem

    Shuofei Qiao, Yunxiang Wei, Xuehai Wang +10

    cs.CLcs.AIcs.IRarXiv:2602.14367v22026
  11. Cost-Efficient RAG for Entity Matching with LLMs: A Blocking-based Exploration

    Chuangtao Ma, Zeyu Zhang, Arijit Khan +2

    cs.DBcs.CLarXiv:2602.05708v12026
  12. Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens

    Weihao Liu, Dehai Min, Lu Cheng

    cs.CLarXiv:2602.10229v22026
  13. Molecular LLM Agents: From Architectural Design to Scientific Autonomy

    Jiatong Li, Wengyu Zhang, Weida Wang +8

    cs.CLcs.AIarXiv:2608.23104v12026
  14. Aligning Large Multimodal Models with Factually Augmented RLHF

    Zhiqing Sun, Sheng Shen, Shengcao Cao +9

    cs.CVcs.CLarXiv:2309.14525v12023
  15. VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs

    Zesen Cheng, Sicong Leng, Hang Zhang +8

    cs.CVcs.CLarXiv:2406.07476v32024
  16. WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs

    Yiming Yao, Chenyang Lyu, Xuanfan Ni +4

    cs.CLcs.SDarXiv:2608.22704v12026
  17. KILT: a Benchmark for Knowledge Intensive Language Tasks

    Fabio Petroni, Aleksandra Piktus, Angela Fan +10

    cs.CLcs.AIcs.IRarXiv:2009.02252v42020
  18. Bilateral Multi-Perspective Matching for Natural Language Sentences

    Zhiguo Wang, Wael Hamza, Radu Florian

    cs.AIcs.CLarXiv:1702.03814v32017
  19. Definitional Sensitivity in Media Bias Detection: A Multi-Definition Dataset and Benchmark

    Martin Wessel, Timo Spinde, Jürgen Pfeffer +1

    cs.CLarXiv:2608.23095v12026
  20. Quantifying Speaker Embedding Phonological Rule Interactions in Accented Speech Synthesis

    Thanathai Lertpetchpun, Yoonjeong Lee, Thanapat Trachu +4

    cs.CLarXiv:2601.14417v22026
  21. Transformers learn in-context by gradient descent

    Johannes von Oswald, Eyvind Niklasson, Ettore Randazzo +4

    cs.LGcs.AIcs.CLarXiv:2212.07677v22022
  22. Instruction Tuning with GPT-4

    Baolin Peng, Chunyuan Li, Pengcheng He +2

    cs.CLcs.AIarXiv:2304.03277v12023
  23. Tool Verification for Test-Time Reinforcement Learning

    Ruotong Liao, Nikolai Röhrich, Xiaohan Wang +4

    cs.AIcs.CLarXiv:2603.02203v12026
  24. BeamPERL: Parameter-Efficient RL with Verifiable Rewards Specializes Compact LLMs for Structured Beam Mechanics Reasoning

    Tarjei Paule Hage, Markus J. Buehler

    cs.AIcond-mat.mtrl-scics.CLarXiv:2603.04124v12026
  25. IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation

    Bosi Wen, Yilin Niu, Cunxiang Wang +5

    cs.CLarXiv:2603.04738v22026
  26. NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors

    Lingfeng Ren, Weihao Yu, Runpeng Yu +1

    cs.CVcs.AIcs.CLarXiv:2602.22144v12026
  27. What Can Transformers Learn In-Context? A Case Study of Simple Function Classes

    Shivam Garg, Dimitris Tsipras, Percy Liang +1

    cs.CLcs.LGarXiv:2208.01066v32022
  28. Beyond Factual Knowledge: Benchmarking and Learning Step-Level Procedural Rule Reasoning in Large Language Models

    Bohan Yu, Pengfei Cao, Chen Han +7

    cs.CLarXiv:2608.22753v12026
  29. Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization

    Qianben Chen, Tianrui Qin, King Zhu +21

    cs.CLarXiv:2602.22675v22026
  30. Don't Repeat Yourself: Stopping Verbatim Loops at Sampling Time

    Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder +2

    cs.CLcs.AIcs.LGarXiv:2608.22761v12026
  31. Lost in Backpropagation: The LM Head is a Gradient Bottleneck

    Nathan Godey, Yoav Artzi

    cs.CLarXiv:2603.10145v22026
  32. The Woman Worked as a Babysitter: On Biases in Language Generation

    Emily Sheng, Kai-Wei Chang, Premkumar Natarajan +1

    cs.CLcs.AIarXiv:1909.01326v22019
  33. The FLORES-101 Evaluation Benchmark for Low-Resource and Multilingual Machine Translation

    Naman Goyal, Cynthia Gao, Vishrav Chaudhary +7

    cs.CLcs.AIarXiv:2106.03193v12021
  34. SlowBA: An efficiency backdoor attack towards VLM-based GUI agents

    Junxian Li, Tu Lan, Haozhen Tan +2

    cs.CRcs.CLcs.CVarXiv:2603.08316v32026
  35. Neural Summarization by Extracting Sentences and Words

    Jianpeng Cheng, Mirella Lapata

    cs.CLarXiv:1603.07252v32016
  36. SAMSum Corpus: A Human-annotated Dialogue Dataset for Abstractive Summarization

    Bogdan Gliwa, Iwona Mochol, Maciej Biesek +1

    cs.CLarXiv:1911.12237v22019
  37. XTC: Head-Aware Sampling by Excluding Top Choices

    Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder +2

    cs.CLcs.AIcs.LGarXiv:2608.22758v12026
  38. RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation

    Sihong Wu, Yiling Ma, Yilun Zhao +4

    cs.CLcs.AIarXiv:2603.09723v22026
  39. One-Eval: An Agentic System for Automated and Traceable LLM Evaluation

    Chengyu Shen, Yanheng Hou, Minghui Pan +8

    cs.CLarXiv:2603.09821v12026
  40. What Does Activation Steering Control? Attribution Across Answer Encodings and Output-Sensitive Subspaces

    Zhiwei Gao, Shaowen Peng, Shoko Wakamiya +1

    cs.CLarXiv:2608.22985v12026
  41. Brevity Constraints Reverse Performance Hierarchies in Language Models

    MD Azizul Hakim

    cs.CLcs.AIarXiv:2604.00025v12026
  42. TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning

    Alliot Nagle, Jakhongir Saydaliev, Dhia Garbaya +3

    cs.LGcs.AIcs.CLarXiv:2603.12529v22026
  43. TinyLlama: An Open-Source Small Language Model

    Peiyuan Zhang, Guangtao Zeng, Tianduo Wang +1

    cs.CLcs.AIarXiv:2401.02385v22024
  44. Ex Machina: Personal Attacks Seen at Scale

    Ellery Wulczyn, Nithum Thain, Lucas Dixon

    cs.CLarXiv:1610.08914v22016
  45. Persona Prompting as a Lens on LLM Social Reasoning

    Jing Yang, Moritz Hechtbauer, Elisabeth Khalilov +3

    cs.CLarXiv:2601.20757v12026
  46. Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing

    Lingkun Long, Yushi Huang, Shihao Bai +4

    cs.CLarXiv:2602.02159v12026
  47. The Web as a Knowledge-base for Answering Complex Questions

    Alon Talmor, Jonathan Berant

    cs.CLcs.AIcs.LGarXiv:1803.06643v12018
  48. FASA: Frequency-aware Sparse Attention

    Yifei Wang, Yueqi Wang, Zhenrui Yue +6

    cs.CLarXiv:2602.03152v32026
  49. Future Querying: Can LLMs Serve as Implicit Medical World Models?

    Siri Willems, James Butterworth, Lore Goetschalckx +4

    cs.CLcs.AIarXiv:2608.23248v12026
  50. Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models

    Haitao Jiang, Wenbo Zhang, Jiarui Yao +3

    cs.AIcs.CLarXiv:2603.13985v12026
  51. Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics

    Ziwen Xu, Chenyan Wu, Hengyu Sun +9

    cs.CLcs.AIcs.CVarXiv:2602.02343v32026
  52. Automated Construction of FAIR Digital Object Knowledge Graphs from Flat Cultural Heritage Records

    Zeyd Boukhers, Lingxiao Kong, Xenophon Zabulis +1

    cs.AIcs.CLcs.DLarXiv:2608.23263v12026
  53. EndoCoT: Scaling Endogenous Chain-of-Thought Reasoning in Diffusion Models

    Xuanlang Dai, Yujie Zhou, Long Xing +6

    cs.CVcs.CLarXiv:2603.12252v42026
  54. Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry

    Zhuochun Li, Yong Zhang, Ming Li +8

    cs.CLcs.AIcs.LGarXiv:2601.22588v22026
  55. SnapKV: LLM Knows What You are Looking for Before Generation

    Yuhong Li, Yingbing Huang, Bowen Yang +6

    cs.CLcs.AIarXiv:2404.14469v22024
  56. BBQ: A Hand-Built Bias Benchmark for Question Answering

    Alicia Parrish, Angelica Chen, Nikita Nangia +5

    cs.CLarXiv:2110.08193v22021
  57. SafePred: A Predictive Guardrail for Computer-Using Agents via World Models

    Yurun Chen, Zeyi Liao, Ping Yin +3

    cs.CLcs.AIcs.LGarXiv:2602.01725v12026
  58. Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration

    Yu Zhang, Mufan Xu, Xuefeng Bai +4

    cs.CLarXiv:2602.03677v22026
  59. KEPLER: A Unified Model for Knowledge Embedding and Pre-trained Language Representation

    Xiaozhi Wang, Tianyu Gao, Zhaocheng Zhu +4

    cs.CLarXiv:1911.06136v32019
  60. From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation

    Yibin Liu, Yaxing Lyu, Daqi Gao +5

    cs.ROcs.AIcs.CLarXiv:2603.15600v22026