Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,001 to 9,060 of 11,332
HateXplain: A Benchmark Dataset for Explainable Hate Speech Detection
Binny Mathew, Punyajoy Saha, Seid Muhie Yimam +3
cs.CLcs.AIcs.SIarXiv:2012.10289v22020AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces
Sungho Park, Wonjoong Kim, Rongyuan Tan +10
cs.AIcs.CLcs.LGarXiv:2608.23041v12026Learning Modality-Specific Representations with Self-Supervised Multi-Task Learning for Multimodal Sentiment Analysis
Wenmeng Yu, Hua Xu, Ziqi Yuan +1
cs.CLarXiv:2102.04830v12021TRACE: A Self-Evolving Skill Bank for Consistent, Limit-Aware LLM Agents
Wenhao Wu, Menghao Zhang, Xin Wang +3
cs.CLcs.AIarXiv:2608.22793v12026The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies
Chenxu Wang, Chaozhuo Li, Songyang Liu +10
cs.CLarXiv:2602.09877v22026When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
Leheng Sheng, Yongtao Zhang, Wenchang Ma +6
cs.CLcs.AIarXiv:2602.10560v12026CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data
Guillaume Wenzek, Marie-Anne Lachaux, Alexis Conneau +4
cs.CLcs.IRcs.LGarXiv:1911.00359v22019MiniCPM-SALA: Hybridizing Sparse and Linear Attention for Efficient Long-Context Modeling
MiniCPM Team, Wenhao An, Yingfa Chen +44
cs.CLcs.AIcs.LGarXiv:2602.11761v22026Privasis: Synthesizing the Largest "Public" Private Dataset from Scratch
Hyunwoo Kim, Niloofar Mireshghallah, Michael Duan +11
cs.CLcs.AIarXiv:2602.03183v12026InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem
Shuofei Qiao, Yunxiang Wei, Xuehai Wang +10
cs.CLcs.AIcs.IRarXiv:2602.14367v22026Cost-Efficient RAG for Entity Matching with LLMs: A Blocking-based Exploration
Chuangtao Ma, Zeyu Zhang, Arijit Khan +2
cs.DBcs.CLarXiv:2602.05708v12026Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens
Weihao Liu, Dehai Min, Lu Cheng
cs.CLarXiv:2602.10229v22026Molecular LLM Agents: From Architectural Design to Scientific Autonomy
Jiatong Li, Wengyu Zhang, Weida Wang +8
cs.CLcs.AIarXiv:2608.23104v12026Aligning Large Multimodal Models with Factually Augmented RLHF
Zhiqing Sun, Sheng Shen, Shengcao Cao +9
cs.CVcs.CLarXiv:2309.14525v12023VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs
Zesen Cheng, Sicong Leng, Hang Zhang +8
cs.CVcs.CLarXiv:2406.07476v32024WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs
Yiming Yao, Chenyang Lyu, Xuanfan Ni +4
cs.CLcs.SDarXiv:2608.22704v12026KILT: a Benchmark for Knowledge Intensive Language Tasks
Fabio Petroni, Aleksandra Piktus, Angela Fan +10
cs.CLcs.AIcs.IRarXiv:2009.02252v42020Bilateral Multi-Perspective Matching for Natural Language Sentences
Zhiguo Wang, Wael Hamza, Radu Florian
cs.AIcs.CLarXiv:1702.03814v32017Definitional Sensitivity in Media Bias Detection: A Multi-Definition Dataset and Benchmark
Martin Wessel, Timo Spinde, Jürgen Pfeffer +1
cs.CLarXiv:2608.23095v12026Quantifying Speaker Embedding Phonological Rule Interactions in Accented Speech Synthesis
Thanathai Lertpetchpun, Yoonjeong Lee, Thanapat Trachu +4
cs.CLarXiv:2601.14417v22026Transformers learn in-context by gradient descent
Johannes von Oswald, Eyvind Niklasson, Ettore Randazzo +4
cs.LGcs.AIcs.CLarXiv:2212.07677v22022Instruction Tuning with GPT-4
Baolin Peng, Chunyuan Li, Pengcheng He +2
cs.CLcs.AIarXiv:2304.03277v12023Tool Verification for Test-Time Reinforcement Learning
Ruotong Liao, Nikolai Röhrich, Xiaohan Wang +4
cs.AIcs.CLarXiv:2603.02203v12026BeamPERL: Parameter-Efficient RL with Verifiable Rewards Specializes Compact LLMs for Structured Beam Mechanics Reasoning
Tarjei Paule Hage, Markus J. Buehler
cs.AIcond-mat.mtrl-scics.CLarXiv:2603.04124v12026IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation
Bosi Wen, Yilin Niu, Cunxiang Wang +5
cs.CLarXiv:2603.04738v22026NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors
Lingfeng Ren, Weihao Yu, Runpeng Yu +1
cs.CVcs.AIcs.CLarXiv:2602.22144v12026What Can Transformers Learn In-Context? A Case Study of Simple Function Classes
Shivam Garg, Dimitris Tsipras, Percy Liang +1
cs.CLcs.LGarXiv:2208.01066v32022Beyond Factual Knowledge: Benchmarking and Learning Step-Level Procedural Rule Reasoning in Large Language Models
Bohan Yu, Pengfei Cao, Chen Han +7
cs.CLarXiv:2608.22753v12026Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization
Qianben Chen, Tianrui Qin, King Zhu +21
cs.CLarXiv:2602.22675v22026Don't Repeat Yourself: Stopping Verbatim Loops at Sampling Time
Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder +2
cs.CLcs.AIcs.LGarXiv:2608.22761v12026Lost in Backpropagation: The LM Head is a Gradient Bottleneck
Nathan Godey, Yoav Artzi
cs.CLarXiv:2603.10145v22026The Woman Worked as a Babysitter: On Biases in Language Generation
Emily Sheng, Kai-Wei Chang, Premkumar Natarajan +1
cs.CLcs.AIarXiv:1909.01326v22019The FLORES-101 Evaluation Benchmark for Low-Resource and Multilingual Machine Translation
Naman Goyal, Cynthia Gao, Vishrav Chaudhary +7
cs.CLcs.AIarXiv:2106.03193v12021SlowBA: An efficiency backdoor attack towards VLM-based GUI agents
Junxian Li, Tu Lan, Haozhen Tan +2
cs.CRcs.CLcs.CVarXiv:2603.08316v32026Neural Summarization by Extracting Sentences and Words
Jianpeng Cheng, Mirella Lapata
cs.CLarXiv:1603.07252v32016SAMSum Corpus: A Human-annotated Dialogue Dataset for Abstractive Summarization
Bogdan Gliwa, Iwona Mochol, Maciej Biesek +1
cs.CLarXiv:1911.12237v22019XTC: Head-Aware Sampling by Excluding Top Choices
Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder +2
cs.CLcs.AIcs.LGarXiv:2608.22758v12026RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation
Sihong Wu, Yiling Ma, Yilun Zhao +4
cs.CLcs.AIarXiv:2603.09723v22026One-Eval: An Agentic System for Automated and Traceable LLM Evaluation
Chengyu Shen, Yanheng Hou, Minghui Pan +8
cs.CLarXiv:2603.09821v12026What Does Activation Steering Control? Attribution Across Answer Encodings and Output-Sensitive Subspaces
Zhiwei Gao, Shaowen Peng, Shoko Wakamiya +1
cs.CLarXiv:2608.22985v12026Brevity Constraints Reverse Performance Hierarchies in Language Models
MD Azizul Hakim
cs.CLcs.AIarXiv:2604.00025v12026TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning
Alliot Nagle, Jakhongir Saydaliev, Dhia Garbaya +3
cs.LGcs.AIcs.CLarXiv:2603.12529v22026TinyLlama: An Open-Source Small Language Model
Peiyuan Zhang, Guangtao Zeng, Tianduo Wang +1
cs.CLcs.AIarXiv:2401.02385v22024Ex Machina: Personal Attacks Seen at Scale
Ellery Wulczyn, Nithum Thain, Lucas Dixon
cs.CLarXiv:1610.08914v22016Persona Prompting as a Lens on LLM Social Reasoning
Jing Yang, Moritz Hechtbauer, Elisabeth Khalilov +3
cs.CLarXiv:2601.20757v12026Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing
Lingkun Long, Yushi Huang, Shihao Bai +4
cs.CLarXiv:2602.02159v12026The Web as a Knowledge-base for Answering Complex Questions
Alon Talmor, Jonathan Berant
cs.CLcs.AIcs.LGarXiv:1803.06643v12018FASA: Frequency-aware Sparse Attention
Yifei Wang, Yueqi Wang, Zhenrui Yue +6
cs.CLarXiv:2602.03152v32026Future Querying: Can LLMs Serve as Implicit Medical World Models?
Siri Willems, James Butterworth, Lore Goetschalckx +4
cs.CLcs.AIarXiv:2608.23248v12026Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
Haitao Jiang, Wenbo Zhang, Jiarui Yao +3
cs.AIcs.CLarXiv:2603.13985v12026Why Steering Works: Toward a Unified View of Language Model Parameter Dynamics
Ziwen Xu, Chenyan Wu, Hengyu Sun +9
cs.CLcs.AIcs.CVarXiv:2602.02343v32026Automated Construction of FAIR Digital Object Knowledge Graphs from Flat Cultural Heritage Records
Zeyd Boukhers, Lingxiao Kong, Xenophon Zabulis +1
cs.AIcs.CLcs.DLarXiv:2608.23263v12026EndoCoT: Scaling Endogenous Chain-of-Thought Reasoning in Diffusion Models
Xuanlang Dai, Yujie Zhou, Long Xing +6
cs.CVcs.CLarXiv:2603.12252v42026Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
Zhuochun Li, Yong Zhang, Ming Li +8
cs.CLcs.AIcs.LGarXiv:2601.22588v22026SnapKV: LLM Knows What You are Looking for Before Generation
Yuhong Li, Yingbing Huang, Bowen Yang +6
cs.CLcs.AIarXiv:2404.14469v22024BBQ: A Hand-Built Bias Benchmark for Question Answering
Alicia Parrish, Angelica Chen, Nikita Nangia +5
cs.CLarXiv:2110.08193v22021SafePred: A Predictive Guardrail for Computer-Using Agents via World Models
Yurun Chen, Zeyi Liao, Ping Yin +3
cs.CLcs.AIcs.LGarXiv:2602.01725v12026Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration
Yu Zhang, Mufan Xu, Xuefeng Bai +4
cs.CLarXiv:2602.03677v22026KEPLER: A Unified Model for Knowledge Embedding and Pre-trained Language Representation
Xiaozhi Wang, Tianyu Gao, Zhaocheng Zhu +4
cs.CLarXiv:1911.06136v32019From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation
Yibin Liu, Yaxing Lyu, Daqi Gao +5
cs.ROcs.AIcs.CLarXiv:2603.15600v22026