Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
181 to 240 of 11,241
Improving Factual Consistency of Abstractive Summarization via Question Answering
Feng Nan, Cicero Nogueira dos Santos, Henghui Zhu +7
cs.CLcs.AIarXiv:2105.04623v12021Emoti-Attack: Zero-Perturbation Adversarial Attacks on NLP Systems via Emoji Sequences
Yangshijie Zhang
cs.AIcs.CLcs.CRarXiv:2502.17392v12025Fair Transfer of Multiple Style Attributes in Text
Karan Dabas, Nishtha Madan, Vijay Arya +3
cs.CLcs.AIcs.LGarXiv:2001.06693v12020Understanding Back-Translation at Scale
Sergey Edunov, Myle Ott, Michael Auli +1
cs.CLarXiv:1808.09381v22018PEER: A Collaborative Language Model
Timo Schick, Jane Dwivedi-Yu, Zhengbao Jiang +7
cs.CLarXiv:2208.11663v12022Training Language Models with Language Feedback
Jérémy Scheurer, Jon Ander Campos, Jun Shern Chan +3
cs.CLcs.AIcs.LGarXiv:2204.14146v42022Rainier: Reinforced Knowledge Introspector for Commonsense Question Answering
Jiacheng Liu, Skyler Hallinan, Ximing Lu +4
cs.CLcs.AIarXiv:2210.03078v22022Towards Empathetic Open-domain Conversation Models: a New Benchmark and Dataset
Hannah Rashkin, Eric Michael Smith, Margaret Li +1
cs.CLarXiv:1811.00207v52018DeepSeek-V3 Technical Report
DeepSeek-AI, Aixin Liu, Bei Feng +197
cs.CLcs.AIarXiv:2412.19437v22024VeOmni: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo
Qianli Ma, Yaowei Zheng, Zhelun Shi +9
cs.CLcs.AIcs.DCarXiv:2508.02317v32025Effective Parallel Corpus Mining using Bilingual Sentence Embeddings
Mandy Guo, Qinlan Shen, Yinfei Yang +8
cs.CLarXiv:1807.11906v22018AgentInstruct: Toward Generative Teaching with Agentic Flows
Arindam Mitra, Luciano Del Corro, Guoqing Zheng +11
cs.AIcs.CLcs.LGarXiv:2407.03502v12024Knowing Before Saying: LLM Representations Encode Information About Chain-of-Thought Success Before Completion
Anum Afzal, Florian Matthes, Gal Chechik +1
cs.CLarXiv:2505.24362v22025BoardgameQA: A Dataset for Natural Language Reasoning with Contradictory Information
Mehran Kazemi, Quan Yuan, Deepti Bhatia +4
cs.CLcs.AIcs.LGarXiv:2306.07934v12023SONAR: Sentence-Level Multimodal and Language-Agnostic Representations
Paul-Ambroise Duquenne, Holger Schwenk, Benoît Sagot
cs.CLarXiv:2308.11466v22023Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline
Meng Lu, Ruochen Zhang, Carsten Eickhoff +1
cs.CLarXiv:2505.20546v22025Amnesic Probing: Behavioral Explanation with Amnesic Counterfactuals
Yanai Elazar, Shauli Ravfogel, Alon Jacovi +1
cs.CLarXiv:2006.00995v32020Soft Tokens, Hard Truths
Natasha Butt, Ariel Kwiatkowski, Ismail Labiad +2
cs.CLcs.AIcs.LGarXiv:2509.19170v22025SONAR-LLM: Autoregressive Transformer that Thinks in Sentence Embeddings and Speaks in Tokens
Nikita Dragunov, Temurbek Rahmatullaev, Elizaveta Goncharova +5
cs.CLarXiv:2508.05305v22025Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles
Kulin Shah, Nishanth Dikkala, Xin Wang +1
cs.LGcs.CLarXiv:2409.10502v12024Monitoring Latent World States in Language Models with Propositional Probes
Jiahai Feng, Stuart Russell, Jacob Steinhardt
cs.CLcs.LGarXiv:2406.19501v22024Humor in AI: Massive Scale Crowd-Sourced Preferences and Benchmarks for Cartoon Captioning
Jifan Zhang, Lalit Jain, Yang Guo +9
cs.LGcs.AIcs.CLarXiv:2406.10522v22024Summing Up the Facts: Additive Mechanisms Behind Factual Recall in LLMs
Bilal Chughtai, Alan Cooney, Neel Nanda
cs.LGcs.CLarXiv:2402.07321v12024Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
Shahar Katz, Yonatan Belinkov, Mor Geva +1
cs.CLcs.AIcs.LGarXiv:2402.12865v12024Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?
Chengzhi Zhong, Fei Cheng, Qianying Liu +5
cs.CLcs.AIarXiv:2408.10811v12024From Failure to Mastery: Generating Hard Samples for Tool-use Agents
Bingguang Hao, Zengzhuang Xu, Yuntao Wen +11
cs.CLarXiv:2601.01498v12026Deep Research Pretraining via Predictive Navigation
Jiang Zhou, Zhiyuan Fan, Xing Wu +3
cs.CLarXiv:2608.00432v12026Learning from Task Descriptions
Orion Weller, Nicholas Lourie, Matt Gardner +1
cs.CLarXiv:2011.08115v12020Measuring Semantic Similarity by Latent Relational Analysis
Peter D. Turney
cs.LGcs.CLcs.IRarXiv:cs/0508053v12005TinyV: Reducing False Negatives in Verification Improves RL for LLM Reasoning
Zhangchen Xu, Yuetai Li, Fengqing Jiang +4
cs.LGcs.AIcs.CLarXiv:2505.14625v22025Brain-to-Text Decoding: A Non-invasive Approach via Typing
Jarod Lévy, Mingfang Zhang, Svetlana Pinet +4
eess.SPcs.AIcs.CLarXiv:2502.17480v12025Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems
Taejin Park, Ivan Medennikov, Kunal Dhawan +6
eess.AScs.CLcs.LGarXiv:2409.06656v32024SemGloVe: Semantic Co-occurrences for GloVe from BERT
Leilei Gan, Zhiyang Teng, Yue Zhang +3
cs.CLcs.AIarXiv:2012.15197v22020Incorporating Visual Semantics into Sentence Representations within a Grounded Space
Patrick Bordes, Eloi Zablocki, Laure Soulier +2
cs.CLarXiv:2002.02734v12020Following the Autoregressive Nature of LLM Embeddings via Compression and Alignment
Jingcheng Deng, Zhongtao Jiang, Liang Pang +5
cs.CLarXiv:2502.11401v32025ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents
Yusheng Liao, Shuyang Jiang, Yanfeng Wang +1
cs.CLarXiv:2410.17657v32024MegaPairs: Massive Data Synthesis For Universal Multimodal Retrieval
Junjie Zhou, Zheng Liu, Ze Liu +6
cs.CVcs.CLarXiv:2412.14475v12024MagicLens: Self-Supervised Image Retrieval with Open-Ended Instructions
Kai Zhang, Yi Luan, Hexiang Hu +5
cs.CVcs.AIcs.CLarXiv:2403.19651v22024Reasoning Up the Instruction Ladder for Controllable Language Models
Zishuo Zheng, Vidhisha Balachandran, Chan Young Park +2
cs.CLcs.AIarXiv:2511.04694v52025CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning
Hao Yu, Zhuokai Zhao, Shen Yan +7
cs.CVcs.AIcs.CLarXiv:2503.19900v12025Simpler Context-Dependent Logical Forms via Model Projections
Reginald Long, Panupong Pasupat, Percy Liang
cs.CLarXiv:1606.05378v12016MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
Kejian Zhu, Zhuoran Jin, Hongbang Yuan +6
cs.CVcs.CLarXiv:2506.04141v22025ResearchTown: Simulator of Human Research Community
Haofei Yu, Zhaochen Hong, Zirui Cheng +5
cs.CLcs.LGarXiv:2412.17767v22024DyFlow: Dynamic Workflow Framework for Agentic Reasoning
Yanbo Wang, Zixiang Xu, Yue Huang +9
cs.CLarXiv:2509.26062v12025Order in the Court: Explainable AI Methods Prone to Disagreement
Michael Neely, Stefan F. Schouten, Maurits J. R. Bleeker +1
cs.LGcs.CLarXiv:2105.03287v32021Are Arithmetic Heuristic Neurons Form-Invariant? A Mechanistic Analysis of Symbols, Text, and Code in LLMs
Sharath Naganna, Tanvir Ahmed Sijan, Uddipta Kalita
cs.CLarXiv:2607.16693v12026Bridging the Multilingual Safety Divide: Efficient, Culturally-Aware Alignment for Global South Languages
Somnath Banerjee, Rima Hazra, Animesh Mukherjee
cs.CLarXiv:2602.13867v12026Racing Thoughts: Explaining Contextualization Errors in Large Language Models
Michael A. Lepori, Michael C. Mozer, Asma Ghandeharioun
cs.CLarXiv:2410.02102v22024Learning to Reason for Hallucination Span Detection
Hsuan Su, Ting-Yao Hu, Hema Swetha Koppula +7
cs.CLcs.AIcs.LGarXiv:2510.02173v22025R-Transformer: Recurrent Neural Network Enhanced Transformer
Zhiwei Wang, Yao Ma, Zitao Liu +1
cs.LGcs.CLcs.CVarXiv:1907.05572v12019Beg to Differ: Understanding Reasoning-Answer Misalignment Across Languages
Anaelia Ovalle, Candace Ross, Sebastian Ruder +4
cs.CLarXiv:2512.22712v32025GerAV: Towards New Heights in German Authorship Verification using Fine-Tuned LLMs on a New Benchmark
Lotta Kiefer, Christoph Leiter, Sotaro Takeshita +2
cs.CLarXiv:2601.13711v22026TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning
Christian Greisinger, Steffen Eger
cs.AIcs.CLcs.CVarXiv:2603.03072v32026AutomaTikZ: Text-Guided Synthesis of Scientific Vector Graphics with TikZ
Jonas Belouadi, Anne Lauscher, Steffen Eger
cs.CLcs.CVarXiv:2310.00367v22023DiagrammerGPT: Generating Open-Domain, Open-Platform Diagrams via LLM Planning
Abhay Zala, Han Lin, Jaemin Cho +1
cs.CVcs.AIcs.CLarXiv:2310.12128v22023Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models
Jonggeun Lee, Woojung Song, Jongwook Han +2
cs.CLarXiv:2510.07248v32025The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models
Noah Y. Siegel, Oana-Maria Camburu, Nicolas Heess +1
cs.CLcs.AIarXiv:2404.03189v22024Reaching Human-level Performance in Automatic Grammatical Error Correction: An Empirical Study
Tao Ge, Furu Wei, Ming Zhou
cs.CLcs.AIarXiv:1807.01270v52018Addressing Some Limitations of Transformers with Feedback Memory
Angela Fan, Thibaut Lavril, Edouard Grave +2
cs.LGcs.CLstat.MLarXiv:2002.09402v32020Paper2Agent: Reimagining Research Papers As Interactive and Reliable AI Agents
Jiacheng Miao, Joe R. Davis, Yaohui Zhang +2
cs.AIcs.CLcs.LGarXiv:2509.06917v22025