Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

181 to 240 of 11,241

  1. Improving Factual Consistency of Abstractive Summarization via Question Answering

    Feng Nan, Cicero Nogueira dos Santos, Henghui Zhu +7

    cs.CLcs.AIarXiv:2105.04623v12021
  2. Emoti-Attack: Zero-Perturbation Adversarial Attacks on NLP Systems via Emoji Sequences

    Yangshijie Zhang

    cs.AIcs.CLcs.CRarXiv:2502.17392v12025
  3. Fair Transfer of Multiple Style Attributes in Text

    Karan Dabas, Nishtha Madan, Vijay Arya +3

    cs.CLcs.AIcs.LGarXiv:2001.06693v12020
  4. Understanding Back-Translation at Scale

    Sergey Edunov, Myle Ott, Michael Auli +1

    cs.CLarXiv:1808.09381v22018
  5. PEER: A Collaborative Language Model

    Timo Schick, Jane Dwivedi-Yu, Zhengbao Jiang +7

    cs.CLarXiv:2208.11663v12022
  6. Training Language Models with Language Feedback

    Jérémy Scheurer, Jon Ander Campos, Jun Shern Chan +3

    cs.CLcs.AIcs.LGarXiv:2204.14146v42022
  7. Rainier: Reinforced Knowledge Introspector for Commonsense Question Answering

    Jiacheng Liu, Skyler Hallinan, Ximing Lu +4

    cs.CLcs.AIarXiv:2210.03078v22022
  8. Towards Empathetic Open-domain Conversation Models: a New Benchmark and Dataset

    Hannah Rashkin, Eric Michael Smith, Margaret Li +1

    cs.CLarXiv:1811.00207v52018
  9. DeepSeek-V3 Technical Report

    DeepSeek-AI, Aixin Liu, Bei Feng +197

    cs.CLcs.AIarXiv:2412.19437v22024
  10. VeOmni: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo

    Qianli Ma, Yaowei Zheng, Zhelun Shi +9

    cs.CLcs.AIcs.DCarXiv:2508.02317v32025
  11. Effective Parallel Corpus Mining using Bilingual Sentence Embeddings

    Mandy Guo, Qinlan Shen, Yinfei Yang +8

    cs.CLarXiv:1807.11906v22018
  12. AgentInstruct: Toward Generative Teaching with Agentic Flows

    Arindam Mitra, Luciano Del Corro, Guoqing Zheng +11

    cs.AIcs.CLcs.LGarXiv:2407.03502v12024
  13. Knowing Before Saying: LLM Representations Encode Information About Chain-of-Thought Success Before Completion

    Anum Afzal, Florian Matthes, Gal Chechik +1

    cs.CLarXiv:2505.24362v22025
  14. BoardgameQA: A Dataset for Natural Language Reasoning with Contradictory Information

    Mehran Kazemi, Quan Yuan, Deepti Bhatia +4

    cs.CLcs.AIcs.LGarXiv:2306.07934v12023
  15. SONAR: Sentence-Level Multimodal and Language-Agnostic Representations

    Paul-Ambroise Duquenne, Holger Schwenk, Benoît Sagot

    cs.CLarXiv:2308.11466v22023
  16. Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline

    Meng Lu, Ruochen Zhang, Carsten Eickhoff +1

    cs.CLarXiv:2505.20546v22025
  17. Amnesic Probing: Behavioral Explanation with Amnesic Counterfactuals

    Yanai Elazar, Shauli Ravfogel, Alon Jacovi +1

    cs.CLarXiv:2006.00995v32020
  18. Soft Tokens, Hard Truths

    Natasha Butt, Ariel Kwiatkowski, Ismail Labiad +2

    cs.CLcs.AIcs.LGarXiv:2509.19170v22025
  19. SONAR-LLM: Autoregressive Transformer that Thinks in Sentence Embeddings and Speaks in Tokens

    Nikita Dragunov, Temurbek Rahmatullaev, Elizaveta Goncharova +5

    cs.CLarXiv:2508.05305v22025
  20. Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles

    Kulin Shah, Nishanth Dikkala, Xin Wang +1

    cs.LGcs.CLarXiv:2409.10502v12024
  21. Monitoring Latent World States in Language Models with Propositional Probes

    Jiahai Feng, Stuart Russell, Jacob Steinhardt

    cs.CLcs.LGarXiv:2406.19501v22024
  22. Humor in AI: Massive Scale Crowd-Sourced Preferences and Benchmarks for Cartoon Captioning

    Jifan Zhang, Lalit Jain, Yang Guo +9

    cs.LGcs.AIcs.CLarXiv:2406.10522v22024
  23. Summing Up the Facts: Additive Mechanisms Behind Factual Recall in LLMs

    Bilal Chughtai, Alan Cooney, Neel Nanda

    cs.LGcs.CLarXiv:2402.07321v12024
  24. Backward Lens: Projecting Language Model Gradients into the Vocabulary Space

    Shahar Katz, Yonatan Belinkov, Mor Geva +1

    cs.CLcs.AIcs.LGarXiv:2402.12865v12024
  25. Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?

    Chengzhi Zhong, Fei Cheng, Qianying Liu +5

    cs.CLcs.AIarXiv:2408.10811v12024
  26. From Failure to Mastery: Generating Hard Samples for Tool-use Agents

    Bingguang Hao, Zengzhuang Xu, Yuntao Wen +11

    cs.CLarXiv:2601.01498v12026
  27. Deep Research Pretraining via Predictive Navigation

    Jiang Zhou, Zhiyuan Fan, Xing Wu +3

    cs.CLarXiv:2608.00432v12026
  28. Learning from Task Descriptions

    Orion Weller, Nicholas Lourie, Matt Gardner +1

    cs.CLarXiv:2011.08115v12020
  29. Measuring Semantic Similarity by Latent Relational Analysis

    Peter D. Turney

    cs.LGcs.CLcs.IRarXiv:cs/0508053v12005
  30. TinyV: Reducing False Negatives in Verification Improves RL for LLM Reasoning

    Zhangchen Xu, Yuetai Li, Fengqing Jiang +4

    cs.LGcs.AIcs.CLarXiv:2505.14625v22025
  31. Brain-to-Text Decoding: A Non-invasive Approach via Typing

    Jarod Lévy, Mingfang Zhang, Svetlana Pinet +4

    eess.SPcs.AIcs.CLarXiv:2502.17480v12025
  32. Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems

    Taejin Park, Ivan Medennikov, Kunal Dhawan +6

    eess.AScs.CLcs.LGarXiv:2409.06656v32024
  33. SemGloVe: Semantic Co-occurrences for GloVe from BERT

    Leilei Gan, Zhiyang Teng, Yue Zhang +3

    cs.CLcs.AIarXiv:2012.15197v22020
  34. Incorporating Visual Semantics into Sentence Representations within a Grounded Space

    Patrick Bordes, Eloi Zablocki, Laure Soulier +2

    cs.CLarXiv:2002.02734v12020
  35. Following the Autoregressive Nature of LLM Embeddings via Compression and Alignment

    Jingcheng Deng, Zhongtao Jiang, Liang Pang +5

    cs.CLarXiv:2502.11401v32025
  36. ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents

    Yusheng Liao, Shuyang Jiang, Yanfeng Wang +1

    cs.CLarXiv:2410.17657v32024
  37. MegaPairs: Massive Data Synthesis For Universal Multimodal Retrieval

    Junjie Zhou, Zheng Liu, Ze Liu +6

    cs.CVcs.CLarXiv:2412.14475v12024
  38. MagicLens: Self-Supervised Image Retrieval with Open-Ended Instructions

    Kai Zhang, Yi Luan, Hexiang Hu +5

    cs.CVcs.AIcs.CLarXiv:2403.19651v22024
  39. Reasoning Up the Instruction Ladder for Controllable Language Models

    Zishuo Zheng, Vidhisha Balachandran, Chan Young Park +2

    cs.CLcs.AIarXiv:2511.04694v52025
  40. CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning

    Hao Yu, Zhuokai Zhao, Shen Yan +7

    cs.CVcs.AIcs.CLarXiv:2503.19900v12025
  41. Simpler Context-Dependent Logical Forms via Model Projections

    Reginald Long, Panupong Pasupat, Percy Liang

    cs.CLarXiv:1606.05378v12016
  42. MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos

    Kejian Zhu, Zhuoran Jin, Hongbang Yuan +6

    cs.CVcs.CLarXiv:2506.04141v22025
  43. ResearchTown: Simulator of Human Research Community

    Haofei Yu, Zhaochen Hong, Zirui Cheng +5

    cs.CLcs.LGarXiv:2412.17767v22024
  44. DyFlow: Dynamic Workflow Framework for Agentic Reasoning

    Yanbo Wang, Zixiang Xu, Yue Huang +9

    cs.CLarXiv:2509.26062v12025
  45. Order in the Court: Explainable AI Methods Prone to Disagreement

    Michael Neely, Stefan F. Schouten, Maurits J. R. Bleeker +1

    cs.LGcs.CLarXiv:2105.03287v32021
  46. Are Arithmetic Heuristic Neurons Form-Invariant? A Mechanistic Analysis of Symbols, Text, and Code in LLMs

    Sharath Naganna, Tanvir Ahmed Sijan, Uddipta Kalita

    cs.CLarXiv:2607.16693v12026
  47. Bridging the Multilingual Safety Divide: Efficient, Culturally-Aware Alignment for Global South Languages

    Somnath Banerjee, Rima Hazra, Animesh Mukherjee

    cs.CLarXiv:2602.13867v12026
  48. Racing Thoughts: Explaining Contextualization Errors in Large Language Models

    Michael A. Lepori, Michael C. Mozer, Asma Ghandeharioun

    cs.CLarXiv:2410.02102v22024
  49. Learning to Reason for Hallucination Span Detection

    Hsuan Su, Ting-Yao Hu, Hema Swetha Koppula +7

    cs.CLcs.AIcs.LGarXiv:2510.02173v22025
  50. R-Transformer: Recurrent Neural Network Enhanced Transformer

    Zhiwei Wang, Yao Ma, Zitao Liu +1

    cs.LGcs.CLcs.CVarXiv:1907.05572v12019
  51. Beg to Differ: Understanding Reasoning-Answer Misalignment Across Languages

    Anaelia Ovalle, Candace Ross, Sebastian Ruder +4

    cs.CLarXiv:2512.22712v32025
  52. GerAV: Towards New Heights in German Authorship Verification using Fine-Tuned LLMs on a New Benchmark

    Lotta Kiefer, Christoph Leiter, Sotaro Takeshita +2

    cs.CLarXiv:2601.13711v22026
  53. TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning

    Christian Greisinger, Steffen Eger

    cs.AIcs.CLcs.CVarXiv:2603.03072v32026
  54. AutomaTikZ: Text-Guided Synthesis of Scientific Vector Graphics with TikZ

    Jonas Belouadi, Anne Lauscher, Steffen Eger

    cs.CLcs.CVarXiv:2310.00367v22023
  55. DiagrammerGPT: Generating Open-Domain, Open-Platform Diagrams via LLM Planning

    Abhay Zala, Han Lin, Jaemin Cho +1

    cs.CVcs.AIcs.CLarXiv:2310.12128v22023
  56. Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models

    Jonggeun Lee, Woojung Song, Jongwook Han +2

    cs.CLarXiv:2510.07248v32025
  57. The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models

    Noah Y. Siegel, Oana-Maria Camburu, Nicolas Heess +1

    cs.CLcs.AIarXiv:2404.03189v22024
  58. Reaching Human-level Performance in Automatic Grammatical Error Correction: An Empirical Study

    Tao Ge, Furu Wei, Ming Zhou

    cs.CLcs.AIarXiv:1807.01270v52018
  59. Addressing Some Limitations of Transformers with Feedback Memory

    Angela Fan, Thibaut Lavril, Edouard Grave +2

    cs.LGcs.CLstat.MLarXiv:2002.09402v32020
  60. Paper2Agent: Reimagining Research Papers As Interactive and Reliable AI Agents

    Jiacheng Miao, Joe R. Davis, Yaohui Zhang +2

    cs.AIcs.CLcs.LGarXiv:2509.06917v22025