Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,121 to 3,180 of 11,250

  1. SAMGPT: Text-free Graph Foundation Model for Multi-domain Pre-training and Cross-domain Adaptation

    Xingtong Yu, Zechuan Gong, Chang Zhou +2

    cs.CLcs.AIarXiv:2502.05424v22025
  2. A Review of Keyphrase Extraction

    Eirini Papagiannopoulou, Grigorios Tsoumakas

    cs.CLcs.IRarXiv:1905.05044v22019
  3. BRIGHTER: BRIdging the Gap in Human-Annotated Textual Emotion Recognition Datasets for 28 Languages

    Shamsuddeen Hassan Muhammad, Nedjma Ousidhoum, Idris Abdulmumin +45

    cs.CLarXiv:2502.11926v42025
  4. PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in Persian

    Mohammad Hossein Shalchian, Mostafa Amiri, Amir Mahdi Sadeghzadeh

    cs.CLarXiv:2609.00958v12026
  5. MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models

    Kailai Yang, Tianlin Zhang, Ziyan Kuang +3

    cs.CLarXiv:2309.13567v32023
  6. Energy Considerations of Large Language Model Inference and Efficiency Optimizations

    Jared Fernandez, Clara Na, Vashisth Tiwari +3

    cs.CLcs.LGarXiv:2504.17674v12025
  7. r/Fakeddit: A New Multimodal Benchmark Dataset for Fine-grained Fake News Detection

    Kai Nakamura, Sharon Levy, William Yang Wang

    cs.CLcs.CYcs.IRarXiv:1911.03854v22019
  8. SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience

    Zeyi Sun, Ziyu Liu, Yuhang Zang +5

    cs.AIcs.CLcs.CVarXiv:2508.04700v22025
  9. JSONSchemaBench: A Rigorous Benchmark of Structured Outputs for Language Models

    Saibo Geng, Hudson Cooper, Michał Moskal +6

    cs.CLcs.AIarXiv:2501.10868v32025
  10. Self-Harness: Harnesses That Improve Themselves

    Hangfan Zhang, Shao Zhang, Kangcong Li +5

    cs.CLarXiv:2606.09498v32026
  11. MM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs

    Erik Daxberger, Nina Wenzel, David Griffiths +8

    cs.CVcs.CLcs.LGarXiv:2503.13111v22025
  12. ReasonIR: Training Retrievers for Reasoning Tasks

    Rulin Shao, Rui Qiao, Varsha Kishore +8

    cs.AIcs.CLcs.IRarXiv:2504.20595v12025
  13. TxGemma: Efficient and Agentic LLMs for Therapeutics

    Eric Wang, Samuel Schmidgall, Paul F. Jaeger +6

    cs.AIcs.CLcs.LGarXiv:2504.06196v12025
  14. Moving Down the Long Tail of Word Sense Disambiguation with Gloss-Informed Biencoders

    Terra Blevins, Luke Zettlemoyer

    cs.CLarXiv:2005.02590v22020
  15. Self-Training Elicits Concise Reasoning in Large Language Models

    Tergel Munkhbat, Namgyu Ho, Seo Hyun Kim +3

    cs.CLcs.AIcs.LGarXiv:2502.20122v32025
  16. MAGE: Machine-generated Text Detection in the Wild

    Yafu Li, Qintong Li, Leyang Cui +6

    cs.CLarXiv:2305.13242v32023
  17. Poisoning Retrieval Corpora by Injecting Adversarial Passages

    Zexuan Zhong, Ziqing Huang, Alexander Wettig +1

    cs.CLcs.IRarXiv:2310.19156v12023
  18. Value Over Language Model: Detecting Original Contribution in Writing

    Vibhhu Sharma, Thorsten Joachims, Sarah Dean

    cs.AIcs.CLarXiv:2609.00700v12026
  19. AgentRewardBench: Evaluating Automatic Evaluations of Web Agent Trajectories

    Xing Han Lù, Amirhossein Kazemnejad, Nicholas Meade +7

    cs.LGcs.AIcs.CLarXiv:2504.08942v22025
  20. Generative Language Models Exhibit Social Identity Biases

    Tiancheng Hu, Yara Kyrychenko, Steve Rathje +3

    cs.CLcs.CYarXiv:2310.15819v22023
  21. Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting

    Howard Chen, Noam Razin, Karthik Narasimhan +1

    cs.LGcs.CLarXiv:2510.18874v32025
  22. An Empirical Study on Eliciting and Improving R1-like Reasoning Models

    Zhipeng Chen, Yingqian Min, Beichen Zhang +10

    cs.CLarXiv:2503.04548v12025
  23. GPT Takes the Bar Exam

    Michael Bommarito, Daniel Martin Katz

    cs.CLcs.AIcs.LGarXiv:2212.14402v12022
  24. Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning

    Zhaowei Liu, Xin Guo, Zhi Yang +14

    cs.CLarXiv:2503.16252v52025
  25. A Comprehensive Survey of Retrieval-Augmented Generation (RAG): Evolution, Current Landscape and Future Directions

    Shailja Gupta, Rajesh Ranjan, Surya Narayan Singh

    cs.CLcs.AIcs.IRarXiv:2410.12837v12024
  26. Knowledge Graph-Guided Retrieval Augmented Generation

    Xiangrong Zhu, Yuexiang Xie, Yi Liu +2

    cs.CLcs.AIarXiv:2502.06864v12025
  27. Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad

    Ivo Petrov, Jasper Dekoninck, Lyuben Baltadzhiev +5

    cs.CLarXiv:2503.21934v52025
  28. Modeling the Complexity and Descriptive Adequacy of Construction Grammars

    Jonathan Dunn

    cs.CLarXiv:1904.05588v12019
  29. Paper2Poster: Towards Multimodal Poster Automation from Scientific Papers

    Wei Pang, Kevin Qinghong Lin, Xiangru Jian +2

    cs.CVcs.AIcs.CLarXiv:2505.21497v22025
  30. The emergence of number and syntax units in LSTM language models

    Yair Lakretz, German Kruszewski, Theo Desbordes +3

    cs.CLarXiv:1903.07435v22019
  31. Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback

    Xiaoying Zhang, Yipeng Zhang, Hao Sun +4

    cs.CLcs.AIarXiv:2506.03106v72025
  32. LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs

    Yunhui Xia, Wei Shen, Yan Wang +5

    cs.LGcs.CLcs.SEarXiv:2504.14655v12025
  33. Synthetic Data Generation Using Large Language Models: Advances in Text and Code

    Mihai Nadas, Laura Diosan, Andreea Tomescu

    cs.CLarXiv:2503.14023v22025
  34. TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators

    Jianling Li, Shangzhan Li, Zhenye Gao +9

    cs.CLcs.LGarXiv:2502.14752v12025
  35. Canary-1B-v2 & Parakeet-TDT-0.6B-v3: Efficient and High-Performance Models for Multilingual ASR and AST

    Monica Sekoyan, Nithin Rao Koluguri, Nune Tadevosyan +5

    cs.CLeess.ASarXiv:2509.14128v22025
  36. Knowledge Graph Embedding: A Survey from the Perspective of Representation Spaces

    Jiahang Cao, Jinyuan Fang, Zaiqiao Meng +1

    cs.LGcs.AIcs.CLarXiv:2211.03536v22022
  37. SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration

    Keyan Ding, Jing Yu, Junjie Huang +3

    cs.AIcs.CLarXiv:2507.20280v12025
  38. Reward Shaping to Mitigate Reward Hacking in RLHF

    Jiayi Fu, Xuandong Zhao, Chengyuan Yao +2

    cs.LGcs.AIcs.CLarXiv:2502.18770v72025
  39. Image-Grounded Conversations: Multimodal Context for Natural Question and Response Generation

    Nasrin Mostafazadeh, Chris Brockett, Bill Dolan +4

    cs.CLcs.AIcs.CVarXiv:1701.08251v22017
  40. Systematic Inequalities in Language Technology Performance across the World's Languages

    Damián Blasi, Antonios Anastasopoulos, Graham Neubig

    cs.CLarXiv:2110.06733v12021
  41. Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing

    Yusu Qian, Eli Bocek-Rivele, Liangchen Song +5

    cs.CVcs.CLcs.LGarXiv:2510.19808v12025
  42. Compressed Chain of Thought: Efficient Reasoning Through Dense Representations

    Jeffrey Cheng, Benjamin Van Durme

    cs.CLarXiv:2412.13171v12024
  43. Attention Strategies for Multi-Source Sequence-to-Sequence Learning

    Jindřich Libovický, Jindřich Helcl

    cs.CLcs.NEarXiv:1704.06567v12017
  44. Factual Error Correction for Abstractive Summarization Models

    Meng Cao, Yue Dong, Jiapeng Wu +1

    cs.CLcs.AIarXiv:2010.08712v22020
  45. Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond

    Chongyu Fan, Jinghan Jia, Yihua Zhang +3

    cs.LGcs.CLarXiv:2502.05374v42025
  46. Attending to Characters in Neural Sequence Labeling Models

    Marek Rei, Gamal K. O. Crichton, Sampo Pyysalo

    cs.CLcs.LGcs.NEarXiv:1611.04361v12016
  47. Towards Causal VQA: Revealing and Reducing Spurious Correlations by Invariant and Covariant Semantic Editing

    Vedika Agarwal, Rakshith Shetty, Mario Fritz

    cs.CVcs.CLcs.LGarXiv:1912.07538v32019
  48. MedHELM: Holistic Evaluation of Large Language Models for Medical Tasks

    Suhana Bedi, Hejie Cui, Miguel Fuentes +78

    cs.CLcs.AIarXiv:2505.23802v22025
  49. Modeling Localness for Self-Attention Networks

    Baosong Yang, Zhaopeng Tu, Derek F. Wong +3

    cs.CLcs.AIarXiv:1810.10182v12018
  50. AutoPresent: Designing Structured Visuals from Scratch

    Jiaxin Ge, Zora Zhiruo Wang, Xuhui Zhou +8

    cs.CVcs.CLarXiv:2501.00912v22025
  51. GRPO-LEAD: A Difficulty-Aware Reinforcement Learning Approach for Concise Mathematical Reasoning in Language Models

    Jixiao Zhang, Chunsheng Zuo

    cs.CLarXiv:2504.09696v22025
  52. AnyEdit: Edit Any Knowledge Encoded in Language Models

    Houcheng Jiang, Junfeng Fang, Ningyu Zhang +5

    cs.CLarXiv:2502.05628v32025
  53. ACECODER: Acing Coder RL via Automated Test-Case Synthesis

    Huaye Zeng, Dongfu Jiang, Haozhe Wang +3

    cs.SEcs.AIcs.CLarXiv:2502.01718v42025
  54. OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment Prediction

    Jaehoon Jeong, Jay-Yoon Lee

    cs.CLcs.AIarXiv:2609.02158v12026
  55. UTP-Bench: Uncertainty-aware Travel Planning Benchmark

    Etcharla Revanth Rao, Priyanshu Karmakar, Shubhojit Mallick +3

    cs.AIcs.CLarXiv:2609.02421v12026
  56. Airbert: In-domain Pretraining for Vision-and-Language Navigation

    Pierre-Louis Guhur, Makarand Tapaswi, Shizhe Chen +2

    cs.CVcs.AIcs.CLarXiv:2108.09105v12021
  57. Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR Bases

    Bernard Muller, László Tóth, LaVonne Roberts

    cs.CLcs.SDarXiv:2609.02735v12026
  58. AceReason-Nemotron 1.1: Advancing Math and Code Reasoning through SFT and RL Synergy

    Zihan Liu, Zhuolin Yang, Yang Chen +4

    cs.CLcs.AIcs.LGarXiv:2506.13284v12025
  59. PragAlign: Feedback-Guided Pragmatic Alignment for Controlled Synthetic Dialogue Generation

    Smitha Muthya Sudheendra, Jaideep Srivastava

    cs.CLarXiv:2609.02480v12026
  60. When Decodability Is Not Enough: Logical Validity Representations, Behavioral Dissociation, and Causal Tests in Language Models

    Smitha Muthya Sudheendra, Jaideep Srivastava

    cs.CLcs.LGarXiv:2609.02438v12026