Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,121 to 3,180 of 11,250
SAMGPT: Text-free Graph Foundation Model for Multi-domain Pre-training and Cross-domain Adaptation
Xingtong Yu, Zechuan Gong, Chang Zhou +2
cs.CLcs.AIarXiv:2502.05424v22025A Review of Keyphrase Extraction
Eirini Papagiannopoulou, Grigorios Tsoumakas
cs.CLcs.IRarXiv:1905.05044v22019BRIGHTER: BRIdging the Gap in Human-Annotated Textual Emotion Recognition Datasets for 28 Languages
Shamsuddeen Hassan Muhammad, Nedjma Ousidhoum, Idris Abdulmumin +45
cs.CLarXiv:2502.11926v42025PersianAnonymizer: Evaluating LLM-Labeled Training for Efficient NER-based Anonymization in Persian
Mohammad Hossein Shalchian, Mostafa Amiri, Amir Mahdi Sadeghzadeh
cs.CLarXiv:2609.00958v12026MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models
Kailai Yang, Tianlin Zhang, Ziyan Kuang +3
cs.CLarXiv:2309.13567v32023Energy Considerations of Large Language Model Inference and Efficiency Optimizations
Jared Fernandez, Clara Na, Vashisth Tiwari +3
cs.CLcs.LGarXiv:2504.17674v12025r/Fakeddit: A New Multimodal Benchmark Dataset for Fine-grained Fake News Detection
Kai Nakamura, Sharon Levy, William Yang Wang
cs.CLcs.CYcs.IRarXiv:1911.03854v22019SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience
Zeyi Sun, Ziyu Liu, Yuhang Zang +5
cs.AIcs.CLcs.CVarXiv:2508.04700v22025JSONSchemaBench: A Rigorous Benchmark of Structured Outputs for Language Models
Saibo Geng, Hudson Cooper, Michał Moskal +6
cs.CLcs.AIarXiv:2501.10868v32025Self-Harness: Harnesses That Improve Themselves
Hangfan Zhang, Shao Zhang, Kangcong Li +5
cs.CLarXiv:2606.09498v32026MM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs
Erik Daxberger, Nina Wenzel, David Griffiths +8
cs.CVcs.CLcs.LGarXiv:2503.13111v22025ReasonIR: Training Retrievers for Reasoning Tasks
Rulin Shao, Rui Qiao, Varsha Kishore +8
cs.AIcs.CLcs.IRarXiv:2504.20595v12025TxGemma: Efficient and Agentic LLMs for Therapeutics
Eric Wang, Samuel Schmidgall, Paul F. Jaeger +6
cs.AIcs.CLcs.LGarXiv:2504.06196v12025Moving Down the Long Tail of Word Sense Disambiguation with Gloss-Informed Biencoders
Terra Blevins, Luke Zettlemoyer
cs.CLarXiv:2005.02590v22020Self-Training Elicits Concise Reasoning in Large Language Models
Tergel Munkhbat, Namgyu Ho, Seo Hyun Kim +3
cs.CLcs.AIcs.LGarXiv:2502.20122v32025MAGE: Machine-generated Text Detection in the Wild
Yafu Li, Qintong Li, Leyang Cui +6
cs.CLarXiv:2305.13242v32023Poisoning Retrieval Corpora by Injecting Adversarial Passages
Zexuan Zhong, Ziqing Huang, Alexander Wettig +1
cs.CLcs.IRarXiv:2310.19156v12023Value Over Language Model: Detecting Original Contribution in Writing
Vibhhu Sharma, Thorsten Joachims, Sarah Dean
cs.AIcs.CLarXiv:2609.00700v12026AgentRewardBench: Evaluating Automatic Evaluations of Web Agent Trajectories
Xing Han Lù, Amirhossein Kazemnejad, Nicholas Meade +7
cs.LGcs.AIcs.CLarXiv:2504.08942v22025Generative Language Models Exhibit Social Identity Biases
Tiancheng Hu, Yara Kyrychenko, Steve Rathje +3
cs.CLcs.CYarXiv:2310.15819v22023Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting
Howard Chen, Noam Razin, Karthik Narasimhan +1
cs.LGcs.CLarXiv:2510.18874v32025An Empirical Study on Eliciting and Improving R1-like Reasoning Models
Zhipeng Chen, Yingqian Min, Beichen Zhang +10
cs.CLarXiv:2503.04548v12025GPT Takes the Bar Exam
Michael Bommarito, Daniel Martin Katz
cs.CLcs.AIcs.LGarXiv:2212.14402v12022Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning
Zhaowei Liu, Xin Guo, Zhi Yang +14
cs.CLarXiv:2503.16252v52025A Comprehensive Survey of Retrieval-Augmented Generation (RAG): Evolution, Current Landscape and Future Directions
Shailja Gupta, Rajesh Ranjan, Surya Narayan Singh
cs.CLcs.AIcs.IRarXiv:2410.12837v12024Knowledge Graph-Guided Retrieval Augmented Generation
Xiangrong Zhu, Yuexiang Xie, Yi Liu +2
cs.CLcs.AIarXiv:2502.06864v12025Proof or Bluff? Evaluating LLMs on 2025 USA Math Olympiad
Ivo Petrov, Jasper Dekoninck, Lyuben Baltadzhiev +5
cs.CLarXiv:2503.21934v52025Modeling the Complexity and Descriptive Adequacy of Construction Grammars
Jonathan Dunn
cs.CLarXiv:1904.05588v12019Paper2Poster: Towards Multimodal Poster Automation from Scientific Papers
Wei Pang, Kevin Qinghong Lin, Xiangru Jian +2
cs.CVcs.AIcs.CLarXiv:2505.21497v22025The emergence of number and syntax units in LSTM language models
Yair Lakretz, German Kruszewski, Theo Desbordes +3
cs.CLarXiv:1903.07435v22019Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback
Xiaoying Zhang, Yipeng Zhang, Hao Sun +4
cs.CLcs.AIarXiv:2506.03106v72025LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
Yunhui Xia, Wei Shen, Yan Wang +5
cs.LGcs.CLcs.SEarXiv:2504.14655v12025Synthetic Data Generation Using Large Language Models: Advances in Text and Code
Mihai Nadas, Laura Diosan, Andreea Tomescu
cs.CLarXiv:2503.14023v22025TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators
Jianling Li, Shangzhan Li, Zhenye Gao +9
cs.CLcs.LGarXiv:2502.14752v12025Canary-1B-v2 & Parakeet-TDT-0.6B-v3: Efficient and High-Performance Models for Multilingual ASR and AST
Monica Sekoyan, Nithin Rao Koluguri, Nune Tadevosyan +5
cs.CLeess.ASarXiv:2509.14128v22025Knowledge Graph Embedding: A Survey from the Perspective of Representation Spaces
Jiahang Cao, Jinyuan Fang, Zaiqiao Meng +1
cs.LGcs.AIcs.CLarXiv:2211.03536v22022SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
Keyan Ding, Jing Yu, Junjie Huang +3
cs.AIcs.CLarXiv:2507.20280v12025Reward Shaping to Mitigate Reward Hacking in RLHF
Jiayi Fu, Xuandong Zhao, Chengyuan Yao +2
cs.LGcs.AIcs.CLarXiv:2502.18770v72025Image-Grounded Conversations: Multimodal Context for Natural Question and Response Generation
Nasrin Mostafazadeh, Chris Brockett, Bill Dolan +4
cs.CLcs.AIcs.CVarXiv:1701.08251v22017Systematic Inequalities in Language Technology Performance across the World's Languages
Damián Blasi, Antonios Anastasopoulos, Graham Neubig
cs.CLarXiv:2110.06733v12021Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing
Yusu Qian, Eli Bocek-Rivele, Liangchen Song +5
cs.CVcs.CLcs.LGarXiv:2510.19808v12025Compressed Chain of Thought: Efficient Reasoning Through Dense Representations
Jeffrey Cheng, Benjamin Van Durme
cs.CLarXiv:2412.13171v12024Attention Strategies for Multi-Source Sequence-to-Sequence Learning
Jindřich Libovický, Jindřich Helcl
cs.CLcs.NEarXiv:1704.06567v12017Factual Error Correction for Abstractive Summarization Models
Meng Cao, Yue Dong, Jiapeng Wu +1
cs.CLcs.AIarXiv:2010.08712v22020Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
Chongyu Fan, Jinghan Jia, Yihua Zhang +3
cs.LGcs.CLarXiv:2502.05374v42025Attending to Characters in Neural Sequence Labeling Models
Marek Rei, Gamal K. O. Crichton, Sampo Pyysalo
cs.CLcs.LGcs.NEarXiv:1611.04361v12016Towards Causal VQA: Revealing and Reducing Spurious Correlations by Invariant and Covariant Semantic Editing
Vedika Agarwal, Rakshith Shetty, Mario Fritz
cs.CVcs.CLcs.LGarXiv:1912.07538v32019MedHELM: Holistic Evaluation of Large Language Models for Medical Tasks
Suhana Bedi, Hejie Cui, Miguel Fuentes +78
cs.CLcs.AIarXiv:2505.23802v22025Modeling Localness for Self-Attention Networks
Baosong Yang, Zhaopeng Tu, Derek F. Wong +3
cs.CLcs.AIarXiv:1810.10182v12018AutoPresent: Designing Structured Visuals from Scratch
Jiaxin Ge, Zora Zhiruo Wang, Xuhui Zhou +8
cs.CVcs.CLarXiv:2501.00912v22025GRPO-LEAD: A Difficulty-Aware Reinforcement Learning Approach for Concise Mathematical Reasoning in Language Models
Jixiao Zhang, Chunsheng Zuo
cs.CLarXiv:2504.09696v22025AnyEdit: Edit Any Knowledge Encoded in Language Models
Houcheng Jiang, Junfeng Fang, Ningyu Zhang +5
cs.CLarXiv:2502.05628v32025ACECODER: Acing Coder RL via Automated Test-Case Synthesis
Huaye Zeng, Dongfu Jiang, Haozhe Wang +3
cs.SEcs.AIcs.CLarXiv:2502.01718v42025OBJECTION! Lawyer Agents Mitigate Guilty Bias in Legal Judgment Prediction
Jaehoon Jeong, Jay-Yoon Lee
cs.CLcs.AIarXiv:2609.02158v12026UTP-Bench: Uncertainty-aware Travel Planning Benchmark
Etcharla Revanth Rao, Priyanshu Karmakar, Shubhojit Mallick +3
cs.AIcs.CLarXiv:2609.02421v12026Airbert: In-domain Pretraining for Vision-and-Language Navigation
Pierre-Louis Guhur, Makarand Tapaswi, Shizhe Chen +2
cs.CVcs.AIcs.CLarXiv:2108.09105v12021Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR Bases
Bernard Muller, László Tóth, LaVonne Roberts
cs.CLcs.SDarXiv:2609.02735v12026AceReason-Nemotron 1.1: Advancing Math and Code Reasoning through SFT and RL Synergy
Zihan Liu, Zhuolin Yang, Yang Chen +4
cs.CLcs.AIcs.LGarXiv:2506.13284v12025PragAlign: Feedback-Guided Pragmatic Alignment for Controlled Synthetic Dialogue Generation
Smitha Muthya Sudheendra, Jaideep Srivastava
cs.CLarXiv:2609.02480v12026When Decodability Is Not Enough: Logical Validity Representations, Behavioral Dissociation, and Causal Tests in Language Models
Smitha Muthya Sudheendra, Jaideep Srivastava
cs.CLcs.LGarXiv:2609.02438v12026