Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,441 to 10,500 of 11,299
RewardHarness: Self-Evolving Agentic Post-Training
Yuxuan Zhang, Penghui Du, Bo Li +11
cs.AIcs.CLcs.CVarXiv:2605.08703v12026A Single Layer to Explain Them All:Understanding Massive Activations in Large Language Models
Zeru Shi, Zhenting Wang, Fan Yang +2
cs.CLarXiv:2605.08504v22026InterLV-Search: Benchmarking Interleaved Multimodal Agentic Search
Bohan Hou, Jiuning Gu, Jiayan Guo +5
cs.CVcs.CLcs.IRarXiv:2605.07510v12026Summaries:한국어Teaching Language Models to Think in Code
Hyeon Hwang, Jiwoo Lee, Jaewoo Kang
cs.CLarXiv:2605.07237v22026Summaries:한국어RaguTeam at SemEval-2026 Task 8: Meno and Friends in a Judge-Orchestrated LLM Ensemble for Faithful Multi-Turn Response Generation
Ivan Bondarenko, Roman Derunets, Oleg Sedukhin +3
cs.CLcs.AIcs.LGarXiv:2605.04523v12026Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Traces
Chenchen Zhang
cs.CLarXiv:2605.02801v12026InfoLaw: Information Scaling Laws for Large Language Models with Quality-Weighted Mixture Data and Repetition
Fengze Liu, Weidong Zhou, Binbin Liu +7
cs.CLarXiv:2605.02364v12026Summaries:한국어FAMA: Failure-Aware Meta-Agentic Framework for Open-Source LLMs in Interactive Tool Use Environments
Amir Saeidi, Venkatesh Mishra, Souradeep Mukhopadhyay +4
cs.CLarXiv:2604.25135v12026The Power of Scale for Parameter-Efficient Prompt Tuning
Brian Lester, Rami Al-Rfou, Noah Constant
cs.CLarXiv:2104.08691v22021RoBERTa: A Robustly Optimized BERT Pretraining Approach
Yinhan Liu, Myle Ott, Naman Goyal +7
cs.CLarXiv:1907.11692v12019Parameter-Efficient Transfer Learning for NLP
Neil Houlsby, Andrei Giurgiu, Stanislaw Jastrzebski +5
cs.LGcs.CLstat.MLarXiv:1902.00751v22019Prompt-Level Distillation: A Non-Parametric Alternative to Model Fine-Tuning for Efficient Reasoning
Sanket Badhe, Deep Shah
cs.CLcs.IRarXiv:2602.21103v22026Diffusion-Pretrained Dense and Contextual Embeddings
Sedigheh Eslami, Maksim Gaiduk, Markus Krimmel +3
cs.LGcs.CLcs.IRarXiv:2602.11151v22026Summaries:한국어FollowUpBot: An LLM-Based Conversational Robot for Automatic Postoperative Follow-up
Chen Chen, Jianing Yin, Jiannong Cao +5
cs.HCcs.CLcs.ROarXiv:2507.15502v12025DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
Zhihong Shao, Peiyi Wang, Qihao Zhu +8
cs.CLcs.AIcs.LGarXiv:2402.03300v32024Qwen Technical Report
Jinze Bai, Shuai Bai, Yunfei Chu +45
cs.CLarXiv:2309.16609v12023RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
Anthony Brohan, Noah Brown, Justice Carbajal +51
cs.ROcs.CLcs.CVarXiv:2307.15818v12023Large Language Models Encode Clinical Knowledge
Karan Singhal, Shekoofeh Azizi, Tao Tu +27
cs.CLarXiv:2212.13138v12022Robust Speech Recognition via Large-Scale Weak Supervision
Alec Radford, Jong Wook Kim, Tao Xu +3
eess.AScs.CLcs.LGarXiv:2212.04356v12022Large Language Models are Zero-Shot Reasoners
Takeshi Kojima, Shixiang Shane Gu, Machel Reid +2
cs.CLcs.AIcs.LGarXiv:2205.11916v42022Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback
Yuntao Bai, Andy Jones, Kamal Ndousse +28
cs.CLcs.LGarXiv:2204.05862v12022TruthfulQA: Measuring How Models Mimic Human Falsehoods
Stephanie Lin, Jacob Hilton, Owain Evans
cs.CLcs.AIcs.CYarXiv:2109.07958v22021Don't Stop Pretraining: Adapt Language Models to Domains and Tasks
Suchin Gururangan, Ana Marasović, Swabha Swayamdipta +4
cs.CLcs.LGarXiv:2004.10964v32020Dense Passage Retrieval for Open-Domain Question Answering
Vladimir Karpukhin, Barlas Oğuz, Sewon Min +5
cs.CLarXiv:2004.04906v32020BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding
Jacob Devlin, Ming-Wei Chang, Kenton Lee +1
cs.CLarXiv:1810.04805v22018An Empirical Evaluation of Generic Convolutional and Recurrent Networks for Sequence Modeling
Shaojie Bai, J. Zico Kolter, Vladlen Koltun
cs.LGcs.AIcs.CLarXiv:1803.01271v22018DeepTCM1.0: A Multi-Expert AI Agent for Deciphering Mechanisms of Chinese Herbal Formulae Based on General Large Language Models
Wenxin Duan, Hanwei Wang, Zhongying Peng +4
cs.CLcs.AIarXiv:2608.18103v12026LLMs for Medical Consultation Are Evaluated Too Late: The Preformulation Gap
Yining Hua, Cyrus Ayubcha, Hongbin Na +4
cs.AIcs.CLcs.CYarXiv:2608.17330v12026Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia
Xiang Guan, Roger D. Newman-Norlund, Yong Yang +8
cs.LGcs.CLarXiv:2608.12717v12026Intent Speaks Louder: Controllable User Simulation Beyond Response Imitation
Bo Wang, Ruixing Zhang, Yunqi Liu +4
cs.CLarXiv:2608.09420v12026Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application
Jiachun Li, Zhuoran Jin, Tianyi Men +12
cs.CLcs.AIarXiv:2606.12191v12026Manifold Bandits: Bayesian Curriculum Learning over the Latent Geometry of Large Language Models
Darrien McKenzie, Nicklas Hansen, Xiaolong Wang
cs.LGcs.AIcs.CLarXiv:2606.19750v12026The Limits of Binding in Dual Encoders
Kin Ian Lo
cs.LGcs.CLcs.CVarXiv:2608.15971v12026OScaR: The Occam's Razor for Extreme KV Cache Quantization in LLMs and Beyond
Zunhai Su, Rui Yang, Chao Zhang +11
cs.LGcs.CLarXiv:2605.19660v12026PAAC: Privacy-Aware Agentic Device-Cloud Collaboration
Liangqi Yuan, Wenzhi Fang, Shiqiang Wang +1
cs.LGcs.CLcs.DCarXiv:2605.08646v12026Continuous Latent Diffusion Language Model
Hongcan Guo, Qinyu Zhao, Yian Zhao +8
cs.CLcs.AIcs.CVarXiv:2605.06548v12026Summaries:한국어EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents
Tara Bogavelli, Gabrielle Gauthier Melançon, Katrina Stankiewicz +10
cs.SDcs.AIcs.CLarXiv:2605.13841v22026Bag of Tricks for Efficient Text Classification
Armand Joulin, Edouard Grave, Piotr Bojanowski +1
cs.CLarXiv:1607.01759v32016MineExplorer: Evaluating Open-World Exploration of MLLM Agents in Minecraft
Tianjie Ju, Yueqing Sun, Zheng Wu +7
cs.CLarXiv:2605.30931v22026ChLogic: Evaluating Robustness of Logical Reasoning in Chinese Expressions
Peixian Zhou, Yuxu Chen, Chaorui Zhang +3
cs.CLarXiv:2606.17905v12026Budget-First Tariff Recommendation (BFTR): A Complete Algorithmic Framework for Telecom Plan Recommendation without Overcharging
Ghislain Dorian Tchuente Mondjo
cs.CLcs.AIarXiv:2608.18723v12026Matryoshka Language Model Suites
Nathan Godey, Yoav Artzi
cs.AIcs.CLarXiv:2608.09703v12026Summaries:한국어GPQA: A Graduate-Level Google-Proof Q&A Benchmark
David Rein, Betty Li Hou, Asa Cooper Stickland +5
cs.AIcs.CLarXiv:2311.12022v12023Deep Speech 2: End-to-End Speech Recognition in English and Mandarin
Dario Amodei, Rishita Anubhai, Eric Battenberg +31
cs.CLarXiv:1512.02595v12015CLIPScore: A Reference-free Evaluation Metric for Image Captioning
Jack Hessel, Ari Holtzman, Maxwell Forbes +2
cs.CVcs.CLarXiv:2104.08718v32021DeepFM: A Factorization-Machine based Neural Network for CTR Prediction
Huifeng Guo, Ruiming Tang, Yunming Ye +2
cs.IRcs.CLarXiv:1703.04247v12017Semantics derived automatically from language corpora contain human-like biases
Aylin Caliskan, Joanna J. Bryson, Arvind Narayanan
cs.AIcs.CLcs.CYarXiv:1608.07187v42016Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions
Jonathan Shen, Ruoming Pang, Ron J. Weiss +10
cs.CLarXiv:1712.05884v22017Extracting Training Data from Large Language Models
Nicholas Carlini, Florian Tramer, Eric Wallace +9
cs.CRcs.CLcs.LGarXiv:2012.07805v22020mT5: A massively multilingual pre-trained text-to-text transformer
Linting Xue, Noah Constant, Adam Roberts +5
cs.CLarXiv:2010.11934v32020REALM: Retrieval-Augmented Language Model Pre-Training
Kelvin Guu, Kenton Lee, Zora Tung +2
cs.CLcs.LGarXiv:2002.08909v12020PIQA: Reasoning about Physical Commonsense in Natural Language
Yonatan Bisk, Rowan Zellers, Ronan Le Bras +2
cs.CLcs.AIcs.LGarXiv:1911.11641v12019Automated Hate Speech Detection and the Problem of Offensive Language
Thomas Davidson, Dana Warmsley, Michael Macy +1
cs.CLarXiv:1703.04009v12017Improved Semantic Representations From Tree-Structured Long Short-Term Memory Networks
Kai Sheng Tai, Richard Socher, Christopher D. Manning
cs.CLcs.AIcs.LGarXiv:1503.00075v32015InstructPix2Pix: Learning to Follow Image Editing Instructions
Tim Brooks, Aleksander Holynski, Alexei A. Efros
cs.CVcs.AIcs.CLarXiv:2211.09800v22022Language Models as Knowledge Bases?
Fabio Petroni, Tim Rocktäschel, Patrick Lewis +4
cs.CLarXiv:1909.01066v22019ConceptNet 5.5: An Open Multilingual Graph of General Knowledge
Robyn Speer, Joshua Chin, Catherine Havasi
cs.CLarXiv:1612.03975v22016SWE-bench: Can Language Models Resolve Real-World GitHub Issues?
Carlos E. Jimenez, John Yang, Alexander Wettig +4
cs.CLcs.AIcs.SEarXiv:2310.06770v32023Know What You Don't Know: Unanswerable Questions for SQuAD
Pranav Rajpurkar, Robin Jia, Percy Liang
cs.CLarXiv:1806.03822v12018fairseq: A Fast, Extensible Toolkit for Sequence Modeling
Myle Ott, Sergey Edunov, Alexei Baevski +5
cs.CLarXiv:1904.01038v12019