Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,901 to 9,960 of 11,225
Process Rewards with Learned Reliability
Jinyuan Li, Langlin Huang, Chengsong Huang +5
cs.CLcs.AIcs.LGarXiv:2605.15529v12026Active Learners as Efficient PRP Rerankers
Jeremías Figueiredo Paschmann, Juan Kaplan, Francisco Nattero +3
cs.LGcs.AIcs.CLarXiv:2605.14236v22026Language Models Don't Always Say What They Think: Unfaithful Explanations in Chain-of-Thought Prompting
Miles Turpin, Julian Michael, Ethan Perez +1
cs.CLcs.AIarXiv:2305.04388v22023Large Language Models Are Human-Level Prompt Engineers
Yongchao Zhou, Andrei Ioan Muresanu, Ziwen Han +4
cs.LGcs.AIcs.CLarXiv:2211.01910v22022PaLM 2 Technical Report
Rohan Anil, Andrew M. Dai, Orhan Firat +125
cs.CLcs.AIarXiv:2305.10403v32023Context Memorization for Efficient Long Context Generation
Yasuyuki Okoshi, Hao Mark Chen, Guanxi Lu +3
cs.CLcs.AIarXiv:2605.18226v12026DailyDialog: A Manually Labelled Multi-turn Dialogue Dataset
Yanran Li, Hui Su, Xiaoyu Shen +3
cs.CLarXiv:1710.03957v12017A Survey of Transformers
Tianyang Lin, Yuxin Wang, Xiangyang Liu +1
cs.LGcs.AIcs.CLarXiv:2106.04554v22021Natural Language Processing: State of The Art, Current Trends and Challenges
Diksha Khurana, Aditya Koli, Kiran Khatter +1
cs.CLarXiv:1708.05148v12017Post-Trained MoE Can Skip Half Experts via Self-Distillation
Xingtai Lv, Li Sheng, Kaiyan Zhang +12
cs.LGcs.AIcs.CLarXiv:2605.18643v22026MultiWOZ -- A Large-Scale Multi-Domain Wizard-of-Oz Dataset for Task-Oriented Dialogue Modelling
Paweł Budzianowski, Tsung-Hsien Wen, Bo-Hsiang Tseng +4
cs.CLarXiv:1810.00278v32018Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps
Xanh Ho, Anh-Khoa Duong Nguyen, Saku Sugawara +1
cs.CLarXiv:2011.01060v22020Learn-by-Wire Training Control Governance: Bounded Autonomous Training Under Stress for Stability and Efficiency
Anis Radianis
cs.AIcs.CLcs.LGarXiv:2605.19008v12026Base Models Look Human To AI Detectors
Yixuan Even Xu, Ziqian Zhong, Aditi Raghunathan +2
cs.CLcs.AIcs.LGarXiv:2605.19516v12026CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning
Dachuan Shi, Hanlin Zhu, Xiangchi Yuan +4
cs.CLcs.AIarXiv:2605.20075v12026Passage Re-ranking with BERT
Rodrigo Nogueira, Kyunghyun Cho
cs.IRcs.CLcs.LGarXiv:1901.04085v52019Where Does Authorship Signal Emerge in Encoder-Based Language Models?
Francis Kulumba, Guillaume Vimont, Laurent Romary +1
cs.CLarXiv:2605.19908v22026Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2
cs.CVcs.AIcs.CLarXiv:2605.20158v12026Text Embeddings by Weakly-Supervised Contrastive Pre-training
Liang Wang, Nan Yang, Xiaolong Huang +5
cs.CLcs.IRarXiv:2212.03533v22022LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening
Ming Zhang, Qiyuan Peng, Yinxi Wei +13
cs.CLarXiv:2605.19597v12026From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models
Juncheng Wu, Hardy Chen, Haoqin Tu +6
cs.CLcs.CVarXiv:2605.20177v12026A Survey on Multimodal Large Language Models
Shukang Yin, Chaoyou Fu, Sirui Zhao +4
cs.CVcs.AIcs.CLarXiv:2306.13549v42023On Layer Normalization in the Transformer Architecture
Ruibin Xiong, Yunchang Yang, Di He +7
cs.LGcs.CLstat.MLarXiv:2002.04745v22020LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding
Yushi Bai, Xin Lv, Jiajie Zhang +10
cs.CLarXiv:2308.14508v22023CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis
Erik Nijkamp, Bo Pang, Hiroaki Hayashi +5
cs.LGcs.CLcs.PLarXiv:2203.13474v52022CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation
Shuai Lu, Daya Guo, Shuo Ren +19
cs.SEcs.CLarXiv:2102.04664v22021FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation
Sewon Min, Kalpesh Krishna, Xinxi Lyu +6
cs.CLcs.AIcs.LGarXiv:2305.14251v22023ERNIE: Enhanced Language Representation with Informative Entities
Zhengyan Zhang, Xu Han, Zhiyuan Liu +3
cs.CLarXiv:1905.07129v32019Broadening Access to Transportation Safety Data with Generative AI: A Schema-Grounded Framework for Spatial Natural Language Queries
Mahdi Azhdari, Eric J. Gonzales
cs.CLarXiv:2605.21712v12026Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned
Elena Voita, David Talbot, Fedor Moiseev +2
cs.CLarXiv:1905.09418v22019RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator
Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3
cs.CLarXiv:2605.21748v12026Reflective Prompt Tuning through Language Model Function-Calling
Farima Fatahi Bayat, Moin Aminnaseri, Pouya Pezeshkpour +1
cs.CLarXiv:2605.21781v12026How Far Will They Go? Red-Teaming Online Influence with Large Language Models
Daniel C. Ruiz, Anna Serbina, Ashwin Rao +2
cs.CLcs.AIcs.CYarXiv:2605.22880v12026Incorporating Copying Mechanism in Sequence-to-Sequence Learning
Jiatao Gu, Zhengdong Lu, Hang Li +1
cs.CLcs.AIcs.LGarXiv:1603.06393v32016Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning
Victor Zhong, Caiming Xiong, Richard Socher
cs.CLcs.AIarXiv:1709.00103v72017SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation
Xiaolong Zhou, Yifei Liu, Ziyang Gong +8
cs.CVcs.CLarXiv:2605.22536v22026Transformer Feed-Forward Layers Are Key-Value Memories
Mor Geva, Roei Schuster, Jonathan Berant +1
cs.CLarXiv:2012.14913v22020Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
Aditya Chetan, Eric Cai, Peeyush Kushwaha +5
cs.CVcs.AIcs.CLarXiv:2605.21625v12026Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding
Akira Fukui, Dong Huk Park, Daylen Yang +3
cs.CVcs.AIcs.CLarXiv:1606.01847v32016ACC: Compiling Agent Trajectories for Long-Context Training
Qisheng Su, Zhen Fang, Shiting Huang +8
cs.CLcs.AIarXiv:2605.21850v22026TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation
Hanyu Guo, Jiedong Yang, Chao Chen +3
cs.CLcs.AIcs.LGarXiv:2605.22355v12026Understanding Data Temporality Impact on Large Language Models Pre-training
Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2
cs.CLcs.AIarXiv:2605.22769v22026Learning Word Vectors for 157 Languages
Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2
cs.CLcs.LGarXiv:1802.06893v22018Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
Wenlong Deng, Jiaji Huang, Kaan Ozkara +4
cs.LGcs.CLarXiv:2605.25189v12026Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity
Yao Lu, Max Bartolo, Alastair Moore +2
cs.CLcs.AIarXiv:2104.08786v22021Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey
Bonan Min, Hayley Ross, Elior Sulem +6
cs.CLcs.AIcs.LGarXiv:2111.01243v12021Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
Bo Li, Tianyu Dong, Shaolin Zhu +1
cs.CLcs.AIarXiv:2605.24681v12026Efficient Transformers: A Survey
Yi Tay, Mostafa Dehghani, Dara Bahri +1
cs.LGcs.AIcs.CLarXiv:2009.06732v32020STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media
Liang Xue, Haoyu Liu, Cheng Wang +3
cs.CLcs.AIarXiv:2605.25162v12026OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge
Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1
cs.CVcs.CLarXiv:1906.00067v22019Exploiting Similarities among Languages for Machine Translation
Tomas Mikolov, Quoc V. Le, Ilya Sutskever
cs.CLarXiv:1309.4168v12013XNLI: Evaluating Cross-lingual Sentence Representations
Alexis Conneau, Guillaume Lample, Ruty Rinott +4
cs.CLcs.AIcs.LGarXiv:1809.05053v12018Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference
Sangyun Lee, Sean McLeish, Tom Goldstein +1
cs.CLcs.AIarXiv:2605.26099v32026Advancing Creative Physical Intelligence in Large Multimodal Models
Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10
cs.AIcs.CLcs.LGarXiv:2605.26396v22026Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents
Haoyi Hu, Qirong Lyu, Xianghan Kong +7
cs.CLcs.IRcs.MAarXiv:2605.25971v22026On Faithfulness and Factuality in Abstractive Summarization
Joshua Maynez, Shashi Narayan, Bernd Bohnet +1
cs.CLarXiv:2005.00661v12020A Deep Reinforced Model for Abstractive Summarization
Romain Paulus, Caiming Xiong, Richard Socher
cs.CLarXiv:1705.04304v32017Scaling Language Models: Methods, Analysis & Insights from Training Gopher
Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77
cs.CLcs.AIarXiv:2112.11446v22021Unsupervised Dense Information Retrieval with Contrastive Learning
Gautier Izacard, Mathilde Caron, Lucas Hosseini +4
cs.IRcs.AIcs.CLarXiv:2112.09118v42021Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals
Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech
cs.CLcs.AIarXiv:2605.26045v22026