Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,021 to 10,080 of 11,332
Base Models Look Human To AI Detectors
Yixuan Even Xu, Ziqian Zhong, Aditi Raghunathan +2
cs.CLcs.AIcs.LGarXiv:2605.19516v12026CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning
Dachuan Shi, Hanlin Zhu, Xiangchi Yuan +4
cs.CLcs.AIarXiv:2605.20075v12026Passage Re-ranking with BERT
Rodrigo Nogueira, Kyunghyun Cho
cs.IRcs.CLcs.LGarXiv:1901.04085v52019Where Does Authorship Signal Emerge in Encoder-Based Language Models?
Francis Kulumba, Guillaume Vimont, Laurent Romary +1
cs.CLarXiv:2605.19908v22026Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2
cs.CVcs.AIcs.CLarXiv:2605.20158v12026Text Embeddings by Weakly-Supervised Contrastive Pre-training
Liang Wang, Nan Yang, Xiaolong Huang +5
cs.CLcs.IRarXiv:2212.03533v22022LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening
Ming Zhang, Qiyuan Peng, Yinxi Wei +13
cs.CLarXiv:2605.19597v12026From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models
Juncheng Wu, Hardy Chen, Haoqin Tu +6
cs.CLcs.CVarXiv:2605.20177v12026A Survey on Multimodal Large Language Models
Shukang Yin, Chaoyou Fu, Sirui Zhao +4
cs.CVcs.AIcs.CLarXiv:2306.13549v42023On Layer Normalization in the Transformer Architecture
Ruibin Xiong, Yunchang Yang, Di He +7
cs.LGcs.CLstat.MLarXiv:2002.04745v22020LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding
Yushi Bai, Xin Lv, Jiajie Zhang +10
cs.CLarXiv:2308.14508v22023CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis
Erik Nijkamp, Bo Pang, Hiroaki Hayashi +5
cs.LGcs.CLcs.PLarXiv:2203.13474v52022CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation
Shuai Lu, Daya Guo, Shuo Ren +19
cs.SEcs.CLarXiv:2102.04664v22021FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation
Sewon Min, Kalpesh Krishna, Xinxi Lyu +6
cs.CLcs.AIcs.LGarXiv:2305.14251v22023ERNIE: Enhanced Language Representation with Informative Entities
Zhengyan Zhang, Xu Han, Zhiyuan Liu +3
cs.CLarXiv:1905.07129v32019Broadening Access to Transportation Safety Data with Generative AI: A Schema-Grounded Framework for Spatial Natural Language Queries
Mahdi Azhdari, Eric J. Gonzales
cs.CLarXiv:2605.21712v12026Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned
Elena Voita, David Talbot, Fedor Moiseev +2
cs.CLarXiv:1905.09418v22019RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator
Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3
cs.CLarXiv:2605.21748v12026Reflective Prompt Tuning through Language Model Function-Calling
Farima Fatahi Bayat, Moin Aminnaseri, Pouya Pezeshkpour +1
cs.CLarXiv:2605.21781v12026How Far Will They Go? Red-Teaming Online Influence with Large Language Models
Daniel C. Ruiz, Anna Serbina, Ashwin Rao +2
cs.CLcs.AIcs.CYarXiv:2605.22880v12026Incorporating Copying Mechanism in Sequence-to-Sequence Learning
Jiatao Gu, Zhengdong Lu, Hang Li +1
cs.CLcs.AIcs.LGarXiv:1603.06393v32016Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning
Victor Zhong, Caiming Xiong, Richard Socher
cs.CLcs.AIarXiv:1709.00103v72017SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation
Xiaolong Zhou, Yifei Liu, Ziyang Gong +8
cs.CVcs.CLarXiv:2605.22536v22026Transformer Feed-Forward Layers Are Key-Value Memories
Mor Geva, Roei Schuster, Jonathan Berant +1
cs.CLarXiv:2012.14913v22020Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
Aditya Chetan, Eric Cai, Peeyush Kushwaha +5
cs.CVcs.AIcs.CLarXiv:2605.21625v12026Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding
Akira Fukui, Dong Huk Park, Daylen Yang +3
cs.CVcs.AIcs.CLarXiv:1606.01847v32016ACC: Compiling Agent Trajectories for Long-Context Training
Qisheng Su, Zhen Fang, Shiting Huang +8
cs.CLcs.AIarXiv:2605.21850v22026TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation
Hanyu Guo, Jiedong Yang, Chao Chen +3
cs.CLcs.AIcs.LGarXiv:2605.22355v12026Understanding Data Temporality Impact on Large Language Models Pre-training
Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2
cs.CLcs.AIarXiv:2605.22769v22026Learning Word Vectors for 157 Languages
Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2
cs.CLcs.LGarXiv:1802.06893v22018Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
Wenlong Deng, Jiaji Huang, Kaan Ozkara +4
cs.LGcs.CLarXiv:2605.25189v12026Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity
Yao Lu, Max Bartolo, Alastair Moore +2
cs.CLcs.AIarXiv:2104.08786v22021Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey
Bonan Min, Hayley Ross, Elior Sulem +6
cs.CLcs.AIcs.LGarXiv:2111.01243v12021Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
Bo Li, Tianyu Dong, Shaolin Zhu +1
cs.CLcs.AIarXiv:2605.24681v12026Efficient Transformers: A Survey
Yi Tay, Mostafa Dehghani, Dara Bahri +1
cs.LGcs.AIcs.CLarXiv:2009.06732v32020STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media
Liang Xue, Haoyu Liu, Cheng Wang +3
cs.CLcs.AIarXiv:2605.25162v12026OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge
Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1
cs.CVcs.CLarXiv:1906.00067v22019Exploiting Similarities among Languages for Machine Translation
Tomas Mikolov, Quoc V. Le, Ilya Sutskever
cs.CLarXiv:1309.4168v12013XNLI: Evaluating Cross-lingual Sentence Representations
Alexis Conneau, Guillaume Lample, Ruty Rinott +4
cs.CLcs.AIcs.LGarXiv:1809.05053v12018Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference
Sangyun Lee, Sean McLeish, Tom Goldstein +1
cs.CLcs.AIarXiv:2605.26099v32026Advancing Creative Physical Intelligence in Large Multimodal Models
Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10
cs.AIcs.CLcs.LGarXiv:2605.26396v22026Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents
Haoyi Hu, Qirong Lyu, Xianghan Kong +7
cs.CLcs.IRcs.MAarXiv:2605.25971v22026On Faithfulness and Factuality in Abstractive Summarization
Joshua Maynez, Shashi Narayan, Bernd Bohnet +1
cs.CLarXiv:2005.00661v12020A Deep Reinforced Model for Abstractive Summarization
Romain Paulus, Caiming Xiong, Richard Socher
cs.CLarXiv:1705.04304v32017Scaling Language Models: Methods, Analysis & Insights from Training Gopher
Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77
cs.CLcs.AIarXiv:2112.11446v22021Unsupervised Dense Information Retrieval with Contrastive Learning
Gautier Izacard, Mathilde Caron, Lucas Hosseini +4
cs.IRcs.AIcs.CLarXiv:2112.09118v42021Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals
Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech
cs.CLcs.AIarXiv:2605.26045v22026How Can We Know What Language Models Know?
Zhengbao Jiang, Frank F. Xu, Jun Araki +1
cs.CLcs.LGarXiv:1911.12543v22019HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face
Yongliang Shen, Kaitao Song, Xu Tan +3
cs.CLcs.AIcs.CVarXiv:2303.17580v42023AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration
Ji Lin, Jiaming Tang, Haotian Tang +7
cs.CLarXiv:2306.00978v62023Chartographer: Counterfactual Chart Generation for Evaluating Vision-Language Models
Yifan Jiang, Dae Yon Hwang, Jesse C. Cresswell +1
cs.CLcs.CVarXiv:2605.27311v12026COMET: A Neural Framework for MT Evaluation
Ricardo Rei, Craig Stewart, Ana C Farinha +1
cs.CLarXiv:2009.09025v22020Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
Yi Jing, Zao Dai, Jinwu Hu +4
cs.LGcs.AIcs.CLarXiv:2605.27354v12026Triplet-Block Diffusion RWKV
Ke Lin, Yiyang Luo, Zhaolong Su +2
cs.CLarXiv:2605.25969v12026RACE: Large-scale ReAding Comprehension Dataset From Examinations
Guokun Lai, Qizhe Xie, Hanxiao Liu +2
cs.CLcs.AIcs.LGarXiv:1704.04683v52017Neural Network Acceptability Judgments
Alex Warstadt, Amanpreet Singh, Samuel R. Bowman
cs.CLarXiv:1805.12471v32018Text Summarization with Pretrained Encoders
Yang Liu, Mirella Lapata
cs.CLcs.LGarXiv:1908.08345v22019Unified Language Model Pre-training for Natural Language Understanding and Generation
Li Dong, Nan Yang, Wenhui Wang +6
cs.CLarXiv:1905.03197v32019MobileMoE: Scaling On-Device Mixture of Experts
Yanbei Chen, Hanxian Huang, Ernie Chang +5
cs.LGcs.AIcs.CLarXiv:2605.27358v12026Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval
Lee Xiong, Chenyan Xiong, Ye Li +5
cs.IRcs.CLcs.LGarXiv:2007.00808v22020