Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,021 to 10,080 of 11,332

  1. Base Models Look Human To AI Detectors

    Yixuan Even Xu, Ziqian Zhong, Aditi Raghunathan +2

    cs.CLcs.AIcs.LGarXiv:2605.19516v12026
  2. CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning

    Dachuan Shi, Hanlin Zhu, Xiangchi Yuan +4

    cs.CLcs.AIarXiv:2605.20075v12026
  3. Passage Re-ranking with BERT

    Rodrigo Nogueira, Kyunghyun Cho

    cs.IRcs.CLcs.LGarXiv:1901.04085v52019
  4. Where Does Authorship Signal Emerge in Encoder-Based Language Models?

    Francis Kulumba, Guillaume Vimont, Laurent Romary +1

    cs.CLarXiv:2605.19908v22026
  5. Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models

    Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2

    cs.CVcs.AIcs.CLarXiv:2605.20158v12026
  6. Text Embeddings by Weakly-Supervised Contrastive Pre-training

    Liang Wang, Nan Yang, Xiaolong Huang +5

    cs.CLcs.IRarXiv:2212.03533v22022
  7. LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening

    Ming Zhang, Qiyuan Peng, Yinxi Wei +13

    cs.CLarXiv:2605.19597v12026
  8. From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models

    Juncheng Wu, Hardy Chen, Haoqin Tu +6

    cs.CLcs.CVarXiv:2605.20177v12026
  9. A Survey on Multimodal Large Language Models

    Shukang Yin, Chaoyou Fu, Sirui Zhao +4

    cs.CVcs.AIcs.CLarXiv:2306.13549v42023
  10. On Layer Normalization in the Transformer Architecture

    Ruibin Xiong, Yunchang Yang, Di He +7

    cs.LGcs.CLstat.MLarXiv:2002.04745v22020
  11. LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding

    Yushi Bai, Xin Lv, Jiajie Zhang +10

    cs.CLarXiv:2308.14508v22023
  12. CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis

    Erik Nijkamp, Bo Pang, Hiroaki Hayashi +5

    cs.LGcs.CLcs.PLarXiv:2203.13474v52022
  13. CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation

    Shuai Lu, Daya Guo, Shuo Ren +19

    cs.SEcs.CLarXiv:2102.04664v22021
  14. FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation

    Sewon Min, Kalpesh Krishna, Xinxi Lyu +6

    cs.CLcs.AIcs.LGarXiv:2305.14251v22023
  15. ERNIE: Enhanced Language Representation with Informative Entities

    Zhengyan Zhang, Xu Han, Zhiyuan Liu +3

    cs.CLarXiv:1905.07129v32019
  16. Broadening Access to Transportation Safety Data with Generative AI: A Schema-Grounded Framework for Spatial Natural Language Queries

    Mahdi Azhdari, Eric J. Gonzales

    cs.CLarXiv:2605.21712v12026
  17. Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned

    Elena Voita, David Talbot, Fedor Moiseev +2

    cs.CLarXiv:1905.09418v22019
  18. RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator

    Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3

    cs.CLarXiv:2605.21748v12026
  19. Reflective Prompt Tuning through Language Model Function-Calling

    Farima Fatahi Bayat, Moin Aminnaseri, Pouya Pezeshkpour +1

    cs.CLarXiv:2605.21781v12026
  20. How Far Will They Go? Red-Teaming Online Influence with Large Language Models

    Daniel C. Ruiz, Anna Serbina, Ashwin Rao +2

    cs.CLcs.AIcs.CYarXiv:2605.22880v12026
  21. Incorporating Copying Mechanism in Sequence-to-Sequence Learning

    Jiatao Gu, Zhengdong Lu, Hang Li +1

    cs.CLcs.AIcs.LGarXiv:1603.06393v32016
  22. Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning

    Victor Zhong, Caiming Xiong, Richard Socher

    cs.CLcs.AIarXiv:1709.00103v72017
  23. SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation

    Xiaolong Zhou, Yifei Liu, Ziyang Gong +8

    cs.CVcs.CLarXiv:2605.22536v22026
  24. Transformer Feed-Forward Layers Are Key-Value Memories

    Mor Geva, Roei Schuster, Jonathan Berant +1

    cs.CLarXiv:2012.14913v22020
  25. Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly

    Aditya Chetan, Eric Cai, Peeyush Kushwaha +5

    cs.CVcs.AIcs.CLarXiv:2605.21625v12026
  26. Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding

    Akira Fukui, Dong Huk Park, Daylen Yang +3

    cs.CVcs.AIcs.CLarXiv:1606.01847v32016
  27. ACC: Compiling Agent Trajectories for Long-Context Training

    Qisheng Su, Zhen Fang, Shiting Huang +8

    cs.CLcs.AIarXiv:2605.21850v22026
  28. TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation

    Hanyu Guo, Jiedong Yang, Chao Chen +3

    cs.CLcs.AIcs.LGarXiv:2605.22355v12026
  29. Understanding Data Temporality Impact on Large Language Models Pre-training

    Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2

    cs.CLcs.AIarXiv:2605.22769v22026
  30. Learning Word Vectors for 157 Languages

    Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2

    cs.CLcs.LGarXiv:1802.06893v22018
  31. Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models

    Wenlong Deng, Jiaji Huang, Kaan Ozkara +4

    cs.LGcs.CLarXiv:2605.25189v12026
  32. Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity

    Yao Lu, Max Bartolo, Alastair Moore +2

    cs.CLcs.AIarXiv:2104.08786v22021
  33. Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey

    Bonan Min, Hayley Ross, Elior Sulem +6

    cs.CLcs.AIcs.LGarXiv:2111.01243v12021
  34. Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs

    Bo Li, Tianyu Dong, Shaolin Zhu +1

    cs.CLcs.AIarXiv:2605.24681v12026
  35. Efficient Transformers: A Survey

    Yi Tay, Mostafa Dehghani, Dara Bahri +1

    cs.LGcs.AIcs.CLarXiv:2009.06732v32020
  36. STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media

    Liang Xue, Haoyu Liu, Cheng Wang +3

    cs.CLcs.AIarXiv:2605.25162v12026
  37. OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge

    Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1

    cs.CVcs.CLarXiv:1906.00067v22019
  38. Exploiting Similarities among Languages for Machine Translation

    Tomas Mikolov, Quoc V. Le, Ilya Sutskever

    cs.CLarXiv:1309.4168v12013
  39. XNLI: Evaluating Cross-lingual Sentence Representations

    Alexis Conneau, Guillaume Lample, Ruty Rinott +4

    cs.CLcs.AIcs.LGarXiv:1809.05053v12018
  40. Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference

    Sangyun Lee, Sean McLeish, Tom Goldstein +1

    cs.CLcs.AIarXiv:2605.26099v32026
  41. Advancing Creative Physical Intelligence in Large Multimodal Models

    Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10

    cs.AIcs.CLcs.LGarXiv:2605.26396v22026
  42. Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents

    Haoyi Hu, Qirong Lyu, Xianghan Kong +7

    cs.CLcs.IRcs.MAarXiv:2605.25971v22026
  43. On Faithfulness and Factuality in Abstractive Summarization

    Joshua Maynez, Shashi Narayan, Bernd Bohnet +1

    cs.CLarXiv:2005.00661v12020
  44. A Deep Reinforced Model for Abstractive Summarization

    Romain Paulus, Caiming Xiong, Richard Socher

    cs.CLarXiv:1705.04304v32017
  45. Scaling Language Models: Methods, Analysis & Insights from Training Gopher

    Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77

    cs.CLcs.AIarXiv:2112.11446v22021
  46. Unsupervised Dense Information Retrieval with Contrastive Learning

    Gautier Izacard, Mathilde Caron, Lucas Hosseini +4

    cs.IRcs.AIcs.CLarXiv:2112.09118v42021
  47. Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

    Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech

    cs.CLcs.AIarXiv:2605.26045v22026
  48. How Can We Know What Language Models Know?

    Zhengbao Jiang, Frank F. Xu, Jun Araki +1

    cs.CLcs.LGarXiv:1911.12543v22019
  49. HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face

    Yongliang Shen, Kaitao Song, Xu Tan +3

    cs.CLcs.AIcs.CVarXiv:2303.17580v42023
  50. AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration

    Ji Lin, Jiaming Tang, Haotian Tang +7

    cs.CLarXiv:2306.00978v62023
  51. Chartographer: Counterfactual Chart Generation for Evaluating Vision-Language Models

    Yifan Jiang, Dae Yon Hwang, Jesse C. Cresswell +1

    cs.CLcs.CVarXiv:2605.27311v12026
  52. COMET: A Neural Framework for MT Evaluation

    Ricardo Rei, Craig Stewart, Ana C Farinha +1

    cs.CLarXiv:2009.09025v22020
  53. Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders

    Yi Jing, Zao Dai, Jinwu Hu +4

    cs.LGcs.AIcs.CLarXiv:2605.27354v12026
  54. Triplet-Block Diffusion RWKV

    Ke Lin, Yiyang Luo, Zhaolong Su +2

    cs.CLarXiv:2605.25969v12026
  55. RACE: Large-scale ReAding Comprehension Dataset From Examinations

    Guokun Lai, Qizhe Xie, Hanxiao Liu +2

    cs.CLcs.AIcs.LGarXiv:1704.04683v52017
  56. Neural Network Acceptability Judgments

    Alex Warstadt, Amanpreet Singh, Samuel R. Bowman

    cs.CLarXiv:1805.12471v32018
  57. Text Summarization with Pretrained Encoders

    Yang Liu, Mirella Lapata

    cs.CLcs.LGarXiv:1908.08345v22019
  58. Unified Language Model Pre-training for Natural Language Understanding and Generation

    Li Dong, Nan Yang, Wenhui Wang +6

    cs.CLarXiv:1905.03197v32019
  59. MobileMoE: Scaling On-Device Mixture of Experts

    Yanbei Chen, Hanxian Huang, Ernie Chang +5

    cs.LGcs.AIcs.CLarXiv:2605.27358v12026
  60. Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval

    Lee Xiong, Chenyan Xiong, Ye Li +5

    cs.IRcs.CLcs.LGarXiv:2007.00808v22020