Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,901 to 9,960 of 11,225

  1. Process Rewards with Learned Reliability

    Jinyuan Li, Langlin Huang, Chengsong Huang +5

    cs.CLcs.AIcs.LGarXiv:2605.15529v12026
  2. Active Learners as Efficient PRP Rerankers

    Jeremías Figueiredo Paschmann, Juan Kaplan, Francisco Nattero +3

    cs.LGcs.AIcs.CLarXiv:2605.14236v22026
  3. Language Models Don't Always Say What They Think: Unfaithful Explanations in Chain-of-Thought Prompting

    Miles Turpin, Julian Michael, Ethan Perez +1

    cs.CLcs.AIarXiv:2305.04388v22023
  4. Large Language Models Are Human-Level Prompt Engineers

    Yongchao Zhou, Andrei Ioan Muresanu, Ziwen Han +4

    cs.LGcs.AIcs.CLarXiv:2211.01910v22022
  5. PaLM 2 Technical Report

    Rohan Anil, Andrew M. Dai, Orhan Firat +125

    cs.CLcs.AIarXiv:2305.10403v32023
  6. Context Memorization for Efficient Long Context Generation

    Yasuyuki Okoshi, Hao Mark Chen, Guanxi Lu +3

    cs.CLcs.AIarXiv:2605.18226v12026
  7. DailyDialog: A Manually Labelled Multi-turn Dialogue Dataset

    Yanran Li, Hui Su, Xiaoyu Shen +3

    cs.CLarXiv:1710.03957v12017
  8. A Survey of Transformers

    Tianyang Lin, Yuxin Wang, Xiangyang Liu +1

    cs.LGcs.AIcs.CLarXiv:2106.04554v22021
  9. Natural Language Processing: State of The Art, Current Trends and Challenges

    Diksha Khurana, Aditya Koli, Kiran Khatter +1

    cs.CLarXiv:1708.05148v12017
  10. Post-Trained MoE Can Skip Half Experts via Self-Distillation

    Xingtai Lv, Li Sheng, Kaiyan Zhang +12

    cs.LGcs.AIcs.CLarXiv:2605.18643v22026
  11. MultiWOZ -- A Large-Scale Multi-Domain Wizard-of-Oz Dataset for Task-Oriented Dialogue Modelling

    Paweł Budzianowski, Tsung-Hsien Wen, Bo-Hsiang Tseng +4

    cs.CLarXiv:1810.00278v32018
  12. Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps

    Xanh Ho, Anh-Khoa Duong Nguyen, Saku Sugawara +1

    cs.CLarXiv:2011.01060v22020
  13. Learn-by-Wire Training Control Governance: Bounded Autonomous Training Under Stress for Stability and Efficiency

    Anis Radianis

    cs.AIcs.CLcs.LGarXiv:2605.19008v12026
  14. Base Models Look Human To AI Detectors

    Yixuan Even Xu, Ziqian Zhong, Aditi Raghunathan +2

    cs.CLcs.AIcs.LGarXiv:2605.19516v12026
  15. CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning

    Dachuan Shi, Hanlin Zhu, Xiangchi Yuan +4

    cs.CLcs.AIarXiv:2605.20075v12026
  16. Passage Re-ranking with BERT

    Rodrigo Nogueira, Kyunghyun Cho

    cs.IRcs.CLcs.LGarXiv:1901.04085v52019
  17. Where Does Authorship Signal Emerge in Encoder-Based Language Models?

    Francis Kulumba, Guillaume Vimont, Laurent Romary +1

    cs.CLarXiv:2605.19908v22026
  18. Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models

    Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2

    cs.CVcs.AIcs.CLarXiv:2605.20158v12026
  19. Text Embeddings by Weakly-Supervised Contrastive Pre-training

    Liang Wang, Nan Yang, Xiaolong Huang +5

    cs.CLcs.IRarXiv:2212.03533v22022
  20. LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening

    Ming Zhang, Qiyuan Peng, Yinxi Wei +13

    cs.CLarXiv:2605.19597v12026
  21. From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models

    Juncheng Wu, Hardy Chen, Haoqin Tu +6

    cs.CLcs.CVarXiv:2605.20177v12026
  22. A Survey on Multimodal Large Language Models

    Shukang Yin, Chaoyou Fu, Sirui Zhao +4

    cs.CVcs.AIcs.CLarXiv:2306.13549v42023
  23. On Layer Normalization in the Transformer Architecture

    Ruibin Xiong, Yunchang Yang, Di He +7

    cs.LGcs.CLstat.MLarXiv:2002.04745v22020
  24. LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding

    Yushi Bai, Xin Lv, Jiajie Zhang +10

    cs.CLarXiv:2308.14508v22023
  25. CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis

    Erik Nijkamp, Bo Pang, Hiroaki Hayashi +5

    cs.LGcs.CLcs.PLarXiv:2203.13474v52022
  26. CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation

    Shuai Lu, Daya Guo, Shuo Ren +19

    cs.SEcs.CLarXiv:2102.04664v22021
  27. FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation

    Sewon Min, Kalpesh Krishna, Xinxi Lyu +6

    cs.CLcs.AIcs.LGarXiv:2305.14251v22023
  28. ERNIE: Enhanced Language Representation with Informative Entities

    Zhengyan Zhang, Xu Han, Zhiyuan Liu +3

    cs.CLarXiv:1905.07129v32019
  29. Broadening Access to Transportation Safety Data with Generative AI: A Schema-Grounded Framework for Spatial Natural Language Queries

    Mahdi Azhdari, Eric J. Gonzales

    cs.CLarXiv:2605.21712v12026
  30. Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned

    Elena Voita, David Talbot, Fedor Moiseev +2

    cs.CLarXiv:1905.09418v22019
  31. RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator

    Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3

    cs.CLarXiv:2605.21748v12026
  32. Reflective Prompt Tuning through Language Model Function-Calling

    Farima Fatahi Bayat, Moin Aminnaseri, Pouya Pezeshkpour +1

    cs.CLarXiv:2605.21781v12026
  33. How Far Will They Go? Red-Teaming Online Influence with Large Language Models

    Daniel C. Ruiz, Anna Serbina, Ashwin Rao +2

    cs.CLcs.AIcs.CYarXiv:2605.22880v12026
  34. Incorporating Copying Mechanism in Sequence-to-Sequence Learning

    Jiatao Gu, Zhengdong Lu, Hang Li +1

    cs.CLcs.AIcs.LGarXiv:1603.06393v32016
  35. Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning

    Victor Zhong, Caiming Xiong, Richard Socher

    cs.CLcs.AIarXiv:1709.00103v72017
  36. SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation

    Xiaolong Zhou, Yifei Liu, Ziyang Gong +8

    cs.CVcs.CLarXiv:2605.22536v22026
  37. Transformer Feed-Forward Layers Are Key-Value Memories

    Mor Geva, Roei Schuster, Jonathan Berant +1

    cs.CLarXiv:2012.14913v22020
  38. Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly

    Aditya Chetan, Eric Cai, Peeyush Kushwaha +5

    cs.CVcs.AIcs.CLarXiv:2605.21625v12026
  39. Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding

    Akira Fukui, Dong Huk Park, Daylen Yang +3

    cs.CVcs.AIcs.CLarXiv:1606.01847v32016
  40. ACC: Compiling Agent Trajectories for Long-Context Training

    Qisheng Su, Zhen Fang, Shiting Huang +8

    cs.CLcs.AIarXiv:2605.21850v22026
  41. TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation

    Hanyu Guo, Jiedong Yang, Chao Chen +3

    cs.CLcs.AIcs.LGarXiv:2605.22355v12026
  42. Understanding Data Temporality Impact on Large Language Models Pre-training

    Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2

    cs.CLcs.AIarXiv:2605.22769v22026
  43. Learning Word Vectors for 157 Languages

    Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2

    cs.CLcs.LGarXiv:1802.06893v22018
  44. Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models

    Wenlong Deng, Jiaji Huang, Kaan Ozkara +4

    cs.LGcs.CLarXiv:2605.25189v12026
  45. Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity

    Yao Lu, Max Bartolo, Alastair Moore +2

    cs.CLcs.AIarXiv:2104.08786v22021
  46. Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey

    Bonan Min, Hayley Ross, Elior Sulem +6

    cs.CLcs.AIcs.LGarXiv:2111.01243v12021
  47. Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs

    Bo Li, Tianyu Dong, Shaolin Zhu +1

    cs.CLcs.AIarXiv:2605.24681v12026
  48. Efficient Transformers: A Survey

    Yi Tay, Mostafa Dehghani, Dara Bahri +1

    cs.LGcs.AIcs.CLarXiv:2009.06732v32020
  49. STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media

    Liang Xue, Haoyu Liu, Cheng Wang +3

    cs.CLcs.AIarXiv:2605.25162v12026
  50. OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge

    Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1

    cs.CVcs.CLarXiv:1906.00067v22019
  51. Exploiting Similarities among Languages for Machine Translation

    Tomas Mikolov, Quoc V. Le, Ilya Sutskever

    cs.CLarXiv:1309.4168v12013
  52. XNLI: Evaluating Cross-lingual Sentence Representations

    Alexis Conneau, Guillaume Lample, Ruty Rinott +4

    cs.CLcs.AIcs.LGarXiv:1809.05053v12018
  53. Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference

    Sangyun Lee, Sean McLeish, Tom Goldstein +1

    cs.CLcs.AIarXiv:2605.26099v32026
  54. Advancing Creative Physical Intelligence in Large Multimodal Models

    Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10

    cs.AIcs.CLcs.LGarXiv:2605.26396v22026
  55. Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents

    Haoyi Hu, Qirong Lyu, Xianghan Kong +7

    cs.CLcs.IRcs.MAarXiv:2605.25971v22026
  56. On Faithfulness and Factuality in Abstractive Summarization

    Joshua Maynez, Shashi Narayan, Bernd Bohnet +1

    cs.CLarXiv:2005.00661v12020
  57. A Deep Reinforced Model for Abstractive Summarization

    Romain Paulus, Caiming Xiong, Richard Socher

    cs.CLarXiv:1705.04304v32017
  58. Scaling Language Models: Methods, Analysis & Insights from Training Gopher

    Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77

    cs.CLcs.AIarXiv:2112.11446v22021
  59. Unsupervised Dense Information Retrieval with Contrastive Learning

    Gautier Izacard, Mathilde Caron, Lucas Hosseini +4

    cs.IRcs.AIcs.CLarXiv:2112.09118v42021
  60. Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

    Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech

    cs.CLcs.AIarXiv:2605.26045v22026