Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,961 to 10,020 of 11,247

  1. Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding

    Akira Fukui, Dong Huk Park, Daylen Yang +3

    cs.CVcs.AIcs.CLarXiv:1606.01847v32016
  2. ACC: Compiling Agent Trajectories for Long-Context Training

    Qisheng Su, Zhen Fang, Shiting Huang +8

    cs.CLcs.AIarXiv:2605.21850v22026
  3. TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation

    Hanyu Guo, Jiedong Yang, Chao Chen +3

    cs.CLcs.AIcs.LGarXiv:2605.22355v12026
  4. Understanding Data Temporality Impact on Large Language Models Pre-training

    Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2

    cs.CLcs.AIarXiv:2605.22769v22026
  5. Learning Word Vectors for 157 Languages

    Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2

    cs.CLcs.LGarXiv:1802.06893v22018
  6. Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models

    Wenlong Deng, Jiaji Huang, Kaan Ozkara +4

    cs.LGcs.CLarXiv:2605.25189v12026
  7. Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity

    Yao Lu, Max Bartolo, Alastair Moore +2

    cs.CLcs.AIarXiv:2104.08786v22021
  8. Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey

    Bonan Min, Hayley Ross, Elior Sulem +6

    cs.CLcs.AIcs.LGarXiv:2111.01243v12021
  9. Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs

    Bo Li, Tianyu Dong, Shaolin Zhu +1

    cs.CLcs.AIarXiv:2605.24681v12026
  10. Efficient Transformers: A Survey

    Yi Tay, Mostafa Dehghani, Dara Bahri +1

    cs.LGcs.AIcs.CLarXiv:2009.06732v32020
  11. STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media

    Liang Xue, Haoyu Liu, Cheng Wang +3

    cs.CLcs.AIarXiv:2605.25162v12026
  12. OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge

    Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1

    cs.CVcs.CLarXiv:1906.00067v22019
  13. Exploiting Similarities among Languages for Machine Translation

    Tomas Mikolov, Quoc V. Le, Ilya Sutskever

    cs.CLarXiv:1309.4168v12013
  14. XNLI: Evaluating Cross-lingual Sentence Representations

    Alexis Conneau, Guillaume Lample, Ruty Rinott +4

    cs.CLcs.AIcs.LGarXiv:1809.05053v12018
  15. Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference

    Sangyun Lee, Sean McLeish, Tom Goldstein +1

    cs.CLcs.AIarXiv:2605.26099v32026
  16. Advancing Creative Physical Intelligence in Large Multimodal Models

    Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10

    cs.AIcs.CLcs.LGarXiv:2605.26396v22026
  17. Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents

    Haoyi Hu, Qirong Lyu, Xianghan Kong +7

    cs.CLcs.IRcs.MAarXiv:2605.25971v22026
  18. On Faithfulness and Factuality in Abstractive Summarization

    Joshua Maynez, Shashi Narayan, Bernd Bohnet +1

    cs.CLarXiv:2005.00661v12020
  19. A Deep Reinforced Model for Abstractive Summarization

    Romain Paulus, Caiming Xiong, Richard Socher

    cs.CLarXiv:1705.04304v32017
  20. Scaling Language Models: Methods, Analysis & Insights from Training Gopher

    Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77

    cs.CLcs.AIarXiv:2112.11446v22021
  21. Unsupervised Dense Information Retrieval with Contrastive Learning

    Gautier Izacard, Mathilde Caron, Lucas Hosseini +4

    cs.IRcs.AIcs.CLarXiv:2112.09118v42021
  22. Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

    Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech

    cs.CLcs.AIarXiv:2605.26045v22026
  23. How Can We Know What Language Models Know?

    Zhengbao Jiang, Frank F. Xu, Jun Araki +1

    cs.CLcs.LGarXiv:1911.12543v22019
  24. HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face

    Yongliang Shen, Kaitao Song, Xu Tan +3

    cs.CLcs.AIcs.CVarXiv:2303.17580v42023
  25. AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration

    Ji Lin, Jiaming Tang, Haotian Tang +7

    cs.CLarXiv:2306.00978v62023
  26. Chartographer: Counterfactual Chart Generation for Evaluating Vision-Language Models

    Yifan Jiang, Dae Yon Hwang, Jesse C. Cresswell +1

    cs.CLcs.CVarXiv:2605.27311v12026
  27. COMET: A Neural Framework for MT Evaluation

    Ricardo Rei, Craig Stewart, Ana C Farinha +1

    cs.CLarXiv:2009.09025v22020
  28. Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders

    Yi Jing, Zao Dai, Jinwu Hu +4

    cs.LGcs.AIcs.CLarXiv:2605.27354v12026
  29. Triplet-Block Diffusion RWKV

    Ke Lin, Yiyang Luo, Zhaolong Su +2

    cs.CLarXiv:2605.25969v12026
  30. RACE: Large-scale ReAding Comprehension Dataset From Examinations

    Guokun Lai, Qizhe Xie, Hanxiao Liu +2

    cs.CLcs.AIcs.LGarXiv:1704.04683v52017
  31. Neural Network Acceptability Judgments

    Alex Warstadt, Amanpreet Singh, Samuel R. Bowman

    cs.CLarXiv:1805.12471v32018
  32. Text Summarization with Pretrained Encoders

    Yang Liu, Mirella Lapata

    cs.CLcs.LGarXiv:1908.08345v22019
  33. Unified Language Model Pre-training for Natural Language Understanding and Generation

    Li Dong, Nan Yang, Wenhui Wang +6

    cs.CLarXiv:1905.03197v32019
  34. MobileMoE: Scaling On-Device Mixture of Experts

    Yanbei Chen, Hanxian Huang, Ernie Chang +5

    cs.LGcs.AIcs.CLarXiv:2605.27358v12026
  35. Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval

    Lee Xiong, Chenyan Xiong, Ye Li +5

    cs.IRcs.CLcs.LGarXiv:2007.00808v22020
  36. GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints

    Joshua Ainslie, James Lee-Thorp, Michiel de Jong +3

    cs.CLcs.LGarXiv:2305.13245v32023
  37. Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time

    Mitchell Wortsman, Gabriel Ilharco, Samir Yitzhak Gadre +8

    cs.LGcs.CLcs.CVarXiv:2203.05482v32022
  38. ChatGPT Outperforms Crowd-Workers for Text-Annotation Tasks

    Fabrizio Gilardi, Meysam Alizadeh, Maël Kubli

    cs.CLcs.CYarXiv:2303.15056v22023
  39. MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations

    Soujanya Poria, Devamanyu Hazarika, Navonil Majumder +3

    cs.CLarXiv:1810.02508v62018
  40. M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation

    Jianlv Chen, Shitao Xiao, Peitian Zhang +3

    cs.CLcs.AIcs.LGarXiv:2402.03216v52024
  41. Pre-trained Models for Natural Language Processing: A Survey

    Xipeng Qiu, Tianxiang Sun, Yige Xu +3

    cs.CLcs.LGarXiv:2003.08271v42020
  42. A simple neural network module for relational reasoning

    Adam Santoro, David Raposo, David G. T. Barrett +4

    cs.CLcs.LGarXiv:1706.01427v12017
  43. word2vec Explained: deriving Mikolov et al.'s negative-sampling word-embedding method

    Yoav Goldberg, Omer Levy

    cs.CLcs.LGstat.MLarXiv:1402.3722v12014
  44. ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

    Team GLM, :, Aohan Zeng +56

    cs.CLarXiv:2406.12793v22024
  45. "Liar, Liar Pants on Fire": A New Benchmark Dataset for Fake News Detection

    William Yang Wang

    cs.CLcs.CYarXiv:1705.00648v12017
  46. Character-Aware Neural Language Models

    Yoon Kim, Yacine Jernite, David Sontag +1

    cs.CLcs.NEstat.MLarXiv:1508.06615v42015
  47. ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning

    Ahmed Masry, Do Xuan Long, Jia Qing Tan +2

    cs.CLarXiv:2203.10244v12022
  48. ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations

    Jie Zhu, Huaixia Dou, Shuo Jiang +5

    cs.CLcs.AIarXiv:2605.27908v12026
  49. OmniInteract: Benchmarking Real-World Streaming Interaction for Real-Time Omnimodal Assistants

    Xudong Lu, Xueying Li, Annan Wang +8

    cs.CVcs.CLarXiv:2605.26485v12026
  50. Adversarial Examples for Evaluating Reading Comprehension Systems

    Robin Jia, Percy Liang

    cs.CLcs.LGarXiv:1707.07328v12017
  51. Alignment Tampering: How Reinforcement Learning from Human Feedback Is Exploited to Optimize Misaligned Biases

    Dongyoon Hahm, Dylan Hadfield-Menell, Kimin Lee

    cs.AIcs.CLcs.LGarXiv:2605.27355v22026
  52. Grounded Language-Image Pre-training

    Liunian Harold Li, Pengchuan Zhang, Haotian Zhang +9

    cs.CVcs.AIcs.CLarXiv:2112.03857v22021
  53. ESPnet: End-to-End Speech Processing Toolkit

    Shinji Watanabe, Takaaki Hori, Shigeki Karita +9

    cs.CLarXiv:1804.00015v12018
  54. Revealing Algorithmic Deductive Circuits for Logical Reasoning

    Phuong Minh Nguyen, Tien Huu Dang, Naoya Inoue

    cs.AIcs.CLarXiv:2605.27824v12026
  55. Models That Know How Evaluations Are Designed Score Safer

    Katharina Deckenbach, Haritz Puerto, Jonas Geiping +1

    cs.CLcs.AIarXiv:2605.28591v32026
  56. DialoGPT: Large-Scale Generative Pre-training for Conversational Response Generation

    Yizhe Zhang, Siqi Sun, Michel Galley +6

    cs.CLcs.LGarXiv:1911.00536v32019
  57. How multilingual is Multilingual BERT?

    Telmo Pires, Eva Schlinger, Dan Garrette

    cs.CLcs.AIcs.LGarXiv:1906.01502v12019
  58. PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective

    Yangyi Huang, Ruotian Peng, Zeju Qiu +4

    cs.LGcs.CLarXiv:2605.28819v12026
  59. Hierarchical Question-Image Co-Attention for Visual Question Answering

    Jiasen Lu, Jianwei Yang, Dhruv Batra +1

    cs.CVcs.CLarXiv:1606.00061v52016
  60. Experience Makes Skillful: Enabling Generalizable Medical Agent Reasoning via Self-Evolving Skill Memory

    Haoran Sun, Wenjie Li, Yujie Zhang +8

    cs.AIcs.CLarXiv:2606.09365v32026
    Summaries:한국어