Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,961 to 10,020 of 11,247
Multimodal Compact Bilinear Pooling for Visual Question Answering and Visual Grounding
Akira Fukui, Dong Huk Park, Daylen Yang +3
cs.CVcs.AIcs.CLarXiv:1606.01847v32016ACC: Compiling Agent Trajectories for Long-Context Training
Qisheng Su, Zhen Fang, Shiting Huang +8
cs.CLcs.AIarXiv:2605.21850v22026TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation
Hanyu Guo, Jiedong Yang, Chao Chen +3
cs.CLcs.AIcs.LGarXiv:2605.22355v12026Understanding Data Temporality Impact on Large Language Models Pre-training
Hippolyte Pilchen, Romain Fabre, Franck Signe Talla +2
cs.CLcs.AIarXiv:2605.22769v22026Learning Word Vectors for 157 Languages
Edouard Grave, Piotr Bojanowski, Prakhar Gupta +2
cs.CLcs.LGarXiv:1802.06893v22018Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
Wenlong Deng, Jiaji Huang, Kaan Ozkara +4
cs.LGcs.CLarXiv:2605.25189v12026Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity
Yao Lu, Max Bartolo, Alastair Moore +2
cs.CLcs.AIarXiv:2104.08786v22021Recent Advances in Natural Language Processing via Large Pre-Trained Language Models: A Survey
Bonan Min, Hayley Ross, Elior Sulem +6
cs.CLcs.AIcs.LGarXiv:2111.01243v12021Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
Bo Li, Tianyu Dong, Shaolin Zhu +1
cs.CLcs.AIarXiv:2605.24681v12026Efficient Transformers: A Survey
Yi Tay, Mostafa Dehghani, Dara Bahri +1
cs.LGcs.AIcs.CLarXiv:2009.06732v32020STREAM: A Data-Centric Framework for Mining High-Value Task-Oriented Dialogues from Streaming Media
Liang Xue, Haoyu Liu, Cheng Wang +3
cs.CLcs.AIarXiv:2605.25162v12026OK-VQA: A Visual Question Answering Benchmark Requiring External Knowledge
Kenneth Marino, Mohammad Rastegari, Ali Farhadi +1
cs.CVcs.CLarXiv:1906.00067v22019Exploiting Similarities among Languages for Machine Translation
Tomas Mikolov, Quoc V. Le, Ilya Sutskever
cs.CLarXiv:1309.4168v12013XNLI: Evaluating Cross-lingual Sentence Representations
Alexis Conneau, Guillaume Lample, Ruty Rinott +4
cs.CLcs.AIcs.LGarXiv:1809.05053v12018Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference
Sangyun Lee, Sean McLeish, Tom Goldstein +1
cs.CLcs.AIarXiv:2605.26099v32026Advancing Creative Physical Intelligence in Large Multimodal Models
Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10
cs.AIcs.CLcs.LGarXiv:2605.26396v22026Anticipate and Learn: Unleashing Idle-Time Compute in Proactive Agents
Haoyi Hu, Qirong Lyu, Xianghan Kong +7
cs.CLcs.IRcs.MAarXiv:2605.25971v22026On Faithfulness and Factuality in Abstractive Summarization
Joshua Maynez, Shashi Narayan, Bernd Bohnet +1
cs.CLarXiv:2005.00661v12020A Deep Reinforced Model for Abstractive Summarization
Romain Paulus, Caiming Xiong, Richard Socher
cs.CLarXiv:1705.04304v32017Scaling Language Models: Methods, Analysis & Insights from Training Gopher
Jack W. Rae, Sebastian Borgeaud, Trevor Cai +77
cs.CLcs.AIarXiv:2112.11446v22021Unsupervised Dense Information Retrieval with Contrastive Learning
Gautier Izacard, Mathilde Caron, Lucas Hosseini +4
cs.IRcs.AIcs.CLarXiv:2112.09118v42021Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals
Federico Torrielli, Peter Schneider-Kamp, Lukas Galke Poech
cs.CLcs.AIarXiv:2605.26045v22026How Can We Know What Language Models Know?
Zhengbao Jiang, Frank F. Xu, Jun Araki +1
cs.CLcs.LGarXiv:1911.12543v22019HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face
Yongliang Shen, Kaitao Song, Xu Tan +3
cs.CLcs.AIcs.CVarXiv:2303.17580v42023AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration
Ji Lin, Jiaming Tang, Haotian Tang +7
cs.CLarXiv:2306.00978v62023Chartographer: Counterfactual Chart Generation for Evaluating Vision-Language Models
Yifan Jiang, Dae Yon Hwang, Jesse C. Cresswell +1
cs.CLcs.CVarXiv:2605.27311v12026COMET: A Neural Framework for MT Evaluation
Ricardo Rei, Craig Stewart, Ana C Farinha +1
cs.CLarXiv:2009.09025v22020Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
Yi Jing, Zao Dai, Jinwu Hu +4
cs.LGcs.AIcs.CLarXiv:2605.27354v12026Triplet-Block Diffusion RWKV
Ke Lin, Yiyang Luo, Zhaolong Su +2
cs.CLarXiv:2605.25969v12026RACE: Large-scale ReAding Comprehension Dataset From Examinations
Guokun Lai, Qizhe Xie, Hanxiao Liu +2
cs.CLcs.AIcs.LGarXiv:1704.04683v52017Neural Network Acceptability Judgments
Alex Warstadt, Amanpreet Singh, Samuel R. Bowman
cs.CLarXiv:1805.12471v32018Text Summarization with Pretrained Encoders
Yang Liu, Mirella Lapata
cs.CLcs.LGarXiv:1908.08345v22019Unified Language Model Pre-training for Natural Language Understanding and Generation
Li Dong, Nan Yang, Wenhui Wang +6
cs.CLarXiv:1905.03197v32019MobileMoE: Scaling On-Device Mixture of Experts
Yanbei Chen, Hanxian Huang, Ernie Chang +5
cs.LGcs.AIcs.CLarXiv:2605.27358v12026Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval
Lee Xiong, Chenyan Xiong, Ye Li +5
cs.IRcs.CLcs.LGarXiv:2007.00808v22020GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints
Joshua Ainslie, James Lee-Thorp, Michiel de Jong +3
cs.CLcs.LGarXiv:2305.13245v32023Model soups: averaging weights of multiple fine-tuned models improves accuracy without increasing inference time
Mitchell Wortsman, Gabriel Ilharco, Samir Yitzhak Gadre +8
cs.LGcs.CLcs.CVarXiv:2203.05482v32022ChatGPT Outperforms Crowd-Workers for Text-Annotation Tasks
Fabrizio Gilardi, Meysam Alizadeh, Maël Kubli
cs.CLcs.CYarXiv:2303.15056v22023MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations
Soujanya Poria, Devamanyu Hazarika, Navonil Majumder +3
cs.CLarXiv:1810.02508v62018M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
Jianlv Chen, Shitao Xiao, Peitian Zhang +3
cs.CLcs.AIcs.LGarXiv:2402.03216v52024Pre-trained Models for Natural Language Processing: A Survey
Xipeng Qiu, Tianxiang Sun, Yige Xu +3
cs.CLcs.LGarXiv:2003.08271v42020A simple neural network module for relational reasoning
Adam Santoro, David Raposo, David G. T. Barrett +4
cs.CLcs.LGarXiv:1706.01427v12017word2vec Explained: deriving Mikolov et al.'s negative-sampling word-embedding method
Yoav Goldberg, Omer Levy
cs.CLcs.LGstat.MLarXiv:1402.3722v12014ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools
Team GLM, :, Aohan Zeng +56
cs.CLarXiv:2406.12793v22024"Liar, Liar Pants on Fire": A New Benchmark Dataset for Fake News Detection
William Yang Wang
cs.CLcs.CYarXiv:1705.00648v12017Character-Aware Neural Language Models
Yoon Kim, Yacine Jernite, David Sontag +1
cs.CLcs.NEstat.MLarXiv:1508.06615v42015ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning
Ahmed Masry, Do Xuan Long, Jia Qing Tan +2
cs.CLarXiv:2203.10244v12022ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations
Jie Zhu, Huaixia Dou, Shuo Jiang +5
cs.CLcs.AIarXiv:2605.27908v12026OmniInteract: Benchmarking Real-World Streaming Interaction for Real-Time Omnimodal Assistants
Xudong Lu, Xueying Li, Annan Wang +8
cs.CVcs.CLarXiv:2605.26485v12026Adversarial Examples for Evaluating Reading Comprehension Systems
Robin Jia, Percy Liang
cs.CLcs.LGarXiv:1707.07328v12017Alignment Tampering: How Reinforcement Learning from Human Feedback Is Exploited to Optimize Misaligned Biases
Dongyoon Hahm, Dylan Hadfield-Menell, Kimin Lee
cs.AIcs.CLcs.LGarXiv:2605.27355v22026Grounded Language-Image Pre-training
Liunian Harold Li, Pengchuan Zhang, Haotian Zhang +9
cs.CVcs.AIcs.CLarXiv:2112.03857v22021ESPnet: End-to-End Speech Processing Toolkit
Shinji Watanabe, Takaaki Hori, Shigeki Karita +9
cs.CLarXiv:1804.00015v12018Revealing Algorithmic Deductive Circuits for Logical Reasoning
Phuong Minh Nguyen, Tien Huu Dang, Naoya Inoue
cs.AIcs.CLarXiv:2605.27824v12026Models That Know How Evaluations Are Designed Score Safer
Katharina Deckenbach, Haritz Puerto, Jonas Geiping +1
cs.CLcs.AIarXiv:2605.28591v32026DialoGPT: Large-Scale Generative Pre-training for Conversational Response Generation
Yizhe Zhang, Siqi Sun, Michel Galley +6
cs.CLcs.LGarXiv:1911.00536v32019How multilingual is Multilingual BERT?
Telmo Pires, Eva Schlinger, Dan Garrette
cs.CLcs.AIcs.LGarXiv:1906.01502v12019PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
Yangyi Huang, Ruotian Peng, Zeju Qiu +4
cs.LGcs.CLarXiv:2605.28819v12026Hierarchical Question-Image Co-Attention for Visual Question Answering
Jiasen Lu, Jianwei Yang, Dhruv Batra +1
cs.CVcs.CLarXiv:1606.00061v52016Experience Makes Skillful: Enabling Generalizable Medical Agent Reasoning via Self-Evolving Skill Memory
Haoran Sun, Wenjie Li, Yujie Zhang +8
cs.AIcs.CLarXiv:2606.09365v32026Summaries:한국어