Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,061 to 6,120 of 11,259
Nested Byte-Level Vocabularies Are Cheap to Deploy and Expensive to Share: A Pre-Registered Negative Result
Christos Koutsiaris
cs.CLcs.AIcs.IRarXiv:2608.28151v12026SimpCue: Cue-Based Prompting for Multilingual Text Simplification
Mehrzad Tareh, Horacio Saggion, Stefan Bott
cs.CLcs.AIarXiv:2608.28042v12026MiME: Multilevel Medical Embedding of Electronic Health Records for Predictive Healthcare
Edward Choi, Cao Xiao, Walter F. Stewart +1
cs.LGcs.CLstat.MLarXiv:1810.09593v12018Towards End-to-End Learning for Dialog State Tracking and Management using Deep Reinforcement Learning
Tiancheng Zhao, Maxine Eskenazi
cs.AIcs.CLcs.LGarXiv:1606.02560v22016Distilling Reasoning Capabilities into Smaller Language Models
Kumar Shridhar, Alessandro Stolfo, Mrinmaya Sachan
cs.LGcs.CLarXiv:2212.00193v22022Chain of Agents: Large Language Models Collaborating on Long-Context Tasks
Yusen Zhang, Ruoxi Sun, Yanfei Chen +3
cs.CLarXiv:2406.02818v12024Re-imagining Algorithmic Fairness in India and Beyond
Nithya Sambasivan, Erin Arnesen, Ben Hutchinson +2
cs.CYcs.AIcs.CLarXiv:2101.09995v22021Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View
Jintian Zhang, Xin Xu, Ningyu Zhang +3
cs.CLcs.AIcs.CYarXiv:2310.02124v32023Why Self-Attention? A Targeted Evaluation of Neural Machine Translation Architectures
Gongbo Tang, Mathias Müller, Annette Rios +1
cs.CLarXiv:1808.08946v32018Emergent Multi-Agent Communication in the Deep Learning Era
Angeliki Lazaridou, Marco Baroni
cs.CLcs.AIarXiv:2006.02419v22020Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting
Haoyang Huang, Tianyi Tang, Dongdong Zhang +4
cs.CLarXiv:2305.07004v22023Ask Me Anything: A simple strategy for prompting language models
Simran Arora, Avanika Narayan, Mayee F. Chen +6
cs.CLarXiv:2210.02441v32022LandingAgent: A Reference-Annotated Dataset and Agentic Generation Framework for Landing Pages
Injun Baek, HyeongSeok Lee, Yearim Kim +2
cs.CLcs.AIarXiv:2608.27902v12026Massively Multilingual Word Embeddings
Waleed Ammar, George Mulcaire, Yulia Tsvetkov +3
cs.CLarXiv:1602.01925v22016Bridging the Gap between Training and Inference for Neural Machine Translation
Wen Zhang, Yang Feng, Fandong Meng +2
cs.CLcs.LGstat.MLarXiv:1906.02448v22019DocBank: A Benchmark Dataset for Document Layout Analysis
Minghao Li, Yiheng Xu, Lei Cui +4
cs.CLarXiv:2006.01038v32020Image-to-Markup Generation with Coarse-to-Fine Attention
Yuntian Deng, Anssi Kanervisto, Jeffrey Ling +1
cs.CVcs.CLcs.LGarXiv:1609.04938v22016PAQ: 65 Million Probably-Asked Questions and What You Can Do With Them
Patrick Lewis, Yuxiang Wu, Linqing Liu +5
cs.CLcs.AIcs.LGarXiv:2102.07033v12021HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs
Junying Chen, Zhenyang Cai, Ke Ji +5
cs.CLcs.AIcs.LGarXiv:2412.18925v12024Monotonic Chunkwise Attention
Chung-Cheng Chiu, Colin Raffel
cs.CLstat.MLarXiv:1712.05382v22017OpenStamp: A Watermark for Open-Source Language Models
Miroojin Bakshi, Saksham Rastogi, Danish Pruthi
cs.CLcs.AIcs.LGarXiv:2608.27899v12026Detecting Online Hate Speech Using Context Aware Models
Lei Gao, Ruihong Huang
cs.CLarXiv:1710.07395v22017Online and Linear-Time Attention by Enforcing Monotonic Alignments
Colin Raffel, Minh-Thang Luong, Peter J. Liu +2
cs.LGcs.CLarXiv:1704.00784v22017First Make It Playable, Then Make It Good: Staged Interaction Learning for Small Dialogue-Game Agents
Syed Mahbubul Huq, Pranava Madhyastha
cs.CLcs.AIarXiv:2608.27672v12026Compositional Failure in Audio-Visual LLMs: Late-Layer Prior Dominance Under Cross-modal Conflict
Adarsh Sudheer, David Li, Omar Elbanna +3
cs.CLcs.AIarXiv:2608.27785v12026Chains of Reasoning over Entities, Relations, and Text using Recurrent Neural Networks
Rajarshi Das, Arvind Neelakantan, David Belanger +1
cs.CLarXiv:1607.01426v32016BinaryBERT: Pushing the Limit of BERT Quantization
Haoli Bai, Wei Zhang, Lu Hou +6
cs.CLarXiv:2012.15701v22020GPT4Graph: Can Large Language Models Understand Graph Structured Data ? An Empirical Evaluation and Benchmarking
Jiayan Guo, Lun Du, Hengyu Liu +3
cs.AIcs.CLarXiv:2305.15066v22023VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos
Ziyang Wang, Shoubin Yu, Elias Stengel-Eskin +4
cs.CVcs.AIcs.CLarXiv:2405.19209v32024InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction
Xiao Wang, Weikang Zhou, Can Zu +11
cs.CLcs.AIarXiv:2304.08085v12023Towards Building the Federated GPT: Federated Instruction Tuning
Jianyi Zhang, Saeed Vahidian, Martin Kuo +6
cs.CLcs.DCeess.SYarXiv:2305.05644v22023Large Language Models Meet NL2Code: A Survey
Daoguang Zan, Bei Chen, Fengji Zhang +5
cs.SEcs.AIcs.CLarXiv:2212.09420v22022Effective Modeling of Encoder-Decoder Architecture for Joint Entity and Relation Extraction
Tapas Nayak, Hwee Tou Ng
cs.CLcs.LGarXiv:1911.09886v12019Semantic Watermarking with Order-Robust Detection over Sub-sentence Units
Abdulrahman Diaa, Jonathan Petit, Florian Kerschbaum
cs.CRcs.AIcs.CLarXiv:2608.27666v12026Knowing Before Answering: Decoding Language Models for Reliable RAG
Syed Mahbubul Huq, Christopher Child, Tillman Weyde +1
cs.CLcs.AIarXiv:2608.27661v12026PubMed 200k RCT: a Dataset for Sequential Sentence Classification in Medical Abstracts
Franck Dernoncourt, Ji Young Lee
cs.CLcs.AIstat.MLarXiv:1710.06071v12017Woodpecker: Hallucination Correction for Multimodal Large Language Models
Shukang Yin, Chaoyou Fu, Sirui Zhao +7
cs.CVcs.AIcs.CLarXiv:2310.16045v22023Generating Datasets with Pretrained Language Models
Timo Schick, Hinrich Schütze
cs.CLcs.LGarXiv:2104.07540v32021XHotpotQA: A Benchmark for Cross-Lingual Knowledge Composition in Multi-Hop Question Answering
Iman Barati, Arash Ghafouri, Behrouz Minaei-Bidgoli
cs.CLcs.AIarXiv:2608.27481v12026A Survey on Rubric-Guided Reinforcement Learning for Language Models
Zifei Shan, Fangning Shao
cs.CLcs.AIarXiv:2608.27505v12026Synthetic QA Corpora Generation with Roundtrip Consistency
Chris Alberti, Daniel Andor, Emily Pitler +2
cs.CLarXiv:1906.05416v12019Tower: An Open Multilingual Large Language Model for Translation-Related Tasks
Duarte M. Alves, José Pombal, Nuno M. Guerreiro +10
cs.CLarXiv:2402.17733v12024Select, Don't Train: The Benefits of Modular Entity Disambiguation with LLM-Based Selection
Fina Polat, Daniel Daza, Pengyu Zhang +2
cs.CLcs.AIcs.DBarXiv:2608.27470v12026PACE: Publisher-Adaptive Content Extraction via Agentic Automation
Zhanlin Liu, Munirathnam Srikanth
cs.CLcs.AIarXiv:2608.27466v12026Speak Foreign Languages with Your Own Voice: Cross-Lingual Neural Codec Language Modeling
Ziqiang Zhang, Long Zhou, Chengyi Wang +10
cs.CLcs.AIcs.SDarXiv:2303.03926v12023Unsupervised Text Style Transfer using Language Models as Discriminators
Zichao Yang, Zhiting Hu, Chris Dyer +2
cs.CLarXiv:1805.11749v32018Trajectory-Level Speculative Decoding for Diffusion Language Models
Tianxiang Pan, Baitao Gong, Mo Guang +5
cs.CLcs.AIarXiv:2608.27514v12026Quantization-Triggered Backdoors in Language Models: Cross-Quantizer Transferability and the Validation--Deployment Gap
Jacopo Dardini, Claudio Stanzione, Giordano Colò +1
cs.LGcs.AIcs.CLarXiv:2608.27512v12026Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models
Matt Deitke, Christopher Clark, Sangho Lee +47
cs.CVcs.CLcs.LGarXiv:2409.17146v22024ParsBERT: Transformer-based Model for Persian Language Understanding
Mehrdad Farahani, Mohammad Gharachorloo, Marzieh Farahani +1
cs.CLarXiv:2005.12515v22020Natural Language Inference over Interaction Space
Yichen Gong, Heng Luo, Jian Zhang
cs.CLarXiv:1709.04348v22017UIC-AIHealth4All at ArchEHR-QA 2026: Answer-First Evidence Grounding for Clinical Question Answering
Mohammad Arvan, Hossein Haeri, Natalie Parde +1
cs.CLcs.AIcs.HCarXiv:2608.27467v12026FewRel 2.0: Towards More Challenging Few-Shot Relation Classification
Tianyu Gao, Xu Han, Hao Zhu +4
cs.CLarXiv:1910.07124v12019Reframing Instructional Prompts to GPTk's Language
Swaroop Mishra, Daniel Khashabi, Chitta Baral +2
cs.CLcs.AIcs.LGarXiv:2109.07830v32021When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI
Sihan Jia, Oliver Lemon
cs.AIcs.CLcs.ROarXiv:2608.28518v12026A Systematic Assessment of Syntactic Generalization in Neural Language Models
Jennifer Hu, Jon Gauthier, Peng Qian +2
cs.CLarXiv:2005.03692v22020Frames: A Corpus for Adding Memory to Goal-Oriented Dialogue Systems
Layla El Asri, Hannes Schulz, Shikhar Sharma +5
cs.CLarXiv:1704.00057v22017The Effect of Emotional Context on Large Language Models' Endorsement of Premature Decisions: Comparing Emotional Vulnerability Across Six Commercial Models
Cheolho Shin, Yoojin Han, Donghun Shin +1
cs.CLcs.AIcs.CYarXiv:2608.27465v12026Sledgehammer or Scalpel? A Fine-grained Adaptive Framework for Implicit Hate Speech
Han Wang, Yuhu Cheng, Xuesong Wang +1
cs.CLcs.AIarXiv:2608.27462v12026MasakhaNER: Named Entity Recognition for African Languages
David Ifeoluwa Adelani, Jade Abbott, Graham Neubig +58
cs.CLcs.AIarXiv:2103.11811v22021