Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,061 to 6,120 of 11,259

  1. Nested Byte-Level Vocabularies Are Cheap to Deploy and Expensive to Share: A Pre-Registered Negative Result

    Christos Koutsiaris

    cs.CLcs.AIcs.IRarXiv:2608.28151v12026
  2. SimpCue: Cue-Based Prompting for Multilingual Text Simplification

    Mehrzad Tareh, Horacio Saggion, Stefan Bott

    cs.CLcs.AIarXiv:2608.28042v12026
  3. MiME: Multilevel Medical Embedding of Electronic Health Records for Predictive Healthcare

    Edward Choi, Cao Xiao, Walter F. Stewart +1

    cs.LGcs.CLstat.MLarXiv:1810.09593v12018
  4. Towards End-to-End Learning for Dialog State Tracking and Management using Deep Reinforcement Learning

    Tiancheng Zhao, Maxine Eskenazi

    cs.AIcs.CLcs.LGarXiv:1606.02560v22016
  5. Distilling Reasoning Capabilities into Smaller Language Models

    Kumar Shridhar, Alessandro Stolfo, Mrinmaya Sachan

    cs.LGcs.CLarXiv:2212.00193v22022
  6. Chain of Agents: Large Language Models Collaborating on Long-Context Tasks

    Yusen Zhang, Ruoxi Sun, Yanfei Chen +3

    cs.CLarXiv:2406.02818v12024
  7. Re-imagining Algorithmic Fairness in India and Beyond

    Nithya Sambasivan, Erin Arnesen, Ben Hutchinson +2

    cs.CYcs.AIcs.CLarXiv:2101.09995v22021
  8. Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View

    Jintian Zhang, Xin Xu, Ningyu Zhang +3

    cs.CLcs.AIcs.CYarXiv:2310.02124v32023
  9. Why Self-Attention? A Targeted Evaluation of Neural Machine Translation Architectures

    Gongbo Tang, Mathias Müller, Annette Rios +1

    cs.CLarXiv:1808.08946v32018
  10. Emergent Multi-Agent Communication in the Deep Learning Era

    Angeliki Lazaridou, Marco Baroni

    cs.CLcs.AIarXiv:2006.02419v22020
  11. Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting

    Haoyang Huang, Tianyi Tang, Dongdong Zhang +4

    cs.CLarXiv:2305.07004v22023
  12. Ask Me Anything: A simple strategy for prompting language models

    Simran Arora, Avanika Narayan, Mayee F. Chen +6

    cs.CLarXiv:2210.02441v32022
  13. LandingAgent: A Reference-Annotated Dataset and Agentic Generation Framework for Landing Pages

    Injun Baek, HyeongSeok Lee, Yearim Kim +2

    cs.CLcs.AIarXiv:2608.27902v12026
  14. Massively Multilingual Word Embeddings

    Waleed Ammar, George Mulcaire, Yulia Tsvetkov +3

    cs.CLarXiv:1602.01925v22016
  15. Bridging the Gap between Training and Inference for Neural Machine Translation

    Wen Zhang, Yang Feng, Fandong Meng +2

    cs.CLcs.LGstat.MLarXiv:1906.02448v22019
  16. DocBank: A Benchmark Dataset for Document Layout Analysis

    Minghao Li, Yiheng Xu, Lei Cui +4

    cs.CLarXiv:2006.01038v32020
  17. Image-to-Markup Generation with Coarse-to-Fine Attention

    Yuntian Deng, Anssi Kanervisto, Jeffrey Ling +1

    cs.CVcs.CLcs.LGarXiv:1609.04938v22016
  18. PAQ: 65 Million Probably-Asked Questions and What You Can Do With Them

    Patrick Lewis, Yuxiang Wu, Linqing Liu +5

    cs.CLcs.AIcs.LGarXiv:2102.07033v12021
  19. HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs

    Junying Chen, Zhenyang Cai, Ke Ji +5

    cs.CLcs.AIcs.LGarXiv:2412.18925v12024
  20. Monotonic Chunkwise Attention

    Chung-Cheng Chiu, Colin Raffel

    cs.CLstat.MLarXiv:1712.05382v22017
  21. OpenStamp: A Watermark for Open-Source Language Models

    Miroojin Bakshi, Saksham Rastogi, Danish Pruthi

    cs.CLcs.AIcs.LGarXiv:2608.27899v12026
  22. Detecting Online Hate Speech Using Context Aware Models

    Lei Gao, Ruihong Huang

    cs.CLarXiv:1710.07395v22017
  23. Online and Linear-Time Attention by Enforcing Monotonic Alignments

    Colin Raffel, Minh-Thang Luong, Peter J. Liu +2

    cs.LGcs.CLarXiv:1704.00784v22017
  24. First Make It Playable, Then Make It Good: Staged Interaction Learning for Small Dialogue-Game Agents

    Syed Mahbubul Huq, Pranava Madhyastha

    cs.CLcs.AIarXiv:2608.27672v12026
  25. Compositional Failure in Audio-Visual LLMs: Late-Layer Prior Dominance Under Cross-modal Conflict

    Adarsh Sudheer, David Li, Omar Elbanna +3

    cs.CLcs.AIarXiv:2608.27785v12026
  26. Chains of Reasoning over Entities, Relations, and Text using Recurrent Neural Networks

    Rajarshi Das, Arvind Neelakantan, David Belanger +1

    cs.CLarXiv:1607.01426v32016
  27. BinaryBERT: Pushing the Limit of BERT Quantization

    Haoli Bai, Wei Zhang, Lu Hou +6

    cs.CLarXiv:2012.15701v22020
  28. GPT4Graph: Can Large Language Models Understand Graph Structured Data ? An Empirical Evaluation and Benchmarking

    Jiayan Guo, Lun Du, Hengyu Liu +3

    cs.AIcs.CLarXiv:2305.15066v22023
  29. VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos

    Ziyang Wang, Shoubin Yu, Elias Stengel-Eskin +4

    cs.CVcs.AIcs.CLarXiv:2405.19209v32024
  30. InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction

    Xiao Wang, Weikang Zhou, Can Zu +11

    cs.CLcs.AIarXiv:2304.08085v12023
  31. Towards Building the Federated GPT: Federated Instruction Tuning

    Jianyi Zhang, Saeed Vahidian, Martin Kuo +6

    cs.CLcs.DCeess.SYarXiv:2305.05644v22023
  32. Large Language Models Meet NL2Code: A Survey

    Daoguang Zan, Bei Chen, Fengji Zhang +5

    cs.SEcs.AIcs.CLarXiv:2212.09420v22022
  33. Effective Modeling of Encoder-Decoder Architecture for Joint Entity and Relation Extraction

    Tapas Nayak, Hwee Tou Ng

    cs.CLcs.LGarXiv:1911.09886v12019
  34. Semantic Watermarking with Order-Robust Detection over Sub-sentence Units

    Abdulrahman Diaa, Jonathan Petit, Florian Kerschbaum

    cs.CRcs.AIcs.CLarXiv:2608.27666v12026
  35. Knowing Before Answering: Decoding Language Models for Reliable RAG

    Syed Mahbubul Huq, Christopher Child, Tillman Weyde +1

    cs.CLcs.AIarXiv:2608.27661v12026
  36. PubMed 200k RCT: a Dataset for Sequential Sentence Classification in Medical Abstracts

    Franck Dernoncourt, Ji Young Lee

    cs.CLcs.AIstat.MLarXiv:1710.06071v12017
  37. Woodpecker: Hallucination Correction for Multimodal Large Language Models

    Shukang Yin, Chaoyou Fu, Sirui Zhao +7

    cs.CVcs.AIcs.CLarXiv:2310.16045v22023
  38. Generating Datasets with Pretrained Language Models

    Timo Schick, Hinrich Schütze

    cs.CLcs.LGarXiv:2104.07540v32021
  39. XHotpotQA: A Benchmark for Cross-Lingual Knowledge Composition in Multi-Hop Question Answering

    Iman Barati, Arash Ghafouri, Behrouz Minaei-Bidgoli

    cs.CLcs.AIarXiv:2608.27481v12026
  40. A Survey on Rubric-Guided Reinforcement Learning for Language Models

    Zifei Shan, Fangning Shao

    cs.CLcs.AIarXiv:2608.27505v12026
  41. Synthetic QA Corpora Generation with Roundtrip Consistency

    Chris Alberti, Daniel Andor, Emily Pitler +2

    cs.CLarXiv:1906.05416v12019
  42. Tower: An Open Multilingual Large Language Model for Translation-Related Tasks

    Duarte M. Alves, José Pombal, Nuno M. Guerreiro +10

    cs.CLarXiv:2402.17733v12024
  43. Select, Don't Train: The Benefits of Modular Entity Disambiguation with LLM-Based Selection

    Fina Polat, Daniel Daza, Pengyu Zhang +2

    cs.CLcs.AIcs.DBarXiv:2608.27470v12026
  44. PACE: Publisher-Adaptive Content Extraction via Agentic Automation

    Zhanlin Liu, Munirathnam Srikanth

    cs.CLcs.AIarXiv:2608.27466v12026
  45. Speak Foreign Languages with Your Own Voice: Cross-Lingual Neural Codec Language Modeling

    Ziqiang Zhang, Long Zhou, Chengyi Wang +10

    cs.CLcs.AIcs.SDarXiv:2303.03926v12023
  46. Unsupervised Text Style Transfer using Language Models as Discriminators

    Zichao Yang, Zhiting Hu, Chris Dyer +2

    cs.CLarXiv:1805.11749v32018
  47. Trajectory-Level Speculative Decoding for Diffusion Language Models

    Tianxiang Pan, Baitao Gong, Mo Guang +5

    cs.CLcs.AIarXiv:2608.27514v12026
  48. Quantization-Triggered Backdoors in Language Models: Cross-Quantizer Transferability and the Validation--Deployment Gap

    Jacopo Dardini, Claudio Stanzione, Giordano Colò +1

    cs.LGcs.AIcs.CLarXiv:2608.27512v12026
  49. Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models

    Matt Deitke, Christopher Clark, Sangho Lee +47

    cs.CVcs.CLcs.LGarXiv:2409.17146v22024
  50. ParsBERT: Transformer-based Model for Persian Language Understanding

    Mehrdad Farahani, Mohammad Gharachorloo, Marzieh Farahani +1

    cs.CLarXiv:2005.12515v22020
  51. Natural Language Inference over Interaction Space

    Yichen Gong, Heng Luo, Jian Zhang

    cs.CLarXiv:1709.04348v22017
  52. UIC-AIHealth4All at ArchEHR-QA 2026: Answer-First Evidence Grounding for Clinical Question Answering

    Mohammad Arvan, Hossein Haeri, Natalie Parde +1

    cs.CLcs.AIcs.HCarXiv:2608.27467v12026
  53. FewRel 2.0: Towards More Challenging Few-Shot Relation Classification

    Tianyu Gao, Xu Han, Hao Zhu +4

    cs.CLarXiv:1910.07124v12019
  54. Reframing Instructional Prompts to GPTk's Language

    Swaroop Mishra, Daniel Khashabi, Chitta Baral +2

    cs.CLcs.AIcs.LGarXiv:2109.07830v32021
  55. When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI

    Sihan Jia, Oliver Lemon

    cs.AIcs.CLcs.ROarXiv:2608.28518v12026
  56. A Systematic Assessment of Syntactic Generalization in Neural Language Models

    Jennifer Hu, Jon Gauthier, Peng Qian +2

    cs.CLarXiv:2005.03692v22020
  57. Frames: A Corpus for Adding Memory to Goal-Oriented Dialogue Systems

    Layla El Asri, Hannes Schulz, Shikhar Sharma +5

    cs.CLarXiv:1704.00057v22017
  58. The Effect of Emotional Context on Large Language Models' Endorsement of Premature Decisions: Comparing Emotional Vulnerability Across Six Commercial Models

    Cheolho Shin, Yoojin Han, Donghun Shin +1

    cs.CLcs.AIcs.CYarXiv:2608.27465v12026
  59. Sledgehammer or Scalpel? A Fine-grained Adaptive Framework for Implicit Hate Speech

    Han Wang, Yuhu Cheng, Xuesong Wang +1

    cs.CLcs.AIarXiv:2608.27462v12026
  60. MasakhaNER: Named Entity Recognition for African Languages

    David Ifeoluwa Adelani, Jade Abbott, Graham Neubig +58

    cs.CLcs.AIarXiv:2103.11811v22021