Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,121 to 6,180 of 11,291

  1. VideoTree: Adaptive Tree-based Video Representation for LLM Reasoning on Long Videos

    Ziyang Wang, Shoubin Yu, Elias Stengel-Eskin +4

    cs.CVcs.AIcs.CLarXiv:2405.19209v32024
  2. InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction

    Xiao Wang, Weikang Zhou, Can Zu +11

    cs.CLcs.AIarXiv:2304.08085v12023
  3. Towards Building the Federated GPT: Federated Instruction Tuning

    Jianyi Zhang, Saeed Vahidian, Martin Kuo +6

    cs.CLcs.DCeess.SYarXiv:2305.05644v22023
  4. Large Language Models Meet NL2Code: A Survey

    Daoguang Zan, Bei Chen, Fengji Zhang +5

    cs.SEcs.AIcs.CLarXiv:2212.09420v22022
  5. Effective Modeling of Encoder-Decoder Architecture for Joint Entity and Relation Extraction

    Tapas Nayak, Hwee Tou Ng

    cs.CLcs.LGarXiv:1911.09886v12019
  6. Semantic Watermarking with Order-Robust Detection over Sub-sentence Units

    Abdulrahman Diaa, Jonathan Petit, Florian Kerschbaum

    cs.CRcs.AIcs.CLarXiv:2608.27666v12026
  7. Knowing Before Answering: Decoding Language Models for Reliable RAG

    Syed Mahbubul Huq, Christopher Child, Tillman Weyde +1

    cs.CLcs.AIarXiv:2608.27661v12026
  8. PubMed 200k RCT: a Dataset for Sequential Sentence Classification in Medical Abstracts

    Franck Dernoncourt, Ji Young Lee

    cs.CLcs.AIstat.MLarXiv:1710.06071v12017
  9. Woodpecker: Hallucination Correction for Multimodal Large Language Models

    Shukang Yin, Chaoyou Fu, Sirui Zhao +7

    cs.CVcs.AIcs.CLarXiv:2310.16045v22023
  10. Generating Datasets with Pretrained Language Models

    Timo Schick, Hinrich Schütze

    cs.CLcs.LGarXiv:2104.07540v32021
  11. XHotpotQA: A Benchmark for Cross-Lingual Knowledge Composition in Multi-Hop Question Answering

    Iman Barati, Arash Ghafouri, Behrouz Minaei-Bidgoli

    cs.CLcs.AIarXiv:2608.27481v12026
  12. A Survey on Rubric-Guided Reinforcement Learning for Language Models

    Zifei Shan, Fangning Shao

    cs.CLcs.AIarXiv:2608.27505v12026
  13. Synthetic QA Corpora Generation with Roundtrip Consistency

    Chris Alberti, Daniel Andor, Emily Pitler +2

    cs.CLarXiv:1906.05416v12019
  14. Tower: An Open Multilingual Large Language Model for Translation-Related Tasks

    Duarte M. Alves, José Pombal, Nuno M. Guerreiro +10

    cs.CLarXiv:2402.17733v12024
  15. Select, Don't Train: The Benefits of Modular Entity Disambiguation with LLM-Based Selection

    Fina Polat, Daniel Daza, Pengyu Zhang +2

    cs.CLcs.AIcs.DBarXiv:2608.27470v12026
  16. PACE: Publisher-Adaptive Content Extraction via Agentic Automation

    Zhanlin Liu, Munirathnam Srikanth

    cs.CLcs.AIarXiv:2608.27466v12026
  17. Speak Foreign Languages with Your Own Voice: Cross-Lingual Neural Codec Language Modeling

    Ziqiang Zhang, Long Zhou, Chengyi Wang +10

    cs.CLcs.AIcs.SDarXiv:2303.03926v12023
  18. Unsupervised Text Style Transfer using Language Models as Discriminators

    Zichao Yang, Zhiting Hu, Chris Dyer +2

    cs.CLarXiv:1805.11749v32018
  19. Trajectory-Level Speculative Decoding for Diffusion Language Models

    Tianxiang Pan, Baitao Gong, Mo Guang +5

    cs.CLcs.AIarXiv:2608.27514v12026
  20. Quantization-Triggered Backdoors in Language Models: Cross-Quantizer Transferability and the Validation--Deployment Gap

    Jacopo Dardini, Claudio Stanzione, Giordano Colò +1

    cs.LGcs.AIcs.CLarXiv:2608.27512v12026
  21. Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models

    Matt Deitke, Christopher Clark, Sangho Lee +47

    cs.CVcs.CLcs.LGarXiv:2409.17146v22024
  22. ParsBERT: Transformer-based Model for Persian Language Understanding

    Mehrdad Farahani, Mohammad Gharachorloo, Marzieh Farahani +1

    cs.CLarXiv:2005.12515v22020
  23. Natural Language Inference over Interaction Space

    Yichen Gong, Heng Luo, Jian Zhang

    cs.CLarXiv:1709.04348v22017
  24. UIC-AIHealth4All at ArchEHR-QA 2026: Answer-First Evidence Grounding for Clinical Question Answering

    Mohammad Arvan, Hossein Haeri, Natalie Parde +1

    cs.CLcs.AIcs.HCarXiv:2608.27467v12026
  25. FewRel 2.0: Towards More Challenging Few-Shot Relation Classification

    Tianyu Gao, Xu Han, Hao Zhu +4

    cs.CLarXiv:1910.07124v12019
  26. Reframing Instructional Prompts to GPTk's Language

    Swaroop Mishra, Daniel Khashabi, Chitta Baral +2

    cs.CLcs.AIcs.LGarXiv:2109.07830v32021
  27. When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI

    Sihan Jia, Oliver Lemon

    cs.AIcs.CLcs.ROarXiv:2608.28518v12026
  28. A Systematic Assessment of Syntactic Generalization in Neural Language Models

    Jennifer Hu, Jon Gauthier, Peng Qian +2

    cs.CLarXiv:2005.03692v22020
  29. Frames: A Corpus for Adding Memory to Goal-Oriented Dialogue Systems

    Layla El Asri, Hannes Schulz, Shikhar Sharma +5

    cs.CLarXiv:1704.00057v22017
  30. The Effect of Emotional Context on Large Language Models' Endorsement of Premature Decisions: Comparing Emotional Vulnerability Across Six Commercial Models

    Cheolho Shin, Yoojin Han, Donghun Shin +1

    cs.CLcs.AIcs.CYarXiv:2608.27465v12026
  31. Sledgehammer or Scalpel? A Fine-grained Adaptive Framework for Implicit Hate Speech

    Han Wang, Yuhu Cheng, Xuesong Wang +1

    cs.CLcs.AIarXiv:2608.27462v12026
  32. MasakhaNER: Named Entity Recognition for African Languages

    David Ifeoluwa Adelani, Jade Abbott, Graham Neubig +58

    cs.CLcs.AIarXiv:2103.11811v22021
  33. Graph-based Neural Multi-Document Summarization

    Michihiro Yasunaga, Rui Zhang, Kshitijh Meelu +3

    cs.CLcs.LGarXiv:1706.06681v32017
  34. Quark: Controllable Text Generation with Reinforced Unlearning

    Ximing Lu, Sean Welleck, Jack Hessel +5

    cs.CLcs.LGarXiv:2205.13636v22022
  35. DiffCSE: Difference-based Contrastive Learning for Sentence Embeddings

    Yung-Sung Chuang, Rumen Dangovski, Hongyin Luo +7

    cs.CLarXiv:2204.10298v12022
  36. PRGC: Potential Relation and Global Correspondence Based Joint Relational Triple Extraction

    Hengyi Zheng, Rui Wen, Xi Chen +7

    cs.CLarXiv:2106.09895v12021
  37. LABR: A Large Scale Arabic Sentiment Analysis Benchmark

    Mahmoud Nabil, Mohamed Aly, Amir Atiya

    cs.CLcs.LGarXiv:1411.6718v22014
  38. GlossBERT: BERT for Word Sense Disambiguation with Gloss Knowledge

    Luyao Huang, Chi Sun, Xipeng Qiu +1

    cs.CLarXiv:1908.07245v42019
  39. "I think this is the most disruptive technology": Exploring Sentiments of ChatGPT Early Adopters using Twitter Data

    Mubin Ul Haque, Isuru Dharmadasa, Zarrin Tasnim Sworna +2

    cs.CLarXiv:2212.05856v12022
  40. COIL: Revisit Exact Lexical Match in Information Retrieval with Contextualized Inverted List

    Luyu Gao, Zhuyun Dai, Jamie Callan

    cs.IRcs.CLarXiv:2104.07186v12021
  41. Modifying Memories in Transformer Models

    Chen Zhu, Ankit Singh Rawat, Manzil Zaheer +4

    cs.CLcs.LGarXiv:2012.00363v12020
  42. ProcessBench: Identifying Process Errors in Mathematical Reasoning

    Chujie Zheng, Zhenru Zhang, Beichen Zhang +6

    cs.AIcs.CLcs.LGarXiv:2412.06559v42024
  43. A Compare-Aggregate Model for Matching Text Sequences

    Shuohang Wang, Jing Jiang

    cs.CLcs.AIarXiv:1611.01747v12016
  44. Blockwise Self-Attention for Long Document Understanding

    Jiezhong Qiu, Hao Ma, Omer Levy +3

    cs.CLcs.LGarXiv:1911.02972v22019
  45. Language Models of Code are Few-Shot Commonsense Learners

    Aman Madaan, Shuyan Zhou, Uri Alon +2

    cs.CLcs.LGarXiv:2210.07128v32022
  46. Seen and Unseen emotional style transfer for voice conversion with a new emotional speech dataset

    Kun Zhou, Berrak Sisman, Rui Liu +1

    cs.SDcs.CLeess.ASarXiv:2010.14794v22020
  47. A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA

    Damjan Kalajdzievski

    cs.CLcs.LGarXiv:2312.03732v12023
  48. Improved training of end-to-end attention models for speech recognition

    Albert Zeyer, Kazuki Irie, Ralf Schlüter +1

    cs.CLcs.LGstat.MLarXiv:1805.03294v12018
  49. Tree-to-Sequence Attentional Neural Machine Translation

    Akiko Eriguchi, Kazuma Hashimoto, Yoshimasa Tsuruoka

    cs.CLarXiv:1603.06075v32016
  50. CometKiwi: IST-Unbabel 2022 Submission for the Quality Estimation Shared Task

    Ricardo Rei, Marcos Treviso, Nuno M. Guerreiro +9

    cs.CLcs.LGarXiv:2209.06243v12022
  51. Stay Within Your Bounds: Distance-Guided Decoding for Guaranteed Context-Free Grammar Compliance

    Vincenzo Collura, Karim Tit, Eleonora Giunchiglia +2

    cs.AIcs.CLcs.FLarXiv:2608.28229v12026
  52. MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQL

    Bing Wang, Changyu Ren, Jian Yang +8

    cs.CLarXiv:2312.11242v62023
  53. A Survey of Vision-Language Pre-Trained Models

    Yifan Du, Zikang Liu, Junyi Li +1

    cs.CVcs.CLcs.LGarXiv:2202.10936v22022
  54. Speculative Probing: LLM Monitoring at Speculative-Decoding Cost

    Collin Zhang, Tingwei Zhang, Vitaly Shmatikov

    cs.AIcs.CLarXiv:2608.28099v12026
  55. A Monolingual Approach to Contextualized Word Embeddings for Mid-Resource Languages

    Pedro Javier Ortiz Suárez, Laurent Romary, Benoît Sagot

    cs.CLarXiv:2006.06202v22020
  56. Re3: Generating Longer Stories With Recursive Reprompting and Revision

    Kevin Yang, Yuandong Tian, Nanyun Peng +1

    cs.CLcs.AIarXiv:2210.06774v32022
  57. Fast Weight Attention for Continual Learning

    Yifan Zhang, Steve Ta, Jasper Zhang +8

    cs.LGcs.CLstat.MLarXiv:2608.27763v12026
  58. Neural Architectures for Nested NER through Linearization

    Jana Straková, Milan Straka, Jan Hajič

    cs.CLcs.LGarXiv:1908.06926v12019
  59. Improving Vision-and-Language Navigation with Image-Text Pairs from the Web

    Arjun Majumdar, Ayush Shrivastava, Stefan Lee +3

    cs.CVcs.AIcs.CLarXiv:2004.14973v22020
  60. Chain-of-Table: Evolving Tables in the Reasoning Chain for Table Understanding

    Zilong Wang, Hao Zhang, Chun-Liang Li +8

    cs.CLarXiv:2401.04398v22024