Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,921 to 4,980 of 11,252

  1. Trust Your Guide Only When Certain: Uncertainty-Aware Sparse Alignment at Inference Time

    Zeen Zhu, Zhuo Li, Weiyang Guo +4

    cs.CLarXiv:2609.00624v12026
  2. VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers

    Sanyuan Chen, Shujie Liu, Long Zhou +6

    cs.CLcs.SDeess.ASarXiv:2406.05370v22024
  3. A Survey on Computational Propaganda Detection

    Giovanni Da San Martino, Stefano Cresci, Alberto Barron-Cedeno +3

    cs.CLcs.IRcs.LGarXiv:2007.08024v12020
  4. Analysing Lexical Semantic Change with Contextualised Word Representations

    Mario Giulianelli, Marco Del Tredici, Raquel Fernández

    cs.CLcs.CYarXiv:2004.14118v12020
  5. Towards Adversarial Attack on Vision-Language Pre-training Models

    Jiaming Zhang, Qi Yi, Jitao Sang

    cs.LGcs.CLcs.CVarXiv:2206.09391v22022
  6. SeamlessM4T: Massively Multilingual & Multimodal Machine Translation

    Seamless Communication, Loïc Barrault, Yu-An Chung +65

    cs.CLarXiv:2308.11596v32023
  7. Aligning Modalities in Vision Large Language Models via Preference Fine-tuning

    Yiyang Zhou, Chenhang Cui, Rafael Rafailov +2

    cs.LGcs.CLcs.CVarXiv:2402.11411v12024
  8. BioRED: A Rich Biomedical Relation Extraction Dataset

    Ling Luo, Po-Ting Lai, Chih-Hsuan Wei +2

    cs.CLarXiv:2204.04263v22022
  9. GPL: Generative Pseudo Labeling for Unsupervised Domain Adaptation of Dense Retrieval

    Kexin Wang, Nandan Thakur, Nils Reimers +1

    cs.CLcs.IRarXiv:2112.07577v32021
  10. LLM-Driven Autonomous Vehicles Inherit Human Driver Biases in Pedestrian Yielding: Results and Implications From A New Benchmark

    Irem Yoldas, Martim Brandão, Jie Zhang +1

    cs.AIcs.CLcs.CVarXiv:2609.00192v12026
  11. MOMENTA: A Multimodal Framework for Detecting Harmful Memes and Their Targets

    Shraman Pramanick, Shivam Sharma, Dimitar Dimitrov +3

    cs.MMcs.CLarXiv:2109.05184v22021
  12. Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall

    Jacqueline He, Howard Yen, Shuyue Stella Li +9

    cs.CLarXiv:2609.01532v12026
  13. HybridRAG: Integrating Knowledge Graphs and Vector Retrieval Augmented Generation for Efficient Information Extraction

    Bhaskarjit Sarmah, Benika Hall, Rohan Rao +3

    cs.CLcs.LGq-fin.STarXiv:2408.04948v12024
  14. GluonCV and GluonNLP: Deep Learning in Computer Vision and Natural Language Processing

    Jian Guo, He He, Tong He +13

    cs.LGcs.CLcs.CVarXiv:1907.04433v22019
  15. Dr. Claw: An AI Scientist Workspace for Vibe Research

    Dingjie Song, Hanrong Zhang, Dawei Liu +10

    cs.AIcs.CLcs.CVarXiv:2609.00365v12026
  16. Learning and Evaluating General Linguistic Intelligence

    Dani Yogatama, Cyprien de Masson d'Autume, Jerome Connor +8

    cs.LGcs.CLstat.MLarXiv:1901.11373v12019
  17. Self-Guided Contrastive Learning for BERT Sentence Representations

    Taeuk Kim, Kang Min Yoo, Sang-goo Lee

    cs.CLcs.AIarXiv:2106.07345v12021
  18. Pre-training on high-resource speech recognition improves low-resource speech-to-text translation

    Sameer Bansal, Herman Kamper, Karen Livescu +2

    cs.CLarXiv:1809.01431v22018
  19. Enoki: Efficient Multi-Level Hallucination Detection

    Elisei Rykov, Timur Ionov, Nikolay Ivanov +5

    cs.CLarXiv:2609.00581v12026
  20. Assessing The Factual Accuracy of Generated Text

    Ben Goodrich, Vinay Rao, Mohammad Saleh +1

    cs.CLarXiv:1905.13322v22019
  21. SSD-LM: Semi-autoregressive Simplex-based Diffusion Language Model for Text Generation and Modular Control

    Xiaochuang Han, Sachin Kumar, Yulia Tsvetkov

    cs.CLcs.LGarXiv:2210.17432v22022
  22. ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything

    Yufan Dang, Shu Yao, Bowen Lai +6

    cs.AIcs.CLcs.MAarXiv:2609.00714v12026
  23. Zero-Shot Transfer Learning for Event Extraction

    Lifu Huang, Heng Ji, Kyunghyun Cho +1

    cs.CLarXiv:1707.01066v12017
  24. Constructing Narrative Event Evolutionary Graph for Script Event Prediction

    Zhongyang Li, Xiao Ding, Ting Liu

    cs.AIcs.CLarXiv:1805.05081v22018
  25. Hierarchical Recurrent Attention Network for Response Generation

    Chen Xing, Wei Wu, Yu Wu +3

    cs.CLarXiv:1701.07149v12017
  26. It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning

    Runpeng Dai, Kaili Huang, Changsung Kang +1

    cs.IRcs.CLarXiv:2609.00638v12026
  27. The Interlingua Hypothesis: LLMs Translate via a Latent Task-agnostic Feature Space

    Jacob Brinton, Jannik Brinkmann, Mark Crovella +1

    cs.CLcs.AIarXiv:2609.00515v12026
  28. From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step

    Yuntian Deng, Yejin Choi, Stuart Shieber

    cs.CLcs.AIcs.LGarXiv:2405.14838v12024
  29. ExpertPrompting: Instructing Large Language Models to be Distinguished Experts

    Benfeng Xu, An Yang, Junyang Lin +4

    cs.CLcs.AIarXiv:2305.14688v22023
  30. Instruction Induction: From Few Examples to Natural Language Task Descriptions

    Or Honovich, Uri Shaham, Samuel R. Bowman +1

    cs.CLarXiv:2205.10782v12022
  31. Neural End-to-End Learning for Computational Argumentation Mining

    Steffen Eger, Johannes Daxenberger, Iryna Gurevych

    cs.CLarXiv:1704.06104v22017
  32. Semantic Specialisation of Distributional Word Vector Spaces using Monolingual and Cross-Lingual Constraints

    Nikola Mrkšić, Ivan Vulić, Diarmuid Ó Séaghdha +5

    cs.CLcs.AIcs.LGarXiv:1706.00374v12017
  33. Evaluating Retrieval Quality in Retrieval-Augmented Generation

    Alireza Salemi, Hamed Zamani

    cs.CLcs.IRarXiv:2404.13781v12024
  34. Online normalizer calculation for softmax

    Maxim Milakov, Natalia Gimelshein

    cs.PFcs.AIcs.CLarXiv:1805.02867v22018
  35. Evaluating ChatGPT's Information Extraction Capabilities: An Assessment of Performance, Explainability, Calibration, and Faithfulness

    Bo Li, Gexiang Fang, Yang Yang +4

    cs.CLarXiv:2304.11633v12023
  36. Getting Gender Right in Neural Machine Translation

    Eva Vanmassenhove, Christian Hardmeier, Andy Way

    cs.CLarXiv:1909.05088v12019
  37. SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step Reasoning

    Ning Miao, Yee Whye Teh, Tom Rainforth

    cs.AIcs.CLcs.LGarXiv:2308.00436v32023
  38. Token-Budget-Aware LLM Reasoning

    Tingxu Han, Zhenting Wang, Chunrong Fang +3

    cs.CLcs.AIcs.LGarXiv:2412.18547v52024
  39. Improving Referring Expression Grounding with Cross-modal Attention-guided Erasing

    Xihui Liu, Zihao Wang, Jing Shao +2

    cs.CVcs.CLarXiv:1903.00839v22019
  40. Neural Machine Translation with Byte-Level Subwords

    Changhan Wang, Kyunghyun Cho, Jiatao Gu

    cs.CLarXiv:1909.03341v22019
  41. Continuous diffusion for categorical data

    Sander Dieleman, Laurent Sartran, Arman Roshannai +11

    cs.CLcs.LGarXiv:2211.15089v32022
  42. Radiology Report Generation with a Learned Knowledge Base and Multi-modal Alignment

    Shuxin Yang, Xian Wu, Shen Ge +2

    eess.IVcs.CLcs.CVarXiv:2112.15011v22021
  43. Making Neural QA as Simple as Possible but not Simpler

    Dirk Weissenborn, Georg Wiese, Laura Seiffe

    cs.CLcs.AIcs.NEarXiv:1703.04816v32017
  44. Charformer: Fast Character Transformers via Gradient-based Subword Tokenization

    Yi Tay, Vinh Q. Tran, Sebastian Ruder +7

    cs.CLcs.AIcs.LGarXiv:2106.12672v32021
  45. The Expando-Mono-Duo Design Pattern for Text Ranking with Pretrained Sequence-to-Sequence Models

    Ronak Pradeep, Rodrigo Nogueira, Jimmy Lin

    cs.IRcs.CLarXiv:2101.05667v12021
  46. Towards Building Multilingual Language Model for Medicine

    Pengcheng Qiu, Chaoyi Wu, Xiaoman Zhang +5

    cs.CLarXiv:2402.13963v42024
  47. Fact-Checking Complex Claims with Program-Guided Reasoning

    Liangming Pan, Xiaobao Wu, Xinyuan Lu +4

    cs.CLcs.AIarXiv:2305.12744v12023
  48. Adapting Pre-trained Language Models to African Languages via Multilingual Adaptive Fine-Tuning

    Jesujoba O. Alabi, David Ifeoluwa Adelani, Marius Mosbach +1

    cs.CLarXiv:2204.06487v32022
  49. WT5?! Training Text-to-Text Models to Explain their Predictions

    Sharan Narang, Colin Raffel, Katherine Lee +3

    cs.CLcs.LGarXiv:2004.14546v12020
  50. Cold-start Active Learning through Self-supervised Language Modeling

    Michelle Yuan, Hsuan-Tien Lin, Jordan Boyd-Graber

    cs.CLcs.LGarXiv:2010.09535v22020
  51. Monotonic Infinite Lookback Attention for Simultaneous Machine Translation

    Naveen Arivazhagan, Colin Cherry, Wolfgang Macherey +5

    cs.CLarXiv:1906.05218v12019
  52. Cross-topic Argument Mining from Heterogeneous Sources Using Attention-based Neural Networks

    Christian Stab, Tristan Miller, Iryna Gurevych

    cs.CLarXiv:1802.05758v12018
  53. Multi-Task Pre-Training for Plug-and-Play Task-Oriented Dialogue System

    Yixuan Su, Lei Shu, Elman Mansimov +4

    cs.CLarXiv:2109.14739v22021
  54. Evolutionary Computation in the Era of Large Language Model: Survey and Roadmap

    Xingyu Wu, Sheng-hao Wu, Jibin Wu +2

    cs.NEcs.AIcs.CLarXiv:2401.10034v32024
  55. Unsupervised Evaluation of Interactive Dialog with DialoGPT

    Shikib Mehri, Maxine Eskenazi

    cs.CLcs.AIcs.HCarXiv:2006.12719v12020
  56. Sentiment and Sarcasm Classification with Multitask Learning

    Navonil Majumder, Soujanya Poria, Haiyun Peng +3

    cs.CLarXiv:1901.08014v22019
  57. ProPILE: Probing Privacy Leakage in Large Language Models

    Siwon Kim, Sangdoo Yun, Hwaran Lee +3

    cs.CRcs.CLarXiv:2307.01881v12023
  58. A Review on Language Models as Knowledge Bases

    Badr AlKhamissi, Millicent Li, Asli Celikyilmaz +2

    cs.CLcs.AIarXiv:2204.06031v12022
  59. FlowTransformer: A Transformer Framework for Flow-based Network Intrusion Detection Systems

    Liam Daly Manocchio, Siamak Layeghy, Wai Weng Lo +3

    cs.CRcs.AIcs.CLarXiv:2304.14746v12023
  60. aNMM: Ranking Short Answer Texts with Attention-Based Neural Matching Model

    Liu Yang, Qingyao Ai, Jiafeng Guo +1

    cs.IRcs.CLarXiv:1801.01641v22018