Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,921 to 4,980 of 11,252
Trust Your Guide Only When Certain: Uncertainty-Aware Sparse Alignment at Inference Time
Zeen Zhu, Zhuo Li, Weiyang Guo +4
cs.CLarXiv:2609.00624v12026VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers
Sanyuan Chen, Shujie Liu, Long Zhou +6
cs.CLcs.SDeess.ASarXiv:2406.05370v22024A Survey on Computational Propaganda Detection
Giovanni Da San Martino, Stefano Cresci, Alberto Barron-Cedeno +3
cs.CLcs.IRcs.LGarXiv:2007.08024v12020Analysing Lexical Semantic Change with Contextualised Word Representations
Mario Giulianelli, Marco Del Tredici, Raquel Fernández
cs.CLcs.CYarXiv:2004.14118v12020Towards Adversarial Attack on Vision-Language Pre-training Models
Jiaming Zhang, Qi Yi, Jitao Sang
cs.LGcs.CLcs.CVarXiv:2206.09391v22022SeamlessM4T: Massively Multilingual & Multimodal Machine Translation
Seamless Communication, Loïc Barrault, Yu-An Chung +65
cs.CLarXiv:2308.11596v32023Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
Yiyang Zhou, Chenhang Cui, Rafael Rafailov +2
cs.LGcs.CLcs.CVarXiv:2402.11411v12024BioRED: A Rich Biomedical Relation Extraction Dataset
Ling Luo, Po-Ting Lai, Chih-Hsuan Wei +2
cs.CLarXiv:2204.04263v22022GPL: Generative Pseudo Labeling for Unsupervised Domain Adaptation of Dense Retrieval
Kexin Wang, Nandan Thakur, Nils Reimers +1
cs.CLcs.IRarXiv:2112.07577v32021LLM-Driven Autonomous Vehicles Inherit Human Driver Biases in Pedestrian Yielding: Results and Implications From A New Benchmark
Irem Yoldas, Martim Brandão, Jie Zhang +1
cs.AIcs.CLcs.CVarXiv:2609.00192v12026MOMENTA: A Multimodal Framework for Detecting Harmful Memes and Their Targets
Shraman Pramanick, Shivam Sharma, Dimitar Dimitrov +3
cs.MMcs.CLarXiv:2109.05184v22021Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall
Jacqueline He, Howard Yen, Shuyue Stella Li +9
cs.CLarXiv:2609.01532v12026HybridRAG: Integrating Knowledge Graphs and Vector Retrieval Augmented Generation for Efficient Information Extraction
Bhaskarjit Sarmah, Benika Hall, Rohan Rao +3
cs.CLcs.LGq-fin.STarXiv:2408.04948v12024GluonCV and GluonNLP: Deep Learning in Computer Vision and Natural Language Processing
Jian Guo, He He, Tong He +13
cs.LGcs.CLcs.CVarXiv:1907.04433v22019Dr. Claw: An AI Scientist Workspace for Vibe Research
Dingjie Song, Hanrong Zhang, Dawei Liu +10
cs.AIcs.CLcs.CVarXiv:2609.00365v12026Learning and Evaluating General Linguistic Intelligence
Dani Yogatama, Cyprien de Masson d'Autume, Jerome Connor +8
cs.LGcs.CLstat.MLarXiv:1901.11373v12019Self-Guided Contrastive Learning for BERT Sentence Representations
Taeuk Kim, Kang Min Yoo, Sang-goo Lee
cs.CLcs.AIarXiv:2106.07345v12021Pre-training on high-resource speech recognition improves low-resource speech-to-text translation
Sameer Bansal, Herman Kamper, Karen Livescu +2
cs.CLarXiv:1809.01431v22018Enoki: Efficient Multi-Level Hallucination Detection
Elisei Rykov, Timur Ionov, Nikolay Ivanov +5
cs.CLarXiv:2609.00581v12026Assessing The Factual Accuracy of Generated Text
Ben Goodrich, Vinay Rao, Mohammad Saleh +1
cs.CLarXiv:1905.13322v22019SSD-LM: Semi-autoregressive Simplex-based Diffusion Language Model for Text Generation and Modular Control
Xiaochuang Han, Sachin Kumar, Yulia Tsvetkov
cs.CLcs.LGarXiv:2210.17432v22022ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything
Yufan Dang, Shu Yao, Bowen Lai +6
cs.AIcs.CLcs.MAarXiv:2609.00714v12026Zero-Shot Transfer Learning for Event Extraction
Lifu Huang, Heng Ji, Kyunghyun Cho +1
cs.CLarXiv:1707.01066v12017Constructing Narrative Event Evolutionary Graph for Script Event Prediction
Zhongyang Li, Xiao Ding, Ting Liu
cs.AIcs.CLarXiv:1805.05081v22018Hierarchical Recurrent Attention Network for Response Generation
Chen Xing, Wei Wu, Yu Wu +3
cs.CLarXiv:1701.07149v12017It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning
Runpeng Dai, Kaili Huang, Changsung Kang +1
cs.IRcs.CLarXiv:2609.00638v12026The Interlingua Hypothesis: LLMs Translate via a Latent Task-agnostic Feature Space
Jacob Brinton, Jannik Brinkmann, Mark Crovella +1
cs.CLcs.AIarXiv:2609.00515v12026From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
Yuntian Deng, Yejin Choi, Stuart Shieber
cs.CLcs.AIcs.LGarXiv:2405.14838v12024ExpertPrompting: Instructing Large Language Models to be Distinguished Experts
Benfeng Xu, An Yang, Junyang Lin +4
cs.CLcs.AIarXiv:2305.14688v22023Instruction Induction: From Few Examples to Natural Language Task Descriptions
Or Honovich, Uri Shaham, Samuel R. Bowman +1
cs.CLarXiv:2205.10782v12022Neural End-to-End Learning for Computational Argumentation Mining
Steffen Eger, Johannes Daxenberger, Iryna Gurevych
cs.CLarXiv:1704.06104v22017Semantic Specialisation of Distributional Word Vector Spaces using Monolingual and Cross-Lingual Constraints
Nikola Mrkšić, Ivan Vulić, Diarmuid Ó Séaghdha +5
cs.CLcs.AIcs.LGarXiv:1706.00374v12017Evaluating Retrieval Quality in Retrieval-Augmented Generation
Alireza Salemi, Hamed Zamani
cs.CLcs.IRarXiv:2404.13781v12024Online normalizer calculation for softmax
Maxim Milakov, Natalia Gimelshein
cs.PFcs.AIcs.CLarXiv:1805.02867v22018Evaluating ChatGPT's Information Extraction Capabilities: An Assessment of Performance, Explainability, Calibration, and Faithfulness
Bo Li, Gexiang Fang, Yang Yang +4
cs.CLarXiv:2304.11633v12023Getting Gender Right in Neural Machine Translation
Eva Vanmassenhove, Christian Hardmeier, Andy Way
cs.CLarXiv:1909.05088v12019SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step Reasoning
Ning Miao, Yee Whye Teh, Tom Rainforth
cs.AIcs.CLcs.LGarXiv:2308.00436v32023Token-Budget-Aware LLM Reasoning
Tingxu Han, Zhenting Wang, Chunrong Fang +3
cs.CLcs.AIcs.LGarXiv:2412.18547v52024Improving Referring Expression Grounding with Cross-modal Attention-guided Erasing
Xihui Liu, Zihao Wang, Jing Shao +2
cs.CVcs.CLarXiv:1903.00839v22019Neural Machine Translation with Byte-Level Subwords
Changhan Wang, Kyunghyun Cho, Jiatao Gu
cs.CLarXiv:1909.03341v22019Continuous diffusion for categorical data
Sander Dieleman, Laurent Sartran, Arman Roshannai +11
cs.CLcs.LGarXiv:2211.15089v32022Radiology Report Generation with a Learned Knowledge Base and Multi-modal Alignment
Shuxin Yang, Xian Wu, Shen Ge +2
eess.IVcs.CLcs.CVarXiv:2112.15011v22021Making Neural QA as Simple as Possible but not Simpler
Dirk Weissenborn, Georg Wiese, Laura Seiffe
cs.CLcs.AIcs.NEarXiv:1703.04816v32017Charformer: Fast Character Transformers via Gradient-based Subword Tokenization
Yi Tay, Vinh Q. Tran, Sebastian Ruder +7
cs.CLcs.AIcs.LGarXiv:2106.12672v32021The Expando-Mono-Duo Design Pattern for Text Ranking with Pretrained Sequence-to-Sequence Models
Ronak Pradeep, Rodrigo Nogueira, Jimmy Lin
cs.IRcs.CLarXiv:2101.05667v12021Towards Building Multilingual Language Model for Medicine
Pengcheng Qiu, Chaoyi Wu, Xiaoman Zhang +5
cs.CLarXiv:2402.13963v42024Fact-Checking Complex Claims with Program-Guided Reasoning
Liangming Pan, Xiaobao Wu, Xinyuan Lu +4
cs.CLcs.AIarXiv:2305.12744v12023Adapting Pre-trained Language Models to African Languages via Multilingual Adaptive Fine-Tuning
Jesujoba O. Alabi, David Ifeoluwa Adelani, Marius Mosbach +1
cs.CLarXiv:2204.06487v32022WT5?! Training Text-to-Text Models to Explain their Predictions
Sharan Narang, Colin Raffel, Katherine Lee +3
cs.CLcs.LGarXiv:2004.14546v12020Cold-start Active Learning through Self-supervised Language Modeling
Michelle Yuan, Hsuan-Tien Lin, Jordan Boyd-Graber
cs.CLcs.LGarXiv:2010.09535v22020Monotonic Infinite Lookback Attention for Simultaneous Machine Translation
Naveen Arivazhagan, Colin Cherry, Wolfgang Macherey +5
cs.CLarXiv:1906.05218v12019Cross-topic Argument Mining from Heterogeneous Sources Using Attention-based Neural Networks
Christian Stab, Tristan Miller, Iryna Gurevych
cs.CLarXiv:1802.05758v12018Multi-Task Pre-Training for Plug-and-Play Task-Oriented Dialogue System
Yixuan Su, Lei Shu, Elman Mansimov +4
cs.CLarXiv:2109.14739v22021Evolutionary Computation in the Era of Large Language Model: Survey and Roadmap
Xingyu Wu, Sheng-hao Wu, Jibin Wu +2
cs.NEcs.AIcs.CLarXiv:2401.10034v32024Unsupervised Evaluation of Interactive Dialog with DialoGPT
Shikib Mehri, Maxine Eskenazi
cs.CLcs.AIcs.HCarXiv:2006.12719v12020Sentiment and Sarcasm Classification with Multitask Learning
Navonil Majumder, Soujanya Poria, Haiyun Peng +3
cs.CLarXiv:1901.08014v22019ProPILE: Probing Privacy Leakage in Large Language Models
Siwon Kim, Sangdoo Yun, Hwaran Lee +3
cs.CRcs.CLarXiv:2307.01881v12023A Review on Language Models as Knowledge Bases
Badr AlKhamissi, Millicent Li, Asli Celikyilmaz +2
cs.CLcs.AIarXiv:2204.06031v12022FlowTransformer: A Transformer Framework for Flow-based Network Intrusion Detection Systems
Liam Daly Manocchio, Siamak Layeghy, Wai Weng Lo +3
cs.CRcs.AIcs.CLarXiv:2304.14746v12023aNMM: Ranking Short Answer Texts with Attention-Based Neural Matching Model
Liu Yang, Qingyao Ai, Jiafeng Guo +1
cs.IRcs.CLarXiv:1801.01641v22018