Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
5,161 to 5,220 of 11,252
How Many Topics? Stability Analysis for Topic Models
Derek Greene, Derek O'Callaghan, Pádraig Cunningham
cs.LGcs.CLcs.IRarXiv:1404.4606v32014ScisummNet: A Large Annotated Corpus and Content-Impact Models for Scientific Paper Summarization with Citation Networks
Michihiro Yasunaga, Jungo Kasai, Rui Zhang +4
cs.CLcs.IRcs.LGarXiv:1909.01716v32019EmoLASP: Emotion Recognition with Language Models and Answer Set Programming
Thao Le, Michael Thielscher
cs.AIcs.CLarXiv:2608.29035v12026Audio2Head: Audio-driven One-shot Talking-head Generation with Natural Head Motion
Suzhen Wang, Lincheng Li, Yu Ding +2
cs.CVcs.CLarXiv:2107.09293v12021Unsupervised Keyphrase Extraction with Multipartite Graphs
Florian Boudin
cs.IRcs.CLarXiv:1803.08721v22018You Autocomplete Me: Poisoning Vulnerabilities in Neural Code Completion
Roei Schuster, Congzheng Song, Eran Tromer +1
cs.CRcs.CLcs.LGarXiv:2007.02220v32020SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
Dahyun Kim, Chanjun Park, Sanghoon Kim +15
cs.CLcs.AIcs.LGarXiv:2312.15166v32023Autoregressive Search Engines: Generating Substrings as Document Identifiers
Michele Bevilacqua, Giuseppe Ottaviano, Patrick Lewis +3
cs.CLcs.IRarXiv:2204.10628v12022VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks
Ziyan Jiang, Rui Meng, Xinyi Yang +3
cs.CVcs.AIcs.CLarXiv:2410.05160v32024BookSum: A Collection of Datasets for Long-form Narrative Summarization
Wojciech Kryściński, Nazneen Rajani, Divyansh Agarwal +2
cs.CLarXiv:2105.08209v22021MKQA: A Linguistically Diverse Benchmark for Multilingual Open Domain Question Answering
Shayne Longpre, Yi Lu, Joachim Daiber
cs.CLarXiv:2007.15207v22020Suicidal Ideation Detection: A Review of Machine Learning Methods and Applications
Shaoxiong Ji, Shirui Pan, Xue Li +3
cs.CYcs.AIcs.CLarXiv:1910.12611v42019Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models
Orevaoghene Ahia, Sachin Kumar, Hila Gonen +4
cs.CLarXiv:2305.13707v12023NegBio: a high-performance tool for negation and uncertainty detection in radiology reports
Yifan Peng, Xiaosong Wang, Le Lu +3
cs.CLarXiv:1712.05898v22017Coherent Multi-Sentence Video Description with Variable Level of Detail
Anna Senina, Marcus Rohrbach, Wei Qiu +5
cs.CVcs.CLarXiv:1403.6173v12014Learning to Ask Good Questions: Ranking Clarification Questions using Neural Expected Value of Perfect Information
Sudha Rao, Hal Daumé
cs.CLarXiv:1805.04655v22018Multi-domain Clinical Natural Language Processing with MedCAT: the Medical Concept Annotation Toolkit
Zeljko Kraljevic, Thomas Searle, Anthony Shek +15
cs.CLcs.AIcs.LGarXiv:2010.01165v22020Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge
Saransh Kumar Gupta, Armaan Shah, Lipika Dey +2
cs.AIcs.CLcs.IRarXiv:2608.29249v22026Adapt or Get Left Behind: Domain Adaptation through BERT Language Model Finetuning for Aspect-Target Sentiment Classification
Alexander Rietzler, Sebastian Stabinger, Paul Opitz +1
cs.CLarXiv:1908.11860v22019Visually Grounded Reasoning across Languages and Cultures
Fangyu Liu, Emanuele Bugliarello, Edoardo Maria Ponti +3
cs.CLcs.AIcs.CVarXiv:2109.13238v22021Data Engineering for Scaling Language Models to 128K Context
Yao Fu, Rameswar Panda, Xinyao Niu +4
cs.CLcs.AIarXiv:2402.10171v12024Comparative layer-wise analysis of self-supervised speech models
Ankita Pasad, Bowen Shi, Karen Livescu
cs.CLcs.LGcs.SDarXiv:2211.03929v32022Contrastive Attention for Automatic Chest X-ray Report Generation
Fenglin Liu, Changchang Yin, Xian Wu +5
cs.CVcs.CLarXiv:2106.06965v52021The Tatoeba Translation Challenge -- Realistic Data Sets for Low Resource and Multilingual MT
Jörg Tiedemann
cs.CLarXiv:2010.06354v12020Retrieval Head Mechanistically Explains Long-Context Factuality
Wenhao Wu, Yizhong Wang, Guangxuan Xiao +2
cs.CLarXiv:2404.15574v12024ShieldGemma: Generative AI Content Moderation Based on Gemma
Wenjun Zeng, Yuchi Liu, Ryan Mullins +9
cs.CLcs.LGarXiv:2407.21772v22024A network approach to topic models
Martin Gerlach, Tiago P. Peixoto, Eduardo G. Altmann
stat.MLcs.CLphysics.data-anarXiv:1708.01677v22017Exploiting Social Network Structure for Person-to-Person Sentiment Analysis
Robert West, Hristo S. Paskov, Jure Leskovec +1
cs.SIcs.CLphysics.soc-pharXiv:1409.2450v12014Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
Tsendsuren Munkhdalai, Manaal Faruqui, Siddharth Gopal
cs.CLcs.AIcs.LGarXiv:2404.07143v22024Transfer Learning across Low-Resource, Related Languages for Neural Machine Translation
Toan Q. Nguyen, David Chiang
cs.CLarXiv:1708.09803v22017Large Language Models with Controllable Working Memory
Daliang Li, Ankit Singh Rawat, Manzil Zaheer +5
cs.CLcs.AIcs.LGarXiv:2211.05110v12022Robust Distant Supervision Relation Extraction via Deep Reinforcement Learning
Pengda Qin, Weiran Xu, William Yang Wang
cs.CLarXiv:1805.09927v12018EMMA: End-to-End Multimodal Model for Autonomous Driving
Jyh-Jing Hwang, Runsheng Xu, Hubert Lin +11
cs.CVcs.AIcs.CLarXiv:2410.23262v32024UI-Venus-2 Technical Report
Venus Team, Zhuohan Cai, Haoxing Chen +28
cs.AIcs.CLcs.CVarXiv:2609.00028v12026RedPajama: an Open Dataset for Training Large Language Models
Maurice Weber, Daniel Fu, Quentin Anthony +16
cs.CLcs.LGarXiv:2411.12372v12024Control-Data Flow Separation: Stable Prompt Optimization in Multi-Agent LLMs
Wentao Zhang, Syed Shariyar Murtaza, Junaid Ahmad Bhatti +4
cs.AIcs.CLcs.MAarXiv:2609.00621v12026TANDA: Transfer and Adapt Pre-Trained Transformer Models for Answer Sentence Selection
Siddhant Garg, Thuy Vu, Alessandro Moschitti
cs.CLarXiv:1911.04118v22019Many Languages, One Parser
Waleed Ammar, George Mulcaire, Miguel Ballesteros +2
cs.CLarXiv:1602.01595v42016Tagged Back-Translation
Isaac Caswell, Ciprian Chelba, David Grangier
cs.CLcs.LGarXiv:1906.06442v12019SemEval-2017 Task 3: Community Question Answering
Preslav Nakov, Doris Hoogeveen, Lluís Màrquez +4
cs.CLcs.AIcs.IRarXiv:1912.00730v12019StudentSim: Training LLM-based Student Simulators
Ke Yang, Chenglong Wang, Michel Galley +4
cs.CLarXiv:2609.01591v12026Document-level Relation Extraction as Semantic Segmentation
Ningyu Zhang, Xiang Chen, Xin Xie +6
cs.CLcs.AIcs.CVarXiv:2106.03618v22021SyntaxSQLNet: Syntax Tree Networks for Complex and Cross-DomainText-to-SQL Task
Tao Yu, Michihiro Yasunaga, Kai Yang +4
cs.CLcs.AIarXiv:1810.05237v22018Table Meets LLM: Can Large Language Models Understand Structured Table Data? A Benchmark and Empirical Study
Yuan Sui, Mengyu Zhou, Mingjie Zhou +2
cs.CLcs.AIcs.IRarXiv:2305.13062v52023Fine-tuning ChatGPT for Automatic Scoring
Ehsan Latif, Xiaoming Zhai
cs.CLcs.AIarXiv:2310.10072v32023LGESQL: Line Graph Enhanced Text-to-SQL Model with Mixed Local and Non-Local Relations
Ruisheng Cao, Lu Chen, Zhi Chen +3
cs.CLarXiv:2106.01093v32021ESPnet-TTS: Unified, Reproducible, and Integratable Open Source End-to-End Text-to-Speech Toolkit
Tomoki Hayashi, Ryuichi Yamamoto, Katsuki Inoue +6
cs.CLeess.ASarXiv:1910.10909v22019Exploring Neural Transducers for End-to-End Speech Recognition
Eric Battenberg, Jitong Chen, Rewon Child +8
cs.CLcs.NEarXiv:1707.07413v12017EM^2Mem: Event-Centric Multimodal Memory for Large Language Models
Yijun Chen, Yaqi Zheng, Yanya Li +11
cs.CLcs.AIcs.LGarXiv:2609.00551v12026Event Representations for Automated Story Generation with Deep Neural Nets
Lara J. Martin, Prithviraj Ammanabrolu, Xinyu Wang +4
cs.CLcs.AIcs.LGarXiv:1706.01331v32017DocPrompting: Generating Code by Retrieving the Docs
Shuyan Zhou, Uri Alon, Frank F. Xu +3
cs.CLcs.AIcs.SEarXiv:2207.05987v32022WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
Zehan Qi, Xiao Liu, Iat Long Iong +11
cs.CLarXiv:2411.02337v32024Multilingual Twitter Sentiment Classification: The Role of Human Annotators
Igor Mozetic, Miha Grcar, Jasmina Smailovic
cs.CLcs.AIarXiv:1602.07563v22016Deep Bayesian Active Learning for Natural Language Processing: Results of a Large-Scale Empirical Study
Aditya Siddhant, Zachary C. Lipton
cs.CLcs.LGstat.MLarXiv:1808.05697v32018Cost-Efficient Large Language Model Serving for Multi-turn Conversations with CachedAttention
Bin Gao, Zhuomin He, Puru Sharma +6
cs.CLcs.LGarXiv:2403.19708v32024GUI-CC: Benchmarking Contextual Consistency of GUI World Models as Agent Environments
Lin Fu, Zheyuan Yang, Tianhui Zhang +5
cs.CLcs.AIarXiv:2609.00048v12026Findings of the Second Shared Task on Multimodal Machine Translation and Multilingual Image Description
Desmond Elliott, Stella Frank, Loïc Barrault +2
cs.CLcs.CVarXiv:1710.07177v12017On Adversarial Examples for Character-Level Neural Machine Translation
Javid Ebrahimi, Daniel Lowd, Dejing Dou
cs.CLcs.AIarXiv:1806.09030v12018Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data
Chaoyi Wu, Xiaoman Zhang, Ya Zhang +2
cs.CVcs.CLarXiv:2308.02463v52023TimeTraveler: Reinforcement Learning for Temporal Knowledge Graph Forecasting
Haohai Sun, Jialun Zhong, Yunpu Ma +2
cs.LGcs.AIcs.CLarXiv:2109.04101v12021