Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,161 to 5,220 of 11,252

  1. How Many Topics? Stability Analysis for Topic Models

    Derek Greene, Derek O'Callaghan, Pádraig Cunningham

    cs.LGcs.CLcs.IRarXiv:1404.4606v32014
  2. ScisummNet: A Large Annotated Corpus and Content-Impact Models for Scientific Paper Summarization with Citation Networks

    Michihiro Yasunaga, Jungo Kasai, Rui Zhang +4

    cs.CLcs.IRcs.LGarXiv:1909.01716v32019
  3. EmoLASP: Emotion Recognition with Language Models and Answer Set Programming

    Thao Le, Michael Thielscher

    cs.AIcs.CLarXiv:2608.29035v12026
  4. Audio2Head: Audio-driven One-shot Talking-head Generation with Natural Head Motion

    Suzhen Wang, Lincheng Li, Yu Ding +2

    cs.CVcs.CLarXiv:2107.09293v12021
  5. Unsupervised Keyphrase Extraction with Multipartite Graphs

    Florian Boudin

    cs.IRcs.CLarXiv:1803.08721v22018
  6. You Autocomplete Me: Poisoning Vulnerabilities in Neural Code Completion

    Roei Schuster, Congzheng Song, Eran Tromer +1

    cs.CRcs.CLcs.LGarXiv:2007.02220v32020
  7. SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling

    Dahyun Kim, Chanjun Park, Sanghoon Kim +15

    cs.CLcs.AIcs.LGarXiv:2312.15166v32023
  8. Autoregressive Search Engines: Generating Substrings as Document Identifiers

    Michele Bevilacqua, Giuseppe Ottaviano, Patrick Lewis +3

    cs.CLcs.IRarXiv:2204.10628v12022
  9. VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks

    Ziyan Jiang, Rui Meng, Xinyi Yang +3

    cs.CVcs.AIcs.CLarXiv:2410.05160v32024
  10. BookSum: A Collection of Datasets for Long-form Narrative Summarization

    Wojciech Kryściński, Nazneen Rajani, Divyansh Agarwal +2

    cs.CLarXiv:2105.08209v22021
  11. MKQA: A Linguistically Diverse Benchmark for Multilingual Open Domain Question Answering

    Shayne Longpre, Yi Lu, Joachim Daiber

    cs.CLarXiv:2007.15207v22020
  12. Suicidal Ideation Detection: A Review of Machine Learning Methods and Applications

    Shaoxiong Ji, Shirui Pan, Xue Li +3

    cs.CYcs.AIcs.CLarXiv:1910.12611v42019
  13. Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models

    Orevaoghene Ahia, Sachin Kumar, Hila Gonen +4

    cs.CLarXiv:2305.13707v12023
  14. NegBio: a high-performance tool for negation and uncertainty detection in radiology reports

    Yifan Peng, Xiaosong Wang, Le Lu +3

    cs.CLarXiv:1712.05898v22017
  15. Coherent Multi-Sentence Video Description with Variable Level of Detail

    Anna Senina, Marcus Rohrbach, Wei Qiu +5

    cs.CVcs.CLarXiv:1403.6173v12014
  16. Learning to Ask Good Questions: Ranking Clarification Questions using Neural Expected Value of Perfect Information

    Sudha Rao, Hal Daumé

    cs.CLarXiv:1805.04655v22018
  17. Multi-domain Clinical Natural Language Processing with MedCAT: the Medical Concept Annotation Toolkit

    Zeljko Kraljevic, Thomas Searle, Anthony Shek +15

    cs.CLcs.AIcs.LGarXiv:2010.01165v22020
  18. Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge

    Saransh Kumar Gupta, Armaan Shah, Lipika Dey +2

    cs.AIcs.CLcs.IRarXiv:2608.29249v22026
  19. Adapt or Get Left Behind: Domain Adaptation through BERT Language Model Finetuning for Aspect-Target Sentiment Classification

    Alexander Rietzler, Sebastian Stabinger, Paul Opitz +1

    cs.CLarXiv:1908.11860v22019
  20. Visually Grounded Reasoning across Languages and Cultures

    Fangyu Liu, Emanuele Bugliarello, Edoardo Maria Ponti +3

    cs.CLcs.AIcs.CVarXiv:2109.13238v22021
  21. Data Engineering for Scaling Language Models to 128K Context

    Yao Fu, Rameswar Panda, Xinyao Niu +4

    cs.CLcs.AIarXiv:2402.10171v12024
  22. Comparative layer-wise analysis of self-supervised speech models

    Ankita Pasad, Bowen Shi, Karen Livescu

    cs.CLcs.LGcs.SDarXiv:2211.03929v32022
  23. Contrastive Attention for Automatic Chest X-ray Report Generation

    Fenglin Liu, Changchang Yin, Xian Wu +5

    cs.CVcs.CLarXiv:2106.06965v52021
  24. The Tatoeba Translation Challenge -- Realistic Data Sets for Low Resource and Multilingual MT

    Jörg Tiedemann

    cs.CLarXiv:2010.06354v12020
  25. Retrieval Head Mechanistically Explains Long-Context Factuality

    Wenhao Wu, Yizhong Wang, Guangxuan Xiao +2

    cs.CLarXiv:2404.15574v12024
  26. ShieldGemma: Generative AI Content Moderation Based on Gemma

    Wenjun Zeng, Yuchi Liu, Ryan Mullins +9

    cs.CLcs.LGarXiv:2407.21772v22024
  27. A network approach to topic models

    Martin Gerlach, Tiago P. Peixoto, Eduardo G. Altmann

    stat.MLcs.CLphysics.data-anarXiv:1708.01677v22017
  28. Exploiting Social Network Structure for Person-to-Person Sentiment Analysis

    Robert West, Hristo S. Paskov, Jure Leskovec +1

    cs.SIcs.CLphysics.soc-pharXiv:1409.2450v12014
  29. Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention

    Tsendsuren Munkhdalai, Manaal Faruqui, Siddharth Gopal

    cs.CLcs.AIcs.LGarXiv:2404.07143v22024
  30. Transfer Learning across Low-Resource, Related Languages for Neural Machine Translation

    Toan Q. Nguyen, David Chiang

    cs.CLarXiv:1708.09803v22017
  31. Large Language Models with Controllable Working Memory

    Daliang Li, Ankit Singh Rawat, Manzil Zaheer +5

    cs.CLcs.AIcs.LGarXiv:2211.05110v12022
  32. Robust Distant Supervision Relation Extraction via Deep Reinforcement Learning

    Pengda Qin, Weiran Xu, William Yang Wang

    cs.CLarXiv:1805.09927v12018
  33. EMMA: End-to-End Multimodal Model for Autonomous Driving

    Jyh-Jing Hwang, Runsheng Xu, Hubert Lin +11

    cs.CVcs.AIcs.CLarXiv:2410.23262v32024
  34. UI-Venus-2 Technical Report

    Venus Team, Zhuohan Cai, Haoxing Chen +28

    cs.AIcs.CLcs.CVarXiv:2609.00028v12026
  35. RedPajama: an Open Dataset for Training Large Language Models

    Maurice Weber, Daniel Fu, Quentin Anthony +16

    cs.CLcs.LGarXiv:2411.12372v12024
  36. Control-Data Flow Separation: Stable Prompt Optimization in Multi-Agent LLMs

    Wentao Zhang, Syed Shariyar Murtaza, Junaid Ahmad Bhatti +4

    cs.AIcs.CLcs.MAarXiv:2609.00621v12026
  37. TANDA: Transfer and Adapt Pre-Trained Transformer Models for Answer Sentence Selection

    Siddhant Garg, Thuy Vu, Alessandro Moschitti

    cs.CLarXiv:1911.04118v22019
  38. Many Languages, One Parser

    Waleed Ammar, George Mulcaire, Miguel Ballesteros +2

    cs.CLarXiv:1602.01595v42016
  39. Tagged Back-Translation

    Isaac Caswell, Ciprian Chelba, David Grangier

    cs.CLcs.LGarXiv:1906.06442v12019
  40. SemEval-2017 Task 3: Community Question Answering

    Preslav Nakov, Doris Hoogeveen, Lluís Màrquez +4

    cs.CLcs.AIcs.IRarXiv:1912.00730v12019
  41. StudentSim: Training LLM-based Student Simulators

    Ke Yang, Chenglong Wang, Michel Galley +4

    cs.CLarXiv:2609.01591v12026
  42. Document-level Relation Extraction as Semantic Segmentation

    Ningyu Zhang, Xiang Chen, Xin Xie +6

    cs.CLcs.AIcs.CVarXiv:2106.03618v22021
  43. SyntaxSQLNet: Syntax Tree Networks for Complex and Cross-DomainText-to-SQL Task

    Tao Yu, Michihiro Yasunaga, Kai Yang +4

    cs.CLcs.AIarXiv:1810.05237v22018
  44. Table Meets LLM: Can Large Language Models Understand Structured Table Data? A Benchmark and Empirical Study

    Yuan Sui, Mengyu Zhou, Mingjie Zhou +2

    cs.CLcs.AIcs.IRarXiv:2305.13062v52023
  45. Fine-tuning ChatGPT for Automatic Scoring

    Ehsan Latif, Xiaoming Zhai

    cs.CLcs.AIarXiv:2310.10072v32023
  46. LGESQL: Line Graph Enhanced Text-to-SQL Model with Mixed Local and Non-Local Relations

    Ruisheng Cao, Lu Chen, Zhi Chen +3

    cs.CLarXiv:2106.01093v32021
  47. ESPnet-TTS: Unified, Reproducible, and Integratable Open Source End-to-End Text-to-Speech Toolkit

    Tomoki Hayashi, Ryuichi Yamamoto, Katsuki Inoue +6

    cs.CLeess.ASarXiv:1910.10909v22019
  48. Exploring Neural Transducers for End-to-End Speech Recognition

    Eric Battenberg, Jitong Chen, Rewon Child +8

    cs.CLcs.NEarXiv:1707.07413v12017
  49. EM^2Mem: Event-Centric Multimodal Memory for Large Language Models

    Yijun Chen, Yaqi Zheng, Yanya Li +11

    cs.CLcs.AIcs.LGarXiv:2609.00551v12026
  50. Event Representations for Automated Story Generation with Deep Neural Nets

    Lara J. Martin, Prithviraj Ammanabrolu, Xinyu Wang +4

    cs.CLcs.AIcs.LGarXiv:1706.01331v32017
  51. DocPrompting: Generating Code by Retrieving the Docs

    Shuyan Zhou, Uri Alon, Frank F. Xu +3

    cs.CLcs.AIcs.SEarXiv:2207.05987v32022
  52. WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning

    Zehan Qi, Xiao Liu, Iat Long Iong +11

    cs.CLarXiv:2411.02337v32024
  53. Multilingual Twitter Sentiment Classification: The Role of Human Annotators

    Igor Mozetic, Miha Grcar, Jasmina Smailovic

    cs.CLcs.AIarXiv:1602.07563v22016
  54. Deep Bayesian Active Learning for Natural Language Processing: Results of a Large-Scale Empirical Study

    Aditya Siddhant, Zachary C. Lipton

    cs.CLcs.LGstat.MLarXiv:1808.05697v32018
  55. Cost-Efficient Large Language Model Serving for Multi-turn Conversations with CachedAttention

    Bin Gao, Zhuomin He, Puru Sharma +6

    cs.CLcs.LGarXiv:2403.19708v32024
  56. GUI-CC: Benchmarking Contextual Consistency of GUI World Models as Agent Environments

    Lin Fu, Zheyuan Yang, Tianhui Zhang +5

    cs.CLcs.AIarXiv:2609.00048v12026
  57. Findings of the Second Shared Task on Multimodal Machine Translation and Multilingual Image Description

    Desmond Elliott, Stella Frank, Loïc Barrault +2

    cs.CLcs.CVarXiv:1710.07177v12017
  58. On Adversarial Examples for Character-Level Neural Machine Translation

    Javid Ebrahimi, Daniel Lowd, Dejing Dou

    cs.CLcs.AIarXiv:1806.09030v12018
  59. Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data

    Chaoyi Wu, Xiaoman Zhang, Ya Zhang +2

    cs.CVcs.CLarXiv:2308.02463v52023
  60. TimeTraveler: Reinforcement Learning for Temporal Knowledge Graph Forecasting

    Haohai Sun, Jialun Zhong, Yunpu Ma +2

    cs.LGcs.AIcs.CLarXiv:2109.04101v12021