Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,241 to 6,300 of 11,332

  1. An analysis of incorporating an external language model into a sequence-to-sequence model

    Anjuli Kannan, Yonghui Wu, Patrick Nguyen +3

    eess.AScs.AIcs.CLarXiv:1712.01996v12017
  2. Secrets of RLHF in Large Language Models Part I: PPO

    Rui Zheng, Shihan Dou, Songyang Gao +24

    cs.CLcs.AIcs.LGarXiv:2307.04964v22023
  3. Testing of Detection Tools for AI-Generated Text

    Debora Weber-Wulff, Alla Anohina-Naumeca, Sonja Bjelobaba +5

    cs.CLcs.AIcs.CYarXiv:2306.15666v22023
  4. BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks

    Kai Zhang, Rong Zhou, Eashan Adhikarla +20

    cs.CLcs.AIarXiv:2305.17100v42023
  5. Does Localization Inform Editing? Surprising Differences in Causality-Based Localization vs. Knowledge Editing in Language Models

    Peter Hase, Mohit Bansal, Been Kim +1

    cs.LGcs.AIcs.CLarXiv:2301.04213v22023
  6. The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics

    Sebastian Gehrmann, Tosin Adewumi, Karmanya Aggarwal +53

    cs.CLcs.AIcs.LGarXiv:2102.01672v32021
  7. Incremental Knowledge Base Construction Using DeepDive

    Jaeho Shin, Sen Wu, Feiran Wang +3

    cs.DBcs.CLcs.LGarXiv:1502.00731v42015
  8. Query2doc: Query Expansion with Large Language Models

    Liang Wang, Nan Yang, Furu Wei

    cs.IRcs.CLarXiv:2303.07678v22023
  9. Any-to-Any Generation via Composable Diffusion

    Zineng Tang, Ziyi Yang, Chenguang Zhu +2

    cs.CVcs.CLcs.LGarXiv:2305.11846v12023
  10. Transformers without Tears: Improving the Normalization of Self-Attention

    Toan Q. Nguyen, Julian Salazar

    cs.CLcs.LGstat.MLarXiv:1910.05895v22019
  11. DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models

    Licheng Wen, Daocheng Fu, Xin Li +7

    cs.ROcs.CLarXiv:2309.16292v32023
  12. In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering

    Sheng Liu, Haotian Ye, Lei Xing +1

    cs.LGcs.AIcs.CLarXiv:2311.06668v32023
  13. The IIT Bombay English-Hindi Parallel Corpus

    Anoop Kunchukuttan, Pratik Mehta, Pushpak Bhattacharyya

    cs.CLarXiv:1710.02855v22017
  14. C3: Zero-shot Text-to-SQL with ChatGPT

    Xuemei Dong, Chao Zhang, Yuhang Ge +5

    cs.CLcs.AIarXiv:2307.07306v12023
  15. Text Classification via Large Language Models

    Xiaofei Sun, Xiaoya Li, Jiwei Li +4

    cs.CLarXiv:2305.08377v32023
  16. Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks

    Erfan Shayegani, Md Abdullah Al Mamun, Yu Fu +3

    cs.CLcs.CRcs.LGarXiv:2310.10844v12023
  17. Problems With Evaluation of Word Embeddings Using Word Similarity Tasks

    Manaal Faruqui, Yulia Tsvetkov, Pushpendre Rastogi +1

    cs.CLarXiv:1605.02276v32016
  18. TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks

    Frank F. Xu, Yufan Song, Boxuan Li +18

    cs.CLarXiv:2412.14161v32024
  19. Retrieving Relations, Detecting Fallacies: A RAG Approach to Political Debate Analysis

    Deborah Dore, Greta Damo, Elena Cabrio +1

    cs.AIcs.CLarXiv:2608.27471v12026
  20. Learning Natural Language Inference using Bidirectional LSTM model and Inner-Attention

    Yang Liu, Chengjie Sun, Lei Lin +1

    cs.CLarXiv:1605.09090v12016
  21. CLUTRR: A Diagnostic Benchmark for Inductive Reasoning from Text

    Koustuv Sinha, Shagun Sodhani, Jin Dong +2

    cs.LGcs.CLcs.LOarXiv:1908.06177v22019
  22. On Second Thought, Let's Not Think Step by Step! Bias and Toxicity in Zero-Shot Reasoning

    Omar Shaikh, Hongxin Zhang, William Held +2

    cs.CLarXiv:2212.08061v22022
  23. DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models

    Sam Ade Jacobs, Masahiro Tanaka, Chengming Zhang +4

    cs.LGcs.CLcs.DCarXiv:2309.14509v22023
  24. Selective Question Answering under Domain Shift

    Amita Kamath, Robin Jia, Percy Liang

    cs.CLcs.LGarXiv:2006.09462v12020
  25. A Diagnostic Study of Explainability Techniques for Text Classification

    Pepa Atanasova, Jakob Grue Simonsen, Christina Lioma +1

    cs.CLcs.LGarXiv:2009.13295v12020
  26. Multi-view Knowledge Graph Embedding for Entity Alignment

    Qingheng Zhang, Zequn Sun, Wei Hu +3

    cs.AIcs.CLcs.LGarXiv:1906.02390v12019
  27. Table-to-text Generation by Structure-aware Seq2seq Learning

    Tianyu Liu, Kexiang Wang, Lei Sha +2

    cs.CLcs.AIarXiv:1711.09724v12017
  28. OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis

    Zhuofeng Li, Dongfu Jiang, Xueguang Ma +7

    cs.IRcs.AIcs.CLarXiv:2603.20278v12026
  29. Efficient Reasoning on the Edge

    Yelysei Bondarenko, Thomas Hehn, Rob Hesselink +15

    cs.LGcs.CLarXiv:2603.16867v22026
  30. daVinci-Env: Open SWE Environment Synthesis at Scale

    Dayuan Fu, Shenyu Wu, Yunze Wu +11

    cs.SEcs.AIcs.CLarXiv:2603.13023v22026
  31. Large language models can accurately predict searcher preferences

    Paul Thomas, Seth Spielman, Nick Craswell +1

    cs.IRcs.AIcs.CLarXiv:2309.10621v32023
  32. Cross-Recurrence Quantification Analysis of Categorical and Continuous Time Series: an R package

    Moreno I. Coco, Rick Dale

    cs.CLstat.AParXiv:1310.0201v22013
  33. Evolution of Semantic Similarity -- A Survey

    Dhivya Chandrasekaran, Vijay Mago

    cs.CLcs.IRarXiv:2004.13820v22020
  34. PlotQA: Reasoning over Scientific Plots

    Nitesh Methani, Pritha Ganguly, Mitesh M. Khapra +1

    cs.CVcs.AIcs.CLarXiv:1909.00997v32019
  35. Insertion Transformer: Flexible Sequence Generation via Insertion Operations

    Mitchell Stern, William Chan, Jamie Kiros +1

    cs.CLcs.LGstat.MLarXiv:1902.03249v12019
  36. Multi-hop Reading Comprehension through Question Decomposition and Rescoring

    Sewon Min, Victor Zhong, Luke Zettlemoyer +1

    cs.CLcs.AIarXiv:1906.02916v22019
  37. The Voice Conversion Challenge 2018: Promoting Development of Parallel and Nonparallel Methods

    Jaime Lorenzo-Trueba, Junichi Yamagishi, Tomoki Toda +4

    eess.AScs.CLcs.SDarXiv:1804.04262v12018
  38. Unsupervised Domain Clusters in Pretrained Language Models

    Roee Aharoni, Yoav Goldberg

    cs.CLarXiv:2004.02105v22020
  39. Universal Language Model Fine-tuning for Text Classification

    Jeremy Howard, Sebastian Ruder

    cs.CLcs.LGstat.MLarXiv:1801.06146v52018
  40. Guiding Pretraining in Reinforcement Learning with Large Language Models

    Yuqing Du, Olivia Watkins, Zihan Wang +5

    cs.LGcs.AIcs.CLarXiv:2302.06692v22023
  41. Language Modeling Is Compression

    Grégoire Delétang, Anian Ruoss, Paul-Ambroise Duquenne +9

    cs.LGcs.AIcs.CLarXiv:2309.10668v22023
  42. Direct speech-to-speech translation with a sequence-to-sequence model

    Ye Jia, Ron J. Weiss, Fadi Biadsy +4

    cs.CLcs.LGcs.SDarXiv:1904.06037v22019
  43. Blind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledge

    Zhuoshi Pan, Junru Lu, Yan Qian +3

    cs.CLarXiv:2608.28478v12026
  44. DiffusionBERT: Improving Generative Masked Language Models with Diffusion Models

    Zhengfu He, Tianxiang Sun, Kuanning Wang +2

    cs.CLcs.AIcs.LGarXiv:2211.15029v22022
  45. Multilingual Constituency Parsing with Self-Attention and Pre-Training

    Nikita Kitaev, Steven Cao, Dan Klein

    cs.CLarXiv:1812.11760v22018
  46. TLDR: Extreme Summarization of Scientific Documents

    Isabel Cachola, Kyle Lo, Arman Cohan +1

    cs.CLarXiv:2004.15011v32020
  47. Zero-Resource Translation with Multi-Lingual Neural Machine Translation

    Orhan Firat, Baskaran Sankaran, Yaser Al-Onaizan +2

    cs.CLarXiv:1606.04164v12016
  48. Reformulating Unsupervised Style Transfer as Paraphrase Generation

    Kalpesh Krishna, John Wieting, Mohit Iyyer

    cs.CLarXiv:2010.05700v12020
  49. MDFEND: Multi-domain Fake News Detection

    Qiong Nan, Juan Cao, Yongchun Zhu +2

    cs.CLcs.AIcs.SIarXiv:2201.00987v12022
  50. Hate Speech Detection and Racial Bias Mitigation in Social Media based on BERT model

    Marzieh Mozafari, Reza Farahbakhsh, Noel Crespi

    cs.SIcs.CLcs.IRarXiv:2008.06460v22020
  51. One-Shot Relational Learning for Knowledge Graphs

    Wenhan Xiong, Mo Yu, Shiyu Chang +2

    cs.CLarXiv:1808.09040v12018
  52. Training Software Engineering Agents and Verifiers with SWE-Gym

    Jiayi Pan, Xingyao Wang, Graham Neubig +4

    cs.SEcs.CLarXiv:2412.21139v22024
  53. Double Graph Based Reasoning for Document-level Relation Extraction

    Shuang Zeng, Runxin Xu, Baobao Chang +1

    cs.CLcs.AIcs.LGarXiv:2009.13752v12020
  54. WASSA-2017 Shared Task on Emotion Intensity

    Saif M. Mohammad, Felipe Bravo-Marquez

    cs.CLarXiv:1708.03700v12017
  55. LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models

    Yukang Chen, Shengju Qian, Haotian Tang +4

    cs.CLcs.AIcs.LGarXiv:2309.12307v32023
  56. Unsupervised Commonsense Question Answering with Self-Talk

    Vered Shwartz, Peter West, Ronan Le Bras +2

    cs.CLarXiv:2004.05483v22020
  57. Contextualized Perturbation for Textual Adversarial Attack

    Dianqi Li, Yizhe Zhang, Hao Peng +4

    cs.CLarXiv:2009.07502v22020
  58. Zero-Shot Entity Linking by Reading Entity Descriptions

    Lajanugen Logeswaran, Ming-Wei Chang, Kenton Lee +3

    cs.CLcs.LGarXiv:1906.07348v12019
  59. GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot

    Aohan Zeng, Zhengxiao Du, Mingdao Liu +5

    cs.CLcs.SDeess.ASarXiv:2412.02612v12024
  60. The Science of Detecting LLM-Generated Texts

    Ruixiang Tang, Yu-Neng Chuang, Xia Hu

    cs.CLcs.AIarXiv:2303.07205v32023