Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,741 to 4,800 of 11,259

  1. Document-Level Machine Translation with Large Language Models

    Longyue Wang, Chenyang Lyu, Tianbo Ji +4

    cs.CLcs.AIarXiv:2304.02210v22023
  2. TALM: Tool Augmented Language Models

    Aaron Parisi, Yao Zhao, Noah Fiedel

    cs.CLcs.AIarXiv:2205.12255v12022
  3. A Survey on Open Information Extraction

    Christina Niklaus, Matthias Cetto, André Freitas +1

    cs.CLarXiv:1806.05599v12018
  4. Meta-Transformer: A Unified Framework for Multimodal Learning

    Yiyuan Zhang, Kaixiong Gong, Kaipeng Zhang +4

    cs.CVcs.AIcs.CLarXiv:2307.10802v12023
  5. Advancing LLM Reasoning Generalists with Preference Trees

    Lifan Yuan, Ganqu Cui, Hanbin Wang +12

    cs.AIcs.CLcs.LGarXiv:2404.02078v12024
  6. Mixing Dirichlet Topic Models and Word Embeddings to Make lda2vec

    Christopher E Moody

    cs.CLarXiv:1605.02019v12016
  7. Unsupervised Question Decomposition for Question Answering

    Ethan Perez, Patrick Lewis, Wen-tau Yih +2

    cs.CLcs.AIcs.LGarXiv:2002.09758v32020
  8. Integrating Document Clustering and Topic Modeling

    Pengtao Xie, Eric P. Xing

    cs.LGcs.CLcs.IRarXiv:1309.6874v12013
  9. Joint Entity and Relation Extraction with Set Prediction Networks

    Dianbo Sui, Yubo Chen, Kang Liu +3

    cs.CLarXiv:2011.01675v22020
  10. LeakageBench: Document-Level Leakage Risk for Redacting Personally Identifiable Information in Document Images

    Vishnu Prasad Vijaya Kumar, Santhosh Venkatesh, Ivan P. Yamshchikov

    cs.CVcs.CLarXiv:2609.02207v12026
  11. Optimizing the Factual Correctness of a Summary: A Study of Summarizing Radiology Reports

    Yuhao Zhang, Derek Merck, Emily Bao Tsai +2

    cs.CLarXiv:1911.02541v32019
  12. Inter-sentence Relation Extraction with Document-level Graph Convolutional Neural Network

    Sunil Kumar Sahu, Fenia Christopoulou, Makoto Miwa +1

    cs.CLcs.IRarXiv:1906.04684v12019
  13. mGPT: Few-Shot Learners Go Multilingual

    Oleh Shliazhko, Alena Fenogenova, Maria Tikhonova +3

    cs.CLcs.AIarXiv:2204.07580v22022
  14. Selective Knowledge Edit Reversal via Gated Singular Vector Shrinkage

    Weifeng Jiang, Ruirui Chen, Qianren Mao +3

    cs.CLarXiv:2609.02091v12026
  15. How Output Format Confounds Data Quality and Capability in Instruction Tuning

    Chengguang Gan, Hanjun Wei, Yunhao Liang +3

    cs.CLarXiv:2609.02015v12026
  16. Transfer Safety Awareness for Cross-Modal Safety Drift in Multimodal Large Language Models

    Tianqi Xiao, Shiyao Cui, Minghao Zhang +2

    cs.MMcs.AIcs.CLarXiv:2609.02082v12026
  17. Cloze-driven Pretraining of Self-attention Networks

    Alexei Baevski, Sergey Edunov, Yinhan Liu +2

    cs.CLarXiv:1903.07785v12019
  18. Dutch Books for Language Models

    Isaiah Andrews, Suproteem Sarkar

    econ.GNcs.AIcs.CLarXiv:2609.02797v12026
  19. Meta-learning via Language Model In-context Tuning

    Yanda Chen, Ruiqi Zhong, Sheng Zha +2

    cs.CLcs.LGarXiv:2110.07814v22021
  20. Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model

    Deepanway Ghosal, Navonil Majumder, Ambuj Mehrish +1

    eess.AScs.AIcs.CLarXiv:2304.13731v22023
  21. ILDC for CJPE: Indian Legal Documents Corpus for Court Judgment Prediction and Explanation

    Vijit Malik, Rishabh Sanjay, Shubham Kumar Nigam +4

    cs.CLcs.AIarXiv:2105.13562v22021
  22. Few-shot Natural Language Generation for Task-Oriented Dialog

    Baolin Peng, Chenguang Zhu, Chunyuan Li +4

    cs.CLarXiv:2002.12328v12020
  23. HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale

    Junying Chen, Chi Gui, Ruyi Ouyang +10

    cs.CVcs.AIcs.CLarXiv:2406.19280v42024
  24. Multi-Sentence Argument Linking

    Seth Ebner, Patrick Xia, Ryan Culkin +2

    cs.CLarXiv:1911.03766v32019
  25. ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL

    Yifei Zhou, Andrea Zanette, Jiayi Pan +2

    cs.LGcs.AIcs.CLarXiv:2402.19446v12024
  26. Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering

    Vaibhav Adlakha, Parishad BehnamGhader, Xing Han Lu +2

    cs.CLcs.AIarXiv:2307.16877v22023
  27. Learning Symmetric Collaborative Dialogue Agents with Dynamic Knowledge Graph Embeddings

    He He, Anusha Balakrishnan, Mihail Eric +1

    cs.CLarXiv:1704.07130v12017
  28. AlphaMath Almost Zero: Process Supervision without Process

    Guoxin Chen, Minpeng Liao, Chengxi Li +1

    cs.CLcs.AIarXiv:2405.03553v32024
  29. Multi-Reward Reinforced Summarization with Saliency and Entailment

    Ramakanth Pasunuru, Mohit Bansal

    cs.CLcs.AIcs.LGarXiv:1804.06451v22018
  30. What do RNN Language Models Learn about Filler-Gap Dependencies?

    Ethan Wilcox, Roger Levy, Takashi Morita +1

    cs.CLarXiv:1809.00042v12018
  31. Having Beer after Prayer? Measuring Cultural Bias in Large Language Models

    Tarek Naous, Michael J. Ryan, Alan Ritter +1

    cs.CLcs.AIcs.LGarXiv:2305.14456v42023
  32. Multi-modal Dense Video Captioning

    Vladimir Iashin, Esa Rahtu

    cs.CVcs.CLcs.LGarXiv:2003.07758v22020
  33. Towards Measuring and Modeling "Culture" in LLMs: A Survey

    Muhammad Farid Adilazuarda, Sagnik Mukherjee, Pradhyumna Lavania +5

    cs.CYcs.AIcs.CLarXiv:2403.15412v52024
  34. What Algorithms can Transformers Learn? A Study in Length Generalization

    Hattie Zhou, Arwen Bradley, Etai Littwin +5

    cs.LGcs.AIcs.CLarXiv:2310.16028v12023
  35. COLD Decoding: Energy-based Constrained Text Generation with Langevin Dynamics

    Lianhui Qin, Sean Welleck, Daniel Khashabi +1

    cs.CLcs.AIcs.LGarXiv:2202.11705v32022
  36. On the Representation Collapse of Sparse Mixture of Experts

    Zewen Chi, Li Dong, Shaohan Huang +9

    cs.CLcs.LGarXiv:2204.09179v32022
  37. Recent Advances and Challenges in Task-oriented Dialog System

    Zheng Zhang, Ryuichi Takanobu, Qi Zhu +2

    cs.CLarXiv:2003.07490v32020
  38. Graph Optimal Transport for Cross-Domain Alignment

    Liqun Chen, Zhe Gan, Yu Cheng +3

    cs.CLcs.CVcs.LGarXiv:2006.14744v32020
  39. ZeroSCROLLS: A Zero-Shot Benchmark for Long Text Understanding

    Uri Shaham, Maor Ivgi, Avia Efrat +2

    cs.CLcs.AIcs.LGarXiv:2305.14196v32023
  40. Sparse Overcomplete Word Vector Representations

    Manaal Faruqui, Yulia Tsvetkov, Dani Yogatama +2

    cs.CLarXiv:1506.02004v12015
  41. Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge

    Tianhao Wu, Weizhe Yuan, Olga Golovneva +5

    cs.CLcs.AIarXiv:2407.19594v22024
  42. Trace as State: Reasoning Traces as Conditional States for Long-Context Transformers

    Xu Zou, Jie Tang

    cs.CLarXiv:2609.02702v12026
  43. Entity Structure Within and Throughout: Modeling Mention Dependencies for Document-Level Relation Extraction

    Benfeng Xu, Quan Wang, Yajuan Lyu +2

    cs.CLcs.AIarXiv:2102.10249v12021
  44. VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation

    Max Ku, Dongfu Jiang, Cong Wei +2

    cs.CVcs.AIcs.CLarXiv:2312.14867v22023
  45. Towards a Cleaner Document-Oriented Multilingual Crawled Corpus

    Julien Abadji, Pedro Ortiz Suarez, Laurent Romary +1

    cs.CLarXiv:2201.06642v12022
  46. Complex Sequential Question Answering: Towards Learning to Converse Over Linked Question Answer Pairs with a Knowledge Graph

    Amrita Saha, Vardaan Pahuja, Mitesh M. Khapra +2

    cs.CLarXiv:1801.10314v22018
  47. Automatically Neutralizing Subjective Bias in Text

    Reid Pryzant, Richard Diehl Martinez, Nathan Dass +3

    cs.CLcs.AIarXiv:1911.09709v32019
  48. Learning Evidence Sufficiency Boundaries for Selective Answering in Grounded Multi-Hop QA

    Haruto Sato, Yuki Tanaka, Ren Nakamura +2

    cs.CLarXiv:2609.01687v12026
  49. AMMU : A Survey of Transformer-based Biomedical Pretrained Language Models

    Katikapalli Subramanyam Kalyan, Ajit Rajasekharan, Sivanesan Sangeetha

    cs.CLcs.AIcs.LGarXiv:2105.00827v22021
  50. Towards generalisable hate speech detection: a review on obstacles and solutions

    Wenjie Yin, Arkaitz Zubiaga

    cs.CLarXiv:2102.08886v12021
  51. The Revolution of Multimodal Large Language Models: A Survey

    Davide Caffagni, Federico Cocchi, Luca Barsellotti +6

    cs.CVcs.AIcs.CLarXiv:2402.12451v22024
  52. SonicCaps: Large-Scale Diverse and Fine-Grained Captioning for Improved Audio-Retrieval

    Zineb Lahrichi, Marc Ferras, Gaël Richard +1

    cs.SDcs.CLcs.MMarXiv:2609.02343v12026
  53. Named Entity Recognition and Classification on Historical Documents: A Survey

    Maud Ehrmann, Ahmed Hamdi, Elvys Linhares Pontes +2

    cs.CLcs.LGarXiv:2109.11406v12021
  54. SciMON: Scientific Inspiration Machines Optimized for Novelty

    Qingyun Wang, Doug Downey, Heng Ji +1

    cs.CLcs.AIcs.LGarXiv:2305.14259v72023
  55. A Tri-Agent Framework for Evaluating and Aligning Question Clarification Capabilities of Large Language Models

    Yikai Zhao, Saurabh Pandey, Pradeep Kumar Misra

    cs.CLarXiv:2609.02054v12026
  56. A Review of Sparse Expert Models in Deep Learning

    William Fedus, Jeff Dean, Barret Zoph

    cs.LGcs.CLarXiv:2209.01667v12022
  57. DKL: Decoupled Knowledge Learning for Instruction-Tuned Language Models

    Kushagra Bhushan, Meghanadh Pulivarthi, Sai Krishna Reddy Sathi +7

    cs.CLcs.AIarXiv:2609.02685v12026
  58. DiffIE: Diffusion-based Open Information Extraction

    Konstantin Fedorov, Valentin Malykh

    cs.CLcs.AIarXiv:2609.02315v12026
  59. Efficient GUI Agents: A Systems Survey of Observation, Memory, Action, and Runtime Optimization

    Bizhe Bai, Jiakang Yuan, Hongming Wu +8

    cs.CLarXiv:2609.02309v12026
  60. W2VLDA: Almost Unsupervised System for Aspect Based Sentiment Analysis

    Aitor García-Pablos, Montse Cuadros, German Rigau

    cs.CLarXiv:1705.07687v22017