Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,741 to 4,800 of 11,259
Document-Level Machine Translation with Large Language Models
Longyue Wang, Chenyang Lyu, Tianbo Ji +4
cs.CLcs.AIarXiv:2304.02210v22023TALM: Tool Augmented Language Models
Aaron Parisi, Yao Zhao, Noah Fiedel
cs.CLcs.AIarXiv:2205.12255v12022A Survey on Open Information Extraction
Christina Niklaus, Matthias Cetto, André Freitas +1
cs.CLarXiv:1806.05599v12018Meta-Transformer: A Unified Framework for Multimodal Learning
Yiyuan Zhang, Kaixiong Gong, Kaipeng Zhang +4
cs.CVcs.AIcs.CLarXiv:2307.10802v12023Advancing LLM Reasoning Generalists with Preference Trees
Lifan Yuan, Ganqu Cui, Hanbin Wang +12
cs.AIcs.CLcs.LGarXiv:2404.02078v12024Mixing Dirichlet Topic Models and Word Embeddings to Make lda2vec
Christopher E Moody
cs.CLarXiv:1605.02019v12016Unsupervised Question Decomposition for Question Answering
Ethan Perez, Patrick Lewis, Wen-tau Yih +2
cs.CLcs.AIcs.LGarXiv:2002.09758v32020Integrating Document Clustering and Topic Modeling
Pengtao Xie, Eric P. Xing
cs.LGcs.CLcs.IRarXiv:1309.6874v12013Joint Entity and Relation Extraction with Set Prediction Networks
Dianbo Sui, Yubo Chen, Kang Liu +3
cs.CLarXiv:2011.01675v22020LeakageBench: Document-Level Leakage Risk for Redacting Personally Identifiable Information in Document Images
Vishnu Prasad Vijaya Kumar, Santhosh Venkatesh, Ivan P. Yamshchikov
cs.CVcs.CLarXiv:2609.02207v12026Optimizing the Factual Correctness of a Summary: A Study of Summarizing Radiology Reports
Yuhao Zhang, Derek Merck, Emily Bao Tsai +2
cs.CLarXiv:1911.02541v32019Inter-sentence Relation Extraction with Document-level Graph Convolutional Neural Network
Sunil Kumar Sahu, Fenia Christopoulou, Makoto Miwa +1
cs.CLcs.IRarXiv:1906.04684v12019mGPT: Few-Shot Learners Go Multilingual
Oleh Shliazhko, Alena Fenogenova, Maria Tikhonova +3
cs.CLcs.AIarXiv:2204.07580v22022Selective Knowledge Edit Reversal via Gated Singular Vector Shrinkage
Weifeng Jiang, Ruirui Chen, Qianren Mao +3
cs.CLarXiv:2609.02091v12026How Output Format Confounds Data Quality and Capability in Instruction Tuning
Chengguang Gan, Hanjun Wei, Yunhao Liang +3
cs.CLarXiv:2609.02015v12026Transfer Safety Awareness for Cross-Modal Safety Drift in Multimodal Large Language Models
Tianqi Xiao, Shiyao Cui, Minghao Zhang +2
cs.MMcs.AIcs.CLarXiv:2609.02082v12026Cloze-driven Pretraining of Self-attention Networks
Alexei Baevski, Sergey Edunov, Yinhan Liu +2
cs.CLarXiv:1903.07785v12019Dutch Books for Language Models
Isaiah Andrews, Suproteem Sarkar
econ.GNcs.AIcs.CLarXiv:2609.02797v12026Meta-learning via Language Model In-context Tuning
Yanda Chen, Ruiqi Zhong, Sheng Zha +2
cs.CLcs.LGarXiv:2110.07814v22021Text-to-Audio Generation using Instruction-Tuned LLM and Latent Diffusion Model
Deepanway Ghosal, Navonil Majumder, Ambuj Mehrish +1
eess.AScs.AIcs.CLarXiv:2304.13731v22023ILDC for CJPE: Indian Legal Documents Corpus for Court Judgment Prediction and Explanation
Vijit Malik, Rishabh Sanjay, Shubham Kumar Nigam +4
cs.CLcs.AIarXiv:2105.13562v22021Few-shot Natural Language Generation for Task-Oriented Dialog
Baolin Peng, Chenguang Zhu, Chunyuan Li +4
cs.CLarXiv:2002.12328v12020HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale
Junying Chen, Chi Gui, Ruyi Ouyang +10
cs.CVcs.AIcs.CLarXiv:2406.19280v42024Multi-Sentence Argument Linking
Seth Ebner, Patrick Xia, Ryan Culkin +2
cs.CLarXiv:1911.03766v32019ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
Yifei Zhou, Andrea Zanette, Jiayi Pan +2
cs.LGcs.AIcs.CLarXiv:2402.19446v12024Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering
Vaibhav Adlakha, Parishad BehnamGhader, Xing Han Lu +2
cs.CLcs.AIarXiv:2307.16877v22023Learning Symmetric Collaborative Dialogue Agents with Dynamic Knowledge Graph Embeddings
He He, Anusha Balakrishnan, Mihail Eric +1
cs.CLarXiv:1704.07130v12017AlphaMath Almost Zero: Process Supervision without Process
Guoxin Chen, Minpeng Liao, Chengxi Li +1
cs.CLcs.AIarXiv:2405.03553v32024Multi-Reward Reinforced Summarization with Saliency and Entailment
Ramakanth Pasunuru, Mohit Bansal
cs.CLcs.AIcs.LGarXiv:1804.06451v22018What do RNN Language Models Learn about Filler-Gap Dependencies?
Ethan Wilcox, Roger Levy, Takashi Morita +1
cs.CLarXiv:1809.00042v12018Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
Tarek Naous, Michael J. Ryan, Alan Ritter +1
cs.CLcs.AIcs.LGarXiv:2305.14456v42023Multi-modal Dense Video Captioning
Vladimir Iashin, Esa Rahtu
cs.CVcs.CLcs.LGarXiv:2003.07758v22020Towards Measuring and Modeling "Culture" in LLMs: A Survey
Muhammad Farid Adilazuarda, Sagnik Mukherjee, Pradhyumna Lavania +5
cs.CYcs.AIcs.CLarXiv:2403.15412v52024What Algorithms can Transformers Learn? A Study in Length Generalization
Hattie Zhou, Arwen Bradley, Etai Littwin +5
cs.LGcs.AIcs.CLarXiv:2310.16028v12023COLD Decoding: Energy-based Constrained Text Generation with Langevin Dynamics
Lianhui Qin, Sean Welleck, Daniel Khashabi +1
cs.CLcs.AIcs.LGarXiv:2202.11705v32022On the Representation Collapse of Sparse Mixture of Experts
Zewen Chi, Li Dong, Shaohan Huang +9
cs.CLcs.LGarXiv:2204.09179v32022Recent Advances and Challenges in Task-oriented Dialog System
Zheng Zhang, Ryuichi Takanobu, Qi Zhu +2
cs.CLarXiv:2003.07490v32020Graph Optimal Transport for Cross-Domain Alignment
Liqun Chen, Zhe Gan, Yu Cheng +3
cs.CLcs.CVcs.LGarXiv:2006.14744v32020ZeroSCROLLS: A Zero-Shot Benchmark for Long Text Understanding
Uri Shaham, Maor Ivgi, Avia Efrat +2
cs.CLcs.AIcs.LGarXiv:2305.14196v32023Sparse Overcomplete Word Vector Representations
Manaal Faruqui, Yulia Tsvetkov, Dani Yogatama +2
cs.CLarXiv:1506.02004v12015Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge
Tianhao Wu, Weizhe Yuan, Olga Golovneva +5
cs.CLcs.AIarXiv:2407.19594v22024Trace as State: Reasoning Traces as Conditional States for Long-Context Transformers
Xu Zou, Jie Tang
cs.CLarXiv:2609.02702v12026Entity Structure Within and Throughout: Modeling Mention Dependencies for Document-Level Relation Extraction
Benfeng Xu, Quan Wang, Yajuan Lyu +2
cs.CLcs.AIarXiv:2102.10249v12021VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation
Max Ku, Dongfu Jiang, Cong Wei +2
cs.CVcs.AIcs.CLarXiv:2312.14867v22023Towards a Cleaner Document-Oriented Multilingual Crawled Corpus
Julien Abadji, Pedro Ortiz Suarez, Laurent Romary +1
cs.CLarXiv:2201.06642v12022Complex Sequential Question Answering: Towards Learning to Converse Over Linked Question Answer Pairs with a Knowledge Graph
Amrita Saha, Vardaan Pahuja, Mitesh M. Khapra +2
cs.CLarXiv:1801.10314v22018Automatically Neutralizing Subjective Bias in Text
Reid Pryzant, Richard Diehl Martinez, Nathan Dass +3
cs.CLcs.AIarXiv:1911.09709v32019Learning Evidence Sufficiency Boundaries for Selective Answering in Grounded Multi-Hop QA
Haruto Sato, Yuki Tanaka, Ren Nakamura +2
cs.CLarXiv:2609.01687v12026AMMU : A Survey of Transformer-based Biomedical Pretrained Language Models
Katikapalli Subramanyam Kalyan, Ajit Rajasekharan, Sivanesan Sangeetha
cs.CLcs.AIcs.LGarXiv:2105.00827v22021Towards generalisable hate speech detection: a review on obstacles and solutions
Wenjie Yin, Arkaitz Zubiaga
cs.CLarXiv:2102.08886v12021The Revolution of Multimodal Large Language Models: A Survey
Davide Caffagni, Federico Cocchi, Luca Barsellotti +6
cs.CVcs.AIcs.CLarXiv:2402.12451v22024SonicCaps: Large-Scale Diverse and Fine-Grained Captioning for Improved Audio-Retrieval
Zineb Lahrichi, Marc Ferras, Gaël Richard +1
cs.SDcs.CLcs.MMarXiv:2609.02343v12026Named Entity Recognition and Classification on Historical Documents: A Survey
Maud Ehrmann, Ahmed Hamdi, Elvys Linhares Pontes +2
cs.CLcs.LGarXiv:2109.11406v12021SciMON: Scientific Inspiration Machines Optimized for Novelty
Qingyun Wang, Doug Downey, Heng Ji +1
cs.CLcs.AIcs.LGarXiv:2305.14259v72023A Tri-Agent Framework for Evaluating and Aligning Question Clarification Capabilities of Large Language Models
Yikai Zhao, Saurabh Pandey, Pradeep Kumar Misra
cs.CLarXiv:2609.02054v12026A Review of Sparse Expert Models in Deep Learning
William Fedus, Jeff Dean, Barret Zoph
cs.LGcs.CLarXiv:2209.01667v12022DKL: Decoupled Knowledge Learning for Instruction-Tuned Language Models
Kushagra Bhushan, Meghanadh Pulivarthi, Sai Krishna Reddy Sathi +7
cs.CLcs.AIarXiv:2609.02685v12026DiffIE: Diffusion-based Open Information Extraction
Konstantin Fedorov, Valentin Malykh
cs.CLcs.AIarXiv:2609.02315v12026Efficient GUI Agents: A Systems Survey of Observation, Memory, Action, and Runtime Optimization
Bizhe Bai, Jiakang Yuan, Hongming Wu +8
cs.CLarXiv:2609.02309v12026W2VLDA: Almost Unsupervised System for Aspect Based Sentiment Analysis
Aitor García-Pablos, Montse Cuadros, German Rigau
cs.CLarXiv:1705.07687v22017