Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
481 to 540 of 11,224
Understanding Social Reasoning in Language Models with Language Models
Kanishk Gandhi, Jan-Philipp Fränken, Tobias Gerstenberg +1
cs.CLcs.AIcs.HCarXiv:2306.15448v22023Unifying Large Language Models and Knowledge Graphs: A Roadmap
Shirui Pan, Linhao Luo, Yufei Wang +3
cs.CLcs.AIarXiv:2306.08302v32023RestGPT: Connecting Large Language Models with Real-World RESTful APIs
Yifan Song, Weimin Xiong, Dawei Zhu +9
cs.CLarXiv:2306.06624v22023SimAlign: High Quality Word Alignments without Parallel Training Data using Static and Contextualized Embeddings
Masoud Jalili Sabet, Philipp Dufter, François Yvon +1
cs.CLarXiv:2004.08728v42020Knowledge-Augmented Language Model Prompting for Zero-Shot Knowledge Graph Question Answering
Jinheon Baek, Alham Fikri Aji, Amir Saffari
cs.CLarXiv:2306.04136v12023LLM-Pruner: On the Structural Pruning of Large Language Models
Xinyin Ma, Gongfan Fang, Xinchao Wang
cs.CLarXiv:2305.11627v32023Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
Wenhao Zhu, Hongyi Liu, Qingxiu Dong +5
cs.CLarXiv:2304.04675v42023Non-Autoregressive Machine Translation with Latent Alignments
Chitwan Saharia, William Chan, Saurabh Saxena +1
cs.CLcs.LGarXiv:2004.07437v32020A Bibliometric Review of Large Language Models Research from 2017 to 2023
Lizhou Fan, Lingyao Li, Zihui Ma +3
cs.DLcs.CLcs.CYarXiv:2304.02020v12023Deep Learning Models for Multilingual Hate Speech Detection
Sai Saketh Aluru, Binny Mathew, Punyajoy Saha +1
cs.SIcs.CLarXiv:2004.06465v32020Self-Refine: Iterative Refinement with Self-Feedback
Aman Madaan, Niket Tandon, Prakhar Gupta +13
cs.CLcs.AIcs.LGarXiv:2303.17651v22023Summaries:한국어Injecting Numerical Reasoning Skills into Language Models
Mor Geva, Ankit Gupta, Jonathan Berant
cs.CLarXiv:2004.04487v12020Stabilizing Transformer Training by Preventing Attention Entropy Collapse
Shuangfei Zhai, Tatiana Likhomanenko, Etai Littwin +5
cs.LGcs.AIcs.CLarXiv:2303.06296v22023Are These Modules Worth Their Cost? A Paradigm-Level Accuracy-Cost Analysis of In-context Learning Text-to-SQL
Jiayan Lin, Yujia Liu, Zijin Hong +6
cs.CLcs.AIcs.DBarXiv:2608.28432v12026A Survey and Classification of Controlled Natural Languages
Tobias Kuhn
cs.CLarXiv:1507.01701v12015RuleWeaver: Benchmarking Rule-Centered Scenario Reasoning for Large Language Models
Bohan Yu, Shi-Yang Li, Pengfei Cao +2
cs.CLarXiv:2608.26832v12026Double Trouble: Bilingual Pretraining Leaves Language-Conditioned Effects in Shared-Language Representations
Anjishnu Mukherjee, Ziwei Zhu, Antonios Anastasopoulos
cs.CLarXiv:2608.26576v12026Twitter Sentiment Analysis: Lexicon Method, Machine Learning Method and Their Combination
Olga Kolchyna, Tharsis T. P. Souza, Philip Treleaven +1
cs.CLcs.IRcs.LGarXiv:1507.00955v32015MemToC: Benchmarking Memory-Tool Conflict Resolution in Large Language Models
Arseniy Varlamov, Rishat Zinnatullin, Elisei Rykov +2
cs.CLcs.AIcs.MAarXiv:2608.26295v12026Europarl-ST: A Multilingual Corpus For Speech Translation Of Parliamentary Debates
Javier Iranzo-Sánchez, Joan Albert Silvestre-Cerdà, Javier Jorge +5
cs.CLcs.SDeess.ASarXiv:1911.03167v32019How Good Are GPT Models at Machine Translation? A Comprehensive Evaluation
Amr Hendy, Mohamed Abdelrehim, Amr Sharaf +6
cs.CLarXiv:2302.09210v12023CN-CELEB: a challenging Chinese speaker recognition dataset
Yue Fan, Jiawen Kang, Lantian Li +7
eess.AScs.CLcs.SDarXiv:1911.01799v12019Text Understanding from Scratch
Xiang Zhang, Yann LeCun
cs.LGcs.CLarXiv:1502.01710v52015A Dataset for Movie Description
Anna Rohrbach, Marcus Rohrbach, Niket Tandon +1
cs.CVcs.CLcs.IRarXiv:1501.02530v12015The Dialect Tax: Dialectal Biases Persist throughout the Language Modeling Pipeline
Elle
cs.CLcs.AIcs.LGarXiv:2608.24952v12026Prompting Is Programming: A Query Language for Large Language Models
Luca Beurer-Kellner, Marc Fischer, Martin Vechev
cs.CLcs.AIarXiv:2212.06094v32022Addressing the Rare Word Problem in Neural Machine Translation
Minh-Thang Luong, Ilya Sutskever, Quoc V. Le +2
cs.CLcs.LGcs.NEarXiv:1410.8206v42014An Empirical Study of Incorporating Pseudo Data into Grammatical Error Correction
Shun Kiyono, Jun Suzuki, Masato Mita +2
cs.CLarXiv:1909.00502v12019FARCA: Fact-Aligned Reliability-Aware Credit Assignment for Reinforcement Learning with Factual Supervision
Qiming Xie, Wenjie Zheng, Xiangqing Shen +1
cs.CLcs.AIarXiv:2608.24350v12026GLM-130B: An Open Bilingual Pre-trained Model
Aohan Zeng, Xiao Liu, Zhengxiao Du +15
cs.CLcs.AIcs.LGarXiv:2210.02414v22022'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection
Fawzia Zehra, Kara-Isitt, Sonal Khosla +1
cs.CLcs.AIarXiv:2608.24191v12026Natural Language Processing of Clinical Notes on Chronic Diseases: Systematic Review
Seyedmostafa Sheikhalishahi, Riccardo Miotto, Joel T Dudley +3
cs.CYcs.AIcs.CLarXiv:1908.05780v12019AgentSpec: Speculative Decoding for Batch Inference of LLM Agents
Xin Wang, Ziming Miao, Yi Zhu +4
cs.CLarXiv:2608.24004v12026Improving alignment of dialogue agents via targeted human judgements
Amelia Glaese, Nat McAleese, Maja Trębacz +31
cs.LGcs.CLarXiv:2209.14375v12022Video In Sentences Out
Andrei Barbu, Alexander Bridge, Zachary Burchill +15
cs.CVcs.CLcs.IRarXiv:1408.6418v12014Counterfactual Data Augmentation for Mitigating Gender Stereotypes in Languages with Rich Morphology
Ran Zmigrod, Sabrina J. Mielke, Hanna Wallach +1
cs.CLarXiv:1906.04571v32019Is Attention Interpretable?
Sofia Serrano, Noah A. Smith
cs.CLarXiv:1906.03731v12019Cognitive Profiling of LRMs' Reasoning Traces Using Bloom's Taxonomy
Maria-Eleni Zoumpoulidi, Georgios Paraskevopoulos, Alexandros Potamianos
cs.AIcs.CLarXiv:2608.23205v12026Learning Deep Transformer Models for Machine Translation
Qiang Wang, Bei Li, Tong Xiao +4
cs.CLcs.LGarXiv:1906.01787v12019Language models show human-like content effects on reasoning tasks
Ishita Dasgupta, Andrew K. Lampinen, Stephanie C. Y. Chan +5
cs.CLcs.AIcs.LGarXiv:2207.07051v42022LLM Pedagogical Behavior in AI Tutoring Interactions
Suhyeon Lee, Juneha Baek, Jaehyeong Park +1
cs.CLcs.HCarXiv:2608.22993v12026Towards Complex Text-to-SQL in Cross-Domain Database with Intermediate Representation
Jiaqi Guo, Zecheng Zhan, Yan Gao +4
cs.CLarXiv:1905.08205v22019Self-critiquing models for assisting human evaluators
William Saunders, Catherine Yeh, Jeff Wu +4
cs.CLcs.LGarXiv:2206.05802v22022MemGuard: Persisting Verifier Signals for LLM-Agent Memory Governance
Haoyu Wang, Guangyuan Dong, He Liang +5
cs.AIcs.CLarXiv:2608.21867v12026Challenges in Building Intelligent Open-domain Dialog Systems
Minlie Huang, Xiaoyan Zhu, Jianfeng Gao
cs.CLcs.AIarXiv:1905.05709v32019SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems
Alex Wang, Yada Pruksachatkun, Nikita Nangia +5
cs.CLcs.AIarXiv:1905.00537v32019Tangut Word Segmentation under Extreme Resource Scarcity: Integrating Traditional Lexicons and Unlabeled Text
Lifan Deng, Yongwei Zhang, Sen Sun +2
cs.CLarXiv:2608.18437v12026Summaries:한국어Redakto - The Incognito Tab for LLMs
Saurav Kumar Saha, Tom Röhr, Felix Bießmann
cs.AIcs.CLcs.CRarXiv:2608.18260v12026Learning to Speak and Act in a Fantasy Text Adventure Game
Jack Urbanek, Angela Fan, Siddharth Karamcheti +7
cs.CLcs.AIarXiv:1903.03094v12019The IOL-AI Challenge: An Open Challenge towards Advancing Linguistic Reasoning
Eduardo Sánchez, Rita Berrada, Dan-Mircea Mirea +8
cs.CLarXiv:2608.18011v12026STaR: Bootstrapping Reasoning With Reasoning
Eric Zelikman, Yuhuai Wu, Jesse Mu +1
cs.LGcs.AIcs.CLarXiv:2203.14465v22022BEAR-Bench: A Bilingual Enterprise and Academic Reasoning Benchmark for Multimodal Models
Liubov Chubarova, Alexandra Kuleshova, Daniil Volkov +2
cs.CLcs.AIarXiv:2608.17895v12026Semantic Neural Machine Translation using AMR
Linfeng Song, Daniel Gildea, Yue Zhang +2
cs.CLcs.AIarXiv:1902.07282v12019Chart-to-Text: A Large-Scale Benchmark for Chart Summarization
Shankar Kantharaj, Rixie Tiffany Ko Leong, Xiang Lin +4
cs.CLarXiv:2203.06486v32022Time as Structure: Temporal Dependency Graphs for Verifiable Deadline Computation over Legal Documents
Maryia Zhyrko, Lifeng Han, Suzan Verberne
cs.CLarXiv:2608.15270v12026Does a Tool Result Carry More Authority Than Plain Text? Three Prospective Studies of False-Claim Adoption in a Synthetic Assignment Task with Claude Opus 5
Justin Bronder
cs.AIcs.CLarXiv:2608.14992v12026Language Models as Zero-Shot Planners: Extracting Actionable Knowledge for Embodied Agents
Wenlong Huang, Pieter Abbeel, Deepak Pathak +1
cs.LGcs.AIcs.CLarXiv:2201.07207v22022Prompting Visual-Language Models for Efficient Video Understanding
Chen Ju, Tengda Han, Kunhao Zheng +2
cs.CVcs.CLarXiv:2112.04478v22021Synthetic Persona Pretraining: Alignment from Token Zero
Julian Minder, Viktor Moskvoretskii, Raghav Singhal +12
cs.LGcs.AIcs.CLarXiv:2608.13482v12026Leveraging Automated Unit Tests for Unsupervised Code Translation
Baptiste Roziere, Jie M. Zhang, Francois Charton +3
cs.SEcs.CLcs.LGarXiv:2110.06773v22021