Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
5,821 to 5,880 of 11,242
AIM: Anchor Identity Features, Then Match for Multimodal Large Language Model Unlearning
Wonjun Lee, Jaehyuk Jang, Kangwook Ko +2
cs.CVcs.CLarXiv:2608.28312v12026Synth-JDoc: Synthesizing a Japanese Document Image Dataset for OCR with Diverse Layouts and Embedded Images
Keito Sasagawa, Shuhei Kurita, Daisuke Kawahara
cs.CVcs.CLarXiv:2608.28248v12026A Formal Limitation on Learning Human Language From Textual Corpora
Emily Cheng, Ryan Cotterell
cs.CLarXiv:2608.28560v12026Personalized Prompt Learning for Explainable Recommendation
Lei Li, Yongfeng Zhang, Li Chen
cs.IRcs.AIcs.CLarXiv:2202.07371v22022Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine Translation
Di Wu, Sergey Troshin, Christof Monz +2
cs.CLarXiv:2608.28496v12026Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2
Hamish Ivison, Yizhong Wang, Valentina Pyatkin +8
cs.CLarXiv:2311.10702v22023Phoneme- and Word-Level Metrics Using Self-Supervised Speech Representations for Forced Alignment Evaluation
V. S. D. S. Mahesh Akavarapu, Michael Daniel, Gerhard Jäger
cs.CLarXiv:2608.28508v12026Uni3D: Exploring Unified 3D Representation at Scale
Junsheng Zhou, Jinsheng Wang, Baorui Ma +3
cs.CVcs.CLarXiv:2310.06773v12023Zero-Shot Stance Detection: A Dataset and Model using Generalized Topic Representations
Emily Allaway, Kathleen McKeown
cs.CLarXiv:2010.03640v12020FinExam-10K: When Retrieval Helps Financial Reasoning?
Yan Lin, Jingyu Sun, Zhongliang Guo +3
cs.CLarXiv:2608.28155v12026PersonaForge: Realistic Multi-Turn User Simulation for Agentic Systems
Hanglong Lv, Dawei Zhu, Lei Li +11
cs.CLarXiv:2608.28378v12026H-Scale: Hessian-Guided Scale Refinement for NVFP4 Sub-Byte LLM Inference
Hao Yu, Zheng Li, Dayiheng Liu +1
cs.CLarXiv:2608.28113v12026Self-Taught Convolutional Neural Networks for Short Text Clustering
Jiaming Xu, Bo Xu, Peng Wang +4
cs.IRcs.CLarXiv:1701.00185v12017Towards Better UD Parsing: Deep Contextualized Word Embeddings, Ensemble, and Treebank Concatenation
Wanxiang Che, Yijia Liu, Yuxuan Wang +2
cs.CLarXiv:1807.03121v32018MedDialog: Two Large-scale Medical Dialogue Datasets
Xuehai He, Shu Chen, Zeqian Ju +10
cs.LGcs.AIcs.CLarXiv:2004.03329v22020A Unified Framework to Elicit Structured Feedback for Interpretable Multi-Trait Essay Scoring
Shihang Yang, Sanwoo Lee, Ningning Zhao +1
cs.CLarXiv:2608.28407v12026CultureConverse: A Multilingual Multi-turn Simulation Harness for Culturally Grounded Assistance in East and Southeast Asia
Bryan Chen Zhengyu Tan, Weihua Zheng, Thong T. Doan +30
cs.CLcs.CYarXiv:2608.28405v12026A Survey on Efficient Inference for Large Language Models
Zixuan Zhou, Xuefei Ning, Ke Hong +12
cs.CLcs.AIarXiv:2404.14294v32024Semi-Supervised Learning for Neural Machine Translation
Yong Cheng, Wei Xu, Zhongjun He +4
cs.CLarXiv:1606.04596v32016A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness
Fali Wang, Zhiwei Zhang, Xianren Zhang +11
cs.CLcs.AIcs.LGarXiv:2411.03350v22024ClimateBert: A Pretrained Language Model for Climate-Related Text
Nicolas Webersinke, Mathias Kraus, Julia Anna Bingler +1
cs.CLarXiv:2110.12010v32021Exploring Length Generalization in Large Language Models
Cem Anil, Yuhuai Wu, Anders Andreassen +7
cs.CLcs.LGarXiv:2207.04901v22022A Capsule Network-based Embedding Model for Knowledge Graph Completion and Search Personalization
Dai Quoc Nguyen, Thanh Vu, Tu Dinh Nguyen +2
cs.CLcs.IRarXiv:1808.04122v32018Unlearn What You Want to Forget: Efficient Unlearning for LLMs
Jiaao Chen, Diyi Yang
cs.CLcs.AIarXiv:2310.20150v12023Scaling Large Language Model-based Multi-Agent Collaboration
Chen Qian, Zihao Xie, YiFei Wang +9
cs.AIcs.CLcs.MAarXiv:2406.07155v32024Sequence to Backward and Forward Sequences: A Content-Introducing Approach to Generative Short-Text Conversation
Lili Mou, Yiping Song, Rui Yan +3
cs.CLcs.LGarXiv:1607.00970v22016Unsupervised Statistical Machine Translation
Mikel Artetxe, Gorka Labaka, Eneko Agirre
cs.CLcs.AIcs.LGarXiv:1809.01272v12018Joint Robust Voicing Detection and Pitch Estimation Based on Residual Harmonics
Thomas Drugman, Abeer Alwan
cs.SDcs.CLeess.ASarXiv:2001.00459v12019BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack
Yuri Kuratov, Aydar Bulatov, Petr Anokhin +4
cs.CLcs.AIarXiv:2406.10149v22024Supporting Clustering with Contrastive Learning
Dejiao Zhang, Feng Nan, Xiaokai Wei +6
cs.LGcs.CLarXiv:2103.12953v22021MultiModalQA: Complex Question Answering over Text, Tables and Images
Alon Talmor, Ori Yoran, Amnon Catav +6
cs.CLcs.AIcs.LGarXiv:2104.06039v12021On the Sentence Embeddings from Pre-trained Language Models
Bohan Li, Hao Zhou, Junxian He +3
cs.CLcs.LGarXiv:2011.05864v12020Challenges in Discriminating Profanity from Hate Speech
Shervin Malmasi, Marcos Zampieri
cs.CLarXiv:1803.05495v12018Honeybee: Locality-enhanced Projector for Multimodal LLM
Junbum Cha, Wooyoung Kang, Jonghwan Mun +1
cs.CVcs.AIcs.CLarXiv:2312.06742v22023Proving Test Set Contamination in Black Box Language Models
Yonatan Oren, Nicole Meister, Niladri Chatterji +2
cs.CLcs.LGarXiv:2310.17623v22023In-context Examples Selection for Machine Translation
Sweta Agrawal, Chunting Zhou, Mike Lewis +2
cs.CLarXiv:2212.02437v12022Supervised and Semi-Supervised Text Categorization using LSTM for Region Embeddings
Rie Johnson, Tong Zhang
stat.MLcs.CLcs.LGarXiv:1602.02373v22016Memorization Is Not Extraction: Tight Differential-Privacy Bounds and Audit Blind Spots
Xujun Che, Depeng Xu, Shuhan Yuan
cs.CRcs.CLcs.LGarXiv:2608.27782v12026LEACE: Perfect linear concept erasure in closed form
Nora Belrose, David Schneider-Joseph, Shauli Ravfogel +3
cs.LGcs.CLcs.CYarXiv:2306.03819v42023Direct Language Model Alignment from Online AI Feedback
Shangmin Guo, Biao Zhang, Tianlin Liu +9
cs.AIcs.CLcs.HCarXiv:2402.04792v22024LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving
Hao Sha, Yao Mu, Yuxuan Jiang +7
cs.ROcs.AIcs.CLarXiv:2310.03026v32023Scaling Diffusion Language Models via Adaptation from Autoregressive Models
Shansan Gong, Shivam Agarwal, Yizhe Zhang +9
cs.CLarXiv:2410.17891v32024ClassEval: A Manually-Crafted Benchmark for Evaluating LLMs on Class-level Code Generation
Xueying Du, Mingwei Liu, Kaixin Wang +7
cs.CLcs.AIarXiv:2308.01861v22023Many-Shot In-Context Learning
Rishabh Agarwal, Avi Singh, Lei M. Zhang +12
cs.LGcs.AIcs.CLarXiv:2404.11018v32024Answering Complex Open-Domain Questions with Multi-Hop Dense Retrieval
Wenhan Xiong, Xiang Lorraine Li, Srini Iyer +8
cs.CLarXiv:2009.12756v22020Deep learning for affective computing: text-based emotion recognition in decision support
Bernhard Kratzwald, Suzana Ilic, Mathias Kraus +2
cs.CLarXiv:1803.06397v62018MIME: MIMicking Emotions for Empathetic Response Generation
Navonil Majumder, Pengfei Hong, Shanshan Peng +5
cs.CLarXiv:2010.01454v12020SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models
Xiaoxuan Wang, Ziniu Hu, Pan Lu +7
cs.CLcs.AIcs.LGarXiv:2307.10635v32023All You Need is "Love": Evading Hate-speech Detection
Tommi Gröndahl, Luca Pajola, Mika Juuti +2
cs.CLarXiv:1808.09115v32018Multilingual Jailbreak Challenges in Large Language Models
Yue Deng, Wenxuan Zhang, Sinno Jialin Pan +1
cs.CLarXiv:2310.06474v32023JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks
Weidi Luo, Siyuan Ma, Xiaogeng Liu +2
cs.CRcs.AIcs.CLarXiv:2404.03027v42024Deep Residual Learning for Small-Footprint Keyword Spotting
Raphael Tang, Jimmy Lin
cs.CLarXiv:1710.10361v22017Distributional Semantics and Linguistic Theory
Gemma Boleda
cs.CLarXiv:1905.01896v42019Framing COVID-19: How we conceptualize and discuss the pandemic on Twitter
Philipp Wicke, Marianna M. Bolognesi
cs.CLcs.SIarXiv:2004.06986v22020Acquire, Repair, Preserve: A Diagnosis-Guided Post-Training Recipe for Small-Model Dialogue Game Agents
Nan Li
cs.CLcs.LGarXiv:2608.28458v12026Large-Scale Multi-Label Text Classification on EU Legislation
Ilias Chalkidis, Manos Fergadiotis, Prodromos Malakasiotis +1
cs.CLarXiv:1906.02192v12019Thieves on Sesame Street! Model Extraction of BERT-based APIs
Kalpesh Krishna, Gaurav Singh Tomar, Ankur P. Parikh +2
cs.CLcs.CRcs.LGarXiv:1910.12366v32019BOND: BERT-Assisted Open-Domain Named Entity Recognition with Distant Supervision
Chen Liang, Yue Yu, Haoming Jiang +4
cs.CLcs.AIcs.LGarXiv:2006.15509v12020Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
Amrith Setlur, Chirag Nagpal, Adam Fisch +6
cs.LGcs.CLarXiv:2410.08146v12024Planning with Large Language Models for Code Generation
Shun Zhang, Zhenfang Chen, Yikang Shen +3
cs.LGcs.AIcs.CLarXiv:2303.05510v12023