Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,821 to 5,880 of 11,242

  1. AIM: Anchor Identity Features, Then Match for Multimodal Large Language Model Unlearning

    Wonjun Lee, Jaehyuk Jang, Kangwook Ko +2

    cs.CVcs.CLarXiv:2608.28312v12026
  2. Synth-JDoc: Synthesizing a Japanese Document Image Dataset for OCR with Diverse Layouts and Embedded Images

    Keito Sasagawa, Shuhei Kurita, Daisuke Kawahara

    cs.CVcs.CLarXiv:2608.28248v12026
  3. A Formal Limitation on Learning Human Language From Textual Corpora

    Emily Cheng, Ryan Cotterell

    cs.CLarXiv:2608.28560v12026
  4. Personalized Prompt Learning for Explainable Recommendation

    Lei Li, Yongfeng Zhang, Li Chen

    cs.IRcs.AIcs.CLarXiv:2202.07371v22022
  5. Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine Translation

    Di Wu, Sergey Troshin, Christof Monz +2

    cs.CLarXiv:2608.28496v12026
  6. Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2

    Hamish Ivison, Yizhong Wang, Valentina Pyatkin +8

    cs.CLarXiv:2311.10702v22023
  7. Phoneme- and Word-Level Metrics Using Self-Supervised Speech Representations for Forced Alignment Evaluation

    V. S. D. S. Mahesh Akavarapu, Michael Daniel, Gerhard Jäger

    cs.CLarXiv:2608.28508v12026
  8. Uni3D: Exploring Unified 3D Representation at Scale

    Junsheng Zhou, Jinsheng Wang, Baorui Ma +3

    cs.CVcs.CLarXiv:2310.06773v12023
  9. Zero-Shot Stance Detection: A Dataset and Model using Generalized Topic Representations

    Emily Allaway, Kathleen McKeown

    cs.CLarXiv:2010.03640v12020
  10. FinExam-10K: When Retrieval Helps Financial Reasoning?

    Yan Lin, Jingyu Sun, Zhongliang Guo +3

    cs.CLarXiv:2608.28155v12026
  11. PersonaForge: Realistic Multi-Turn User Simulation for Agentic Systems

    Hanglong Lv, Dawei Zhu, Lei Li +11

    cs.CLarXiv:2608.28378v12026
  12. H-Scale: Hessian-Guided Scale Refinement for NVFP4 Sub-Byte LLM Inference

    Hao Yu, Zheng Li, Dayiheng Liu +1

    cs.CLarXiv:2608.28113v12026
  13. Self-Taught Convolutional Neural Networks for Short Text Clustering

    Jiaming Xu, Bo Xu, Peng Wang +4

    cs.IRcs.CLarXiv:1701.00185v12017
  14. Towards Better UD Parsing: Deep Contextualized Word Embeddings, Ensemble, and Treebank Concatenation

    Wanxiang Che, Yijia Liu, Yuxuan Wang +2

    cs.CLarXiv:1807.03121v32018
  15. MedDialog: Two Large-scale Medical Dialogue Datasets

    Xuehai He, Shu Chen, Zeqian Ju +10

    cs.LGcs.AIcs.CLarXiv:2004.03329v22020
  16. A Unified Framework to Elicit Structured Feedback for Interpretable Multi-Trait Essay Scoring

    Shihang Yang, Sanwoo Lee, Ningning Zhao +1

    cs.CLarXiv:2608.28407v12026
  17. CultureConverse: A Multilingual Multi-turn Simulation Harness for Culturally Grounded Assistance in East and Southeast Asia

    Bryan Chen Zhengyu Tan, Weihua Zheng, Thong T. Doan +30

    cs.CLcs.CYarXiv:2608.28405v12026
  18. A Survey on Efficient Inference for Large Language Models

    Zixuan Zhou, Xuefei Ning, Ke Hong +12

    cs.CLcs.AIarXiv:2404.14294v32024
  19. Semi-Supervised Learning for Neural Machine Translation

    Yong Cheng, Wei Xu, Zhongjun He +4

    cs.CLarXiv:1606.04596v32016
  20. A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness

    Fali Wang, Zhiwei Zhang, Xianren Zhang +11

    cs.CLcs.AIcs.LGarXiv:2411.03350v22024
  21. ClimateBert: A Pretrained Language Model for Climate-Related Text

    Nicolas Webersinke, Mathias Kraus, Julia Anna Bingler +1

    cs.CLarXiv:2110.12010v32021
  22. Exploring Length Generalization in Large Language Models

    Cem Anil, Yuhuai Wu, Anders Andreassen +7

    cs.CLcs.LGarXiv:2207.04901v22022
  23. A Capsule Network-based Embedding Model for Knowledge Graph Completion and Search Personalization

    Dai Quoc Nguyen, Thanh Vu, Tu Dinh Nguyen +2

    cs.CLcs.IRarXiv:1808.04122v32018
  24. Unlearn What You Want to Forget: Efficient Unlearning for LLMs

    Jiaao Chen, Diyi Yang

    cs.CLcs.AIarXiv:2310.20150v12023
  25. Scaling Large Language Model-based Multi-Agent Collaboration

    Chen Qian, Zihao Xie, YiFei Wang +9

    cs.AIcs.CLcs.MAarXiv:2406.07155v32024
  26. Sequence to Backward and Forward Sequences: A Content-Introducing Approach to Generative Short-Text Conversation

    Lili Mou, Yiping Song, Rui Yan +3

    cs.CLcs.LGarXiv:1607.00970v22016
  27. Unsupervised Statistical Machine Translation

    Mikel Artetxe, Gorka Labaka, Eneko Agirre

    cs.CLcs.AIcs.LGarXiv:1809.01272v12018
  28. Joint Robust Voicing Detection and Pitch Estimation Based on Residual Harmonics

    Thomas Drugman, Abeer Alwan

    cs.SDcs.CLeess.ASarXiv:2001.00459v12019
  29. BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack

    Yuri Kuratov, Aydar Bulatov, Petr Anokhin +4

    cs.CLcs.AIarXiv:2406.10149v22024
  30. Supporting Clustering with Contrastive Learning

    Dejiao Zhang, Feng Nan, Xiaokai Wei +6

    cs.LGcs.CLarXiv:2103.12953v22021
  31. MultiModalQA: Complex Question Answering over Text, Tables and Images

    Alon Talmor, Ori Yoran, Amnon Catav +6

    cs.CLcs.AIcs.LGarXiv:2104.06039v12021
  32. On the Sentence Embeddings from Pre-trained Language Models

    Bohan Li, Hao Zhou, Junxian He +3

    cs.CLcs.LGarXiv:2011.05864v12020
  33. Challenges in Discriminating Profanity from Hate Speech

    Shervin Malmasi, Marcos Zampieri

    cs.CLarXiv:1803.05495v12018
  34. Honeybee: Locality-enhanced Projector for Multimodal LLM

    Junbum Cha, Wooyoung Kang, Jonghwan Mun +1

    cs.CVcs.AIcs.CLarXiv:2312.06742v22023
  35. Proving Test Set Contamination in Black Box Language Models

    Yonatan Oren, Nicole Meister, Niladri Chatterji +2

    cs.CLcs.LGarXiv:2310.17623v22023
  36. In-context Examples Selection for Machine Translation

    Sweta Agrawal, Chunting Zhou, Mike Lewis +2

    cs.CLarXiv:2212.02437v12022
  37. Supervised and Semi-Supervised Text Categorization using LSTM for Region Embeddings

    Rie Johnson, Tong Zhang

    stat.MLcs.CLcs.LGarXiv:1602.02373v22016
  38. Memorization Is Not Extraction: Tight Differential-Privacy Bounds and Audit Blind Spots

    Xujun Che, Depeng Xu, Shuhan Yuan

    cs.CRcs.CLcs.LGarXiv:2608.27782v12026
  39. LEACE: Perfect linear concept erasure in closed form

    Nora Belrose, David Schneider-Joseph, Shauli Ravfogel +3

    cs.LGcs.CLcs.CYarXiv:2306.03819v42023
  40. Direct Language Model Alignment from Online AI Feedback

    Shangmin Guo, Biao Zhang, Tianlin Liu +9

    cs.AIcs.CLcs.HCarXiv:2402.04792v22024
  41. LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving

    Hao Sha, Yao Mu, Yuxuan Jiang +7

    cs.ROcs.AIcs.CLarXiv:2310.03026v32023
  42. Scaling Diffusion Language Models via Adaptation from Autoregressive Models

    Shansan Gong, Shivam Agarwal, Yizhe Zhang +9

    cs.CLarXiv:2410.17891v32024
  43. ClassEval: A Manually-Crafted Benchmark for Evaluating LLMs on Class-level Code Generation

    Xueying Du, Mingwei Liu, Kaixin Wang +7

    cs.CLcs.AIarXiv:2308.01861v22023
  44. Many-Shot In-Context Learning

    Rishabh Agarwal, Avi Singh, Lei M. Zhang +12

    cs.LGcs.AIcs.CLarXiv:2404.11018v32024
  45. Answering Complex Open-Domain Questions with Multi-Hop Dense Retrieval

    Wenhan Xiong, Xiang Lorraine Li, Srini Iyer +8

    cs.CLarXiv:2009.12756v22020
  46. Deep learning for affective computing: text-based emotion recognition in decision support

    Bernhard Kratzwald, Suzana Ilic, Mathias Kraus +2

    cs.CLarXiv:1803.06397v62018
  47. MIME: MIMicking Emotions for Empathetic Response Generation

    Navonil Majumder, Pengfei Hong, Shanshan Peng +5

    cs.CLarXiv:2010.01454v12020
  48. SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models

    Xiaoxuan Wang, Ziniu Hu, Pan Lu +7

    cs.CLcs.AIcs.LGarXiv:2307.10635v32023
  49. All You Need is "Love": Evading Hate-speech Detection

    Tommi Gröndahl, Luca Pajola, Mika Juuti +2

    cs.CLarXiv:1808.09115v32018
  50. Multilingual Jailbreak Challenges in Large Language Models

    Yue Deng, Wenxuan Zhang, Sinno Jialin Pan +1

    cs.CLarXiv:2310.06474v32023
  51. JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks

    Weidi Luo, Siyuan Ma, Xiaogeng Liu +2

    cs.CRcs.AIcs.CLarXiv:2404.03027v42024
  52. Deep Residual Learning for Small-Footprint Keyword Spotting

    Raphael Tang, Jimmy Lin

    cs.CLarXiv:1710.10361v22017
  53. Distributional Semantics and Linguistic Theory

    Gemma Boleda

    cs.CLarXiv:1905.01896v42019
  54. Framing COVID-19: How we conceptualize and discuss the pandemic on Twitter

    Philipp Wicke, Marianna M. Bolognesi

    cs.CLcs.SIarXiv:2004.06986v22020
  55. Acquire, Repair, Preserve: A Diagnosis-Guided Post-Training Recipe for Small-Model Dialogue Game Agents

    Nan Li

    cs.CLcs.LGarXiv:2608.28458v12026
  56. Large-Scale Multi-Label Text Classification on EU Legislation

    Ilias Chalkidis, Manos Fergadiotis, Prodromos Malakasiotis +1

    cs.CLarXiv:1906.02192v12019
  57. Thieves on Sesame Street! Model Extraction of BERT-based APIs

    Kalpesh Krishna, Gaurav Singh Tomar, Ankur P. Parikh +2

    cs.CLcs.CRcs.LGarXiv:1910.12366v32019
  58. BOND: BERT-Assisted Open-Domain Named Entity Recognition with Distant Supervision

    Chen Liang, Yue Yu, Haoming Jiang +4

    cs.CLcs.AIcs.LGarXiv:2006.15509v12020
  59. Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning

    Amrith Setlur, Chirag Nagpal, Adam Fisch +6

    cs.LGcs.CLarXiv:2410.08146v12024
  60. Planning with Large Language Models for Code Generation

    Shun Zhang, Zhenfang Chen, Yikang Shen +3

    cs.LGcs.AIcs.CLarXiv:2303.05510v12023