Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

8,941 to 9,000 of 11,310

  1. Style Transfer from Non-Parallel Text by Cross-Alignment

    Tianxiao Shen, Tao Lei, Regina Barzilay +1

    cs.CLcs.LGarXiv:1705.09655v22017
  2. Mixture-of-Depths Attention

    Lianghui Zhu, Yuxin Fang, Bencheng Liao +10

    cs.CLcs.AIarXiv:2603.15619v12026
  3. Accelerating Diffusion Language Models via Structured Suffix Modeling

    Zifeng Cheng, Keda Li, Zhiwei Jiang +3

    cs.CLarXiv:2608.23167v12026
  4. A Novel Embedding Model for Knowledge Base Completion Based on Convolutional Neural Network

    Dai Quoc Nguyen, Tu Dinh Nguyen, Dat Quoc Nguyen +1

    cs.CLarXiv:1712.02121v22017
  5. A decoder-only foundation model for time-series forecasting

    Abhimanyu Das, Weihao Kong, Rajat Sen +1

    cs.CLcs.AIcs.LGarXiv:2310.10688v42023
  6. Beyond Scalar Rewards: Dense Feedback for LLM Policy Synthesis in Sequential Social Dilemmas

    Víctor Gallego

    cs.CLcs.GTarXiv:2603.19453v32026
  7. FROST: Filtering Reasoning Outliers with Attention for Efficient Reasoning

    Haozheng Luo, Zhuolin Jiang, Md Zahid Hasan +2

    cs.CLcs.AIcs.LGarXiv:2601.19001v22026
  8. Self-Improving Pretraining: using post-trained models to pretrain better models

    Ellen Xiaoqing Tan, Jack Lanchantin, Shehzaad Dhuliawala +9

    cs.CLcs.AIcs.LGarXiv:2601.21343v32026
  9. SEAR: Schema-Based Evaluation and Routing for LLM Gateways

    Zecheng Zhang, Han Zheng, Yue Xu

    cs.DBcs.AIcs.CLarXiv:2603.26728v12026
  10. Extract Free Dense Labels from CLIP

    Chong Zhou, Chen Change Loy, Bo Dai

    cs.CVcs.CLarXiv:2112.01071v22021
  11. VideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding

    Hu Xu, Gargi Ghosh, Po-Yao Huang +5

    cs.CVcs.CLarXiv:2109.14084v22021
  12. Using the Output Embedding to Improve Language Models

    Ofir Press, Lior Wolf

    cs.CLarXiv:1608.05859v32016
  13. Multi-task Sequence to Sequence Learning

    Minh-Thang Luong, Quoc V. Le, Ilya Sutskever +2

    cs.LGcs.CLstat.MLarXiv:1511.06114v42015
  14. Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization

    Jiecong Wang, Hao Peng, Chunyang Liu

    cs.AIcs.CLarXiv:2601.21358v22026
  15. UnifiedQA: Crossing Format Boundaries With a Single QA System

    Daniel Khashabi, Sewon Min, Tushar Khot +4

    cs.CLcs.AIarXiv:2005.00700v32020
  16. Benchmarking Large Language Models for News Summarization

    Tianyi Zhang, Faisal Ladhak, Esin Durmus +3

    cs.CLcs.AIcs.LGarXiv:2301.13848v12023
  17. Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation

    Pingzhi Tang, Yiding Wang, Muhan Zhang

    cs.LGcs.AIcs.CLarXiv:2601.11258v22026
  18. MovieQA: Understanding Stories in Movies through Question-Answering

    Makarand Tapaswi, Yukun Zhu, Rainer Stiefelhagen +3

    cs.CVcs.CLarXiv:1512.02902v22015
  19. Aligning Agentic World Models via Knowledgeable Experience Learning

    Baochang Ren, Yunzhi Yao, Rui Sun +3

    cs.CLcs.AIcs.CVarXiv:2601.13247v12026
  20. S2D2: Fast Decoding for Diffusion LLMs via Training-Free Self-Speculation

    Ligong Han, Hao Wang, Han Gao +2

    cs.CLarXiv:2603.25702v22026
  21. A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT

    Yihan Cao, Siyu Li, Yixin Liu +4

    cs.AIcs.CLcs.LGarXiv:2303.04226v12023
  22. Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition

    Jinlong Ma, Yu Zhang, Xuefeng Bai +5

    cs.CLarXiv:2602.04486v12026
  23. DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models

    Hao Liang, Zhengyang Zhao, Meiyi Qiang +22

    cs.LGcs.CLarXiv:2603.26164v12026
  24. Learning to Commit: Generating Organic Pull Requests via Online Repository Memory

    Mo Li, L. H. Xu, Qitai Tan +2

    cs.SEcs.CLarXiv:2603.26664v12026
  25. Learning Deep Structure-Preserving Image-Text Embeddings

    Liwei Wang, Yin Li, Svetlana Lazebnik

    cs.CVcs.CLcs.LGarXiv:1511.06078v22015
  26. Expectations and Practices around AI Disclosure in CS Research

    Arati Mohapatra, Danish Pruthi

    cs.CYcs.CLcs.HCarXiv:2608.23271v12026
  27. KG-BERT: BERT for Knowledge Graph Completion

    Liang Yao, Chengsheng Mao, Yuan Luo

    cs.CLcs.AIarXiv:1909.03193v22019
  28. Enrich-Retrieve-Rank: Scaling Capability Discovery Beyond In-Context Routing

    Nazib Sorathiya, Daniel Zhang, Bardiya Akhbari

    cs.CLcs.AIcs.IRarXiv:2608.22695v12026
  29. Adapted Large Language Models Can Outperform Medical Experts in Clinical Text Summarization

    Dave Van Veen, Cara Van Uden, Louis Blankemeier +16

    cs.CLarXiv:2309.07430v52023
  30. SE-Bench: Benchmarking Self-Evolution with Knowledge Internalization

    Jiarui Yuan, Tailin Jin, Weize Chen +1

    cs.CLcs.AIcs.LGarXiv:2602.04811v22026
  31. SAGE: Benchmarking and Improving Retrieval for Deep Research Agents

    Tiansheng Hu, Yilun Zhao, Canyu Zhang +2

    cs.IRcs.CLarXiv:2602.05975v22026
  32. Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding

    Yanzheng Xiang, Lan Wei, Yizhen Yao +8

    cs.CLcs.AIarXiv:2602.06161v22026
  33. ELI5: Long Form Question Answering

    Angela Fan, Yacine Jernite, Ethan Perez +3

    cs.CLarXiv:1907.09190v12019
  34. SPARC: Separating Perception And Reasoning Circuits for Test-time Scaling of VLMs

    Niccolo Avogaro, Nayanika Debnath, Li Mi +6

    cs.CVcs.AIcs.CLarXiv:2602.06566v32026
  35. InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning

    Yuchen Yan, Liang Jiang, Jin Jiang +7

    cs.CLcs.AIarXiv:2602.06960v32026
  36. Balancing Understanding and Generation in Discrete Diffusion Models

    Yue Liu, Yuzhong Zhao, Zheyong Xie +5

    cs.CLarXiv:2602.01362v12026
  37. Linguistic Knowledge and Transferability of Contextual Representations

    Nelson F. Liu, Matt Gardner, Yonatan Belinkov +2

    cs.CLarXiv:1903.08855v52019
  38. DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels

    Haolei Bai, Lingcheng Kong, Xueyi Chen +3

    cs.LGcs.CLarXiv:2602.11715v22026
  39. HateXplain: A Benchmark Dataset for Explainable Hate Speech Detection

    Binny Mathew, Punyajoy Saha, Seid Muhie Yimam +3

    cs.CLcs.AIcs.SIarXiv:2012.10289v22020
  40. AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces

    Sungho Park, Wonjoong Kim, Rongyuan Tan +10

    cs.AIcs.CLcs.LGarXiv:2608.23041v12026
  41. Learning Modality-Specific Representations with Self-Supervised Multi-Task Learning for Multimodal Sentiment Analysis

    Wenmeng Yu, Hua Xu, Ziqi Yuan +1

    cs.CLarXiv:2102.04830v12021
  42. TRACE: A Self-Evolving Skill Bank for Consistent, Limit-Aware LLM Agents

    Wenhao Wu, Menghao Zhang, Xin Wang +3

    cs.CLcs.AIarXiv:2608.22793v12026
  43. The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies

    Chenxu Wang, Chaozhuo Li, Songyang Liu +10

    cs.CLarXiv:2602.09877v22026
  44. When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning

    Leheng Sheng, Yongtao Zhang, Wenchang Ma +6

    cs.CLcs.AIarXiv:2602.10560v12026
  45. CCNet: Extracting High Quality Monolingual Datasets from Web Crawl Data

    Guillaume Wenzek, Marie-Anne Lachaux, Alexis Conneau +4

    cs.CLcs.IRcs.LGarXiv:1911.00359v22019
  46. MiniCPM-SALA: Hybridizing Sparse and Linear Attention for Efficient Long-Context Modeling

    MiniCPM Team, Wenhao An, Yingfa Chen +44

    cs.CLcs.AIcs.LGarXiv:2602.11761v22026
  47. Privasis: Synthesizing the Largest "Public" Private Dataset from Scratch

    Hyunwoo Kim, Niloofar Mireshghallah, Michael Duan +11

    cs.CLcs.AIarXiv:2602.03183v12026
  48. InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem

    Shuofei Qiao, Yunxiang Wei, Xuehai Wang +10

    cs.CLcs.AIcs.IRarXiv:2602.14367v22026
  49. Cost-Efficient RAG for Entity Matching with LLMs: A Blocking-based Exploration

    Chuangtao Ma, Zeyu Zhang, Arijit Khan +2

    cs.DBcs.CLarXiv:2602.05708v12026
  50. Latent Thoughts Tuning: Bridging Context and Reasoning with Fused Information in Latent Tokens

    Weihao Liu, Dehai Min, Lu Cheng

    cs.CLarXiv:2602.10229v22026
  51. Molecular LLM Agents: From Architectural Design to Scientific Autonomy

    Jiatong Li, Wengyu Zhang, Weida Wang +8

    cs.CLcs.AIarXiv:2608.23104v12026
  52. Aligning Large Multimodal Models with Factually Augmented RLHF

    Zhiqing Sun, Sheng Shen, Shengcao Cao +9

    cs.CVcs.CLarXiv:2309.14525v12023
  53. VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs

    Zesen Cheng, Sicong Leng, Hang Zhang +8

    cs.CVcs.CLarXiv:2406.07476v32024
  54. WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs

    Yiming Yao, Chenyang Lyu, Xuanfan Ni +4

    cs.CLcs.SDarXiv:2608.22704v12026
  55. KILT: a Benchmark for Knowledge Intensive Language Tasks

    Fabio Petroni, Aleksandra Piktus, Angela Fan +10

    cs.CLcs.AIcs.IRarXiv:2009.02252v42020
  56. Bilateral Multi-Perspective Matching for Natural Language Sentences

    Zhiguo Wang, Wael Hamza, Radu Florian

    cs.AIcs.CLarXiv:1702.03814v32017
  57. Definitional Sensitivity in Media Bias Detection: A Multi-Definition Dataset and Benchmark

    Martin Wessel, Timo Spinde, Jürgen Pfeffer +1

    cs.CLarXiv:2608.23095v12026
  58. Quantifying Speaker Embedding Phonological Rule Interactions in Accented Speech Synthesis

    Thanathai Lertpetchpun, Yoonjeong Lee, Thanapat Trachu +4

    cs.CLarXiv:2601.14417v22026
  59. Transformers learn in-context by gradient descent

    Johannes von Oswald, Eyvind Niklasson, Ettore Randazzo +4

    cs.LGcs.AIcs.CLarXiv:2212.07677v22022
  60. Instruction Tuning with GPT-4

    Baolin Peng, Chunyuan Li, Pengcheng He +2

    cs.CLcs.AIarXiv:2304.03277v12023