Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

8,821 to 8,880 of 11,259

  1. Few-Step Diffusion Language Models via Trajectory Self-Distillation

    Tunyu Zhang, Xinxi Zhang, Ligong Han +10

    cs.CLcs.LGarXiv:2602.12262v42026
  2. Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review

    Lixiang Yan, Lele Sha, Linxuan Zhao +6

    cs.CLcs.AIcs.CYarXiv:2303.13379v22023
  3. ChatGPT and a New Academic Reality: Artificial Intelligence-Written Research Papers and the Ethics of the Large Language Models in Scholarly Publishing

    Brady Lund, Ting Wang, Nishith Reddy Mannuru +3

    cs.CLcs.CYarXiv:2303.13367v22023
  4. Effective Reasoning Chains Reduce Intrinsic Dimensionality

    Archiki Prasad, Mandar Joshi, Kenton Lee +2

    cs.CLcs.AIcs.LGarXiv:2602.09276v22026
  5. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space

    Jinghui Zhang, Lang Gao, Ao Li +5

    cs.CLcs.AIarXiv:2608.23124v12026
  6. Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models

    Lei Wang, Wanyu Xu, Yihuai Lan +4

    cs.CLarXiv:2305.04091v32023
  7. MLS: A Large-Scale Multilingual Dataset for Speech Research

    Vineel Pratap, Qiantong Xu, Anuroop Sriram +2

    eess.AScs.CLcs.SDarXiv:2012.03411v22020
  8. Reinforced Attention Learning

    Bangzheng Li, Jianmo Ni, Chen Qu +5

    cs.CLcs.CVcs.LGarXiv:2602.04884v22026
  9. Prism: Spectral-Aware Block-Sparse Attention

    Xinghao Wang, Pengyu Wang, Xiaoran Liu +4

    cs.CLcs.AIcs.CVarXiv:2602.08426v22026
  10. Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory

    Hao Zhou, Minlie Huang, Tianyang Zhang +2

    cs.CLcs.AIarXiv:1704.01074v42017
  11. KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs

    Jian Chen, Zhuoran Wang, Jiayu Qin +6

    cs.CLarXiv:2602.05929v22026
  12. Uncertainty Drives Social Bias Changes in Quantized Large Language Models

    Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen

    cs.CLarXiv:2602.06181v12026
  13. C-Pack: Packed Resources For General Chinese Embeddings

    Shitao Xiao, Zheng Liu, Peitian Zhang +3

    cs.CLcs.AIcs.IRarXiv:2309.07597v52023
  14. PAL: Program-aided Language Models

    Luyu Gao, Aman Madaan, Shuyan Zhou +5

    cs.CLcs.AIarXiv:2211.10435v22022
  15. Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs

    Luoyang Sun, Jiwen Jiang, Yifeng Ding +9

    cs.LGcs.CLarXiv:2602.10377v12026
  16. MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation

    Taha Koleilat, Hojat Asgariandehkordi, Omid Nejati Manzari +3

    cs.CVcs.CLarXiv:2602.20423v12026
  17. Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models

    Xin Xu, Clive Bai, Kai Yang +7

    cs.CLarXiv:2602.12036v22026
  18. Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders

    Zhongzhi Li, Xuansheng Wu, Yijiang Li +2

    cs.CLcs.AIarXiv:2602.10388v42026
  19. Weight Decay Improves Language Model Plasticity

    Tessa Han, Sebastian Bordt, Hanlin Zhang +1

    cs.LGcs.AIcs.CLarXiv:2602.11137v22026
  20. ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces

    Xin Xu, Tong Yu, Xiang Chen +3

    cs.AIcs.CLcs.LGarXiv:2602.11683v12026
  21. Robustness of IR Models to Collection Growth

    Emmanouil Georgios Lionis, Debasis Ganguly, Sean MacAvaney

    cs.IRcs.CLarXiv:2608.23419v12026
  22. SelFusion: Self-distillation for Diffusion Language Models

    Hyeongsoo Lim, Jinyoung Kim, Eunseo Seo +2

    cs.CLarXiv:2608.22898v12026
  23. Unsupervised Neural Machine Translation

    Mikel Artetxe, Gorka Labaka, Eneko Agirre +1

    cs.CLcs.AIcs.LGarXiv:1710.11041v22017
  24. MAEB: Massive Audio Embedding Benchmark

    Adnan El Assadi, Isaac Chung, Chenghao Xiao +15

    cs.SDcs.AIcs.CLarXiv:2602.16008v12026
  25. Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

    Yunfei Chu, Jin Xu, Xiaohuan Zhou +5

    eess.AScs.CLcs.LGarXiv:2311.07919v22023
  26. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance

    Or Biton, Tomer Krichli, Itai Allouche +1

    cs.AIcs.CLarXiv:2608.23264v12026
  27. Modeling Distinct Human Interaction in Web Agents

    Faria Huq, Zora Zhiruo Wang, Zhanqiu Guo +6

    cs.CLcs.HCarXiv:2602.17588v42026
  28. Sink-Aware Pruning for Diffusion Language Models

    Aidar Myrzakhan, Tianyi Li, Bowei Guo +2

    cs.CLcs.AIcs.LGarXiv:2602.17664v12026
  29. Less is More: ClipBERT for Video-and-Language Learning via Sparse Sampling

    Jie Lei, Linjie Li, Luowei Zhou +4

    cs.CVcs.CLarXiv:2102.06183v12021
  30. Synthetic and Natural Noise Both Break Neural Machine Translation

    Yonatan Belinkov, Yonatan Bisk

    cs.CLcs.LGarXiv:1711.02173v22017
  31. ExpeL: LLM Agents Are Experiential Learners

    Andrew Zhao, Daniel Huang, Quentin Xu +3

    cs.LGcs.AIcs.CLarXiv:2308.10144v32023
  32. On the "Induction Bias" in Sequence Models

    M. Reza Ebrahimi, Michaël Defferrard, Sunny Panchal +1

    cs.LGcs.CLarXiv:2602.18333v22026
  33. Transition-Based Dependency Parsing with Stack Long Short-Term Memory

    Chris Dyer, Miguel Ballesteros, Wang Ling +2

    cs.CLcs.LGcs.NEarXiv:1505.08075v12015
  34. Nacrith: Neural Lossless Compression via Ensemble Context Modeling and High-Precision CDF Coding

    Roberto Tacconelli

    cs.ITcs.CLarXiv:2602.19626v22026
  35. Cognitive Models and AI Algorithms Provide Templates for Designing Language Agents

    Ryan Liu, Dilip Arumugam, Cedegao E. Zhang +3

    cs.AIcs.CLq-bio.NCarXiv:2602.22523v12026
  36. Towards Simulating Social Media Users with LLMs: Evaluating the Operational Validity of Conditioned Comment Prediction

    Nils Schwager, Simon Münker, Alistair Plum +1

    cs.CLcs.AIarXiv:2602.22752v12026
  37. PTE: Predictive Text Embedding through Large-scale Heterogeneous Text Networks

    Jian Tang, Meng Qu, Qiaozhu Mei

    cs.CLcs.LGcs.NEarXiv:1508.00200v12015
  38. Agentic Critical Training

    Weize Liu, Minghui Liu, Sy-Tuyen Ho +3

    cs.AIcs.CLcs.LGarXiv:2603.08706v12026
  39. Emergence of Grounded Compositional Language in Multi-Agent Populations

    Igor Mordatch, Pieter Abbeel

    cs.AIcs.CLarXiv:1703.04908v22017
  40. How Controllable Are Large Language Models? A Unified Evaluation across Behavioral Granularities

    Ziwen Xu, Kewei Xu, Haoming Xu +8

    cs.CLcs.AIcs.HCarXiv:2603.02578v22026
  41. DARE: Aligning LLM Agents with the R Statistical Ecosystem via Distribution-Aware Retrieval

    Maojun Sun, Yue Wu, Yifei Xie +5

    cs.IRcs.AIcs.CLarXiv:2603.04743v12026
  42. TourPlanner: A Competitive Consensus Framework with Constraint-Gated Reinforcement Learning for Travel Planning

    Yinuo Wang, Mining Tan, Wenxiang Jiao +5

    cs.AIcs.CLcs.LGarXiv:2601.04698v12026
  43. Cross-Domain, Multi-Task Data-to-Text Generation without In-Domain Training Data

    Yifei Song, Kun Efimov-Zhang, Claire Gardent

    cs.CLcs.AIarXiv:2608.23391v12026
  44. Cross-lingual Biography Enrichment via Claim Extraction and Alignment

    Yifei Song, Ziyang Chen, Emil Sayilov +1

    cs.CLcs.AIarXiv:2608.23390v12026
  45. Efficient RLVR Training via Weighted Mutual Information Data Selection

    Xinyu Zhou, Boyu Zhu, Haotian Zhang +2

    cs.LGcs.CLarXiv:2603.01907v12026
  46. Recursive Think-Answer Process for LLMs and VLMs

    Byung-Kwan Lee, Youngchae Chee, Yong Man Ro

    cs.CLarXiv:2603.02099v22026
  47. Aligning Biomedical Texts and Knowledge Graphs: A Systematic Comparison of Lightweight Alignment Strategies

    Artem Bisliouk, Elizaveta Nosova, Heiko Paulheim +2

    cs.CLcs.IRarXiv:2608.23214v12026
  48. Interactive Benchmarks

    Baoqing Yue, Zihan Zhu, Yutong Han +6

    cs.AIcs.CLcs.LGarXiv:2603.04737v42026
  49. Can Large Language Models Keep Up? Benchmarking Online Adaptation to Continual Knowledge Streams

    Jiyeon Kim, Hyunji Lee, Dylan Zhou +6

    cs.CLarXiv:2603.07392v12026
  50. Teaching Models to Express Their Uncertainty in Words

    Stephanie Lin, Jacob Hilton, Owain Evans

    cs.CLcs.AIcs.LGarXiv:2205.14334v22022
  51. Credal Large Language Models for Semantic Commitment under Uncertainty

    Shireen Kudukkil Manchingal, Sofiia Nikolenko, Fabio Cuzzolin

    cs.CLcs.AIcs.LGarXiv:2608.23244v12026
  52. Expert Threshold Routing for Autoregressive Language Modeling with Dynamic Computation Allocation and Load Balancing

    Hanchi Sun, Yixin Liu, Yonghui Wu +1

    cs.AIcs.CLarXiv:2603.11535v12026
  53. DIN-SQL: Decomposed In-Context Learning of Text-to-SQL with Self-Correction

    Mohammadreza Pourreza, Davood Rafiei

    cs.CLcs.AIcs.DBarXiv:2304.11015v32023
  54. DSAEval: Evaluating Data Science Agents on a Wide Range of Real-World Data Science Problems

    Maojun Sun, Yifei Xie, Yue Wu +5

    cs.AIcs.CLarXiv:2601.13591v22026
  55. ColBERTv2: Effective and Efficient Retrieval via Lightweight Late Interaction

    Keshav Santhanam, Omar Khattab, Jon Saad-Falcon +2

    cs.IRcs.CLarXiv:2112.01488v32021
  56. Libri-Light: A Benchmark for ASR with Limited or No Supervision

    Jacob Kahn, Morgane Rivière, Weiyi Zheng +12

    cs.CLcs.SDeess.ASarXiv:1912.07875v12019
  57. Generating Radiology Reports via Memory-driven Transformer

    Zhihong Chen, Yan Song, Tsung-Hui Chang +1

    cs.CLarXiv:2010.16056v22020
  58. Learning Self-Correction in Vision-Language Models via Rollout Augmentation

    Yi Ding, Ziliang Qiu, Bolian Li +1

    cs.CVcs.CLcs.LGarXiv:2602.08503v22026
  59. DPWriter: Reinforcement Learning with Diverse Planning Branching for Creative Writing

    Qian Cao, Yahui Liu, Wei Bi +6

    cs.CLcs.AIarXiv:2601.09609v12026
  60. Discovering Latent Knowledge in Language Models Without Supervision

    Collin Burns, Haotian Ye, Dan Klein +1

    cs.CLcs.AIcs.LGarXiv:2212.03827v22022