Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,341 to 5,400 of 11,252

  1. MultiVerS: Improving scientific claim verification with weak supervision and full-document context

    David Wadden, Kyle Lo, Lucy Lu Wang +3

    cs.CLcs.AIarXiv:2112.01640v22021
  2. Noisy Channel Language Model Prompting for Few-Shot Text Classification

    Sewon Min, Mike Lewis, Hannaneh Hajishirzi +1

    cs.CLcs.AIarXiv:2108.04106v32021
  3. Better Fine-Tuning by Reducing Representational Collapse

    Armen Aghajanyan, Akshat Shrivastava, Anchit Gupta +3

    cs.LGcs.CLstat.MLarXiv:2008.03156v12020
  4. Towards Debiasing Fact Verification Models

    Tal Schuster, Darsh J Shah, Yun Jie Serene Yeo +3

    cs.CLarXiv:1908.05267v22019
  5. TernaryBERT: Distillation-aware Ultra-low Bit BERT

    Wei Zhang, Lu Hou, Yichun Yin +4

    cs.CLcs.LGcs.SDarXiv:2009.12812v32020
  6. Aspire: Can Models Self-Evolve from Vague Goals?

    Yuhao Wu, Jingyuan Zhang, Jiajun Shi +18

    cs.CLarXiv:2608.31111v12026
  7. RWTH ASR Systems for LibriSpeech: Hybrid vs Attention -- w/o Data Augmentation

    Christoph Lüscher, Eugen Beck, Kazuki Irie +5

    cs.CLcs.SDeess.ASarXiv:1905.03072v32019
  8. ExT5: Towards Extreme Multi-Task Scaling for Transfer Learning

    Vamsi Aribandi, Yi Tay, Tal Schuster +11

    cs.CLcs.LGarXiv:2111.10952v22021
  9. S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement?

    Jiajun Shi, Siyuan Tao, Yuhao Wu +18

    cs.CLarXiv:2608.31100v12026
  10. Interpretable Neural Predictions with Differentiable Binary Variables

    Jasmijn Bastings, Wilker Aziz, Ivan Titov

    cs.CLarXiv:1905.08160v22019
  11. "Going on a vacation" takes longer than "Going for a walk": A Study of Temporal Commonsense Understanding

    Ben Zhou, Daniel Khashabi, Qiang Ning +1

    cs.CLarXiv:1909.03065v12019
  12. BioSentVec: creating sentence embeddings for biomedical texts

    Qingyu Chen, Yifan Peng, Zhiyong Lu

    cs.CLcs.AIcs.LGarXiv:1810.09302v62018
  13. MANTIS: Interleaved Multi-Image Instruction Tuning

    Dongfu Jiang, Xuan He, Huaye Zeng +4

    cs.CVcs.AIcs.CLarXiv:2405.01483v32024
  14. Context-Aware Interleaved Batching for WhisperX

    Carlos Bain, Max Bain

    cs.CLarXiv:2608.31170v12026
  15. Speech Recognition by Machine, A Review

    M. A. Anusuya, S. K. Katti

    cs.CLarXiv:1001.2267v12010
  16. Every Token Leaves a Ripple in the Stream of Thought: Eliciting Model-Internal Token Saliency for Chain-of-Thought Compression

    Tianyi Zhao, Yinhan He, Wendy Zheng +1

    cs.CLarXiv:2608.31066v12026
  17. LLM Judges Verify Presence, Not Absence: Omission Blindness in AI Clinical Notes and What Recovers It

    Sebastian Fox, Luke Markham, Ryan Lail +1

    cs.CLcs.AIarXiv:2608.31016v12026
  18. When Does Predictor-Based RL Align with Human Perception? A Study of Subjective Rewards in Codec-Based Speech Language Models

    Joonyong Park, Jerry Li

    cs.CLcs.SDeess.ASarXiv:2608.31035v12026
  19. Stick to What You Know: A Study of Knowledge-Aligned Supervised Fine-Tuning

    Arthur Becker, Jakob Kemmler, David Thulke +3

    cs.CLcs.AIcs.LGarXiv:2608.30987v12026
  20. OpenFedLLM: Training Large Language Models on Decentralized Private Data via Federated Learning

    Rui Ye, Wenhao Wang, Jingyi Chai +6

    cs.LGcs.CLcs.DCarXiv:2402.06954v12024
  21. The First Token Is a Clue: Verbalizing Multi-Token Concepts from the J-lens

    Xijie Gong, Tonghan Wang

    cs.CLarXiv:2608.31084v12026
  22. Improving Information Extraction with Learned Queries

    Omar Sharif, Soroush Vosoughi, Nikhil Singh

    cs.CLarXiv:2608.31058v12026
  23. Type-Balanced Contextual Learning for Incremental Named Entity Recognition

    Duzhen Zhang, Yahan Yu, Xiuyi Chen +2

    cs.CLarXiv:2608.31038v12026
  24. One note in three: a verified census of three deployed AI scribes, and the instrument that counted it

    Sebastian Fox, Luke Markham, Ryan Lail +1

    cs.CLcs.AIcs.CYarXiv:2608.31017v12026
  25. Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM

    Bochuan Cao, Yuanpu Cao, Lu Lin +1

    cs.CLcs.AIcs.CRarXiv:2309.14348v32023
  26. Evidence-Bounded Mental Health Reasoning from Heterogeneous Speech Protocols

    Chengyuan Gao, Jiang Wu, Tao Lu +4

    cs.CLarXiv:2608.31014v12026
  27. Faithfulness Is Not Free: Auditing Offline KV-Cache Quantization in Retrieval-Augmented Generation

    Atta Ul Asad, Ahsan Bilal, Muhammad Ali +2

    cs.CLarXiv:2608.30996v12026
  28. Improvements to deep convolutional neural networks for LVCSR

    Tara N. Sainath, Brian Kingsbury, Abdel-rahman Mohamed +6

    cs.LGcs.CLcs.NEarXiv:1309.1501v32013
  29. Learning to Translate in Real-time with Neural Machine Translation

    Jiatao Gu, Graham Neubig, Kyunghyun Cho +1

    cs.CLcs.LGarXiv:1610.00388v32016
  30. PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference

    Jiaming Ji, Donghai Hong, Borong Zhang +10

    cs.AIcs.CLarXiv:2406.15513v32024
  31. How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model

    Michael Hanna, Ollie Liu, Alexandre Variengien

    cs.CLcs.AIcs.LGarXiv:2305.00586v52023
  32. Retrospective Reader for Machine Reading Comprehension

    Zhuosheng Zhang, Junjie Yang, Hai Zhao

    cs.CLcs.AIcs.IRarXiv:2001.09694v42020
  33. Mixture-of-Depths: Dynamically allocating compute in transformer-based language models

    David Raposo, Sam Ritter, Blake Richards +3

    cs.LGcs.CLarXiv:2404.02258v12024
  34. Natural Language Does Not Emerge 'Naturally' in Multi-Agent Dialog

    Satwik Kottur, José M. F. Moura, Stefan Lee +1

    cs.CLcs.AIcs.CVarXiv:1706.08502v32017
  35. Classification using Hyperdimensional Computing: A Review

    Lulu Ge, Keshab K. Parhi

    cs.LGcs.AIcs.CLarXiv:2004.11204v12020
  36. Language GANs Falling Short

    Massimo Caccia, Lucas Caccia, William Fedus +3

    cs.CLcs.LGarXiv:1811.02549v62018
  37. Geometry of Divergence: Tracking Hidden-State Trajectories for Adaptive Multi-Turn Reasoning

    Jie Liang, Zhengxin Yu, Hamid Nasiri +1

    cs.AIcs.CLarXiv:2608.30650v12026
  38. Neural Language Models as Psycholinguistic Subjects: Representations of Syntactic State

    Richard Futrell, Ethan Wilcox, Takashi Morita +3

    cs.CLarXiv:1903.03260v12019
  39. HSRM: Hidden-State Reward Models for Test-Time Verification

    Xianzhi Li, Xiaodan Zhu

    cs.AIcs.CLarXiv:2608.30841v12026
  40. UniPELT: A Unified Framework for Parameter-Efficient Language Model Tuning

    Yuning Mao, Lambert Mathias, Rui Hou +5

    cs.CLcs.AIcs.LGarXiv:2110.07577v32021
  41. Distant Supervision for Relation Extraction beyond the Sentence Boundary

    Chris Quirk, Hoifung Poon

    cs.CLarXiv:1609.04873v32016
  42. Automatically Auditing Large Language Models via Discrete Optimization

    Erik Jones, Anca Dragan, Aditi Raghunathan +1

    cs.LGcs.CLarXiv:2303.04381v12023
  43. Higher-Dimensional Rotary Position Embedding

    Yixing Li, Ruobing Xie, Yudong Zhang +3

    cs.LGcs.AIcs.CLarXiv:2608.29715v12026
  44. Vocabulary Growth Fundamentals: Bernstein Functions and Hausdorff Sequences

    Łukasz Dębowski

    math.PRcs.CLarXiv:2608.29449v12026
  45. Good-Enough Compositional Data Augmentation

    Jacob Andreas

    cs.CLarXiv:1904.09545v42019
  46. Scalable and Transferable Black-Box Jailbreaks for Language Models via Persona Modulation

    Rusheb Shah, Quentin Feuillade--Montixi, Soroush Pour +3

    cs.CLcs.AIcs.LGarXiv:2311.03348v22023
  47. Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following

    Ziyu Guo, Renrui Zhang, Xiangyang Zhu +8

    cs.CVcs.AIcs.CLarXiv:2309.00615v12023
  48. Configurable Semantic Chunking for Biomedical Information Extraction in Retrieval-Augmented Generation

    Riya Ahuja, Tim Kacprowski, Roya Shiasi Sardoabi

    cs.CLcs.IRarXiv:2608.31139v12026
  49. DIASENTINEL: An Auditable Multi-Agent System for Guideline-Grounded Diabetes Risk Screening

    Yung Wei Shueh, Zhi-Jie Chen, Chia-Hsuan Hsu +9

    cs.CLarXiv:2608.31128v12026
  50. Language-Statistical Analysis of Neural Audio Codec Tokens Across Architectures, Corpora, and Noise Conditions

    Joonyong Park, Shinnosuke Takamichi, David M. Chan +3

    cs.CLcs.SDarXiv:2608.31037v12026
  51. The Multilingual Amazon Reviews Corpus

    Phillip Keung, Yichao Lu, György Szarvas +1

    cs.CLcs.IRcs.LGarXiv:2010.02573v12020
  52. Low-Resource Preference Adaptation of LLMs via Activation-Based Label Propagation

    Alessio Galatolo, Meriem Beloucif

    cs.CLarXiv:2608.30902v12026
  53. ECGQuest: Benchmarking and Fine-Tuning Language Models for Electrocardiography

    Mohammadsina Hassannia, Matthew A. Reyna, Reza Sameni

    cs.CLcs.IRarXiv:2608.30893v12026
  54. Personas Differ from Native-Language Generation: Language Pathways Shape LLM Interpersonal Advice

    Jinhee Won, Xinlan Emily Hu

    cs.CLcs.AIarXiv:2608.30873v12026
  55. TSDAE: Using Transformer-based Sequential Denoising Auto-Encoder for Unsupervised Sentence Embedding Learning

    Kexin Wang, Nils Reimers, Iryna Gurevych

    cs.CLarXiv:2104.06979v32021
  56. Beyond Good Intentions: When Does the Framing of Multilingual and Low-Resource NLP Research Become a Caricature?

    Nedjma Ousidhoum, Noopur Zambare, Mohamed Abdalla

    cs.CLarXiv:2608.30866v12026
  57. Detecting AI Impostors: How Do Middle Schoolers Identify LLM Agents in a Live Collaborative Setting?

    Dan Schumacher, Pragathi Durga Rajarajan, Haven Kotara +6

    cs.CLarXiv:2608.30948v12026
  58. Annotated Surrogate Retrieval for Polish Statutory Law

    Orkun Yiğit Cengiz

    cs.CLarXiv:2608.30929v12026
  59. TRIPPULSE: Multi-Agent Travel Planning with Review-Grounded Reasoning

    Priyanshu Karmakar, Borru Vijay Sai, Shubhojit Mallick +3

    cs.CLarXiv:2608.30924v12026
  60. MMDS-Bench: Benchmarking Multimodal Large Language Models on Dynamic Stance in Social Media Interactions

    Yuzhe Ding, Kang He, Li Zheng +5

    cs.CLarXiv:2608.30903v12026