Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

7,441 to 7,500 of 11,248

  1. DuMateBench: Evaluating Autonomous Agents in Complex Real-World Workflows

    Zechun Niu, Yukun Zhao, Jiaxin Zhang +12

    cs.AIcs.CLarXiv:2608.26546v12026
  2. Pix2seq: A Language Modeling Framework for Object Detection

    Ting Chen, Saurabh Saxena, Lala Li +2

    cs.CVcs.AIcs.CLarXiv:2109.10852v22021
  3. DeflectBench: A Benchmark for Evaluating Rhetorical Fallacy Generation in LLMs

    Art Kanke

    cs.CLarXiv:2608.26119v12026
  4. Can a Model Catch Its Own Hallucinations for Free?: Label-Free Doubt Signals Hold Their Own Against a Labelled Dataset for Abstention

    Ali Asaria, Tony Salomone, Deep Gandhi

    cs.CLcs.LGarXiv:2608.26121v12026
  5. How Language Model Hallucinations Can Snowball

    Muru Zhang, Ofir Press, William Merrill +2

    cs.CLarXiv:2305.13534v12023
  6. Factual Probing Is [MASK]: Learning vs. Learning to Recall

    Zexuan Zhong, Dan Friedman, Danqi Chen

    cs.CLarXiv:2104.05240v22021
  7. Visual Information-Guided Parallel Decoding for Diffusion Multimodal Large Language Models

    Insu Lee, Wooje Park, Wonseok Shin +2

    cs.CVcs.CLarXiv:2608.26580v12026
  8. Agent Seer: Synthesizing Scenarios from Specification Understanding

    Harish Karumuri, Mahesh Vemula, David Lopes Pegna

    cs.CLarXiv:2608.26133v12026
  9. SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression

    Tim Dettmers, Ruslan Svirschevski, Vage Egiazarian +6

    cs.CLcs.LGarXiv:2306.03078v12023
  10. Neural Baby Talk

    Jiasen Lu, Jianwei Yang, Dhruv Batra +1

    cs.CVcs.CLarXiv:1803.09845v12018
  11. Interpretable, Fairly Evaluated Automated L2 Speaking Assessment that Beats the Single-Human Ceiling and Why Pause Encoding Does Not Change LLM Fluency Scores

    Eichi Uehara

    cs.CLcs.LGcs.SDarXiv:2608.26137v12026
  12. Syntax vs. Semantics: How Transformers Learn Deep Dependencies

    Jiangrui Zhao, Xiaoting Du

    cs.CLcs.AIarXiv:2608.26139v12026
  13. Data Science Approaches to Evaluating Honours Candidates

    Francesca von Braun-Bates, Sunreeta Sen, Indraayudh Talukdar +1

    cs.CLarXiv:2608.26135v12026
  14. Reward-Informed Sparse Autoencoders and the Solution-Completeness Confound

    Tanvi Nagilla, Alexander Jameson, Daniel Manta +1

    cs.CLarXiv:2608.26136v12026
  15. AdaThinking-E: One-Token Entropy Regulation for Adaptive Thinking

    Zining Wang, Tongkun Guan, Boming Chen +8

    cs.CLcs.LGarXiv:2608.26141v12026
  16. Attention Guided Graph Convolutional Networks for Relation Extraction

    Zhijiang Guo, Yan Zhang, Wei Lu

    cs.CLcs.LGarXiv:1906.07510v82019
    Summaries:한국어
  17. PlanBench: An Extensible Benchmark for Evaluating Large Language Models on Planning and Reasoning about Change

    Karthik Valmeekam, Matthew Marquez, Alberto Olmo +2

    cs.CLcs.AIarXiv:2206.10498v42022
  18. FIRSTPASS: A Multi-Domain, Multi-Round Peer Review Dataset Grounded in Real Editorial Outcomes

    Prabhjot Singh, Somnath Luitel, Manmeet Singh +1

    cs.CLcs.AIcs.LGarXiv:2608.26129v12026
  19. SLM-Conditioned Hierarchical Relation Routing for Labeled Property Graph Learning

    Michal Podstawski

    cs.LGcs.CLarXiv:2608.26132v12026
  20. Cross-Platform Generalisation Failure in Mental Health Natural Language Processing: A Five-Axis Fairness Audit of Transformer Models on Social Media

    Rajveer Singh Pall, Sameer Yadav

    cs.CLcs.LGarXiv:2608.26138v12026
  21. Evaluating Language Models in Realistic Conversational Contexts

    Ilija Subasic, Andrew Rabinovich, Zhao Chen

    cs.CLarXiv:2608.26131v12026
  22. Affix Cache for Diffusion Large Language Models

    Kaihua Liang, An Zhong, Xin Tan +4

    cs.CLcs.LGarXiv:2608.26140v12026
  23. Position Is All You Need: A Free Lunch Token Compression Strategy for MLLM-based Referring Expression Segmentation

    Yuhan Liu, Yixiong Zou, Yuhua Li +1

    cs.CLcs.AIarXiv:2608.26142v12026
  24. Large Language Models for Generative Information Extraction: A Survey

    Derong Xu, Wei Chen, Wenjun Peng +7

    cs.CLarXiv:2312.17617v32023
  25. A Convolutional Encoder Model for Neural Machine Translation

    Jonas Gehring, Michael Auli, David Grangier +1

    cs.CLarXiv:1611.02344v32016
  26. Natural-Language Policies to Executable Decisions: An Interpretable Large Language Model Framework

    Ziqiang Zhang, Jing Ma, Zilong Wang +6

    cs.CLarXiv:2608.26124v12026
  27. Training-Time Explainability for Multilingual Hate Speech Detection: Aligning Model Reasoning with Human Rationales

    Muhammad Deedahwar Mazhar Qureshi, Sannaan Khan, Muhammad Atif Qureshi +1

    cs.CLcs.AIarXiv:2608.26125v12026
  28. Graph-Based Modeling of Financial Volatility Dynamics

    Chuanzhen Wang, Alice Zhang, Wei Chen +1

    q-fin.STcs.CLcs.LGarXiv:2608.26127v12026
  29. CARE: Causally-Aligned Reasoning Exploration for Medical Large Language Models

    Yucheng Zhou, Peng Luo, Qianning Wang +2

    cs.CLcs.CVarXiv:2608.26147v12026
  30. Enriching Pre-trained Language Model with Entity Information for Relation Classification

    Shanchan Wu, Yifan He

    cs.CLarXiv:1905.08284v12019
  31. Rare Diseases, Common Dilemmas: LLMs Prioritize Equal Resource Distribution over Patient Benefit in Decision-Making

    Minda Zhao, Xu Han, Rishabh Goel +6

    cs.CYcs.AIcs.CLarXiv:2608.25236v12026
  32. Beyond Accuracy: A Qualitative Analysis of Vision-Language Models for Hate Speech Detection in Memes

    Muhammad Jawad Chowdhury, Adiba Hasan, Ishrak Hossain +2

    cs.CLcs.AIarXiv:2608.26143v12026
  33. Vagdhenu: A Vrutta (Meter) Aware Shloka-to-Chant (TTS) System for Sanskrit

    Prathosh A P

    cs.CLarXiv:2608.26146v12026
  34. Why Current XAI Is Not Enough for Arabic NLP: A Critical Survey of the Explainability Gap

    Salima Lamsiyah, Ruslan Mitkov

    cs.CLarXiv:2608.26144v12026
  35. Nyströmformer: A Nyström-Based Algorithm for Approximating Self-Attention

    Yunyang Xiong, Zhanpeng Zeng, Rudrasis Chakraborty +4

    cs.CLcs.LGarXiv:2102.03902v32021
  36. Knowing What, How and Why: A Near Complete Solution for Aspect-based Sentiment Analysis

    Haiyun Peng, Lu Xu, Lidong Bing +3

    cs.CLarXiv:1911.01616v42019
  37. Artificial Intelligence Models Can Predict and Collaboratively Modulate Human Memory Search

    Eric Lacosse, Mariana Duarte, Graham Todd +2

    cs.CLcs.AIcs.HCarXiv:2608.26152v12026
  38. Letters hide the truth from our eyes: English homophones have meaningfully different phonetic realizations

    Yu-Hsiang Tseng, Mirjam T. C. Ernestus, Louis F. M. ten Bosch +1

    cs.CLarXiv:2608.26749v12026
  39. Hallucinations in LLMs: A Lifecycle-Based Survey of Causes, Detection, Mitigation, and Prevention

    Naveen Lamba, Sanju Tiwari, Manas Gaur

    cs.CLcs.AIarXiv:2608.26168v12026
  40. GPT-Driver: Learning to Drive with GPT

    Jiageng Mao, Yuxi Qian, Junjie Ye +2

    cs.CVcs.AIcs.CLarXiv:2310.01415v32023
  41. Evaluating AI Generated Summaries for Cancer Patients

    Muhammad Aurangzeb Ahmad, Kim Shyu, Leon Oliver +2

    cs.CLcs.AIarXiv:2608.26154v12026
  42. VFA: Empowering Multilingual MLLMs via Vision-Free Adaptation

    Yixia Li, Yaqing Shi, Zhiwen Ruan +6

    cs.CLcs.AIarXiv:2608.26155v12026
  43. Self-Generated Text Recognition: Quality Heuristics, Cross-Task Transfer, and Downstream Bias in LLM Evaluation

    Jesse St. Amand, Callum Canavan, Sohaib Imran +5

    cs.CLcs.AIarXiv:2608.26159v12026
  44. Mutual Debiasing via Dual-Seed Comparison for Probabilistic Sampling in Large Language Models

    Zihao Guo, Hongtao Lv, Chaoli Zhang +4

    cs.CLcs.AIarXiv:2608.26161v12026
  45. From Sound to Symptom: Real-Time Respiratory Signal Understanding for Conversational Healthcare Agents

    Tanmay Laud, Herprit Mahal, Subhabrata Mukherjee

    cs.CLcs.AIcs.HCarXiv:2608.26163v12026
  46. Using Poly-Encoders for Computationally Efficient Automated Creativity Assessment

    Sam Grouchnikov, Phillip Gregory, Jiho Noh

    cs.CLcs.AIarXiv:2608.26165v12026
  47. Mitigating Fabrication in Multi-Stage LLM Pipelines for Hiring: An Empirical Evaluation of Prompt Guardrails and Human-in-the-Loop Checkpoints

    Hiroko Takano

    cs.CYcs.CLcs.HCarXiv:2608.26171v12026
  48. Lost in Compression: A Controlled Cross-Lingual Audit of Extractive Prompt Compressors

    Mantas Lukauskas

    cs.CLcs.AIarXiv:2608.26175v12026
  49. Knowledge Cards: Structured Knowledge for AI Systems

    Liliana Ferreira

    cs.AIcs.CLarXiv:2608.26176v12026
  50. Agentless: Demystifying LLM-based Software Engineering Agents

    Chunqiu Steven Xia, Yinlin Deng, Soren Dunn +1

    cs.SEcs.AIcs.CLarXiv:2407.01489v22024
  51. Recent Advances in End-to-End Automatic Speech Recognition

    Jinyu Li

    eess.AScs.AIcs.CLarXiv:2111.01690v22021
  52. Cyclical Annealing Schedule: A Simple Approach to Mitigating KL Vanishing

    Hao Fu, Chunyuan Li, Xiaodong Liu +3

    cs.LGcs.AIcs.CLarXiv:1903.10145v32019
  53. Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation

    Chengyue Wu, Xiaokang Chen, Zhiyu Wu +8

    cs.CVcs.AIcs.CLarXiv:2410.13848v12024
  54. CLUE: A Chinese Language Understanding Evaluation Benchmark

    Liang Xu, Hai Hu, Xuanwei Zhang +29

    cs.CLcs.LGarXiv:2004.05986v32020
  55. I-BERT: Integer-only BERT Quantization

    Sehoon Kim, Amir Gholami, Zhewei Yao +2

    cs.CLarXiv:2101.01321v32021
  56. Emotion Recognition in Conversation: Research Challenges, Datasets, and Recent Advances

    Soujanya Poria, Navonil Majumder, Rada Mihalcea +1

    cs.CLcs.AIarXiv:1905.02947v12019
  57. MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data

    Tianyu Han, Lisa C. Adams, Jens-Michalis Papaioannou +6

    cs.CLcs.AIarXiv:2304.08247v32023
  58. Zero-Shot Self-Orchestration with Ledger-Based Control for Improved LLM Coding Performance

    Victor Gao, Vida Khosrowshahi, Ali Khosrowshahi +4

    cs.MAcs.AIcs.CLarXiv:2608.26480v12026
  59. When the Canonical Completion Is Wrong: Formalizing and Measuring the Jump in Large Language Models

    Dai Shi, Xiaoyu Li, José Miguel Hernández-Lobato

    cs.CLcs.AIcs.LGarXiv:2608.26187v12026
  60. AudioGen: Textually Guided Audio Generation

    Felix Kreuk, Gabriel Synnaeve, Adam Polyak +6

    cs.SDcs.CLcs.LGarXiv:2209.15352v22022