Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
7,441 to 7,500 of 11,248
DuMateBench: Evaluating Autonomous Agents in Complex Real-World Workflows
Zechun Niu, Yukun Zhao, Jiaxin Zhang +12
cs.AIcs.CLarXiv:2608.26546v12026Pix2seq: A Language Modeling Framework for Object Detection
Ting Chen, Saurabh Saxena, Lala Li +2
cs.CVcs.AIcs.CLarXiv:2109.10852v22021DeflectBench: A Benchmark for Evaluating Rhetorical Fallacy Generation in LLMs
Art Kanke
cs.CLarXiv:2608.26119v12026Can a Model Catch Its Own Hallucinations for Free?: Label-Free Doubt Signals Hold Their Own Against a Labelled Dataset for Abstention
Ali Asaria, Tony Salomone, Deep Gandhi
cs.CLcs.LGarXiv:2608.26121v12026How Language Model Hallucinations Can Snowball
Muru Zhang, Ofir Press, William Merrill +2
cs.CLarXiv:2305.13534v12023Factual Probing Is [MASK]: Learning vs. Learning to Recall
Zexuan Zhong, Dan Friedman, Danqi Chen
cs.CLarXiv:2104.05240v22021Visual Information-Guided Parallel Decoding for Diffusion Multimodal Large Language Models
Insu Lee, Wooje Park, Wonseok Shin +2
cs.CVcs.CLarXiv:2608.26580v12026Agent Seer: Synthesizing Scenarios from Specification Understanding
Harish Karumuri, Mahesh Vemula, David Lopes Pegna
cs.CLarXiv:2608.26133v12026SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression
Tim Dettmers, Ruslan Svirschevski, Vage Egiazarian +6
cs.CLcs.LGarXiv:2306.03078v12023Neural Baby Talk
Jiasen Lu, Jianwei Yang, Dhruv Batra +1
cs.CVcs.CLarXiv:1803.09845v12018Interpretable, Fairly Evaluated Automated L2 Speaking Assessment that Beats the Single-Human Ceiling and Why Pause Encoding Does Not Change LLM Fluency Scores
Eichi Uehara
cs.CLcs.LGcs.SDarXiv:2608.26137v12026Syntax vs. Semantics: How Transformers Learn Deep Dependencies
Jiangrui Zhao, Xiaoting Du
cs.CLcs.AIarXiv:2608.26139v12026Data Science Approaches to Evaluating Honours Candidates
Francesca von Braun-Bates, Sunreeta Sen, Indraayudh Talukdar +1
cs.CLarXiv:2608.26135v12026Reward-Informed Sparse Autoencoders and the Solution-Completeness Confound
Tanvi Nagilla, Alexander Jameson, Daniel Manta +1
cs.CLarXiv:2608.26136v12026AdaThinking-E: One-Token Entropy Regulation for Adaptive Thinking
Zining Wang, Tongkun Guan, Boming Chen +8
cs.CLcs.LGarXiv:2608.26141v12026Attention Guided Graph Convolutional Networks for Relation Extraction
Zhijiang Guo, Yan Zhang, Wei Lu
cs.CLcs.LGarXiv:1906.07510v82019Summaries:한국어PlanBench: An Extensible Benchmark for Evaluating Large Language Models on Planning and Reasoning about Change
Karthik Valmeekam, Matthew Marquez, Alberto Olmo +2
cs.CLcs.AIarXiv:2206.10498v42022FIRSTPASS: A Multi-Domain, Multi-Round Peer Review Dataset Grounded in Real Editorial Outcomes
Prabhjot Singh, Somnath Luitel, Manmeet Singh +1
cs.CLcs.AIcs.LGarXiv:2608.26129v12026SLM-Conditioned Hierarchical Relation Routing for Labeled Property Graph Learning
Michal Podstawski
cs.LGcs.CLarXiv:2608.26132v12026Cross-Platform Generalisation Failure in Mental Health Natural Language Processing: A Five-Axis Fairness Audit of Transformer Models on Social Media
Rajveer Singh Pall, Sameer Yadav
cs.CLcs.LGarXiv:2608.26138v12026Evaluating Language Models in Realistic Conversational Contexts
Ilija Subasic, Andrew Rabinovich, Zhao Chen
cs.CLarXiv:2608.26131v12026Affix Cache for Diffusion Large Language Models
Kaihua Liang, An Zhong, Xin Tan +4
cs.CLcs.LGarXiv:2608.26140v12026Position Is All You Need: A Free Lunch Token Compression Strategy for MLLM-based Referring Expression Segmentation
Yuhan Liu, Yixiong Zou, Yuhua Li +1
cs.CLcs.AIarXiv:2608.26142v12026Large Language Models for Generative Information Extraction: A Survey
Derong Xu, Wei Chen, Wenjun Peng +7
cs.CLarXiv:2312.17617v32023A Convolutional Encoder Model for Neural Machine Translation
Jonas Gehring, Michael Auli, David Grangier +1
cs.CLarXiv:1611.02344v32016Natural-Language Policies to Executable Decisions: An Interpretable Large Language Model Framework
Ziqiang Zhang, Jing Ma, Zilong Wang +6
cs.CLarXiv:2608.26124v12026Training-Time Explainability for Multilingual Hate Speech Detection: Aligning Model Reasoning with Human Rationales
Muhammad Deedahwar Mazhar Qureshi, Sannaan Khan, Muhammad Atif Qureshi +1
cs.CLcs.AIarXiv:2608.26125v12026Graph-Based Modeling of Financial Volatility Dynamics
Chuanzhen Wang, Alice Zhang, Wei Chen +1
q-fin.STcs.CLcs.LGarXiv:2608.26127v12026CARE: Causally-Aligned Reasoning Exploration for Medical Large Language Models
Yucheng Zhou, Peng Luo, Qianning Wang +2
cs.CLcs.CVarXiv:2608.26147v12026Enriching Pre-trained Language Model with Entity Information for Relation Classification
Shanchan Wu, Yifan He
cs.CLarXiv:1905.08284v12019Rare Diseases, Common Dilemmas: LLMs Prioritize Equal Resource Distribution over Patient Benefit in Decision-Making
Minda Zhao, Xu Han, Rishabh Goel +6
cs.CYcs.AIcs.CLarXiv:2608.25236v12026Beyond Accuracy: A Qualitative Analysis of Vision-Language Models for Hate Speech Detection in Memes
Muhammad Jawad Chowdhury, Adiba Hasan, Ishrak Hossain +2
cs.CLcs.AIarXiv:2608.26143v12026Vagdhenu: A Vrutta (Meter) Aware Shloka-to-Chant (TTS) System for Sanskrit
Prathosh A P
cs.CLarXiv:2608.26146v12026Why Current XAI Is Not Enough for Arabic NLP: A Critical Survey of the Explainability Gap
Salima Lamsiyah, Ruslan Mitkov
cs.CLarXiv:2608.26144v12026Nyströmformer: A Nyström-Based Algorithm for Approximating Self-Attention
Yunyang Xiong, Zhanpeng Zeng, Rudrasis Chakraborty +4
cs.CLcs.LGarXiv:2102.03902v32021Knowing What, How and Why: A Near Complete Solution for Aspect-based Sentiment Analysis
Haiyun Peng, Lu Xu, Lidong Bing +3
cs.CLarXiv:1911.01616v42019Artificial Intelligence Models Can Predict and Collaboratively Modulate Human Memory Search
Eric Lacosse, Mariana Duarte, Graham Todd +2
cs.CLcs.AIcs.HCarXiv:2608.26152v12026Letters hide the truth from our eyes: English homophones have meaningfully different phonetic realizations
Yu-Hsiang Tseng, Mirjam T. C. Ernestus, Louis F. M. ten Bosch +1
cs.CLarXiv:2608.26749v12026Hallucinations in LLMs: A Lifecycle-Based Survey of Causes, Detection, Mitigation, and Prevention
Naveen Lamba, Sanju Tiwari, Manas Gaur
cs.CLcs.AIarXiv:2608.26168v12026GPT-Driver: Learning to Drive with GPT
Jiageng Mao, Yuxi Qian, Junjie Ye +2
cs.CVcs.AIcs.CLarXiv:2310.01415v32023Evaluating AI Generated Summaries for Cancer Patients
Muhammad Aurangzeb Ahmad, Kim Shyu, Leon Oliver +2
cs.CLcs.AIarXiv:2608.26154v12026VFA: Empowering Multilingual MLLMs via Vision-Free Adaptation
Yixia Li, Yaqing Shi, Zhiwen Ruan +6
cs.CLcs.AIarXiv:2608.26155v12026Self-Generated Text Recognition: Quality Heuristics, Cross-Task Transfer, and Downstream Bias in LLM Evaluation
Jesse St. Amand, Callum Canavan, Sohaib Imran +5
cs.CLcs.AIarXiv:2608.26159v12026Mutual Debiasing via Dual-Seed Comparison for Probabilistic Sampling in Large Language Models
Zihao Guo, Hongtao Lv, Chaoli Zhang +4
cs.CLcs.AIarXiv:2608.26161v12026From Sound to Symptom: Real-Time Respiratory Signal Understanding for Conversational Healthcare Agents
Tanmay Laud, Herprit Mahal, Subhabrata Mukherjee
cs.CLcs.AIcs.HCarXiv:2608.26163v12026Using Poly-Encoders for Computationally Efficient Automated Creativity Assessment
Sam Grouchnikov, Phillip Gregory, Jiho Noh
cs.CLcs.AIarXiv:2608.26165v12026Mitigating Fabrication in Multi-Stage LLM Pipelines for Hiring: An Empirical Evaluation of Prompt Guardrails and Human-in-the-Loop Checkpoints
Hiroko Takano
cs.CYcs.CLcs.HCarXiv:2608.26171v12026Lost in Compression: A Controlled Cross-Lingual Audit of Extractive Prompt Compressors
Mantas Lukauskas
cs.CLcs.AIarXiv:2608.26175v12026Knowledge Cards: Structured Knowledge for AI Systems
Liliana Ferreira
cs.AIcs.CLarXiv:2608.26176v12026Agentless: Demystifying LLM-based Software Engineering Agents
Chunqiu Steven Xia, Yinlin Deng, Soren Dunn +1
cs.SEcs.AIcs.CLarXiv:2407.01489v22024Recent Advances in End-to-End Automatic Speech Recognition
Jinyu Li
eess.AScs.AIcs.CLarXiv:2111.01690v22021Cyclical Annealing Schedule: A Simple Approach to Mitigating KL Vanishing
Hao Fu, Chunyuan Li, Xiaodong Liu +3
cs.LGcs.AIcs.CLarXiv:1903.10145v32019Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation
Chengyue Wu, Xiaokang Chen, Zhiyu Wu +8
cs.CVcs.AIcs.CLarXiv:2410.13848v12024CLUE: A Chinese Language Understanding Evaluation Benchmark
Liang Xu, Hai Hu, Xuanwei Zhang +29
cs.CLcs.LGarXiv:2004.05986v32020I-BERT: Integer-only BERT Quantization
Sehoon Kim, Amir Gholami, Zhewei Yao +2
cs.CLarXiv:2101.01321v32021Emotion Recognition in Conversation: Research Challenges, Datasets, and Recent Advances
Soujanya Poria, Navonil Majumder, Rada Mihalcea +1
cs.CLcs.AIarXiv:1905.02947v12019MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data
Tianyu Han, Lisa C. Adams, Jens-Michalis Papaioannou +6
cs.CLcs.AIarXiv:2304.08247v32023Zero-Shot Self-Orchestration with Ledger-Based Control for Improved LLM Coding Performance
Victor Gao, Vida Khosrowshahi, Ali Khosrowshahi +4
cs.MAcs.AIcs.CLarXiv:2608.26480v12026When the Canonical Completion Is Wrong: Formalizing and Measuring the Jump in Large Language Models
Dai Shi, Xiaoyu Li, José Miguel Hernández-Lobato
cs.CLcs.AIcs.LGarXiv:2608.26187v12026AudioGen: Textually Guided Audio Generation
Felix Kreuk, Gabriel Synnaeve, Adam Polyak +6
cs.SDcs.CLcs.LGarXiv:2209.15352v22022