Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
8,521 to 8,580 of 11,242
Utilizing BERT for Aspect-Based Sentiment Analysis via Constructing Auxiliary Sentence
Chi Sun, Luyao Huang, Xipeng Qiu
cs.CLarXiv:1903.09588v12019DHPLT: large-scale multilingual diachronic corpora and word representations for semantic change modelling
Mariia Fedorova, Andrey Kutuzov, Khonzoda Umarova
cs.CLarXiv:2602.11968v12026ExStrucTiny: A Benchmark for Schema-Variable Structured Information Extraction from Document Images
Mathieu Sibue, Andres Muñoz Garza, Samuel Mensah +4
cs.CLarXiv:2602.12203v12026Noise Floor Audit for Agent Benchmarks
Yihang Chen, Pin Qian, Su Wang +4
cs.CLarXiv:2608.22331v12026Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5
Dongrui Liu, Yi Yu, Jie Zhang +18
cs.AIcs.CLcs.CVarXiv:2602.14457v12026Query as Anchor: Scenario-Adaptive User Representation via Large Language Model
Jiahao Yuan, Yike Xu, Jinyong Wen +9
cs.CLcs.IRarXiv:2602.14492v22026Knowledge Enhanced Contextual Word Representations
Matthew E. Peters, Mark Neumann, Robert L. Logan +4
cs.CLarXiv:1909.04164v22019Who Pays More for Safety? Measuring the Disparate Cost of Safety Alignment across Languages
Chanwoong Yoon, Jungsoo Park, Alan Ritter
cs.CLarXiv:2608.22490v12026Classroom Final Exam: An Instructor-Tested Reasoning Benchmark
Chongyang Gao, Diji Yang, Shuyan Zhou +4
cs.AIcs.CEcs.CLarXiv:2602.19517v22026Intent Laundering: AI Safety Datasets Are Not What They Seem
Shahriar Golchin, Marc Wetter
cs.CRcs.AIcs.CLarXiv:2602.16729v32026TAROT: Test-driven and Capability-adaptive Curriculum Reinforcement Fine-tuning for Code Generation with Large Language Models
Chansung Park, Juyong Jiang, Fan Wang +4
cs.CLcs.LGcs.SEarXiv:2602.15449v12026VATEX: A Large-Scale, High-Quality Multilingual Dataset for Video-and-Language Research
Xin Wang, Jiawei Wu, Junkun Chen +3
cs.CVcs.CLcs.LGarXiv:1904.03493v32019AAVGen: Precision Engineering of Adeno-associated Viral Capsids for Renal Selective Targeting
Mohammadreza Ghaffarzadeh-Esfahani, Yousof Gheisari
q-bio.QMcs.AIcs.CLarXiv:2602.18915v12026NanoKnow: How to Know What Your Language Model Knows
Lingwei Gu, Nour Jedidi, Jimmy Lin
cs.CLcs.AIcs.IRarXiv:2602.20122v22026Visual Programming: Compositional visual reasoning without training
Tanmay Gupta, Aniruddha Kembhavi
cs.CVcs.AIcs.CLarXiv:2211.11559v12022Reasoning Core: A Scalable Procedural Data Generation Suite for Symbolic Pre-training and Post-Training
Valentin Lacombe, Valentin Quesnel, Damien Sileo
cs.CLarXiv:2603.02208v12026Question Answering with Subgraph Embeddings
Antoine Bordes, Sumit Chopra, Jason Weston
cs.CLarXiv:1406.3676v32014Reducing Transformer Depth on Demand with Structured Dropout
Angela Fan, Edouard Grave, Armand Joulin
cs.LGcs.CLstat.MLarXiv:1909.11556v12019VecGlypher: Unified Vector Glyph Generation with Language Models
Xiaoke Huang, Bhavul Gauri, Kam Woh Ng +12
cs.CLarXiv:2602.21461v12026Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets
Hanna Yukhymenko, Anton Alexandrov, Martin Vechev
cs.CLcs.AIcs.LGarXiv:2602.22207v12026Text-to-SQL Empowered by Large Language Models: A Benchmark Evaluation
Dawei Gao, Haibin Wang, Yaliang Li +4
cs.DBcs.CLcs.LGarXiv:2308.15363v42023AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning
Yutong Wang, Siyuan Xiong, Xuebo Liu +4
cs.AIcs.CLarXiv:2602.23258v22026Unsupervised Learning of Sentence Embeddings using Compositional n-Gram Features
Matteo Pagliardini, Prakhar Gupta, Martin Jaggi
cs.CLcs.AIcs.IRarXiv:1703.02507v32017T2S-Bench & Structure-of-Thought: Benchmarking and Prompting Comprehensive Text-to-Structure Reasoning
Qinsi Wang, Hancheng Ye, Jinhee Kim +12
cs.CLcs.AIarXiv:2603.03790v12026Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
Dadi Guo, Yuejin Xie, Qingyu Liu +11
cs.CLarXiv:2603.03202v32026Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question Answering
Aishwarya Agrawal, Dhruv Batra, Devi Parikh +1
cs.CVcs.AIcs.CLarXiv:1712.00377v22017A Corpus for Reasoning About Natural Language Grounded in Photographs
Alane Suhr, Stephanie Zhou, Ally Zhang +3
cs.CLcs.CVarXiv:1811.00491v32018Summaries:한국어Progressive Residual Warmup for Language Model Pretraining
Tianhao Chen, Xin Xu, Lu Yin +4
cs.CLarXiv:2603.05369v12026SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning
Zhaohan Meng, Zaiqiao Meng, Siwei Liu +3
cs.CLcs.AIcs.CEarXiv:2608.22132v12026Knowledge Neurons in Pretrained Transformers
Damai Dai, Li Dong, Yaru Hao +3
cs.CLarXiv:2104.08696v22021SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
Subramanyam Sahoo, Aman Chadha, Vinija Jain +1
cs.AIcs.CLcs.LGarXiv:2603.06333v12026ByteFlow: Language Modeling through Adaptive Byte Compression without a Tokenizer
Chunyuan Deng, Sanket Lokegaonkar, Colin Lockard +3
cs.CLcs.LGarXiv:2603.03583v12026On Measuring Social Biases in Sentence Encoders
Chandler May, Alex Wang, Shikha Bordia +2
cs.CLcs.CYarXiv:1903.10561v12019HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
The Viet Bui, Wenjun Li, Yong Liu
cs.AIcs.CLarXiv:2603.04750v12026SchemaGUI: A Schema-Driven Benchmark for Controllable GUI Generation Evaluation
Jiarui Dong, Yin Cai, Zhouhong Gu +7
cs.CLarXiv:2608.22390v12026Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity
Di Zhang, Xun Wu, Shaohan Huang +9
cs.CLarXiv:2603.05168v12026MoverScore: Text Generation Evaluating with Contextualized Embeddings and Earth Mover Distance
Wei Zhao, Maxime Peyrard, Fei Liu +3
cs.CLarXiv:1909.02622v22019Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
Jaeik Kim, Woojin Kim, Jihwan Hong +8
cs.CLcs.AIarXiv:2604.00007v12026Reward Prediction with Factorized World States
Yijun Shen, Delong Chen, Xianming Hu +4
cs.CLarXiv:2603.09400v12026GTA-RAG: Graph-Trajectory-Augmented Reinforcement Learning for Multi-Turn Retrieval-Augmented Reasoning
Jun Chen, Yongchao Liu, Pengyu Qiu +6
cs.CLcs.LGarXiv:2608.22479v12026Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context
Keivan Alizadeh, Parshin Shojaee, Minsik Cho +1
cs.CLcs.AIcs.LGarXiv:2603.15653v12026Neural Text Generation with Unlikelihood Training
Sean Welleck, Ilia Kulikov, Stephen Roller +3
cs.LGcs.CLstat.MLarXiv:1908.04319v22019A Comparative analysis of Layer-wise Representational Capacity in AR and Diffusion LLMs
Raghavv Goel, Risheek Garrepalli, Sudhanshu Agrawal +3
cs.CLcs.LGarXiv:2603.07475v42026GRAFT: Graph-Distilled Generative Retrieval for Facet-Aware Scientific Literature Exploration
Italo Luis da Silva, Hanqi Yan, Yujing Wang +3
cs.IRcs.CLarXiv:2608.22381v12026BiCLIP: Domain Canonicalization via Structured Geometric Transformation
Pranav Mantini, Shishir K. Shah
cs.CVcs.AIcs.CLarXiv:2603.08942v22026Context-Aware Cluster Decoding: Semantic Anchor-Driven Coherence in dMLLMs
Yikai Zhao, Qiyan Zhao, Jiaquan Zhang +3
cs.CLarXiv:2608.22367v12026The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness
Subramanyam Sahoo, Aman Chadha, Vinija Jain +1
cs.AIcs.CLcs.CYarXiv:2603.09200v12026Argmax Flows and Multinomial Diffusion: Learning Categorical Distributions
Emiel Hoogeboom, Didrik Nielsen, Priyank Jaini +2
stat.MLcs.CLcs.LGarXiv:2102.05379v32021Do What I Say: A Spoken Prompt Dataset for Instruction-Following
Maike Züfle, Sara Papi, Fabian Retkowski +5
cs.CLarXiv:2603.09881v22026Multi-News: a Large-Scale Multi-Document Summarization Dataset and Abstractive Hierarchical Model
Alexander R. Fabbri, Irene Li, Tianwei She +2
cs.CLarXiv:1906.01749v32019Self-Execution Simulation Improves Coding Models
Gallil Maimon, Ori Yoran, Felix Kreuk +4
cs.CLcs.LGarXiv:2604.03253v12026End-to-end Structure-Aware Convolutional Networks for Knowledge Base Completion
Chao Shang, Yun Tang, Jing Huang +3
cs.AIcs.CLarXiv:1811.04441v22018MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization
Chenyang Zhu, Hongxiang Li, Xiu Li +1
cs.CVcs.AIcs.CLarXiv:2603.12743v12026A Comprehensive Survey on Pretrained Foundation Models: A History from BERT to ChatGPT
Ce Zhou, Qian Li, Chen Li +16
cs.AIcs.CLcs.LGarXiv:2302.09419v32023Large-scale Simple Question Answering with Memory Networks
Antoine Bordes, Nicolas Usunier, Sumit Chopra +1
cs.LGcs.CLarXiv:1506.02075v12015ST$^2$U: Stateful Test-Time Unlearning via Restricted Knowledge Boundary Control
Xunlei Chen, Qinghui Gong, Ruini Xue +3
cs.LGcs.CLarXiv:2608.23034v12026vq-wav2vec: Self-Supervised Learning of Discrete Speech Representations
Alexei Baevski, Steffen Schneider, Michael Auli
cs.CLcs.LGarXiv:1910.05453v32019Mending the Holes: Mitigating Reward Hacking in Reinforcement Learning for Multilingual Translation
Yifeng Liu, Siqi Ouyang, Yatish Hosmane Revanasiddappa +1
cs.CLarXiv:2603.13045v12026VoXtream2: Full-stream TTS with dynamic speaking rate control
Nikita Torgashov, Gustav Eje Henter, Gabriel Skantze
eess.AScs.CLcs.HCarXiv:2603.13518v12026ECG-Reasoning-Benchmark: A Benchmark for Evaluating Clinical Reasoning Capabilities in ECG Interpretation
Jungwoo Oh, Hyunseung Chung, Junhee Lee +6
cs.LGcs.AIcs.CLarXiv:2603.14326v12026