Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

8,521 to 8,580 of 11,242

  1. Utilizing BERT for Aspect-Based Sentiment Analysis via Constructing Auxiliary Sentence

    Chi Sun, Luyao Huang, Xipeng Qiu

    cs.CLarXiv:1903.09588v12019
  2. DHPLT: large-scale multilingual diachronic corpora and word representations for semantic change modelling

    Mariia Fedorova, Andrey Kutuzov, Khonzoda Umarova

    cs.CLarXiv:2602.11968v12026
  3. ExStrucTiny: A Benchmark for Schema-Variable Structured Information Extraction from Document Images

    Mathieu Sibue, Andres Muñoz Garza, Samuel Mensah +4

    cs.CLarXiv:2602.12203v12026
  4. Noise Floor Audit for Agent Benchmarks

    Yihang Chen, Pin Qian, Su Wang +4

    cs.CLarXiv:2608.22331v12026
  5. Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5

    Dongrui Liu, Yi Yu, Jie Zhang +18

    cs.AIcs.CLcs.CVarXiv:2602.14457v12026
  6. Query as Anchor: Scenario-Adaptive User Representation via Large Language Model

    Jiahao Yuan, Yike Xu, Jinyong Wen +9

    cs.CLcs.IRarXiv:2602.14492v22026
  7. Knowledge Enhanced Contextual Word Representations

    Matthew E. Peters, Mark Neumann, Robert L. Logan +4

    cs.CLarXiv:1909.04164v22019
  8. Who Pays More for Safety? Measuring the Disparate Cost of Safety Alignment across Languages

    Chanwoong Yoon, Jungsoo Park, Alan Ritter

    cs.CLarXiv:2608.22490v12026
  9. Classroom Final Exam: An Instructor-Tested Reasoning Benchmark

    Chongyang Gao, Diji Yang, Shuyan Zhou +4

    cs.AIcs.CEcs.CLarXiv:2602.19517v22026
  10. Intent Laundering: AI Safety Datasets Are Not What They Seem

    Shahriar Golchin, Marc Wetter

    cs.CRcs.AIcs.CLarXiv:2602.16729v32026
  11. TAROT: Test-driven and Capability-adaptive Curriculum Reinforcement Fine-tuning for Code Generation with Large Language Models

    Chansung Park, Juyong Jiang, Fan Wang +4

    cs.CLcs.LGcs.SEarXiv:2602.15449v12026
  12. VATEX: A Large-Scale, High-Quality Multilingual Dataset for Video-and-Language Research

    Xin Wang, Jiawei Wu, Junkun Chen +3

    cs.CVcs.CLcs.LGarXiv:1904.03493v32019
  13. AAVGen: Precision Engineering of Adeno-associated Viral Capsids for Renal Selective Targeting

    Mohammadreza Ghaffarzadeh-Esfahani, Yousof Gheisari

    q-bio.QMcs.AIcs.CLarXiv:2602.18915v12026
  14. NanoKnow: How to Know What Your Language Model Knows

    Lingwei Gu, Nour Jedidi, Jimmy Lin

    cs.CLcs.AIcs.IRarXiv:2602.20122v22026
  15. Visual Programming: Compositional visual reasoning without training

    Tanmay Gupta, Aniruddha Kembhavi

    cs.CVcs.AIcs.CLarXiv:2211.11559v12022
  16. Reasoning Core: A Scalable Procedural Data Generation Suite for Symbolic Pre-training and Post-Training

    Valentin Lacombe, Valentin Quesnel, Damien Sileo

    cs.CLarXiv:2603.02208v12026
  17. Question Answering with Subgraph Embeddings

    Antoine Bordes, Sumit Chopra, Jason Weston

    cs.CLarXiv:1406.3676v32014
  18. Reducing Transformer Depth on Demand with Structured Dropout

    Angela Fan, Edouard Grave, Armand Joulin

    cs.LGcs.CLstat.MLarXiv:1909.11556v12019
  19. VecGlypher: Unified Vector Glyph Generation with Language Models

    Xiaoke Huang, Bhavul Gauri, Kam Woh Ng +12

    cs.CLarXiv:2602.21461v12026
  20. Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets

    Hanna Yukhymenko, Anton Alexandrov, Martin Vechev

    cs.CLcs.AIcs.LGarXiv:2602.22207v12026
  21. Text-to-SQL Empowered by Large Language Models: A Benchmark Evaluation

    Dawei Gao, Haibin Wang, Yaliang Li +4

    cs.DBcs.CLcs.LGarXiv:2308.15363v42023
  22. AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning

    Yutong Wang, Siyuan Xiong, Xuebo Liu +4

    cs.AIcs.CLarXiv:2602.23258v22026
  23. Unsupervised Learning of Sentence Embeddings using Compositional n-Gram Features

    Matteo Pagliardini, Prakhar Gupta, Martin Jaggi

    cs.CLcs.AIcs.IRarXiv:1703.02507v32017
  24. T2S-Bench & Structure-of-Thought: Benchmarking and Prompting Comprehensive Text-to-Structure Reasoning

    Qinsi Wang, Hancheng Ye, Jinhee Kim +12

    cs.CLcs.AIarXiv:2603.03790v12026
  25. Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?

    Dadi Guo, Yuejin Xie, Qingyu Liu +11

    cs.CLarXiv:2603.03202v32026
  26. Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question Answering

    Aishwarya Agrawal, Dhruv Batra, Devi Parikh +1

    cs.CVcs.AIcs.CLarXiv:1712.00377v22017
  27. A Corpus for Reasoning About Natural Language Grounded in Photographs

    Alane Suhr, Stephanie Zhou, Ally Zhang +3

    cs.CLcs.CVarXiv:1811.00491v32018
    Summaries:한국어
  28. Progressive Residual Warmup for Language Model Pretraining

    Tianhao Chen, Xin Xu, Lu Yin +4

    cs.CLarXiv:2603.05369v12026
  29. SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning

    Zhaohan Meng, Zaiqiao Meng, Siwei Liu +3

    cs.CLcs.AIcs.CEarXiv:2608.22132v12026
  30. Knowledge Neurons in Pretrained Transformers

    Damai Dai, Li Dong, Yaru Hao +3

    cs.CLarXiv:2104.08696v22021
  31. SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement

    Subramanyam Sahoo, Aman Chadha, Vinija Jain +1

    cs.AIcs.CLcs.LGarXiv:2603.06333v12026
  32. ByteFlow: Language Modeling through Adaptive Byte Compression without a Tokenizer

    Chunyuan Deng, Sanket Lokegaonkar, Colin Lockard +3

    cs.CLcs.LGarXiv:2603.03583v12026
  33. On Measuring Social Biases in Sentence Encoders

    Chandler May, Alex Wang, Shikha Bordia +2

    cs.CLcs.CYarXiv:1903.10561v12019
  34. HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel

    The Viet Bui, Wenjun Li, Yong Liu

    cs.AIcs.CLarXiv:2603.04750v12026
  35. SchemaGUI: A Schema-Driven Benchmark for Controllable GUI Generation Evaluation

    Jiarui Dong, Yin Cai, Zhouhong Gu +7

    cs.CLarXiv:2608.22390v12026
  36. Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity

    Di Zhang, Xun Wu, Shaohan Huang +9

    cs.CLarXiv:2603.05168v12026
  37. MoverScore: Text Generation Evaluating with Contextualized Embeddings and Earth Mover Distance

    Wei Zhao, Maxime Peyrard, Fei Liu +3

    cs.CLarXiv:1909.02622v22019
  38. Dynin-Omni: Omnimodal Unified Large Diffusion Language Model

    Jaeik Kim, Woojin Kim, Jihwan Hong +8

    cs.CLcs.AIarXiv:2604.00007v12026
  39. Reward Prediction with Factorized World States

    Yijun Shen, Delong Chen, Xianming Hu +4

    cs.CLarXiv:2603.09400v12026
  40. GTA-RAG: Graph-Trajectory-Augmented Reinforcement Learning for Multi-Turn Retrieval-Augmented Reasoning

    Jun Chen, Yongchao Liu, Pengyu Qiu +6

    cs.CLcs.LGarXiv:2608.22479v12026
  41. Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context

    Keivan Alizadeh, Parshin Shojaee, Minsik Cho +1

    cs.CLcs.AIcs.LGarXiv:2603.15653v12026
  42. Neural Text Generation with Unlikelihood Training

    Sean Welleck, Ilia Kulikov, Stephen Roller +3

    cs.LGcs.CLstat.MLarXiv:1908.04319v22019
  43. A Comparative analysis of Layer-wise Representational Capacity in AR and Diffusion LLMs

    Raghavv Goel, Risheek Garrepalli, Sudhanshu Agrawal +3

    cs.CLcs.LGarXiv:2603.07475v42026
  44. GRAFT: Graph-Distilled Generative Retrieval for Facet-Aware Scientific Literature Exploration

    Italo Luis da Silva, Hanqi Yan, Yujing Wang +3

    cs.IRcs.CLarXiv:2608.22381v12026
  45. BiCLIP: Domain Canonicalization via Structured Geometric Transformation

    Pranav Mantini, Shishir K. Shah

    cs.CVcs.AIcs.CLarXiv:2603.08942v22026
  46. Context-Aware Cluster Decoding: Semantic Anchor-Driven Coherence in dMLLMs

    Yikai Zhao, Qiyan Zhao, Jiaquan Zhang +3

    cs.CLarXiv:2608.22367v12026
  47. The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness

    Subramanyam Sahoo, Aman Chadha, Vinija Jain +1

    cs.AIcs.CLcs.CYarXiv:2603.09200v12026
  48. Argmax Flows and Multinomial Diffusion: Learning Categorical Distributions

    Emiel Hoogeboom, Didrik Nielsen, Priyank Jaini +2

    stat.MLcs.CLcs.LGarXiv:2102.05379v32021
  49. Do What I Say: A Spoken Prompt Dataset for Instruction-Following

    Maike Züfle, Sara Papi, Fabian Retkowski +5

    cs.CLarXiv:2603.09881v22026
  50. Multi-News: a Large-Scale Multi-Document Summarization Dataset and Abstractive Hierarchical Model

    Alexander R. Fabbri, Irene Li, Tianwei She +2

    cs.CLarXiv:1906.01749v32019
  51. Self-Execution Simulation Improves Coding Models

    Gallil Maimon, Ori Yoran, Felix Kreuk +4

    cs.CLcs.LGarXiv:2604.03253v12026
  52. End-to-end Structure-Aware Convolutional Networks for Knowledge Base Completion

    Chao Shang, Yun Tang, Jing Huang +3

    cs.AIcs.CLarXiv:1811.04441v22018
  53. MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization

    Chenyang Zhu, Hongxiang Li, Xiu Li +1

    cs.CVcs.AIcs.CLarXiv:2603.12743v12026
  54. A Comprehensive Survey on Pretrained Foundation Models: A History from BERT to ChatGPT

    Ce Zhou, Qian Li, Chen Li +16

    cs.AIcs.CLcs.LGarXiv:2302.09419v32023
  55. Large-scale Simple Question Answering with Memory Networks

    Antoine Bordes, Nicolas Usunier, Sumit Chopra +1

    cs.LGcs.CLarXiv:1506.02075v12015
  56. ST$^2$U: Stateful Test-Time Unlearning via Restricted Knowledge Boundary Control

    Xunlei Chen, Qinghui Gong, Ruini Xue +3

    cs.LGcs.CLarXiv:2608.23034v12026
  57. vq-wav2vec: Self-Supervised Learning of Discrete Speech Representations

    Alexei Baevski, Steffen Schneider, Michael Auli

    cs.CLcs.LGarXiv:1910.05453v32019
  58. Mending the Holes: Mitigating Reward Hacking in Reinforcement Learning for Multilingual Translation

    Yifeng Liu, Siqi Ouyang, Yatish Hosmane Revanasiddappa +1

    cs.CLarXiv:2603.13045v12026
  59. VoXtream2: Full-stream TTS with dynamic speaking rate control

    Nikita Torgashov, Gustav Eje Henter, Gabriel Skantze

    eess.AScs.CLcs.HCarXiv:2603.13518v12026
  60. ECG-Reasoning-Benchmark: A Benchmark for Evaluating Clinical Reasoning Capabilities in ECG Interpretation

    Jungwoo Oh, Hyunseung Chung, Junhee Lee +6

    cs.LGcs.AIcs.CLarXiv:2603.14326v12026