Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,541 to 3,600 of 11,263

  1. Compile, Don't Memorize: A Context Compilation Architecture (CCA) for In-Context Learning

    Jinhu Qi, Minda Hu, Wentao Zhang +4

    cs.CLarXiv:2609.00759v12026
  2. PersonaMem-v2: Towards Personalized Intelligence via Learning Implicit User Personas and Agentic Memory

    Bowen Jiang, Yuan Yuan, Maohao Shen +13

    cs.CLarXiv:2512.06688v12025
  3. Backdoor Attacks on Pre-trained Models by Layerwise Weight Poisoning

    Linyang Li, Demin Song, Xiaonan Li +3

    cs.CRcs.CLarXiv:2108.13888v12021
  4. Dynamic Cheatsheet: Test-Time Learning with Adaptive Memory

    Mirac Suzgun, Mert Yuksekgonul, Federico Bianchi +2

    cs.LGcs.CLarXiv:2504.07952v12025
  5. olmOCR: Unlocking Trillions of Tokens in PDFs with Vision Language Models

    Jake Poznanski, Aman Rangapur, Jon Borchardt +7

    cs.CLarXiv:2502.18443v32025
  6. Citing Less Critically: LLMs Reshape the Rhetoric and Reach of Scientific Citation

    Yixuan Liu, Lin Chen, Zhuoqi Liu +2

    cs.DLcs.CLcs.CYarXiv:2609.01432v12026
  7. OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling

    Zengzhi Wang, Fan Zhou, Xuefeng Li +1

    cs.CLcs.AIcs.LGarXiv:2506.20512v12025
  8. Aligned but Flattened: Analyzing the Trade-off between Cultural Alignment and Diversity in LLMs

    Jingshen Zhang, Shaoyang Xu, Wenxuan Zhang

    cs.SIcs.CLarXiv:2609.00565v12026
  9. Expected Attention: KV Cache Compression by Estimating Attention from Future Queries Distribution

    Alessio Devoto, Maximilian Jeblick, Simon Jégou

    cs.AIcs.CLarXiv:2510.00636v12025
  10. Polish ModernBERT: The Long and Short of Polish Language Understanding

    Michał Perełkiewicz, Sławomir Dadas, Rafał Poświata +1

    cs.CLarXiv:2609.01379v12026
  11. SWE-rebench: An Automated Pipeline for Task Collection and Decontaminated Evaluation of Software Engineering Agents

    Ibragim Badertdinov, Alexander Golubev, Maksim Nekrashevich +6

    cs.SEcs.CLarXiv:2505.20411v22025
  12. VITA: Towards Open-Source Interactive Omni Multimodal LLM

    Chaoyou Fu, Haojia Lin, Zuwei Long +16

    cs.CVcs.AIcs.CLarXiv:2408.05211v32024
  13. Overview of the TREC 2021 deep learning track

    Nick Craswell, Bhaskar Mitra, Emine Yilmaz +2

    cs.IRcs.AIcs.CLarXiv:2507.08191v12025
  14. LLM Social Simulations Are a Promising Research Method

    Jacy Reese Anthis, Ryan Liu, Sean M. Richardson +5

    cs.HCcs.AIcs.CLarXiv:2504.02234v22025
  15. MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs

    Juncheng Wu, Wenlong Deng, Xingxuan Li +12

    cs.CLcs.AIarXiv:2504.00993v22025
  16. PRMBench: A Fine-grained and Challenging Benchmark for Process-Level Reward Models

    Mingyang Song, Zhaochen Su, Xiaoye Qu +2

    cs.CLcs.AIcs.LGarXiv:2501.03124v52025
  17. AgenTracer: Who Is Inducing Failure in the LLM Agentic Systems?

    Guibin Zhang, Junhao Wang, Junjie Chen +3

    cs.CLcs.MAarXiv:2509.03312v22025
  18. UniIR: Training and Benchmarking Universal Multimodal Information Retrievers

    Cong Wei, Yang Chen, Haonan Chen +5

    cs.CVcs.AIcs.CLarXiv:2311.17136v12023
  19. Latent Visual Reasoning

    Bangzheng Li, Ximeng Sun, Jiang Liu +7

    cs.CVcs.CLarXiv:2509.24251v22025
  20. Jointly Predicting Predicates and Arguments in Neural Semantic Role Labeling

    Luheng He, Kenton Lee, Omer Levy +1

    cs.CLarXiv:1805.04787v22018
  21. Compositional Generalization and Natural Language Variation: Can a Semantic Parsing Approach Handle Both?

    Peter Shaw, Ming-Wei Chang, Panupong Pasupat +1

    cs.CLarXiv:2010.12725v22020
  22. Medical Hallucinations in Foundation Models and Their Impact on Healthcare

    Yubin Kim, Hyewon Jeong, Shan Chen +24

    cs.CLcs.AIcs.CYarXiv:2503.05777v22025
  23. Unifying Conformal Language Tasks with In-Context Ensembles

    Xiao Shi Huang, Chen-Yuan Lin, Bruce Kuwahara +2

    cs.CLcs.LGstat.MLarXiv:2609.03005v12026
  24. The Geometry of Ignorance: LLMs Know When to Temper Bayesian Priors

    Toni J. B. Liu, Jiajun Bao, Yizhou Liu +4

    cs.LGcs.AIcs.CLarXiv:2609.02959v12026
  25. Recursive Language Models

    Alex L. Zhang, Tim Kraska, Omar Khattab

    cs.AIcs.CLarXiv:2512.24601v32025
  26. SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs

    Yige Xu, Xu Guo, Zhiwei Zeng +1

    cs.CLarXiv:2502.12134v22025
  27. Incremental Pooled LLM Evaluation for Cost-Effective Retrieval Model Selection

    Max Nelson, Hanoz Bhathena, Aviral Joshi +1

    cs.IRcs.CLarXiv:2609.02745v12026
  28. LLMs Accelerate Annotation for Medical Information Extraction

    Akshay Goel, Almog Gueta, Omry Gilon +10

    cs.CLcs.AIcs.LGarXiv:2312.02296v12023
  29. Perception-Aware Policy Optimization for Multimodal Reasoning

    Zhenhailong Wang, Xuehang Guo, Sofia Stoica +8

    cs.CLarXiv:2507.06448v52025
  30. Exploring Versatile Generative Language Model Via Parameter-Efficient Transfer Learning

    Zhaojiang Lin, Andrea Madotto, Pascale Fung

    cs.CLarXiv:2004.03829v22020
  31. ToRL: Scaling Tool-Integrated RL

    Xuefeng Li, Haoyang Zou, Pengfei Liu

    cs.CLarXiv:2503.23383v12025
  32. Llasa: Scaling Train-Time and Inference-Time Compute for Llama-based Speech Synthesis

    Zhen Ye, Xinfa Zhu, Chi-Min Chan +17

    eess.AScs.AIcs.CLarXiv:2502.04128v22025
  33. Soft Thinking: Unlocking the Reasoning Potential of LLMs in Continuous Concept Space

    Zhen Zhang, Xuehai He, Weixiang Yan +5

    cs.CLcs.AIarXiv:2505.15778v12025
  34. On Releasing Annotator-Level Labels and Information in Datasets

    Vinodkumar Prabhakaran, Aida Mostafazadeh Davani, Mark Díaz

    cs.CLcs.CYarXiv:2110.05699v12021
  35. HalluLens: LLM Hallucination Benchmark

    Yejin Bang, Ziwei Ji, Alan Schelten +5

    cs.CLcs.AIarXiv:2504.17550v12025
  36. Test-Time Training Done Right

    Tianyuan Zhang, Sai Bi, Yicong Hong +6

    cs.LGcs.CLcs.CVarXiv:2505.23884v12025
  37. Hallucinated but Factual! Inspecting the Factuality of Hallucinations in Abstractive Summarization

    Meng Cao, Yue Dong, Jackie Chi Kit Cheung

    cs.CLarXiv:2109.09784v22021
  38. Scalable Direction-Following TTS via Voice Impression-Guided Pseudo Triplet Construction

    Kenichi Fujita, Yusuke Ijima

    cs.SDcs.CLcs.LGarXiv:2609.02623v12026
  39. Breadth Beats Depth: Improving GCG-Based Jailbreak Optimization with Breadth-Oriented Suffix Search

    Shiliang Xiao, Jingsong Wei, Yuzhi Liang +3

    cs.CLcs.LGarXiv:2609.02172v12026
  40. Reasoning with Sampling: Your Base Model is Smarter Than You Think

    Aayush Karan, Yilun Du

    cs.LGcs.AIcs.CLarXiv:2510.14901v12025
  41. Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents

    Hao Wang, Guozhi Wang, Han Xiao +8

    cs.LGcs.AIcs.CLarXiv:2604.10674v12026
  42. More Agents Is All You Need

    Junyou Li, Qin Zhang, Yangbin Yu +2

    cs.CLcs.AIcs.LGarXiv:2402.05120v22024
  43. From Once Upon a Time to Happily Ever After: Tracking Emotions in Novels and Fairy Tales

    Saif Mohammad

    cs.CLarXiv:1309.5909v12013
  44. Untangling the Mechanisms of Misleading Context in Medical Question Answering

    Robin Linzmayer, Noémie Elhadad

    cs.CLcs.AIcs.LGarXiv:2609.02754v12026
  45. Audio-Reasoner: Improving Reasoning Capability in Large Audio Language Models

    Zhifei Xie, Mingbao Lin, Zihang Liu +3

    cs.SDcs.AIcs.CLarXiv:2503.02318v22025
  46. A Comprehensive Survey on Word Representation Models: From Classical to State-Of-The-Art Word Representation Language Models

    Usman Naseem, Imran Razzak, Shah Khalid Khan +1

    cs.CLarXiv:2010.15036v12020
  47. ResearchRubrics: A Benchmark of Prompts and Rubrics For Evaluating Deep Research Agents

    Manasi Sharma, Chen Bo Calvin Zhang, Chaithanya Bandi +13

    cs.AIcs.CLcs.LGarXiv:2511.07685v12025
  48. Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving

    Luoxin Chen, Jinming Gu, Liankai Huang +33

    cs.AIcs.CLarXiv:2507.23726v22025
  49. Fine-Tuning Large Neural Language Models for Biomedical Natural Language Processing

    Robert Tinn, Hao Cheng, Yu Gu +5

    cs.CLcs.LGarXiv:2112.07869v12021
  50. KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding

    Zhangchen Xu, Yang Liu, Yueqin Yin +2

    cs.LGcs.AIcs.CLarXiv:2503.02951v22025
  51. ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering

    Ahmed Masry, Mohammed Saidul Islam, Mahir Ahmed +11

    cs.CLarXiv:2504.05506v22025
  52. Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks

    Zhenhailong Wang, Haiyang Xu, Junyang Wang +5

    cs.CLcs.CVarXiv:2501.11733v22025
  53. OmniSpatial: Towards Comprehensive Spatial Reasoning Benchmark for Vision Language Models

    Mengdi Jia, Zekun Qi, Shaochen Zhang +5

    cs.CVcs.AIcs.CLarXiv:2506.03135v32025
  54. MobileWorld: Benchmarking Autonomous Mobile Agents in Agent-User Interactive and MCP-Augmented Environments

    Quyu Kong, Xu Zhang, Zhenyu Yang +10

    cs.CLarXiv:2512.19432v32025
  55. Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction

    Ailin Huang, Boyong Wu, Bruce Wang +142

    cs.CLcs.AIcs.HCarXiv:2502.11946v22025
  56. Domain and Function: A Dual-Space Model of Semantic Relations and Compositions

    Peter D. Turney

    cs.CLcs.AIcs.LGarXiv:1309.4035v12013
  57. AutoTAMP: Autoregressive Task and Motion Planning with LLMs as Translators and Checkers

    Yongchao Chen, Jacob Arkin, Charles Dawson +3

    cs.ROcs.CLcs.HCarXiv:2306.06531v32023
  58. Scaling Reasoning Efficiently via Relaxed On-Policy Distillation

    Jongwoo Ko, Sara Abdali, Young Jin Kim +2

    cs.LGcs.CLarXiv:2603.11137v12026
  59. Assessing Suicide Risk in Arabic Crisis Helpline Calls: A Comparison of Arabic and English Large Language Models

    Linhai Ma, Rita El Hachem, Mahatab El Hajj +2

    cs.CLcs.AIarXiv:2609.00191v12026
  60. The Privacy Policy Landscape After the GDPR

    Thomas Linden, Rishabh Khandelwal, Hamza Harkous +1

    cs.CRcs.CLcs.CYarXiv:1809.08396v32018