Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,741 to 10,800 of 11,257

  1. MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems

    Hyunji Lee, Justin Chih-Yao Chen, Joykirat Singh +3

    cs.CLcs.AIarXiv:2605.18565v22026
  2. Mem-$π$: Adaptive Memory through Learning When and What to Generate

    Xiaoqiang Wang, Chao Wang, Hadi Nekoei +5

    cs.CLcs.AIarXiv:2605.21463v12026
  3. You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories

    Zhepei Wei, Xinyu Zhu, Wei-Lin Chen +3

    cs.LGcs.CLarXiv:2605.21468v12026
  4. ACL-Verbatim: hallucination-free question answering for research

    Gábor Recski, Szilveszter Tóth, Nadia Verdha +2

    cs.CLcs.AIcs.SEarXiv:2605.21102v12026
  5. ETCHR: Editing To Clarify and Harness Reasoning

    Beichen Zhang, Yuhong Liu, Jinsong Li +3

    cs.CVcs.AIcs.CLarXiv:2605.23897v12026
  6. Breaking the Chains of Probability: Neutrosophic Logic as a New Framework for Epistemic Uncertainty in Large Language Models

    Maikel Yelandi Leyva-Vázquez, Florentin Smarandache

    cs.AIcs.CLcs.LGarXiv:2605.24053v12026
  7. Measuring the Depth of LLM Unlearning via Activation Patching

    Jaeung Lee, Dohyun Kim, Jaemin Jo

    cs.CLcs.AIcs.LGarXiv:2605.24614v12026
  8. ClinSeekAgent: Automating Multimodal Evidence Seeking for Agentic Clinical Reasoning

    Juncheng Wu, Letian Zhang, Yuhan Wang +5

    cs.CLarXiv:2605.20176v12026
  9. Efficient Agentic Reinforcement Learning with On-Policy Intrinsic Knowledge Boundary Enhancement

    Dingwei Chen, Zefang Zong, Zhipeng Ma +5

    cs.CLarXiv:2605.26952v12026
  10. How LoRA Remembers? A Parametric Memory Law for LLM Finetuning

    Ziwen Xu, Haiwen Hong, Linsong Yu +4

    cs.CLcs.AIcs.CVarXiv:2605.30260v12026
  11. Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning

    Jiapeng Zhu, Jianxiang Yu, Yibo Zhao +5

    cs.CLarXiv:2605.28424v12026
  12. Share More, Search Less: Collaborative Parallel Thinking for Efficient Test-Time Scaling

    Xinglin Wang, Hao Lin, Shaoxiong Feng +9

    cs.CLarXiv:2605.27030v12026
  13. Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)

    Samer Awad, Javier Conde, Carlos Arriaga +3

    cs.CLcs.AIarXiv:2605.27268v12026
  14. Self-Improving Language Models with Bidirectional Evolutionary Search

    Guowei Xu, Zhenting Qi, Huangyuan Su +4

    cs.CLarXiv:2605.28814v12026
  15. CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists

    Junlin Yang, Dylan Zhang, Xiangchen Song +7

    cs.AIcs.CLarXiv:2605.26029v22026
  16. Exploring Autonomous Agentic Data Engineering for Model Specialization

    Yujie Luo, Xiangyuan Ru, Jingsheng Zheng +10

    cs.CLcs.AIcs.IRarXiv:2605.30407v22026
  17. SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic Search

    Yunbo Tang, Chengyi Yang, Shiyu Liu +4

    cs.AIcs.CLcs.LGarXiv:2605.29796v32026
  18. Adapting Multilingual Embedding Models to Turkish via Cross-Lingual Tokenizer Surgery and Offline Distillation

    M. Ali Bayram, Banu Diri, Savaş Yıldırım

    cs.CLarXiv:2605.29992v12026
  19. Multi-Agent Computer Use

    Jing Yu Koh, Ruslan Salakhutdinov, Daniel Fried

    cs.MAcs.CLcs.LGarXiv:2606.01533v12026
  20. FineVerify: Scaling Test-Time Compute with Fine-Grained Self-Verification for Agentic Search

    James Xu Zhao, Hui Chen, Bryan Hooi +1

    cs.CLarXiv:2606.00660v12026
  21. Interpretable Cross-Lingual Alignment in Small Language Models: Probing Cultural and Pragmatic Reasoning in Japanese-English Bilingual LLMs

    Florian Braun

    cs.CLcs.LGarXiv:2608.14896v12026
  22. LLMs Can Predict Failure Risk, But Struggle to Predict Which Collaboration Protocol Pays Off: Cost-Aware Protocol Routing Across Reasoning Tasks

    Chih-Hsuan Yang, Jingyan Jiang, Cheng-Hau Yang +4

    cs.AIcs.CLcs.LGarXiv:2608.14927v12026
  23. Wiola 13M, a Gated Spiral Attention Architecture for Parameter Efficient Small Language Models

    Aryuemaan Kumar Chowdhury, Praveen Oosa, Vineesha Reddy

    cs.CLcs.AIarXiv:2608.14604v12026
  24. Workspace Topology as an Attack Vector in Agentic Coding Assistants

    Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy +9

    cs.CRcs.AIcs.CLarXiv:2608.14876v12026
  25. An Investigation of the NeurIPS and ICML 2025 Position Tracks

    Fan Yang, Wenkai Li, Jun Liu

    cs.CYcs.CLarXiv:2608.16894v12026
  26. Prompting is not enough: supervised baselines and leakage control for measuring shared decision-making with LLMs in pediatric encounters

    Bernardo Modenesi, Jody Lin, Kimberly Kaphingst +4

    cs.CLcs.AIcs.LGarXiv:2608.14792v12026
  27. L3Cube-IndicQuest v2: A Large-Scale Multilingual Benchmark for Evaluating Factual Knowledge of Large Language Models Across Indic Languages

    Rinit Jain, Tirthraj Mahajan, Advait Joshi +1

    cs.CLcs.LGarXiv:2608.15535v12026
  28. Schema-Agnostic Graph Reasoning Agent for Hybrid Knowledge Graphs

    Marius Dragic, Ruben Ifrah, Alexandre Rio

    cs.AIcs.CLcs.DBarXiv:2608.15834v12026
  29. TRACE-BN: Transferring Bangla-English Tutoring Behavior to a Sub-1B Offline Language Model

    Khan Raiyan Ibne Reza, Sanjana Aktar Maria, Mohammad Tushar Abdullah +2

    cs.CLarXiv:2608.15223v12026
  30. A Pilot Study of Autocompleting Tokenizers

    Samuel Wexler, Mark Hopkins

    cs.CLarXiv:2608.15080v12026
  31. LLM Safety Alignment in Low-Resource Languages: A Systematic Literature Review

    Valdini Douglace Lemofouet, Blessing Ngozi Uzor, Paula Chikaodinaka Anyanwu +9

    cs.CLcs.AIcs.LGarXiv:2608.14626v12026
  32. Potential of ChatGPT in predicting stock market trends based on Twitter Sentiment Analysis

    Ummara Mumtaz, Summaya Mumtaz

    q-fin.STcs.AIcs.CLarXiv:2311.06273v12023
  33. KnowSim: Evaluating Information Calibration in LLM Assistants with User Simulators that Learn

    Yoonjoo Lee, Hyoungwook Jin, Tae Soo Kim +3

    cs.AIcs.CLcs.HCarXiv:2608.17150v12026
  34. Towards Safer RAG: Only Agents Capable of System 2 Thinking may Access Untrusted Documents

    Mehrdad Ghassabi

    cs.CLarXiv:2608.17153v12026
  35. Foundation Agents Meet Agentic Deep Research: Evidence-Grounded Clinical Code Forecasting

    Junda Wang, Meysam Ghaffari, Akshat Choube +3

    cs.CLcs.AIarXiv:2608.17075v12026
  36. DA-RAC: Distance-Aware Calibration of LLM Judges for Trustworthy AI Auditing

    Cheng Wu, Vishal Anand, Jaya Krishna Mandivarapu +2

    cs.CLarXiv:2608.14950v12026
  37. Large Language Model Assisted Operational Monitoring for Battery Energy Storage System Integrated Power Distribution Networks

    Azmeer Akhtar, Md Fazley Rafy, Anurag K. Srivastava

    cs.AIcs.CLeess.SYarXiv:2608.15396v12026
  38. A Declarative-Procedural Perspective on Expert Routing in Bilingual Mixture-of-Experts Language Models

    Amrit Gopinath, Raghul, Durairaj Thenmozhi

    cs.CLarXiv:2608.15102v12026
  39. AISA: AI Safety Assistant Framework for Continuous Improvement of Highway Construction

    Mason Smetana, Trevor Neece, Lev Khazanovich

    cs.CLarXiv:2608.17184v12026
  40. Memory Is Communication: The Frontier Between Remembering and Signaling

    Yashar Talebirad, Eden Redman, Ali Parsaee +1

    cs.AIcs.CLcs.ITarXiv:2608.17053v12026
  41. J-Miner: Recovering Executable Decision Knowledge from Language-Model Classifiers

    Yunfan Gao, Xinyi Huang, Tao Sheng +3

    cs.LGcs.CLarXiv:2608.17063v12026
  42. A Glyph Is Not a Letter, a Token Is Not a Word, a Space Is Not a Space: What the Units of Voynichese Are Not

    Liudmila Rozanova, Alexander Temerev

    cs.CLarXiv:2608.17096v12026
  43. Domain-Adapted Molecular Language Models for Efficient Search of Make-on-Demand Libraries

    Henrik Wille, Luis-Finley Schütz, Felix Strieth-Kalthoff

    cs.LGcs.AIcs.CLarXiv:2608.17567v12026
  44. ArguLens: An Open-Source System for Automated Essay Scoring and Label-Aware Feedback Generation

    Weiran Wang, Hongxiang Shi, Huitao Tang +1

    cs.CLarXiv:2608.17356v12026
  45. Uncertainty-Aware Decision Making in Multimodal Large Language Models

    Abderrahmene Boudiaf, Irfan Hussain, Sajid Javed

    cs.CLarXiv:2608.17084v12026
  46. Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models

    Xiutian Zhao, Luqi Sun, Björn Schuller +1

    cs.CLeess.ASeess.IVarXiv:2608.17102v12026
  47. Effects of Answer Format Variation on Gender Bias in Large Language Models

    Ksenia Merzlyakova, Sebastian Padó, Franziska Weeber

    cs.CLarXiv:2608.17516v12026
  48. An Investigation of Translationese in the Generations of Multilingual Large Language Models

    Maria Valentini, Téa Wright, Julisa Granados +2

    cs.CLarXiv:2608.17399v12026
  49. Q-Interference: Memory-Efficient Phase-Aware Quantum-Inspired Attention

    Emama Nahid, Tahmid Imtiaz Imu, Huayue Gu +3

    cs.CLarXiv:2608.17288v12026
  50. What Tokens are Learned when Tokenization is Optimized Jointly with Language Modeling?

    Saketh Reddy Vemula, Parameswari Krishnamurthy

    cs.CLarXiv:2608.17325v12026
  51. PTXBench: Benchmark and Adapt LLMs for GPU Kernel Optimization with Architecture-specific PTX

    Genghan Zhang, Yixin Dong, Chengze Fan +4

    cs.CLcs.AIarXiv:2608.17379v12026
    Summaries:简体中文
  52. Auditing Exposure to Harmful Content on TikTok using Multimodal Language Models: A Cross-National, Age-Stratified Study

    Hamidreza Saffari, Francesco Pierri

    cs.CLarXiv:2608.17583v12026
  53. Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding?

    Jiaqi Tang, Jianmin Chen, Youyang Zhai +6

    cs.CVcs.AIcs.CLarXiv:2606.08063v12026
  54. SkillHarm: Lifecycle-Aware Skill-Based Attacks via Automated Construction

    Yuting Ning, Zhehao Zhang, Yash Kumar Lal +8

    cs.CLarXiv:2606.02540v12026
  55. Evaluating Large Language Models in Dynamic Clinical Decision-Making with Standardized Patient Cases

    Cheng Liang, Pengcheng Qiu, Ya Zhang +3

    cs.CLarXiv:2606.05112v12026
  56. Rethinking Continual Experience Internalization for Self-Evolving LLM Agents

    Jingwen Chen, Wenkai Yang, Shengda Fan +7

    cs.CLcs.LGarXiv:2606.04703v12026
  57. Precision Is Not Faithfulness: Coverage-Aware Evaluation of Grounded Generation with a Complete Oracle

    Juan S. Santillana

    cs.CLarXiv:2606.09376v22026
  58. Routing Divergence Is Not Evidence of Behavioral Influence in Same-Weight MoE Self-Distillation

    Cedric Caruzzo, Donggeun Yoo, Tae Soo Kim

    cs.LGcs.AIcs.CLarXiv:2608.15787v12026
  59. Large Language Models Are Overconfident in Their Own Responses

    Mario Sanz-Guerrero, Manuel Mager, Katharina von der Wense

    cs.CLarXiv:2606.03437v12026
  60. Latent Reasoning with Normalizing Flows

    Guancheng Tu, Xiangjun Fu, Suhao Yu +5

    cs.CLcs.LGarXiv:2606.06447v12026