Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,741 to 10,800 of 11,257
MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems
Hyunji Lee, Justin Chih-Yao Chen, Joykirat Singh +3
cs.CLcs.AIarXiv:2605.18565v22026Mem-$π$: Adaptive Memory through Learning When and What to Generate
Xiaoqiang Wang, Chao Wang, Hadi Nekoei +5
cs.CLcs.AIarXiv:2605.21463v12026You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories
Zhepei Wei, Xinyu Zhu, Wei-Lin Chen +3
cs.LGcs.CLarXiv:2605.21468v12026ACL-Verbatim: hallucination-free question answering for research
Gábor Recski, Szilveszter Tóth, Nadia Verdha +2
cs.CLcs.AIcs.SEarXiv:2605.21102v12026ETCHR: Editing To Clarify and Harness Reasoning
Beichen Zhang, Yuhong Liu, Jinsong Li +3
cs.CVcs.AIcs.CLarXiv:2605.23897v12026Breaking the Chains of Probability: Neutrosophic Logic as a New Framework for Epistemic Uncertainty in Large Language Models
Maikel Yelandi Leyva-Vázquez, Florentin Smarandache
cs.AIcs.CLcs.LGarXiv:2605.24053v12026Measuring the Depth of LLM Unlearning via Activation Patching
Jaeung Lee, Dohyun Kim, Jaemin Jo
cs.CLcs.AIcs.LGarXiv:2605.24614v12026ClinSeekAgent: Automating Multimodal Evidence Seeking for Agentic Clinical Reasoning
Juncheng Wu, Letian Zhang, Yuhan Wang +5
cs.CLarXiv:2605.20176v12026Efficient Agentic Reinforcement Learning with On-Policy Intrinsic Knowledge Boundary Enhancement
Dingwei Chen, Zefang Zong, Zhipeng Ma +5
cs.CLarXiv:2605.26952v12026How LoRA Remembers? A Parametric Memory Law for LLM Finetuning
Ziwen Xu, Haiwen Hong, Linsong Yu +4
cs.CLcs.AIcs.CVarXiv:2605.30260v12026Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning
Jiapeng Zhu, Jianxiang Yu, Yibo Zhao +5
cs.CLarXiv:2605.28424v12026Share More, Search Less: Collaborative Parallel Thinking for Efficient Test-Time Scaling
Xinglin Wang, Hao Lin, Shaoxiong Feng +9
cs.CLarXiv:2605.27030v12026Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)
Samer Awad, Javier Conde, Carlos Arriaga +3
cs.CLcs.AIarXiv:2605.27268v12026Self-Improving Language Models with Bidirectional Evolutionary Search
Guowei Xu, Zhenting Qi, Huangyuan Su +4
cs.CLarXiv:2605.28814v12026CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists
Junlin Yang, Dylan Zhang, Xiangchen Song +7
cs.AIcs.CLarXiv:2605.26029v22026Exploring Autonomous Agentic Data Engineering for Model Specialization
Yujie Luo, Xiangyuan Ru, Jingsheng Zheng +10
cs.CLcs.AIcs.IRarXiv:2605.30407v22026SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic Search
Yunbo Tang, Chengyi Yang, Shiyu Liu +4
cs.AIcs.CLcs.LGarXiv:2605.29796v32026Adapting Multilingual Embedding Models to Turkish via Cross-Lingual Tokenizer Surgery and Offline Distillation
M. Ali Bayram, Banu Diri, Savaş Yıldırım
cs.CLarXiv:2605.29992v12026Multi-Agent Computer Use
Jing Yu Koh, Ruslan Salakhutdinov, Daniel Fried
cs.MAcs.CLcs.LGarXiv:2606.01533v12026FineVerify: Scaling Test-Time Compute with Fine-Grained Self-Verification for Agentic Search
James Xu Zhao, Hui Chen, Bryan Hooi +1
cs.CLarXiv:2606.00660v12026Interpretable Cross-Lingual Alignment in Small Language Models: Probing Cultural and Pragmatic Reasoning in Japanese-English Bilingual LLMs
Florian Braun
cs.CLcs.LGarXiv:2608.14896v12026LLMs Can Predict Failure Risk, But Struggle to Predict Which Collaboration Protocol Pays Off: Cost-Aware Protocol Routing Across Reasoning Tasks
Chih-Hsuan Yang, Jingyan Jiang, Cheng-Hau Yang +4
cs.AIcs.CLcs.LGarXiv:2608.14927v12026Wiola 13M, a Gated Spiral Attention Architecture for Parameter Efficient Small Language Models
Aryuemaan Kumar Chowdhury, Praveen Oosa, Vineesha Reddy
cs.CLcs.AIarXiv:2608.14604v12026Workspace Topology as an Attack Vector in Agentic Coding Assistants
Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy +9
cs.CRcs.AIcs.CLarXiv:2608.14876v12026An Investigation of the NeurIPS and ICML 2025 Position Tracks
Fan Yang, Wenkai Li, Jun Liu
cs.CYcs.CLarXiv:2608.16894v12026Prompting is not enough: supervised baselines and leakage control for measuring shared decision-making with LLMs in pediatric encounters
Bernardo Modenesi, Jody Lin, Kimberly Kaphingst +4
cs.CLcs.AIcs.LGarXiv:2608.14792v12026L3Cube-IndicQuest v2: A Large-Scale Multilingual Benchmark for Evaluating Factual Knowledge of Large Language Models Across Indic Languages
Rinit Jain, Tirthraj Mahajan, Advait Joshi +1
cs.CLcs.LGarXiv:2608.15535v12026Schema-Agnostic Graph Reasoning Agent for Hybrid Knowledge Graphs
Marius Dragic, Ruben Ifrah, Alexandre Rio
cs.AIcs.CLcs.DBarXiv:2608.15834v12026TRACE-BN: Transferring Bangla-English Tutoring Behavior to a Sub-1B Offline Language Model
Khan Raiyan Ibne Reza, Sanjana Aktar Maria, Mohammad Tushar Abdullah +2
cs.CLarXiv:2608.15223v12026A Pilot Study of Autocompleting Tokenizers
Samuel Wexler, Mark Hopkins
cs.CLarXiv:2608.15080v12026LLM Safety Alignment in Low-Resource Languages: A Systematic Literature Review
Valdini Douglace Lemofouet, Blessing Ngozi Uzor, Paula Chikaodinaka Anyanwu +9
cs.CLcs.AIcs.LGarXiv:2608.14626v12026Potential of ChatGPT in predicting stock market trends based on Twitter Sentiment Analysis
Ummara Mumtaz, Summaya Mumtaz
q-fin.STcs.AIcs.CLarXiv:2311.06273v12023KnowSim: Evaluating Information Calibration in LLM Assistants with User Simulators that Learn
Yoonjoo Lee, Hyoungwook Jin, Tae Soo Kim +3
cs.AIcs.CLcs.HCarXiv:2608.17150v12026Towards Safer RAG: Only Agents Capable of System 2 Thinking may Access Untrusted Documents
Mehrdad Ghassabi
cs.CLarXiv:2608.17153v12026Foundation Agents Meet Agentic Deep Research: Evidence-Grounded Clinical Code Forecasting
Junda Wang, Meysam Ghaffari, Akshat Choube +3
cs.CLcs.AIarXiv:2608.17075v12026DA-RAC: Distance-Aware Calibration of LLM Judges for Trustworthy AI Auditing
Cheng Wu, Vishal Anand, Jaya Krishna Mandivarapu +2
cs.CLarXiv:2608.14950v12026Large Language Model Assisted Operational Monitoring for Battery Energy Storage System Integrated Power Distribution Networks
Azmeer Akhtar, Md Fazley Rafy, Anurag K. Srivastava
cs.AIcs.CLeess.SYarXiv:2608.15396v12026A Declarative-Procedural Perspective on Expert Routing in Bilingual Mixture-of-Experts Language Models
Amrit Gopinath, Raghul, Durairaj Thenmozhi
cs.CLarXiv:2608.15102v12026AISA: AI Safety Assistant Framework for Continuous Improvement of Highway Construction
Mason Smetana, Trevor Neece, Lev Khazanovich
cs.CLarXiv:2608.17184v12026Memory Is Communication: The Frontier Between Remembering and Signaling
Yashar Talebirad, Eden Redman, Ali Parsaee +1
cs.AIcs.CLcs.ITarXiv:2608.17053v12026J-Miner: Recovering Executable Decision Knowledge from Language-Model Classifiers
Yunfan Gao, Xinyi Huang, Tao Sheng +3
cs.LGcs.CLarXiv:2608.17063v12026A Glyph Is Not a Letter, a Token Is Not a Word, a Space Is Not a Space: What the Units of Voynichese Are Not
Liudmila Rozanova, Alexander Temerev
cs.CLarXiv:2608.17096v12026Domain-Adapted Molecular Language Models for Efficient Search of Make-on-Demand Libraries
Henrik Wille, Luis-Finley Schütz, Felix Strieth-Kalthoff
cs.LGcs.AIcs.CLarXiv:2608.17567v12026ArguLens: An Open-Source System for Automated Essay Scoring and Label-Aware Feedback Generation
Weiran Wang, Hongxiang Shi, Huitao Tang +1
cs.CLarXiv:2608.17356v12026Uncertainty-Aware Decision Making in Multimodal Large Language Models
Abderrahmene Boudiaf, Irfan Hussain, Sajid Javed
cs.CLarXiv:2608.17084v12026Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models
Xiutian Zhao, Luqi Sun, Björn Schuller +1
cs.CLeess.ASeess.IVarXiv:2608.17102v12026Effects of Answer Format Variation on Gender Bias in Large Language Models
Ksenia Merzlyakova, Sebastian Padó, Franziska Weeber
cs.CLarXiv:2608.17516v12026An Investigation of Translationese in the Generations of Multilingual Large Language Models
Maria Valentini, Téa Wright, Julisa Granados +2
cs.CLarXiv:2608.17399v12026Q-Interference: Memory-Efficient Phase-Aware Quantum-Inspired Attention
Emama Nahid, Tahmid Imtiaz Imu, Huayue Gu +3
cs.CLarXiv:2608.17288v12026What Tokens are Learned when Tokenization is Optimized Jointly with Language Modeling?
Saketh Reddy Vemula, Parameswari Krishnamurthy
cs.CLarXiv:2608.17325v12026PTXBench: Benchmark and Adapt LLMs for GPU Kernel Optimization with Architecture-specific PTX
Genghan Zhang, Yixin Dong, Chengze Fan +4
cs.CLcs.AIarXiv:2608.17379v12026Summaries:简体中文Auditing Exposure to Harmful Content on TikTok using Multimodal Language Models: A Cross-National, Age-Stratified Study
Hamidreza Saffari, Francesco Pierri
cs.CLarXiv:2608.17583v12026Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding?
Jiaqi Tang, Jianmin Chen, Youyang Zhai +6
cs.CVcs.AIcs.CLarXiv:2606.08063v12026SkillHarm: Lifecycle-Aware Skill-Based Attacks via Automated Construction
Yuting Ning, Zhehao Zhang, Yash Kumar Lal +8
cs.CLarXiv:2606.02540v12026Evaluating Large Language Models in Dynamic Clinical Decision-Making with Standardized Patient Cases
Cheng Liang, Pengcheng Qiu, Ya Zhang +3
cs.CLarXiv:2606.05112v12026Rethinking Continual Experience Internalization for Self-Evolving LLM Agents
Jingwen Chen, Wenkai Yang, Shengda Fan +7
cs.CLcs.LGarXiv:2606.04703v12026Precision Is Not Faithfulness: Coverage-Aware Evaluation of Grounded Generation with a Complete Oracle
Juan S. Santillana
cs.CLarXiv:2606.09376v22026Routing Divergence Is Not Evidence of Behavioral Influence in Same-Weight MoE Self-Distillation
Cedric Caruzzo, Donggeun Yoo, Tae Soo Kim
cs.LGcs.AIcs.CLarXiv:2608.15787v12026Large Language Models Are Overconfident in Their Own Responses
Mario Sanz-Guerrero, Manuel Mager, Katharina von der Wense
cs.CLarXiv:2606.03437v12026Latent Reasoning with Normalizing Flows
Guancheng Tu, Xiangjun Fu, Suhao Yu +5
cs.CLcs.LGarXiv:2606.06447v12026