Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,801 to 10,860 of 11,248
Quickest Detection of Hallucination Onset: Delay Bounds and Learned CUSUM Statistics
Igor Itkin
cs.LGcs.AIcs.CLarXiv:2606.12476v32026LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories
Baochang Ren, Xinjie Liu, Xi Chen +15
cs.CLcs.AIcs.LGarXiv:2606.13578v22026ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning
Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5
cs.CVcs.AIcs.CLarXiv:2606.14697v12026VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models
Sen Xu, Shixi Liu, Wei Wang +6
cs.AIcs.CLarXiv:2606.16140v12026Speaking the Language of Science: Toward a General-Purpose Generative Foundation Model for the Natural Sciences
Mingyang Li, Yurou Liu, Jieping Ye +3
cs.CLarXiv:2606.16905v12026Looped World Models
Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang +28
cs.LGcs.AIcs.CLarXiv:2606.18208v12026GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents
Zhe Ren, Yibo Yang, Yimeng Chen +7
cs.LGcs.CLarXiv:2606.18829v12026MAIC-UI: Making Interactive Courseware with Generative UI
Shangqing Tu, Yanjia Li, Keyu Chen +7
cs.CLcs.AIcs.HCarXiv:2604.25806v12026Summaries:한국어Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning
Jiayu Yang, Chao Chen, Shengen Wu +6
cs.LGcs.CLarXiv:2606.13106v12026PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech
Venkata Pushpak Teja Menta
cs.SDcs.CLarXiv:2604.25476v12026XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
Dasol Choi, Eugenia Kim, Jaewon Noh +14
cs.CLcs.AIarXiv:2605.05662v12026EMO: Pretraining Mixture of Experts for Emergent Modularity
Ryan Wang, Akshita Bhagia, Sewon Min
cs.CLarXiv:2605.06663v22026A$^2$TGPO: Agentic Turn-Group Policy Optimization with Adaptive Turn-level Clipping
Dingwei Chen, Zefang Zong, Zhipeng Ma +5
cs.CLarXiv:2605.06200v12026K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts
Nahyun Lee, Dongkeun Yoon, Guijin Son +12
cs.CLarXiv:2606.02404v12026Dynamic Linear Attention
Xin Wang, Hui Shen, Boyuan Zheng +7
cs.CLcs.AIarXiv:2606.10650v12026MyPCBench: A Benchmark for Personally Intelligent Computer-Use Agents
Lawrence Keunho Jang, Andrew Keunwoo Jang, Jing Yu Koh +1
cs.LGcs.CLarXiv:2606.16748v12026Why Fine-Tuning Encourages Hallucinations and How to Fix It
Guy Kaplan, Zorik Gekhman, Zhen Zhu +5
cs.CLcs.AIcs.LGarXiv:2604.15574v12026EviMem: Evidence-Gap-Driven Iterative Retrieval for Long-Term Conversational Memory
Yuyang Li, Yime He, Zeyu Zhang +1
cs.CVcs.CLarXiv:2604.27695v12026Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning
Chengshuai Shi, Wenzhe Li, Xinran Liang +10
cs.LGcs.AIcs.CLarXiv:2605.00347v12026CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10
cs.AIcs.CLcs.LGarXiv:2605.02910v22026When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning
Jiaqi Wei, Xuehang Guo, Pengfei Yu +5
cs.CLarXiv:2605.03314v22026One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue
Xinjie Shen, Rongzhe Wei, Peizhi Niu +6
cs.CLcs.AIcs.CRarXiv:2605.05630v22026SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training
Shengkun Tang, Zekun Wang, Bo Zheng +7
cs.LGcs.AIcs.CLarXiv:2605.08738v22026ThoughtTrace: Understanding User Thoughts in Real-World LLM Interactions
Chuanyang Jin, Binze Li, Haopeng Xie +6
cs.CLcs.AIarXiv:2605.20087v22026Rethinking How to Remember: Beyond Atomic Facts in Lifelong LLM Agent Memory
Jingwei Sun, Jianing Zhu, Jiangchao Yao +2
cs.CLarXiv:2605.19952v12026Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining
Weimin Xiong, Shuhao Gu, Bowen Ye +5
cs.CLcs.AIcs.CVarXiv:2605.14747v12026E-PMQ: Expert-Guided Post-Merge Quantization with Merged-Weight Anchoring
Wenjun Wang, Yanggan Gu, Shuo Cai +4
cs.CLarXiv:2605.16882v12026Decoupling the Benefits of Subword Tokenization for Language Model Training via Byte-level Simulation
Théo Gigant, Bowen Peng, Jeffrey Quesnelle
cs.CLarXiv:2604.27263v22026Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs
Haiquan Lu, Zigeng Chen, Gongfan Fang +2
cs.CLarXiv:2605.20315v12026ResearchMath-14K: Scaling Research-Level Mathematics via Agents
Guijin Son, Seungyeop Yi, Minju Gwak +3
cs.CLarXiv:2605.28003v12026Deep Thought Alignment: Trajectory-Level Latent Distillation for Video Reasoning
Ao Shen, Yongheng Zhang, Yinghui Li +3
cs.CVcs.AIcs.CLarXiv:2608.16316v12026TaoLive Digital Avatar Agent Technical Report: Training Agents to Evolve with Their Harness
TaoLive AIGC LLM Team, Yuhan Sun, Wenhao Lin +7
cs.CLarXiv:2608.15763v12026SkillComposer: Learning Reusable Skills for Natural-Language Robot Programming
John Woods, Hasti Seifi
cs.ROcs.CLcs.LGarXiv:2608.14944v12026Semantic Space of Parts of Speech
Jiří Milička, Ivan Kraus, Arnold Stanovský +5
cs.CLarXiv:2608.15443v12026Coverage Is Not Containment: A Fundamental Limit of Admission-Time Defenses Against Coordinated Poisoning of Vector Retrieval
Prashant Kumar Pathak, Tarun Kumar Sharma
cs.CRcs.CLcs.IRarXiv:2608.16044v12026DuplexGen: Decoupling Content, Timing, and Acoustics for Synthetic Dialogue Speech
Pengcheng Wang, Sheng Li, Jiyi Li +1
cs.CLeess.ASarXiv:2608.16053v12026Whose Gold? Annotator-Pool Disagreement Is Large at the Item Level, and Hidden by Small Leaderboards
Anik Jha
cs.CLcs.LGarXiv:2608.15980v12026Grounding Healthcare LLMs in a Causal Knowledge Graph: Framework, Metrics, and a Cardiovascular Pilot
Ummara Mumtaz, Aimen Noor, Awais Ahmed
cs.AIcs.CLcs.IRarXiv:2608.15382v12026Hallucination Span Detection with Input-Side Evidence Alignment
Miyu Yamada, Yuki Arase
cs.CLarXiv:2608.15804v12026Ask to Be Sure: Informative Interactions for Confident Multi-Turn LLM Recommendation
Cedar Site Bai, Duanshun Li, Zhenyu Liao +6
cs.IRcs.AIcs.CLarXiv:2608.15949v12026What to Forget in Unlearning? Forget Set Curation for Language Models
Animesh Jha, Arpandeep Khatua, Youssef Allouah +1
cs.CLarXiv:2608.14855v12026TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning
Heming Zou, Qi Wang, Yun Qu +9
cs.LGcs.AIcs.CLarXiv:2606.11119v12026QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents
Ye Yuan, Rui Song, Weien Li +12
cs.CLcs.AIcs.MAarXiv:2605.27068v12026Agent Explorative Policy Optimization for Multimodal Agentic Reasoning
Minki Kang, Shizhe Diao, Ryo Hachiuma +4
cs.CLarXiv:2605.28774v12026Skill is Not One-Size-Fits-All: Model-Aware Skill Alignment for LLM Agents
Jianxiang Yu, Jiapeng Zhu, Bochen Lin +3
cs.CLarXiv:2605.30723v12026SEER: Long-Context Reasoning via Selective Visual-Text Compression
Jiawei Xu, Zhilin Zhai, Jinrui Fang +6
cs.CLcs.CVarXiv:2608.15962v12026The Null Token Knows: Reducing Message-Free Hallucination in ASR and NMT
Kirill Borodin, Vasiliy Kudryavtsev, Ivan Viakhirev +1
cs.CLcs.LGcs.SDarXiv:2608.15940v22026NITP: Next Implicit Token Prediction for LLM Pre-training
Xiangdong Zhang, Debing Zhang, Shaofeng Zhang +3
cs.CLarXiv:2605.24956v32026NSF-SciFy: Mining the NSF Awards Database for Scientific Claims
Delip Rao, Weiqiu You, Eric Wong +1
cs.CLarXiv:2503.08600v32025When Stories Evolve: Benchmarking LLM Storytelling Across Agent Architectures in Open-Ended World Simulations
Yuqi Chen, Sixuan Li, Yunfeng Cai +3
cs.CLcs.AIarXiv:2608.15654v12026When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
Haoming Xu, Weihong Xu, Zongrui Li +6
cs.AIcs.CLcs.LGarXiv:2605.30219v12026Draft-OPD: On-Policy Distillation for Speculative Draft Models
Haodi Lei, Yafu Li, Haoran Zhang +8
cs.CLarXiv:2605.29343v22026Towards Human-Like Interactive Speech Recognition With Agentic Correction and Semantic Evaluation
Zixuan Jiang, Yanqiao Zhu, Peng Wang +8
cs.AIcs.CLarXiv:2605.29430v12026AdaCodec: A Predictive Visual Code for Video MLLMs
Haowen Hou, Zhen Huang, Zheming Liang +8
cs.CVcs.AIcs.CLarXiv:2606.02569v12026BraveGuard: From Open-World Threats to Safer Computer-Use Agents
Yunhao Feng, Xiaohu Du, Xinhao Deng +13
cs.CRcs.CLarXiv:2606.01166v22026Domain-Agnostic Neural Topic Modeling with Contextual Token-Level Semantic Graph Representation
Seung-Won Seo, Won Ik Cho, Yongmin Yoo
cs.CLcs.LGarXiv:2608.16269v12026Bridging the Agent-World Gap: Text World Models for LLM-based Agents
Yixia Li, Hongru Wang, Peng Lai +13
cs.CLarXiv:2606.09032v12026FORT-Searcher: Synthesizing Shortcut-Resistant Search Tasks for Training Deep Search Agents
Jia Deng, Yimeng Chen, Xiaoqing Xiang +9
cs.CLarXiv:2606.12087v12026Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning
Xuekang Wang, Zhuoyuan Hao, Shuo Hou +3
cs.LGcs.AIcs.CLarXiv:2606.04923v22026Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution
Liliana Hotsko, Yinxi Li, Yuntian Deng +1
cs.SEcs.AIcs.CLarXiv:2606.06492v12026