Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,801 to 10,860 of 11,248

  1. Quickest Detection of Hallucination Onset: Delay Bounds and Learned CUSUM Statistics

    Igor Itkin

    cs.LGcs.AIcs.CLarXiv:2606.12476v32026
  2. LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories

    Baochang Ren, Xinjie Liu, Xi Chen +15

    cs.CLcs.AIcs.LGarXiv:2606.13578v22026
  3. ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning

    Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5

    cs.CVcs.AIcs.CLarXiv:2606.14697v12026
  4. VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models

    Sen Xu, Shixi Liu, Wei Wang +6

    cs.AIcs.CLarXiv:2606.16140v12026
  5. Speaking the Language of Science: Toward a General-Purpose Generative Foundation Model for the Natural Sciences

    Mingyang Li, Yurou Liu, Jieping Ye +3

    cs.CLarXiv:2606.16905v12026
  6. Looped World Models

    Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang +28

    cs.LGcs.AIcs.CLarXiv:2606.18208v12026
  7. GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents

    Zhe Ren, Yibo Yang, Yimeng Chen +7

    cs.LGcs.CLarXiv:2606.18829v12026
  8. MAIC-UI: Making Interactive Courseware with Generative UI

    Shangqing Tu, Yanjia Li, Keyu Chen +7

    cs.CLcs.AIcs.HCarXiv:2604.25806v12026
    Summaries:한국어
  9. Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning

    Jiayu Yang, Chao Chen, Shengen Wu +6

    cs.LGcs.CLarXiv:2606.13106v12026
  10. PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech

    Venkata Pushpak Teja Menta

    cs.SDcs.CLarXiv:2604.25476v12026
  11. XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity

    Dasol Choi, Eugenia Kim, Jaewon Noh +14

    cs.CLcs.AIarXiv:2605.05662v12026
  12. EMO: Pretraining Mixture of Experts for Emergent Modularity

    Ryan Wang, Akshita Bhagia, Sewon Min

    cs.CLarXiv:2605.06663v22026
  13. A$^2$TGPO: Agentic Turn-Group Policy Optimization with Adaptive Turn-level Clipping

    Dingwei Chen, Zefang Zong, Zhipeng Ma +5

    cs.CLarXiv:2605.06200v12026
  14. K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts

    Nahyun Lee, Dongkeun Yoon, Guijin Son +12

    cs.CLarXiv:2606.02404v12026
  15. Dynamic Linear Attention

    Xin Wang, Hui Shen, Boyuan Zheng +7

    cs.CLcs.AIarXiv:2606.10650v12026
  16. MyPCBench: A Benchmark for Personally Intelligent Computer-Use Agents

    Lawrence Keunho Jang, Andrew Keunwoo Jang, Jing Yu Koh +1

    cs.LGcs.CLarXiv:2606.16748v12026
  17. Why Fine-Tuning Encourages Hallucinations and How to Fix It

    Guy Kaplan, Zorik Gekhman, Zhen Zhu +5

    cs.CLcs.AIcs.LGarXiv:2604.15574v12026
  18. EviMem: Evidence-Gap-Driven Iterative Retrieval for Long-Term Conversational Memory

    Yuyang Li, Yime He, Zeyu Zhang +1

    cs.CVcs.CLarXiv:2604.27695v12026
  19. Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning

    Chengshuai Shi, Wenzhe Li, Xinran Liang +10

    cs.LGcs.AIcs.CLarXiv:2605.00347v12026
  20. CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing

    Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10

    cs.AIcs.CLcs.LGarXiv:2605.02910v22026
  21. When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning

    Jiaqi Wei, Xuehang Guo, Pengfei Yu +5

    cs.CLarXiv:2605.03314v22026
  22. One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue

    Xinjie Shen, Rongzhe Wei, Peizhi Niu +6

    cs.CLcs.AIcs.CRarXiv:2605.05630v22026
  23. SlimQwen: Exploring the Pruning and Distillation in Large MoE Model Pre-training

    Shengkun Tang, Zekun Wang, Bo Zheng +7

    cs.LGcs.AIcs.CLarXiv:2605.08738v22026
  24. ThoughtTrace: Understanding User Thoughts in Real-World LLM Interactions

    Chuanyang Jin, Binze Li, Haopeng Xie +6

    cs.CLcs.AIarXiv:2605.20087v22026
  25. Rethinking How to Remember: Beyond Atomic Facts in Lifelong LLM Agent Memory

    Jingwei Sun, Jianing Zhu, Jiangchao Yao +2

    cs.CLarXiv:2605.19952v12026
  26. Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining

    Weimin Xiong, Shuhao Gu, Bowen Ye +5

    cs.CLcs.AIcs.CVarXiv:2605.14747v12026
  27. E-PMQ: Expert-Guided Post-Merge Quantization with Merged-Weight Anchoring

    Wenjun Wang, Yanggan Gu, Shuo Cai +4

    cs.CLarXiv:2605.16882v12026
  28. Decoupling the Benefits of Subword Tokenization for Language Model Training via Byte-level Simulation

    Théo Gigant, Bowen Peng, Jeffrey Quesnelle

    cs.CLarXiv:2604.27263v22026
  29. Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs

    Haiquan Lu, Zigeng Chen, Gongfan Fang +2

    cs.CLarXiv:2605.20315v12026
  30. ResearchMath-14K: Scaling Research-Level Mathematics via Agents

    Guijin Son, Seungyeop Yi, Minju Gwak +3

    cs.CLarXiv:2605.28003v12026
  31. Deep Thought Alignment: Trajectory-Level Latent Distillation for Video Reasoning

    Ao Shen, Yongheng Zhang, Yinghui Li +3

    cs.CVcs.AIcs.CLarXiv:2608.16316v12026
  32. TaoLive Digital Avatar Agent Technical Report: Training Agents to Evolve with Their Harness

    TaoLive AIGC LLM Team, Yuhan Sun, Wenhao Lin +7

    cs.CLarXiv:2608.15763v12026
  33. SkillComposer: Learning Reusable Skills for Natural-Language Robot Programming

    John Woods, Hasti Seifi

    cs.ROcs.CLcs.LGarXiv:2608.14944v12026
  34. Semantic Space of Parts of Speech

    Jiří Milička, Ivan Kraus, Arnold Stanovský +5

    cs.CLarXiv:2608.15443v12026
  35. Coverage Is Not Containment: A Fundamental Limit of Admission-Time Defenses Against Coordinated Poisoning of Vector Retrieval

    Prashant Kumar Pathak, Tarun Kumar Sharma

    cs.CRcs.CLcs.IRarXiv:2608.16044v12026
  36. DuplexGen: Decoupling Content, Timing, and Acoustics for Synthetic Dialogue Speech

    Pengcheng Wang, Sheng Li, Jiyi Li +1

    cs.CLeess.ASarXiv:2608.16053v12026
  37. Whose Gold? Annotator-Pool Disagreement Is Large at the Item Level, and Hidden by Small Leaderboards

    Anik Jha

    cs.CLcs.LGarXiv:2608.15980v12026
  38. Grounding Healthcare LLMs in a Causal Knowledge Graph: Framework, Metrics, and a Cardiovascular Pilot

    Ummara Mumtaz, Aimen Noor, Awais Ahmed

    cs.AIcs.CLcs.IRarXiv:2608.15382v12026
  39. Hallucination Span Detection with Input-Side Evidence Alignment

    Miyu Yamada, Yuki Arase

    cs.CLarXiv:2608.15804v12026
  40. Ask to Be Sure: Informative Interactions for Confident Multi-Turn LLM Recommendation

    Cedar Site Bai, Duanshun Li, Zhenyu Liao +6

    cs.IRcs.AIcs.CLarXiv:2608.15949v12026
  41. What to Forget in Unlearning? Forget Set Curation for Language Models

    Animesh Jha, Arpandeep Khatua, Youssef Allouah +1

    cs.CLarXiv:2608.14855v12026
  42. TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning

    Heming Zou, Qi Wang, Yun Qu +9

    cs.LGcs.AIcs.CLarXiv:2606.11119v12026
  43. QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents

    Ye Yuan, Rui Song, Weien Li +12

    cs.CLcs.AIcs.MAarXiv:2605.27068v12026
  44. Agent Explorative Policy Optimization for Multimodal Agentic Reasoning

    Minki Kang, Shizhe Diao, Ryo Hachiuma +4

    cs.CLarXiv:2605.28774v12026
  45. Skill is Not One-Size-Fits-All: Model-Aware Skill Alignment for LLM Agents

    Jianxiang Yu, Jiapeng Zhu, Bochen Lin +3

    cs.CLarXiv:2605.30723v12026
  46. SEER: Long-Context Reasoning via Selective Visual-Text Compression

    Jiawei Xu, Zhilin Zhai, Jinrui Fang +6

    cs.CLcs.CVarXiv:2608.15962v12026
  47. The Null Token Knows: Reducing Message-Free Hallucination in ASR and NMT

    Kirill Borodin, Vasiliy Kudryavtsev, Ivan Viakhirev +1

    cs.CLcs.LGcs.SDarXiv:2608.15940v22026
  48. NITP: Next Implicit Token Prediction for LLM Pre-training

    Xiangdong Zhang, Debing Zhang, Shaofeng Zhang +3

    cs.CLarXiv:2605.24956v32026
  49. NSF-SciFy: Mining the NSF Awards Database for Scientific Claims

    Delip Rao, Weiqiu You, Eric Wong +1

    cs.CLarXiv:2503.08600v32025
  50. When Stories Evolve: Benchmarking LLM Storytelling Across Agent Architectures in Open-Ended World Simulations

    Yuqi Chen, Sixuan Li, Yunfeng Cai +3

    cs.CLcs.AIarXiv:2608.15654v12026
  51. When Should Models Change Their Minds? Contextual Belief Management in Large Language Models

    Haoming Xu, Weihong Xu, Zongrui Li +6

    cs.AIcs.CLcs.LGarXiv:2605.30219v12026
  52. Draft-OPD: On-Policy Distillation for Speculative Draft Models

    Haodi Lei, Yafu Li, Haoran Zhang +8

    cs.CLarXiv:2605.29343v22026
  53. Towards Human-Like Interactive Speech Recognition With Agentic Correction and Semantic Evaluation

    Zixuan Jiang, Yanqiao Zhu, Peng Wang +8

    cs.AIcs.CLarXiv:2605.29430v12026
  54. AdaCodec: A Predictive Visual Code for Video MLLMs

    Haowen Hou, Zhen Huang, Zheming Liang +8

    cs.CVcs.AIcs.CLarXiv:2606.02569v12026
  55. BraveGuard: From Open-World Threats to Safer Computer-Use Agents

    Yunhao Feng, Xiaohu Du, Xinhao Deng +13

    cs.CRcs.CLarXiv:2606.01166v22026
  56. Domain-Agnostic Neural Topic Modeling with Contextual Token-Level Semantic Graph Representation

    Seung-Won Seo, Won Ik Cho, Yongmin Yoo

    cs.CLcs.LGarXiv:2608.16269v12026
  57. Bridging the Agent-World Gap: Text World Models for LLM-based Agents

    Yixia Li, Hongru Wang, Peng Lai +13

    cs.CLarXiv:2606.09032v12026
  58. FORT-Searcher: Synthesizing Shortcut-Resistant Search Tasks for Training Deep Search Agents

    Jia Deng, Yimeng Chen, Xiaoqing Xiang +9

    cs.CLarXiv:2606.12087v12026
  59. Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning

    Xuekang Wang, Zhuoyuan Hao, Shuo Hou +3

    cs.LGcs.AIcs.CLarXiv:2606.04923v22026
  60. Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution

    Liliana Hotsko, Yinxi Li, Yuntian Deng +1

    cs.SEcs.AIcs.CLarXiv:2606.06492v12026