Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,361 to 3,420 of 11,238

  1. EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction

    Siyu Yuan, Kaitao Song, Jiangjie Chen +5

    cs.CLarXiv:2401.06201v32024
  2. Emergent and Predictable Memorization in Large Language Models

    Stella Biderman, USVSN Sai Prashanth, Lintang Sutawika +4

    cs.CLarXiv:2304.11158v22023
  3. End-to-End Training of Multi-Document Reader and Retriever for Open-Domain Question Answering

    Devendra Singh Sachan, Siva Reddy, William Hamilton +2

    cs.CLcs.AIcs.IRarXiv:2106.05346v22021
  4. When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors

    Scott Emmons, Erik Jenner, David K. Elson +5

    cs.AIcs.CLarXiv:2507.05246v12025
  5. Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models?

    Hyeong Kyu Choi, Xiaojin Zhu, Sharon Li

    cs.CLcs.MAarXiv:2508.17536v22025
  6. An Agentic System for Rare Disease Diagnosis with Traceable Reasoning

    Weike Zhao, Chaoyi Wu, Yanjie Fan +10

    cs.CLcs.AIcs.CVarXiv:2506.20430v32025
  7. Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems

    Christian Walder, Deep Karkhanis

    cs.LGcs.AIcs.CLarXiv:2505.15201v52025
  8. LightThinker: Thinking Step-by-Step Compression

    Jintian Zhang, Yuqi Zhu, Mengshu Sun +6

    cs.CLcs.AIcs.IRarXiv:2502.15589v22025
  9. Think Before Recommend: Unleashing the Latent Reasoning Power for Sequential Recommendation

    Jiakai Tang, Sunhao Dai, Teng Shi +5

    cs.IRcs.AIcs.CLarXiv:2503.22675v32025
  10. A Comprehensive Survey on Long Context Language Modeling

    Jiaheng Liu, Dawei Zhu, Zhiqi Bai +34

    cs.CLcs.LGarXiv:2503.17407v22025
  11. PromptMRG: Diagnosis-Driven Prompts for Medical Report Generation

    Haibo Jin, Haoxuan Che, Yi Lin +1

    cs.CVcs.CLarXiv:2308.12604v22023
  12. Generalization Bias in Large Language Model Summarization of Scientific Research

    Uwe Peters, Benjamin Chin-Yee

    cs.CLcs.HCarXiv:2504.00025v12025
  13. Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use Agents

    Haoyang Chen, Yi Liu, Jianzhi Shao +3

    cs.AIcs.CLarXiv:2609.00823v12026
  14. SG-Net: Syntax-Guided Machine Reading Comprehension

    Zhuosheng Zhang, Yuwei Wu, Junru Zhou +3

    cs.CLarXiv:1908.05147v32019
    Summaries:한국어
  15. Re-evaluating Automatic Metrics for Image Captioning

    Mert Kilickaya, Aykut Erdem, Nazli Ikizler-Cinbis +1

    cs.CLcs.CVarXiv:1612.07600v12016
  16. From Terminology to Diagrams: Visual-Instruction Generation for Scientific Diagram Understanding

    Raul Ortega, José Manuel Gómez-Pérez

    cs.CVcs.AIcs.CLarXiv:2609.00948v12026
  17. StreamingVLM: Real-Time Understanding for Infinite Video Streams

    Ruyi Xu, Guangxuan Xiao, Yukang Chen +3

    cs.CVcs.AIcs.CLarXiv:2510.09608v22025
  18. PersonaPlex: Voice and Role Control for Full Duplex Conversational Speech Models

    Rajarshi Roy, Jonathan Raiman, Sang-gil Lee +5

    cs.CLarXiv:2602.06053v12026
  19. FinLifeBench: Exhaustive Life-Event History and Financial-State Reconstruction from Longitudinal Banking Dialogue

    Hangyeul Lee, Juyoung Oh, Jaeyong Ko +5

    cs.AIcs.CLarXiv:2609.01198v22026
  20. Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective

    Zhoujun Cheng, Shibo Hao, Tianyang Liu +21

    cs.LGcs.AIcs.CLarXiv:2506.14965v12025
  21. AgentFold: Long-Horizon Web Agents with Proactive Context Management

    Rui Ye, Zhongwang Zhang, Kuan Li +12

    cs.CLcs.AIcs.LGarXiv:2510.24699v12025
  22. How Do Language Models Choose Between Context and Memory?

    Benjamin Shih, John Winnicki, Arianna Cao

    cs.LGcs.CLarXiv:2609.00753v12026
  23. TreeRL: LLM Reinforcement Learning with On-Policy Tree Search

    Zhenyu Hou, Ziniu Hu, Yujiang Li +3

    cs.LGcs.CLarXiv:2506.11902v12025
  24. VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset

    Jing Liu, Sihan Chen, Xingjian He +4

    cs.LGcs.CLcs.CVarXiv:2304.08345v22023
  25. (V)LMs generalize beyond surface co-occurrence: Evidence from cross-modal number agreement

    Zach Studdiford, Kanishka Misra

    cs.CLcs.AIarXiv:2609.00443v12026
  26. MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency

    Dongzhi Jiang, Renrui Zhang, Ziyu Guo +11

    cs.CVcs.AIcs.CLarXiv:2502.09621v12025
  27. A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 Solver

    Haobo Ma, Wenlin Zhang, Manuel Israel Cázares

    cs.CLarXiv:2609.00706v12026
  28. Large Language Models Often Know When They Are Being Evaluated

    Joe Needham, Giles Edkins, Govind Pimpale +2

    cs.CLcs.AIarXiv:2505.23836v32025
  29. Lagged Coupling: Internal Representations Become Readable Before They Become Causal

    Xining Xun

    cs.CLcs.AIarXiv:2609.01048v12026
  30. In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents

    Zhen Tan, Jun Yan, I-Hung Hsu +12

    cs.CLcs.AIarXiv:2503.08026v22025
  31. Evaluating Open-Domain Question Answering in the Era of Large Language Models

    Ehsan Kamalloo, Nouha Dziri, Charles L. A. Clarke +1

    cs.CLarXiv:2305.06984v32023
  32. The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs

    Nitay Calderon, Roi Reichart, Rotem Dror

    cs.CLcs.AIcs.HCarXiv:2501.10970v42025
  33. Anaphora and Coreference Resolution: A Review

    Rhea Sukthanker, Soujanya Poria, Erik Cambria +1

    cs.CLarXiv:1805.11824v12018
  34. Competitive Programming with Large Reasoning Models

    OpenAI, :, Ahmed El-Kishky +23

    cs.LGcs.AIcs.CLarXiv:2502.06807v22025
  35. Blended RAG: Improving RAG (Retriever-Augmented Generation) Accuracy with Semantic Search and Hybrid Query-Based Retrievers

    Kunal Sawarkar, Abhilasha Mangal, Shivam Raj Solanki

    cs.IRcs.AIcs.CLarXiv:2404.07220v22024
  36. Scaling RL to Long Videos

    Yukang Chen, Wei Huang, Baifeng Shi +11

    cs.CVcs.AIcs.CLarXiv:2507.07966v42025
  37. Who Speaks for the Pruned? Visual Token Pruning as Coverage Optimization

    Qingchan Zhu, Weihang You, Hanqi Jiang +3

    cs.CVcs.CLcs.LGarXiv:2609.03158v12026
  38. WebExplorer: Explore and Evolve for Training Long-Horizon Web Agents

    Junteng Liu, Yunji Li, Chi Zhang +12

    cs.CLarXiv:2509.06501v32025
  39. MinMo: A Multimodal Large Language Model for Seamless Voice Interaction

    Qian Chen, Yafeng Chen, Yanni Chen +33

    cs.CLcs.AIcs.HCarXiv:2501.06282v12025
  40. Accelerating Diffusion LLMs via Adaptive Parallel Decoding

    Daniel Israel, Guy Van den Broeck, Aditya Grover

    cs.CLcs.AIcs.LGarXiv:2506.00413v22025
  41. Preference Leakage: A Contamination Problem in LLM-as-a-judge

    Dawei Li, Renliang Sun, Yue Huang +6

    cs.LGcs.AIcs.CLarXiv:2502.01534v32025
  42. CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation

    Jinjun Peng, Leyi Cui, Kele Huang +2

    cs.SEcs.CLcs.LGarXiv:2501.08200v12025
  43. Capabilities of GPT-5 on Multimodal Medical Reasoning

    Shansong Wang, Mingzhe Hu, Qiang Li +2

    cs.CLcs.AIarXiv:2508.08224v22025
  44. NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model

    NVIDIA, :, Aarti Basant +214

    cs.CLcs.AIcs.LGarXiv:2508.14444v42025
  45. Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction

    Tianpeng Li, Jun Liu, Tao Zhang +11

    cs.CLcs.SDeess.ASarXiv:2502.17239v12025
  46. Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?

    Haoang Chi, He Li, Wenjing Yang +5

    cs.AIcs.CLcs.LGarXiv:2506.21215v12025
  47. Latent Recurrent Thoughts: Recurrent Refinement of Proposed Latents for Reasoning with Frozen LLMs

    Zhaoliang Chen, Jie Fu

    cs.AIcs.CLarXiv:2609.01117v12026
  48. DeepReview: Improving LLM-based Paper Review with Human-like Deep Thinking Process

    Minjun Zhu, Yixuan Weng, Linyi Yang +1

    cs.CLcs.LGarXiv:2503.08569v12025
  49. Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution

    Zouying Cao, Jiaji Deng, Li Yu +4

    cs.AIcs.CLarXiv:2512.10696v22025
  50. A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment

    Kun Wang, Guibin Zhang, Zhenhong Zhou +100

    cs.CRcs.AIcs.CLarXiv:2504.15585v42025
  51. AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning

    Yang Chen, Zhuolin Yang, Zihan Liu +5

    cs.LGcs.AIcs.CLarXiv:2505.16400v32025
  52. Machine Generated Text: A Comprehensive Survey of Threat Models and Detection Methods

    Evan Crothers, Nathalie Japkowicz, Herna Viktor

    cs.CLcs.CRcs.CYarXiv:2210.07321v42022
  53. Probing Pre-Trained Language Models for Cross-Cultural Differences in Values

    Arnav Arora, Lucie-Aimée Kaffee, Isabelle Augenstein

    cs.CLarXiv:2203.13722v32022
  54. REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization

    Jian Hu, Jason Klein Liu, Haotian Xu +1

    cs.CLcs.LGarXiv:2501.03262v92025
  55. The Privacy-Hallucination Tradeoff in Differentially Private Language Models

    Krithika Ramesh, Krishna Pillutla, Danish Pruthi +1

    cs.AIcs.CLarXiv:2609.00492v12026
  56. Baichuan-Omni-1.5 Technical Report

    Yadong Li, Jun Liu, Tao Zhang +90

    cs.CLcs.SDeess.ASarXiv:2501.15368v12025
  57. jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval

    Michael Günther, Saba Sturua, Mohammad Kalim Akram +8

    cs.AIcs.CLcs.IRarXiv:2506.18902v32025
  58. MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining

    LLM-Core Xiaomi, :, Bingquan Xia +62

    cs.CLcs.AIcs.LGarXiv:2505.07608v22025
  59. SBERT-WK: A Sentence Embedding Method by Dissecting BERT-based Word Models

    Bin Wang, C. -C. Jay Kuo

    cs.CLcs.LGcs.MMarXiv:2002.06652v22020
  60. PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides

    Hao Zheng, Xinyan Guan, Hao Kong +7

    cs.AIcs.CLarXiv:2501.03936v32025