Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,361 to 3,420 of 11,238
EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction
Siyu Yuan, Kaitao Song, Jiangjie Chen +5
cs.CLarXiv:2401.06201v32024Emergent and Predictable Memorization in Large Language Models
Stella Biderman, USVSN Sai Prashanth, Lintang Sutawika +4
cs.CLarXiv:2304.11158v22023End-to-End Training of Multi-Document Reader and Retriever for Open-Domain Question Answering
Devendra Singh Sachan, Siva Reddy, William Hamilton +2
cs.CLcs.AIcs.IRarXiv:2106.05346v22021When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors
Scott Emmons, Erik Jenner, David K. Elson +5
cs.AIcs.CLarXiv:2507.05246v12025Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models?
Hyeong Kyu Choi, Xiaojin Zhu, Sharon Li
cs.CLcs.MAarXiv:2508.17536v22025An Agentic System for Rare Disease Diagnosis with Traceable Reasoning
Weike Zhao, Chaoyi Wu, Yanjie Fan +10
cs.CLcs.AIcs.CVarXiv:2506.20430v32025Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems
Christian Walder, Deep Karkhanis
cs.LGcs.AIcs.CLarXiv:2505.15201v52025LightThinker: Thinking Step-by-Step Compression
Jintian Zhang, Yuqi Zhu, Mengshu Sun +6
cs.CLcs.AIcs.IRarXiv:2502.15589v22025Think Before Recommend: Unleashing the Latent Reasoning Power for Sequential Recommendation
Jiakai Tang, Sunhao Dai, Teng Shi +5
cs.IRcs.AIcs.CLarXiv:2503.22675v32025A Comprehensive Survey on Long Context Language Modeling
Jiaheng Liu, Dawei Zhu, Zhiqi Bai +34
cs.CLcs.LGarXiv:2503.17407v22025PromptMRG: Diagnosis-Driven Prompts for Medical Report Generation
Haibo Jin, Haoxuan Che, Yi Lin +1
cs.CVcs.CLarXiv:2308.12604v22023Generalization Bias in Large Language Model Summarization of Scientific Research
Uwe Peters, Benjamin Chin-Yee
cs.CLcs.HCarXiv:2504.00025v12025Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use Agents
Haoyang Chen, Yi Liu, Jianzhi Shao +3
cs.AIcs.CLarXiv:2609.00823v12026SG-Net: Syntax-Guided Machine Reading Comprehension
Zhuosheng Zhang, Yuwei Wu, Junru Zhou +3
cs.CLarXiv:1908.05147v32019Summaries:한국어Re-evaluating Automatic Metrics for Image Captioning
Mert Kilickaya, Aykut Erdem, Nazli Ikizler-Cinbis +1
cs.CLcs.CVarXiv:1612.07600v12016From Terminology to Diagrams: Visual-Instruction Generation for Scientific Diagram Understanding
Raul Ortega, José Manuel Gómez-Pérez
cs.CVcs.AIcs.CLarXiv:2609.00948v12026StreamingVLM: Real-Time Understanding for Infinite Video Streams
Ruyi Xu, Guangxuan Xiao, Yukang Chen +3
cs.CVcs.AIcs.CLarXiv:2510.09608v22025PersonaPlex: Voice and Role Control for Full Duplex Conversational Speech Models
Rajarshi Roy, Jonathan Raiman, Sang-gil Lee +5
cs.CLarXiv:2602.06053v12026FinLifeBench: Exhaustive Life-Event History and Financial-State Reconstruction from Longitudinal Banking Dialogue
Hangyeul Lee, Juyoung Oh, Jaeyong Ko +5
cs.AIcs.CLarXiv:2609.01198v22026Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective
Zhoujun Cheng, Shibo Hao, Tianyang Liu +21
cs.LGcs.AIcs.CLarXiv:2506.14965v12025AgentFold: Long-Horizon Web Agents with Proactive Context Management
Rui Ye, Zhongwang Zhang, Kuan Li +12
cs.CLcs.AIcs.LGarXiv:2510.24699v12025How Do Language Models Choose Between Context and Memory?
Benjamin Shih, John Winnicki, Arianna Cao
cs.LGcs.CLarXiv:2609.00753v12026TreeRL: LLM Reinforcement Learning with On-Policy Tree Search
Zhenyu Hou, Ziniu Hu, Yujiang Li +3
cs.LGcs.CLarXiv:2506.11902v12025VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset
Jing Liu, Sihan Chen, Xingjian He +4
cs.LGcs.CLcs.CVarXiv:2304.08345v22023(V)LMs generalize beyond surface co-occurrence: Evidence from cross-modal number agreement
Zach Studdiford, Kanishka Misra
cs.CLcs.AIarXiv:2609.00443v12026MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
Dongzhi Jiang, Renrui Zhang, Ziyu Guo +11
cs.CVcs.AIcs.CLarXiv:2502.09621v12025A Certificate-Producing Cascade for Equational Implication: The SAIR EQT2 Stage 2 Solver
Haobo Ma, Wenlin Zhang, Manuel Israel Cázares
cs.CLarXiv:2609.00706v12026Large Language Models Often Know When They Are Being Evaluated
Joe Needham, Giles Edkins, Govind Pimpale +2
cs.CLcs.AIarXiv:2505.23836v32025Lagged Coupling: Internal Representations Become Readable Before They Become Causal
Xining Xun
cs.CLcs.AIarXiv:2609.01048v12026In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents
Zhen Tan, Jun Yan, I-Hung Hsu +12
cs.CLcs.AIarXiv:2503.08026v22025Evaluating Open-Domain Question Answering in the Era of Large Language Models
Ehsan Kamalloo, Nouha Dziri, Charles L. A. Clarke +1
cs.CLarXiv:2305.06984v32023The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs
Nitay Calderon, Roi Reichart, Rotem Dror
cs.CLcs.AIcs.HCarXiv:2501.10970v42025Anaphora and Coreference Resolution: A Review
Rhea Sukthanker, Soujanya Poria, Erik Cambria +1
cs.CLarXiv:1805.11824v12018Competitive Programming with Large Reasoning Models
OpenAI, :, Ahmed El-Kishky +23
cs.LGcs.AIcs.CLarXiv:2502.06807v22025Blended RAG: Improving RAG (Retriever-Augmented Generation) Accuracy with Semantic Search and Hybrid Query-Based Retrievers
Kunal Sawarkar, Abhilasha Mangal, Shivam Raj Solanki
cs.IRcs.AIcs.CLarXiv:2404.07220v22024Scaling RL to Long Videos
Yukang Chen, Wei Huang, Baifeng Shi +11
cs.CVcs.AIcs.CLarXiv:2507.07966v42025Who Speaks for the Pruned? Visual Token Pruning as Coverage Optimization
Qingchan Zhu, Weihang You, Hanqi Jiang +3
cs.CVcs.CLcs.LGarXiv:2609.03158v12026WebExplorer: Explore and Evolve for Training Long-Horizon Web Agents
Junteng Liu, Yunji Li, Chi Zhang +12
cs.CLarXiv:2509.06501v32025MinMo: A Multimodal Large Language Model for Seamless Voice Interaction
Qian Chen, Yafeng Chen, Yanni Chen +33
cs.CLcs.AIcs.HCarXiv:2501.06282v12025Accelerating Diffusion LLMs via Adaptive Parallel Decoding
Daniel Israel, Guy Van den Broeck, Aditya Grover
cs.CLcs.AIcs.LGarXiv:2506.00413v22025Preference Leakage: A Contamination Problem in LLM-as-a-judge
Dawei Li, Renliang Sun, Yue Huang +6
cs.LGcs.AIcs.CLarXiv:2502.01534v32025CWEval: Outcome-driven Evaluation on Functionality and Security of LLM Code Generation
Jinjun Peng, Leyi Cui, Kele Huang +2
cs.SEcs.CLcs.LGarXiv:2501.08200v12025Capabilities of GPT-5 on Multimodal Medical Reasoning
Shansong Wang, Mingzhe Hu, Qiang Li +2
cs.CLcs.AIarXiv:2508.08224v22025NVIDIA Nemotron Nano 2: An Accurate and Efficient Hybrid Mamba-Transformer Reasoning Model
NVIDIA, :, Aarti Basant +214
cs.CLcs.AIcs.LGarXiv:2508.14444v42025Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
Tianpeng Li, Jun Liu, Tao Zhang +11
cs.CLcs.SDeess.ASarXiv:2502.17239v12025Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
Haoang Chi, He Li, Wenjing Yang +5
cs.AIcs.CLcs.LGarXiv:2506.21215v12025Latent Recurrent Thoughts: Recurrent Refinement of Proposed Latents for Reasoning with Frozen LLMs
Zhaoliang Chen, Jie Fu
cs.AIcs.CLarXiv:2609.01117v12026DeepReview: Improving LLM-based Paper Review with Human-like Deep Thinking Process
Minjun Zhu, Yixuan Weng, Linyi Yang +1
cs.CLcs.LGarXiv:2503.08569v12025Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution
Zouying Cao, Jiaji Deng, Li Yu +4
cs.AIcs.CLarXiv:2512.10696v22025A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment
Kun Wang, Guibin Zhang, Zhenhong Zhou +100
cs.CRcs.AIcs.CLarXiv:2504.15585v42025AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning
Yang Chen, Zhuolin Yang, Zihan Liu +5
cs.LGcs.AIcs.CLarXiv:2505.16400v32025Machine Generated Text: A Comprehensive Survey of Threat Models and Detection Methods
Evan Crothers, Nathalie Japkowicz, Herna Viktor
cs.CLcs.CRcs.CYarXiv:2210.07321v42022Probing Pre-Trained Language Models for Cross-Cultural Differences in Values
Arnav Arora, Lucie-Aimée Kaffee, Isabelle Augenstein
cs.CLarXiv:2203.13722v32022REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization
Jian Hu, Jason Klein Liu, Haotian Xu +1
cs.CLcs.LGarXiv:2501.03262v92025The Privacy-Hallucination Tradeoff in Differentially Private Language Models
Krithika Ramesh, Krishna Pillutla, Danish Pruthi +1
cs.AIcs.CLarXiv:2609.00492v12026Baichuan-Omni-1.5 Technical Report
Yadong Li, Jun Liu, Tao Zhang +90
cs.CLcs.SDeess.ASarXiv:2501.15368v12025jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval
Michael Günther, Saba Sturua, Mohammad Kalim Akram +8
cs.AIcs.CLcs.IRarXiv:2506.18902v32025MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining
LLM-Core Xiaomi, :, Bingquan Xia +62
cs.CLcs.AIcs.LGarXiv:2505.07608v22025SBERT-WK: A Sentence Embedding Method by Dissecting BERT-based Word Models
Bin Wang, C. -C. Jay Kuo
cs.CLcs.LGcs.MMarXiv:2002.06652v22020PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
Hao Zheng, Xinyan Guan, Hao Kong +7
cs.AIcs.CLarXiv:2501.03936v32025