Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,181 to 3,240 of 11,199
LLMs for Explainable AI: A Comprehensive Survey
Ahsan Bilal, David Ebert, Beiyu Lin
cs.AIcs.CLarXiv:2504.00125v12025Ranked by the Matcher: A Reproducibility Audit of Knowledge Graph Extraction from Threat Reports
Safayat Bin Hakim, Houbing Herbert Song
cs.CRcs.AIcs.CLarXiv:2609.01671v12026LLM Post-Training: A Deep Dive into Reasoning Large Language Models
Komal Kumar, Tajamul Ashraf, Omkar Thawakar +7
cs.CLcs.CVarXiv:2502.21321v22025WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
Zile Qiao, Guoxin Chen, Xuanzhong Chen +13
cs.CLarXiv:2509.13309v22025StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization
Ziliang Wang, Xuhui Zheng, Kang An +4
cs.CLcs.AIcs.IRarXiv:2505.15107v22025MuQ: Self-Supervised Music Representation Learning with Mel Residual Vector Quantization
Haina Zhu, Yizhi Zhou, Hangting Chen +6
cs.SDcs.AIcs.CLarXiv:2501.01108v22025Exploring the Impact of Temperature on Large Language Models:Hot or Cold?
Lujun Li, Lama Sleem, Niccolo' Gentile +2
cs.CLarXiv:2506.07295v12025Investigating Assistant Bias in LLM User Simulators Using a Role Vector
Daeheon Jeong, Yoonjoo Lee, Eugene Choi +2
cs.CLcs.HCarXiv:2609.00608v12026Retrieval-Augmented Generation with Conflicting Evidence
Han Wang, Archiki Prasad, Elias Stengel-Eskin +1
cs.CLcs.AIarXiv:2504.13079v22025Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models
Yunxin Li, Zhenyu Liu, Zitao Li +19
cs.CVcs.CLarXiv:2505.04921v22025Overview of the TREC 2022 deep learning track
Nick Craswell, Bhaskar Mitra, Emine Yilmaz +4
cs.IRcs.AIcs.CLarXiv:2507.10865v12025Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
Mingqi Wu, Zhihao Zhang, Qiaole Dong +11
cs.LGcs.AIcs.CLarXiv:2507.10532v32025On Memory Construction and Retrieval for Personalized Conversational Agents
Zhuoshi Pan, Qianhui Wu, Huiqiang Jiang +8
cs.CLcs.AIarXiv:2502.05589v32025Closing Cost-Quality Gap in Document VLMs: Difficulty-Aware Data Curation and Quality-Adjusted Deployment Economics
Maksim Evdokimov, Matvey Ivanov, Dmitrii Tsiupin +3
cs.CLarXiv:2609.01575v12026Real or Fake? Learning to Discriminate Machine from Human Generated Text
Anton Bakhtin, Sam Gross, Myle Ott +3
cs.LGcs.CLstat.MLarXiv:1906.03351v22019From Rollouts to Recipes: Self-Contained Post-Training for LLMs
Yifei Li, Lingling Zhang, Muye Huang +3
cs.CLarXiv:2609.01422v12026ClinTraceBench: Source-Verifiable Longitudinal Clinical Reasoning over EHR-Derived Dialogues
Huimin Wang, Zhengyi Zhao, Yutian Zhao
cs.CLarXiv:2609.01111v12026LLM-Grounder: Open-Vocabulary 3D Visual Grounding with Large Language Model as an Agent
Jianing Yang, Xuweiyi Chen, Shengyi Qian +4
cs.CVcs.AIcs.CLarXiv:2309.12311v12023StarCoder: may the source be with you!
Raymond Li, Loubna Ben Allal, Yangtian Zi +64
cs.CLcs.AIcs.PLarXiv:2305.06161v22023TacoMAS: Test-Time Co-Evolution of Topology and Capability in LLM-based Multi-Agent Systems
Chen Xu, Yicheng Hu, Ruizi Wang +4
cs.CLarXiv:2605.09539v12026Modality Fault Lines: Structural Corruptions Reveal Fragile Omni-Modal Reasoning
Zhaolu Kang, Meixin Wu, Yu Xue +6
cs.CLarXiv:2608.29278v12026Temporal Leakage in Financial News NLP: A Multi-Architecture Audit with a Regime-Specific M&A Signal
Chenhao Xue, Raslen Guesmi, Siwei Feng +5
cs.CLcs.LGarXiv:2608.17223v12026PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs
Soroush Nasiriany, Fei Xia, Wenhao Yu +20
cs.ROcs.CLcs.CVarXiv:2402.07872v12024Recursive Multi-Agent Systems
Jiaru Zou, Rui Pan, Ruizhong Qiu +8
cs.AIcs.CLcs.LGarXiv:2604.25917v22026Summaries:한국어Building Production-Ready Probes For Gemini
János Kramár, Joshua Engels, Zheng Wang +4
cs.LGcs.AIcs.CLarXiv:2601.11516v42026EnvHarness: Awakening Static Worlds for Agent Learning
Chengsong Huang, Zifeng Wang, Rujun Han +14
cs.AIcs.CLcs.LGarXiv:2608.19880v12026Summaries:简体中文Think Again or Think Longer? Selective Verification for Budget-Aware Reasoning
Sajib Acharjee Dip, Dawei Zhou, Liqing Zhang
cs.AIcs.CLarXiv:2606.19808v12026ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence
Rui Meng, Bhavana Dalvi Mishra, Jiefeng Chen +10
cs.AIcs.CLcs.MAarXiv:2605.26340v12026No Hidden Prompts Needed! You Can Game AI Peer Review with Presentation-Only Revisions
Xu Yang, Zhizhou Sha, Junbo Li +10
cs.CLarXiv:2606.13044v12026Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation
Xingyu Su, Jacob Helwig, Shubham Parashar +6
cs.CLcs.AIarXiv:2606.06712v12026CLIPO: Contrastive Learning in Policy Optimization Generalizes RLVR
Sijia Cui, Pengyu Cheng, Jiajun Song +6
cs.LGcs.AIcs.CLarXiv:2603.10101v12026NatureBench: Can Coding Agents Match the Published SOTA of Nature-Family Papers?
Yuru Wang, Lejun Cheng, Yuxin Zuo +14
cs.CLarXiv:2606.24530v22026Memory Decoder at Scale: A Pretrained, Parametric Long-Term Memory
Rubin Wei, Jiaqi Cao, Jiarui Wang +4
cs.CLarXiv:2607.27919v12026Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills
Jianlyu Chen, Yuyang Hu, Hongjin Qian +8
cs.AIcs.CLarXiv:2609.02749v12026Pretraining Large Language Models with NVFP4
NVIDIA, Felix Abecassis, Anjulie Agrusa +87
cs.CLcs.AIcs.LGarXiv:2509.25149v22025SkillOS: Learning Skill Curation for Self-Evolving Agents
Siru Ouyang, Jun Yan, Yanfei Chen +13
cs.AIcs.CLarXiv:2605.06614v12026Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning
NVIDIA, :, Aakshita Chandiramani +544
cs.LGcs.AIcs.CLarXiv:2604.12374v12026PlanSightRAG: A Visual-First Multimodal RAG for Automating Question Answering and Compliance Checking for Civil Standard Plans
Nabaraj Subedi, Shuvo Dip Datta, Ahmed Abdelaty +1
cs.IRcs.CLcs.CVarXiv:2608.26091v12026DeepSearchQA: Bridging the Comprehensiveness Gap for Deep Research Agents
Nikita Gupta, Riju Chatterjee, Lukas Haas +9
cs.CLarXiv:2601.20975v12026PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding
Selim Kuzucu, Alessio Tonioni, Vasile Lup +3
cs.CVcs.AIcs.CLarXiv:2605.30126v12026STAR-1: Safer Alignment of Reasoning LLMs with 1K Data
Zijun Wang, Haoqin Tu, Yuhan Wang +6
cs.CLcs.AIarXiv:2504.01903v22025On Data Engineering for Scaling LLM Terminal Capabilities
Renjie Pi, Grace Lam, Mohammad Shoeybi +3
cs.CLarXiv:2602.21193v12026Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPO
Prakhar Gupta, Vaibhav Gupta
cs.CLcs.AIcs.LGarXiv:2609.00925v12026Layered LLM Defenses as an Ensemble: Access Tiers, Inference Cost, and the Measured Failure Correlation Between Defense Layers
Abrar Alotaibi, Muhammad Shahid Jabbar, Sadam Al-Azani +1
cs.CRcs.AIcs.CLarXiv:2608.28327v12026NeuroCogMap Reveals Cognitive Organization of Large Language Models
Zhongxiang Sun, Haolang Lu, Qiang Ma +11
q-bio.NCcs.AIcs.CLarXiv:2607.00397v12026Summaries:한국어Data Determines Distributional Robustness in Contrastive Language Image Pre-training (CLIP)
Alex Fang, Gabriel Ilharco, Mitchell Wortsman +4
cs.CVcs.CLcs.LGarXiv:2205.01397v22022Geometric-Mean Policy Optimization
Yuzhong Zhao, Yue Liu, Junpeng Liu +9
cs.CLarXiv:2507.20673v32025Uncertainty Quantification and Confidence Calibration in Large Language Models: A Survey
Xiaoou Liu, Tiejin Chen, Longchao Da +3
cs.CLarXiv:2503.15850v22025Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering
Gang Li, Jizhong Liu, Heinrich Dinkel +3
cs.SDcs.AIcs.CLarXiv:2503.11197v42025Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
Yixuan Even Xu, Yash Savani, Fei Fang +1
cs.LGcs.AIcs.CLarXiv:2504.13818v52025Modeling Sentiment Dependencies with Graph Convolutional Networks for Aspect-level Sentiment Classification
Pinlong Zhaoa, Linlin Houb, Ou Wua
cs.CLcs.LGarXiv:1906.04501v12019SWE-Fixer: Training Open-Source LLMs for Effective and Efficient GitHub Issue Resolution
Chengxing Xie, Bowen Li, Chang Gao +4
cs.CLarXiv:2501.05040v32025VDocRAG: Retrieval-Augmented Generation over Visually-Rich Documents
Ryota Tanaka, Taichi Iki, Taku Hasegawa +3
cs.CLcs.AIcs.CVarXiv:2504.09795v12025Better Summarization Evaluation with Word Embeddings for ROUGE
Jun-Ping Ng, Viktoria Abrecht
cs.CLcs.IRarXiv:1508.06034v12015Machine Comprehension by Text-to-Text Neural Question Generation
Xingdi Yuan, Tong Wang, Caglar Gulcehre +5
cs.CLarXiv:1705.02012v22017More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models
Chengzhi Liu, Zhongxing Xu, Qingyue Wei +5
cs.CLcs.AIcs.CVarXiv:2505.21523v32025WritingBench: A Comprehensive Benchmark for Generative Writing
Yuning Wu, Jiahao Mei, Ming Yan +8
cs.AIcs.CLarXiv:2503.05244v42025Lessons from the Trenches on Reproducible Evaluation of Language Models
Stella Biderman, Hailey Schoelkopf, Lintang Sutawika +27
cs.CLarXiv:2405.14782v32024Lingua Franca or Probing Artifact? Rethinking Latent Language in Multilingual LLMs
Deniz Bayazit, Badr AlKhamissi, Antoine Bosselut
cs.CLcs.AIcs.LGarXiv:2609.00155v12026mmBERT: A Modern Multilingual Encoder with Annealed Language Learning
Marc Marone, Orion Weller, William Fleshman +3
cs.CLcs.IRcs.LGarXiv:2509.06888v12025