Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,181 to 3,240 of 11,199

  1. LLMs for Explainable AI: A Comprehensive Survey

    Ahsan Bilal, David Ebert, Beiyu Lin

    cs.AIcs.CLarXiv:2504.00125v12025
  2. Ranked by the Matcher: A Reproducibility Audit of Knowledge Graph Extraction from Threat Reports

    Safayat Bin Hakim, Houbing Herbert Song

    cs.CRcs.AIcs.CLarXiv:2609.01671v12026
  3. LLM Post-Training: A Deep Dive into Reasoning Large Language Models

    Komal Kumar, Tajamul Ashraf, Omkar Thawakar +7

    cs.CLcs.CVarXiv:2502.21321v22025
  4. WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents

    Zile Qiao, Guoxin Chen, Xuanzhong Chen +13

    cs.CLarXiv:2509.13309v22025
  5. StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization

    Ziliang Wang, Xuhui Zheng, Kang An +4

    cs.CLcs.AIcs.IRarXiv:2505.15107v22025
  6. MuQ: Self-Supervised Music Representation Learning with Mel Residual Vector Quantization

    Haina Zhu, Yizhi Zhou, Hangting Chen +6

    cs.SDcs.AIcs.CLarXiv:2501.01108v22025
  7. Exploring the Impact of Temperature on Large Language Models:Hot or Cold?

    Lujun Li, Lama Sleem, Niccolo' Gentile +2

    cs.CLarXiv:2506.07295v12025
  8. Investigating Assistant Bias in LLM User Simulators Using a Role Vector

    Daeheon Jeong, Yoonjoo Lee, Eugene Choi +2

    cs.CLcs.HCarXiv:2609.00608v12026
  9. Retrieval-Augmented Generation with Conflicting Evidence

    Han Wang, Archiki Prasad, Elias Stengel-Eskin +1

    cs.CLcs.AIarXiv:2504.13079v22025
  10. Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models

    Yunxin Li, Zhenyu Liu, Zitao Li +19

    cs.CVcs.CLarXiv:2505.04921v22025
  11. Overview of the TREC 2022 deep learning track

    Nick Craswell, Bhaskar Mitra, Emine Yilmaz +4

    cs.IRcs.AIcs.CLarXiv:2507.10865v12025
  12. Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination

    Mingqi Wu, Zhihao Zhang, Qiaole Dong +11

    cs.LGcs.AIcs.CLarXiv:2507.10532v32025
  13. On Memory Construction and Retrieval for Personalized Conversational Agents

    Zhuoshi Pan, Qianhui Wu, Huiqiang Jiang +8

    cs.CLcs.AIarXiv:2502.05589v32025
  14. Closing Cost-Quality Gap in Document VLMs: Difficulty-Aware Data Curation and Quality-Adjusted Deployment Economics

    Maksim Evdokimov, Matvey Ivanov, Dmitrii Tsiupin +3

    cs.CLarXiv:2609.01575v12026
  15. Real or Fake? Learning to Discriminate Machine from Human Generated Text

    Anton Bakhtin, Sam Gross, Myle Ott +3

    cs.LGcs.CLstat.MLarXiv:1906.03351v22019
  16. From Rollouts to Recipes: Self-Contained Post-Training for LLMs

    Yifei Li, Lingling Zhang, Muye Huang +3

    cs.CLarXiv:2609.01422v12026
  17. ClinTraceBench: Source-Verifiable Longitudinal Clinical Reasoning over EHR-Derived Dialogues

    Huimin Wang, Zhengyi Zhao, Yutian Zhao

    cs.CLarXiv:2609.01111v12026
  18. LLM-Grounder: Open-Vocabulary 3D Visual Grounding with Large Language Model as an Agent

    Jianing Yang, Xuweiyi Chen, Shengyi Qian +4

    cs.CVcs.AIcs.CLarXiv:2309.12311v12023
  19. StarCoder: may the source be with you!

    Raymond Li, Loubna Ben Allal, Yangtian Zi +64

    cs.CLcs.AIcs.PLarXiv:2305.06161v22023
  20. TacoMAS: Test-Time Co-Evolution of Topology and Capability in LLM-based Multi-Agent Systems

    Chen Xu, Yicheng Hu, Ruizi Wang +4

    cs.CLarXiv:2605.09539v12026
  21. Modality Fault Lines: Structural Corruptions Reveal Fragile Omni-Modal Reasoning

    Zhaolu Kang, Meixin Wu, Yu Xue +6

    cs.CLarXiv:2608.29278v12026
  22. Temporal Leakage in Financial News NLP: A Multi-Architecture Audit with a Regime-Specific M&A Signal

    Chenhao Xue, Raslen Guesmi, Siwei Feng +5

    cs.CLcs.LGarXiv:2608.17223v12026
  23. PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs

    Soroush Nasiriany, Fei Xia, Wenhao Yu +20

    cs.ROcs.CLcs.CVarXiv:2402.07872v12024
  24. Recursive Multi-Agent Systems

    Jiaru Zou, Rui Pan, Ruizhong Qiu +8

    cs.AIcs.CLcs.LGarXiv:2604.25917v22026
    Summaries:한국어
  25. Building Production-Ready Probes For Gemini

    János Kramár, Joshua Engels, Zheng Wang +4

    cs.LGcs.AIcs.CLarXiv:2601.11516v42026
  26. EnvHarness: Awakening Static Worlds for Agent Learning

    Chengsong Huang, Zifeng Wang, Rujun Han +14

    cs.AIcs.CLcs.LGarXiv:2608.19880v12026
    Summaries:简体中文
  27. Think Again or Think Longer? Selective Verification for Budget-Aware Reasoning

    Sajib Acharjee Dip, Dawei Zhou, Liqing Zhang

    cs.AIcs.CLarXiv:2606.19808v12026
  28. ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence

    Rui Meng, Bhavana Dalvi Mishra, Jiefeng Chen +10

    cs.AIcs.CLcs.MAarXiv:2605.26340v12026
  29. No Hidden Prompts Needed! You Can Game AI Peer Review with Presentation-Only Revisions

    Xu Yang, Zhizhou Sha, Junbo Li +10

    cs.CLarXiv:2606.13044v12026
  30. Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation

    Xingyu Su, Jacob Helwig, Shubham Parashar +6

    cs.CLcs.AIarXiv:2606.06712v12026
  31. CLIPO: Contrastive Learning in Policy Optimization Generalizes RLVR

    Sijia Cui, Pengyu Cheng, Jiajun Song +6

    cs.LGcs.AIcs.CLarXiv:2603.10101v12026
  32. NatureBench: Can Coding Agents Match the Published SOTA of Nature-Family Papers?

    Yuru Wang, Lejun Cheng, Yuxin Zuo +14

    cs.CLarXiv:2606.24530v22026
  33. Memory Decoder at Scale: A Pretrained, Parametric Long-Term Memory

    Rubin Wei, Jiaqi Cao, Jiarui Wang +4

    cs.CLarXiv:2607.27919v12026
  34. Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills

    Jianlyu Chen, Yuyang Hu, Hongjin Qian +8

    cs.AIcs.CLarXiv:2609.02749v12026
  35. Pretraining Large Language Models with NVFP4

    NVIDIA, Felix Abecassis, Anjulie Agrusa +87

    cs.CLcs.AIcs.LGarXiv:2509.25149v22025
  36. SkillOS: Learning Skill Curation for Self-Evolving Agents

    Siru Ouyang, Jun Yan, Yanfei Chen +13

    cs.AIcs.CLarXiv:2605.06614v12026
  37. Nemotron 3 Super: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

    NVIDIA, :, Aakshita Chandiramani +544

    cs.LGcs.AIcs.CLarXiv:2604.12374v12026
  38. PlanSightRAG: A Visual-First Multimodal RAG for Automating Question Answering and Compliance Checking for Civil Standard Plans

    Nabaraj Subedi, Shuvo Dip Datta, Ahmed Abdelaty +1

    cs.IRcs.CLcs.CVarXiv:2608.26091v12026
  39. DeepSearchQA: Bridging the Comprehensiveness Gap for Deep Research Agents

    Nikita Gupta, Riju Chatterjee, Lukas Haas +9

    cs.CLarXiv:2601.20975v12026
  40. PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding

    Selim Kuzucu, Alessio Tonioni, Vasile Lup +3

    cs.CVcs.AIcs.CLarXiv:2605.30126v12026
  41. STAR-1: Safer Alignment of Reasoning LLMs with 1K Data

    Zijun Wang, Haoqin Tu, Yuhan Wang +6

    cs.CLcs.AIarXiv:2504.01903v22025
  42. On Data Engineering for Scaling LLM Terminal Capabilities

    Renjie Pi, Grace Lam, Mohammad Shoeybi +3

    cs.CLarXiv:2602.21193v12026
  43. Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPO

    Prakhar Gupta, Vaibhav Gupta

    cs.CLcs.AIcs.LGarXiv:2609.00925v12026
  44. Layered LLM Defenses as an Ensemble: Access Tiers, Inference Cost, and the Measured Failure Correlation Between Defense Layers

    Abrar Alotaibi, Muhammad Shahid Jabbar, Sadam Al-Azani +1

    cs.CRcs.AIcs.CLarXiv:2608.28327v12026
  45. NeuroCogMap Reveals Cognitive Organization of Large Language Models

    Zhongxiang Sun, Haolang Lu, Qiang Ma +11

    q-bio.NCcs.AIcs.CLarXiv:2607.00397v12026
    Summaries:한국어
  46. Data Determines Distributional Robustness in Contrastive Language Image Pre-training (CLIP)

    Alex Fang, Gabriel Ilharco, Mitchell Wortsman +4

    cs.CVcs.CLcs.LGarXiv:2205.01397v22022
  47. Geometric-Mean Policy Optimization

    Yuzhong Zhao, Yue Liu, Junpeng Liu +9

    cs.CLarXiv:2507.20673v32025
  48. Uncertainty Quantification and Confidence Calibration in Large Language Models: A Survey

    Xiaoou Liu, Tiejin Chen, Longchao Da +3

    cs.CLarXiv:2503.15850v22025
  49. Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering

    Gang Li, Jizhong Liu, Heinrich Dinkel +3

    cs.SDcs.AIcs.CLarXiv:2503.11197v42025
  50. Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning

    Yixuan Even Xu, Yash Savani, Fei Fang +1

    cs.LGcs.AIcs.CLarXiv:2504.13818v52025
  51. Modeling Sentiment Dependencies with Graph Convolutional Networks for Aspect-level Sentiment Classification

    Pinlong Zhaoa, Linlin Houb, Ou Wua

    cs.CLcs.LGarXiv:1906.04501v12019
  52. SWE-Fixer: Training Open-Source LLMs for Effective and Efficient GitHub Issue Resolution

    Chengxing Xie, Bowen Li, Chang Gao +4

    cs.CLarXiv:2501.05040v32025
  53. VDocRAG: Retrieval-Augmented Generation over Visually-Rich Documents

    Ryota Tanaka, Taichi Iki, Taku Hasegawa +3

    cs.CLcs.AIcs.CVarXiv:2504.09795v12025
  54. Better Summarization Evaluation with Word Embeddings for ROUGE

    Jun-Ping Ng, Viktoria Abrecht

    cs.CLcs.IRarXiv:1508.06034v12015
  55. Machine Comprehension by Text-to-Text Neural Question Generation

    Xingdi Yuan, Tong Wang, Caglar Gulcehre +5

    cs.CLarXiv:1705.02012v22017
  56. More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models

    Chengzhi Liu, Zhongxing Xu, Qingyue Wei +5

    cs.CLcs.AIcs.CVarXiv:2505.21523v32025
  57. WritingBench: A Comprehensive Benchmark for Generative Writing

    Yuning Wu, Jiahao Mei, Ming Yan +8

    cs.AIcs.CLarXiv:2503.05244v42025
  58. Lessons from the Trenches on Reproducible Evaluation of Language Models

    Stella Biderman, Hailey Schoelkopf, Lintang Sutawika +27

    cs.CLarXiv:2405.14782v32024
  59. Lingua Franca or Probing Artifact? Rethinking Latent Language in Multilingual LLMs

    Deniz Bayazit, Badr AlKhamissi, Antoine Bosselut

    cs.CLcs.AIcs.LGarXiv:2609.00155v12026
  60. mmBERT: A Modern Multilingual Encoder with Annealed Language Learning

    Marc Marone, Orion Weller, William Fleshman +3

    cs.CLcs.IRcs.LGarXiv:2509.06888v12025