Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,701 to 2,760 of 11,244

  1. RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation

    Leyi Pan, Shuchang Tao, Yunpeng Zhai +5

    cs.LGcs.CLarXiv:2606.11709v12026
  2. OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles

    Yihe Deng, Hritik Bansal, Fan Yin +3

    cs.CVcs.CLarXiv:2503.17352v32025
  3. LSHTC: A Benchmark for Large-Scale Text Classification

    Ioannis Partalas, Aris Kosmopoulos, Nicolas Baskiotis +6

    cs.IRcs.CLcs.LGarXiv:1503.08581v12015
  4. Fine-grained Hallucination Detection and Editing for Language Models

    Abhika Mishra, Akari Asai, Vidhisha Balachandran +4

    cs.CLarXiv:2401.06855v42024
  5. Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling

    Liliang Ren, Yang Liu, Yadong Lu +3

    cs.CLcs.LGarXiv:2406.07522v32024
  6. RAIN: Your Language Models Can Align Themselves without Finetuning

    Yuhui Li, Fangyun Wei, Jinjing Zhao +2

    cs.CLarXiv:2309.07124v22023
  7. A User Simulator for Task-Completion Dialogues

    Xiujun Li, Zachary C. Lipton, Bhuwan Dhingra +3

    cs.LGcs.AIcs.CLarXiv:1612.05688v32016
  8. Demons in the Detail: On Implementing Load Balancing Loss for Training Specialized Mixture-of-Expert Models

    Zihan Qiu, Zeyu Huang, Bo Zheng +7

    cs.LGcs.CLarXiv:2501.11873v22025
  9. DeepStory: Video Story QA by Deep Embedded Memory Networks

    Kyung-Min Kim, Min-Oh Heo, Seong-Ho Choi +1

    cs.CVcs.AIcs.CLarXiv:1707.00836v12017
  10. Contextual Agent Security: A Policy for Every Purpose

    Lillian Tsai, Eugene Bagdasarian

    cs.CRcs.CLcs.LGarXiv:2501.17070v32025
  11. VideoRAG: Retrieval-Augmented Generation over Video Corpus

    Soyeong Jeong, Kangsan Kim, Jinheon Baek +1

    cs.CVcs.AIcs.CLarXiv:2501.05874v32025
  12. A Survey on Sparse Autoencoders: Interpreting the Internal Mechanisms of Large Language Models

    Dong Shu, Xuansheng Wu, Haiyan Zhao +4

    cs.LGcs.AIcs.CLarXiv:2503.05613v32025
  13. A Survey on Large Language Models for Mathematical Reasoning

    Peng-Yuan Wang, Tian-Shuo Liu, Chenyang Wang +8

    cs.AIcs.CLarXiv:2506.08446v12025
  14. Language Models Use Trigonometry to Do Addition

    Subhash Kantamneni, Max Tegmark

    cs.AIcs.CLcs.LGarXiv:2502.00873v12025
  15. Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities

    Alexander Nikitin, Jannik Kossen, Yarin Gal +1

    cs.LGcs.AIcs.CLarXiv:2405.20003v12024
  16. Neural Language Modeling by Jointly Learning Syntax and Lexicon

    Yikang Shen, Zhouhan Lin, Chin-Wei Huang +1

    cs.CLcs.AIarXiv:1711.02013v22017
  17. MinTL: Minimalist Transfer Learning for Task-Oriented Dialogue Systems

    Zhaojiang Lin, Andrea Madotto, Genta Indra Winata +1

    cs.CLcs.AIarXiv:2009.12005v22020
  18. Glancing Transformer for Non-Autoregressive Neural Machine Translation

    Lihua Qian, Hao Zhou, Yu Bao +5

    cs.CLarXiv:2008.07905v32020
  19. MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models

    Shrey Pandit, Jiawei Xu, Junyuan Hong +4

    cs.CLcs.AIcs.LGarXiv:2502.14302v12025
  20. ChunkKV: Semantic-Preserving KV Cache Compression for Efficient Long-Context LLM Inference

    Xiang Liu, Zhenheng Tang, Peijie Dong +5

    cs.CLarXiv:2502.00299v52025
  21. R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO

    Huanjin Yao, Qixiang Yin, Jingyi Zhang +8

    cs.CVcs.AIcs.CLarXiv:2505.16673v12025
  22. Exploring Wav2vec 2.0 fine-tuning for improved speech emotion recognition

    Li-Wei Chen, Alexander Rudnicky

    eess.AScs.CLcs.LGarXiv:2110.06309v32021
  23. Docling: An Efficient Open-Source Toolkit for AI-driven Document Conversion

    Nikolaos Livathinos, Christoph Auer, Maksym Lysak +14

    cs.CLcs.CVcs.SEarXiv:2501.17887v12025
  24. BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval

    Hongjin Su, Howard Yen, Mengzhou Xia +12

    cs.CLcs.AIcs.IRarXiv:2407.12883v42024
  25. Toppling the Hierarchy in Byte-level Language Modeling

    Lukas Edman, Alexander Fraser

    cs.CLarXiv:2609.00463v12026
  26. From Tool Use to Technological Agency: LoopCAT as a Local-First, Open-Source Tool for Translation Technology Education

    Gokhan Dogru, Adrià Martín Mor

    cs.CLarXiv:2609.00344v12026
  27. Beyond Token Positions: Safety Alignment Across Denoising Steps in Diffusion Language Models

    Guoli Wang, Haonan Shi, Tu Ouyang +1

    cs.CLcs.AIarXiv:2609.00495v12026
  28. A Systematic Review of Key Retrieval-Augmented Generation (RAG) Systems: Progress, Gaps, and Future Directions

    Agada Joseph Oche, Ademola Glory Folashade, Tirthankar Ghosal +1

    cs.CLcs.LGarXiv:2507.18910v12025
  29. Concise Reasoning via Reinforcement Learning

    Mehdi Fatemi, Banafsheh Rafiee, Mingjie Tang +1

    cs.CLarXiv:2504.05185v32025
  30. Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict

    Yihang Chen, Pin Qian, Su Wang +4

    cs.CLcs.AIarXiv:2605.14473v42026
  31. Are Language Models Models?

    Philip Resnik

    cs.CLcs.AIarXiv:2601.10421v12026
  32. The Impact of Reasoning Step Length on Large Language Models

    Mingyu Jin, Qinkai Yu, Dong Shu +5

    cs.CLcs.AIarXiv:2401.04925v42024
  33. Parameter-Efficient Fine-Tuning for Foundation Models

    Dan Zhang, Tao Feng, Lilong Xue +3

    cs.CLcs.AIcs.LGarXiv:2501.13787v12025
  34. Reinforcing the Diffusion Chain of Lateral Thought with Diffusion Language Models

    Zemin Huang, Zhiyang Chen, Zijun Wang +2

    cs.CLarXiv:2505.10446v32025
  35. TIPS: Turn-Level Information-Potential Reward Shaping for Search-Augmented LLMs

    Yutao Xie, Nathaniel Thomas, Nicklas Hansen +3

    cs.CLcs.AIcs.LGarXiv:2603.22293v12026
  36. 1.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training

    Han Zhao, Haotian Wang, Yiping Peng +5

    cs.CLarXiv:2503.19633v12025
  37. Thinking with Generated Images

    Ethan Chern, Zhulin Hu, Steffi Chern +5

    cs.CVcs.AIcs.CLarXiv:2505.22525v12025
  38. Optimizing Large Language Model Training Using FP4 Quantization

    Ruizhe Wang, Yeyun Gong, Xiao Liu +5

    cs.LGcs.CLarXiv:2501.17116v22025
  39. Astra: A Multi-Agent System for GPU Kernel Performance Optimization

    Anjiang Wei, Tianran Sun, Yogesh Seenichamy +5

    cs.DCcs.AIcs.CLarXiv:2509.07506v22025
  40. Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization

    Jiantong Jiang, Peiyu Yang, Rui Zhang +1

    cs.LGcs.AIcs.CLarXiv:2607.08057v12026
  41. Nine Judges, Two Effective Votes: Correlated Errors Undermine LLM Evaluation Panels

    Guneet Kohli

    cs.CLarXiv:2605.29800v12026
  42. Removing RLHF Protections in GPT-4 via Fine-Tuning

    Qiusi Zhan, Richard Fang, Rohan Bindu +3

    cs.CLcs.AIarXiv:2311.05553v32023
  43. OCGQuant: Outlier-Companion Grouping for NVFP4 Quantization

    Yishan Yao, Binjun Li, Hanling Yi +5

    cs.CLcs.AIcs.LGarXiv:2609.00066v12026
  44. Doc-to-LoRA: Learning to Instantly Internalize Contexts

    Rujikorn Charakorn, Edoardo Cetin, Shinnosuke Uesaka +1

    cs.CLcs.AIarXiv:2602.15902v12026
  45. HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats

    Rebecca Soskin Hicks, Mikhail Trofimov, Dominick Lim +13

    cs.CLarXiv:2604.27470v12026
  46. LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning

    Zhibin Lan, Liqiang Niu, Fandong Meng +2

    cs.CVcs.AIcs.CLarXiv:2503.04812v22025
  47. Getting pwn'd by AI: Penetration Testing with Large Language Models

    Andreas Happe, Jürgen Cito

    cs.CLcs.AIcs.CRarXiv:2308.00121v32023
  48. SRPO: Enhancing Multimodal LLM Reasoning via Reflection-Aware Reinforcement Learning

    Zhongwei Wan, Zhihao Dou, Che Liu +11

    cs.CLarXiv:2506.01713v32025
  49. ContextAgent: Context-Aware Proactive LLM Agents with Open-World Sensory Perceptions

    Bufang Yang, Lilin Xu, Liekang Zeng +7

    cs.AIcs.CLcs.HCarXiv:2505.14668v22025
  50. Confidence Is All You Need: Few-Shot RL Fine-Tuning of Language Models

    Pengyi Li, Matvey Skripkin, Alexander Zubrey +2

    cs.CLcs.LGarXiv:2506.06395v32025
  51. Mining User Opinions in Mobile App Reviews: A Keyword-based Approach

    Phong Minh Vu, Tam The Nguyen, Hung Viet Pham +1

    cs.IRcs.CLarXiv:1505.04657v22015
  52. SWE-Lego: Pushing the Limits of Supervised Fine-tuning for Software Issue Resolving

    Chaofan Tao, Jierun Chen, Yuxin Jiang +11

    cs.SEcs.CLarXiv:2601.01426v22026
  53. PyVision: Agentic Vision with Dynamic Tooling

    Shitian Zhao, Haoquan Zhang, Shaoheng Lin +4

    cs.CLcs.AIcs.CVarXiv:2507.07998v32025
  54. UserBench: An Interactive Gym Environment for User-Centric Agents

    Cheng Qian, Zuxin Liu, Akshara Prabhakar +9

    cs.AIcs.CLcs.LGarXiv:2507.22034v12025
  55. Are Reasoning Models More Prone to Hallucination?

    Zijun Yao, Yantao Liu, Yanxu Chen +5

    cs.CLcs.LGarXiv:2505.23646v12025
  56. Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks

    Andy Zhou, Bo Li, Haohan Wang

    cs.LGcs.AIcs.CLarXiv:2401.17263v52024
  57. AdaReTaKe: Adaptive Redundancy Reduction to Perceive Longer for Video-language Understanding

    Xiao Wang, Qingyi Si, Jianlong Wu +3

    cs.CVcs.CLcs.MMarXiv:2503.12559v22025
  58. Generative Pre-Training for Speech with Autoregressive Predictive Coding

    Yu-An Chung, James Glass

    eess.AScs.CLcs.LGarXiv:1910.12607v22019
  59. Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens

    Chengshuai Zhao, Zhen Tan, Pingchuan Ma +5

    cs.AIcs.CLcs.LGarXiv:2508.01191v62025
  60. Generative Judge for Evaluating Alignment

    Junlong Li, Shichao Sun, Weizhe Yuan +3

    cs.CLcs.AIarXiv:2310.05470v22023