Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
2,701 to 2,760 of 11,244
RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation
Leyi Pan, Shuchang Tao, Yunpeng Zhai +5
cs.LGcs.CLarXiv:2606.11709v12026OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles
Yihe Deng, Hritik Bansal, Fan Yin +3
cs.CVcs.CLarXiv:2503.17352v32025LSHTC: A Benchmark for Large-Scale Text Classification
Ioannis Partalas, Aris Kosmopoulos, Nicolas Baskiotis +6
cs.IRcs.CLcs.LGarXiv:1503.08581v12015Fine-grained Hallucination Detection and Editing for Language Models
Abhika Mishra, Akari Asai, Vidhisha Balachandran +4
cs.CLarXiv:2401.06855v42024Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling
Liliang Ren, Yang Liu, Yadong Lu +3
cs.CLcs.LGarXiv:2406.07522v32024RAIN: Your Language Models Can Align Themselves without Finetuning
Yuhui Li, Fangyun Wei, Jinjing Zhao +2
cs.CLarXiv:2309.07124v22023A User Simulator for Task-Completion Dialogues
Xiujun Li, Zachary C. Lipton, Bhuwan Dhingra +3
cs.LGcs.AIcs.CLarXiv:1612.05688v32016Demons in the Detail: On Implementing Load Balancing Loss for Training Specialized Mixture-of-Expert Models
Zihan Qiu, Zeyu Huang, Bo Zheng +7
cs.LGcs.CLarXiv:2501.11873v22025DeepStory: Video Story QA by Deep Embedded Memory Networks
Kyung-Min Kim, Min-Oh Heo, Seong-Ho Choi +1
cs.CVcs.AIcs.CLarXiv:1707.00836v12017Contextual Agent Security: A Policy for Every Purpose
Lillian Tsai, Eugene Bagdasarian
cs.CRcs.CLcs.LGarXiv:2501.17070v32025VideoRAG: Retrieval-Augmented Generation over Video Corpus
Soyeong Jeong, Kangsan Kim, Jinheon Baek +1
cs.CVcs.AIcs.CLarXiv:2501.05874v32025A Survey on Sparse Autoencoders: Interpreting the Internal Mechanisms of Large Language Models
Dong Shu, Xuansheng Wu, Haiyan Zhao +4
cs.LGcs.AIcs.CLarXiv:2503.05613v32025A Survey on Large Language Models for Mathematical Reasoning
Peng-Yuan Wang, Tian-Shuo Liu, Chenyang Wang +8
cs.AIcs.CLarXiv:2506.08446v12025Language Models Use Trigonometry to Do Addition
Subhash Kantamneni, Max Tegmark
cs.AIcs.CLcs.LGarXiv:2502.00873v12025Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities
Alexander Nikitin, Jannik Kossen, Yarin Gal +1
cs.LGcs.AIcs.CLarXiv:2405.20003v12024Neural Language Modeling by Jointly Learning Syntax and Lexicon
Yikang Shen, Zhouhan Lin, Chin-Wei Huang +1
cs.CLcs.AIarXiv:1711.02013v22017MinTL: Minimalist Transfer Learning for Task-Oriented Dialogue Systems
Zhaojiang Lin, Andrea Madotto, Genta Indra Winata +1
cs.CLcs.AIarXiv:2009.12005v22020Glancing Transformer for Non-Autoregressive Neural Machine Translation
Lihua Qian, Hao Zhou, Yu Bao +5
cs.CLarXiv:2008.07905v32020MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
Shrey Pandit, Jiawei Xu, Junyuan Hong +4
cs.CLcs.AIcs.LGarXiv:2502.14302v12025ChunkKV: Semantic-Preserving KV Cache Compression for Efficient Long-Context LLM Inference
Xiang Liu, Zhenheng Tang, Peijie Dong +5
cs.CLarXiv:2502.00299v52025R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO
Huanjin Yao, Qixiang Yin, Jingyi Zhang +8
cs.CVcs.AIcs.CLarXiv:2505.16673v12025Exploring Wav2vec 2.0 fine-tuning for improved speech emotion recognition
Li-Wei Chen, Alexander Rudnicky
eess.AScs.CLcs.LGarXiv:2110.06309v32021Docling: An Efficient Open-Source Toolkit for AI-driven Document Conversion
Nikolaos Livathinos, Christoph Auer, Maksym Lysak +14
cs.CLcs.CVcs.SEarXiv:2501.17887v12025BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval
Hongjin Su, Howard Yen, Mengzhou Xia +12
cs.CLcs.AIcs.IRarXiv:2407.12883v42024Toppling the Hierarchy in Byte-level Language Modeling
Lukas Edman, Alexander Fraser
cs.CLarXiv:2609.00463v12026From Tool Use to Technological Agency: LoopCAT as a Local-First, Open-Source Tool for Translation Technology Education
Gokhan Dogru, Adrià Martín Mor
cs.CLarXiv:2609.00344v12026Beyond Token Positions: Safety Alignment Across Denoising Steps in Diffusion Language Models
Guoli Wang, Haonan Shi, Tu Ouyang +1
cs.CLcs.AIarXiv:2609.00495v12026A Systematic Review of Key Retrieval-Augmented Generation (RAG) Systems: Progress, Gaps, and Future Directions
Agada Joseph Oche, Ademola Glory Folashade, Tirthankar Ghosal +1
cs.CLcs.LGarXiv:2507.18910v12025Concise Reasoning via Reinforcement Learning
Mehdi Fatemi, Banafsheh Rafiee, Mingjie Tang +1
cs.CLarXiv:2504.05185v32025Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict
Yihang Chen, Pin Qian, Su Wang +4
cs.CLcs.AIarXiv:2605.14473v42026Are Language Models Models?
Philip Resnik
cs.CLcs.AIarXiv:2601.10421v12026The Impact of Reasoning Step Length on Large Language Models
Mingyu Jin, Qinkai Yu, Dong Shu +5
cs.CLcs.AIarXiv:2401.04925v42024Parameter-Efficient Fine-Tuning for Foundation Models
Dan Zhang, Tao Feng, Lilong Xue +3
cs.CLcs.AIcs.LGarXiv:2501.13787v12025Reinforcing the Diffusion Chain of Lateral Thought with Diffusion Language Models
Zemin Huang, Zhiyang Chen, Zijun Wang +2
cs.CLarXiv:2505.10446v32025TIPS: Turn-Level Information-Potential Reward Shaping for Search-Augmented LLMs
Yutao Xie, Nathaniel Thomas, Nicklas Hansen +3
cs.CLcs.AIcs.LGarXiv:2603.22293v120261.4 Million Open-Source Distilled Reasoning Dataset to Empower Large Language Model Training
Han Zhao, Haotian Wang, Yiping Peng +5
cs.CLarXiv:2503.19633v12025Thinking with Generated Images
Ethan Chern, Zhulin Hu, Steffi Chern +5
cs.CVcs.AIcs.CLarXiv:2505.22525v12025Optimizing Large Language Model Training Using FP4 Quantization
Ruizhe Wang, Yeyun Gong, Xiao Liu +5
cs.LGcs.CLarXiv:2501.17116v22025Astra: A Multi-Agent System for GPU Kernel Performance Optimization
Anjiang Wei, Tianran Sun, Yogesh Seenichamy +5
cs.DCcs.AIcs.CLarXiv:2509.07506v22025Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization
Jiantong Jiang, Peiyu Yang, Rui Zhang +1
cs.LGcs.AIcs.CLarXiv:2607.08057v12026Nine Judges, Two Effective Votes: Correlated Errors Undermine LLM Evaluation Panels
Guneet Kohli
cs.CLarXiv:2605.29800v12026Removing RLHF Protections in GPT-4 via Fine-Tuning
Qiusi Zhan, Richard Fang, Rohan Bindu +3
cs.CLcs.AIarXiv:2311.05553v32023OCGQuant: Outlier-Companion Grouping for NVFP4 Quantization
Yishan Yao, Binjun Li, Hanling Yi +5
cs.CLcs.AIcs.LGarXiv:2609.00066v12026Doc-to-LoRA: Learning to Instantly Internalize Contexts
Rujikorn Charakorn, Edoardo Cetin, Shinnosuke Uesaka +1
cs.CLcs.AIarXiv:2602.15902v12026HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats
Rebecca Soskin Hicks, Mikhail Trofimov, Dominick Lim +13
cs.CLarXiv:2604.27470v12026LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
Zhibin Lan, Liqiang Niu, Fandong Meng +2
cs.CVcs.AIcs.CLarXiv:2503.04812v22025Getting pwn'd by AI: Penetration Testing with Large Language Models
Andreas Happe, Jürgen Cito
cs.CLcs.AIcs.CRarXiv:2308.00121v32023SRPO: Enhancing Multimodal LLM Reasoning via Reflection-Aware Reinforcement Learning
Zhongwei Wan, Zhihao Dou, Che Liu +11
cs.CLarXiv:2506.01713v32025ContextAgent: Context-Aware Proactive LLM Agents with Open-World Sensory Perceptions
Bufang Yang, Lilin Xu, Liekang Zeng +7
cs.AIcs.CLcs.HCarXiv:2505.14668v22025Confidence Is All You Need: Few-Shot RL Fine-Tuning of Language Models
Pengyi Li, Matvey Skripkin, Alexander Zubrey +2
cs.CLcs.LGarXiv:2506.06395v32025Mining User Opinions in Mobile App Reviews: A Keyword-based Approach
Phong Minh Vu, Tam The Nguyen, Hung Viet Pham +1
cs.IRcs.CLarXiv:1505.04657v22015SWE-Lego: Pushing the Limits of Supervised Fine-tuning for Software Issue Resolving
Chaofan Tao, Jierun Chen, Yuxin Jiang +11
cs.SEcs.CLarXiv:2601.01426v22026PyVision: Agentic Vision with Dynamic Tooling
Shitian Zhao, Haoquan Zhang, Shaoheng Lin +4
cs.CLcs.AIcs.CVarXiv:2507.07998v32025UserBench: An Interactive Gym Environment for User-Centric Agents
Cheng Qian, Zuxin Liu, Akshara Prabhakar +9
cs.AIcs.CLcs.LGarXiv:2507.22034v12025Are Reasoning Models More Prone to Hallucination?
Zijun Yao, Yantao Liu, Yanxu Chen +5
cs.CLcs.LGarXiv:2505.23646v12025Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks
Andy Zhou, Bo Li, Haohan Wang
cs.LGcs.AIcs.CLarXiv:2401.17263v52024AdaReTaKe: Adaptive Redundancy Reduction to Perceive Longer for Video-language Understanding
Xiao Wang, Qingyi Si, Jianlong Wu +3
cs.CVcs.CLcs.MMarXiv:2503.12559v22025Generative Pre-Training for Speech with Autoregressive Predictive Coding
Yu-An Chung, James Glass
eess.AScs.CLcs.LGarXiv:1910.12607v22019Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens
Chengshuai Zhao, Zhen Tan, Pingchuan Ma +5
cs.AIcs.CLcs.LGarXiv:2508.01191v62025Generative Judge for Evaluating Alignment
Junlong Li, Shichao Sun, Weizhe Yuan +3
cs.CLcs.AIarXiv:2310.05470v22023