Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
8,761 to 8,820 of 11,225
Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6
cs.AIcs.CLarXiv:2601.14691v22026Active Retrieval Augmented Generation
Zhengbao Jiang, Frank F. Xu, Luyu Gao +6
cs.CLcs.LGarXiv:2305.06983v22023AVMeme Exam: A Multimodal Multilingual Multicultural Benchmark for LLMs' Contextual and Cultural Knowledge and Thinking
Xilin Jiang, Qiaolin Wang, Junkai Wu +30
cs.SDcs.CLcs.CVarXiv:2601.17645v12026Deep Search with Hierarchical Meta-Cognitive Monitoring Inspired by Cognitive Neuroscience
Zhongxiang Sun, Qipeng Wang, Weijie Yu +3
cs.CLarXiv:2601.23188v12026A Comparative Study on Transformer vs RNN in Speech Applications
Shigeki Karita, Nanxin Chen, Tomoki Hayashi +10
cs.CLcs.SDeess.ASarXiv:1909.06317v22019Spanish Pre-trained BERT Model and Evaluation Data
José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3
cs.CLcs.AIcs.LGarXiv:2308.02976v12023SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?
Deyao Hong, Yizhe Chi, Wenyi Li +7
cs.CLcs.AIcs.SEarXiv:2608.23564v12026Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains
Miguel Contreras, Scott Siegel, Subhash Nerella +30
cs.CLcs.AIarXiv:2608.22622v12026RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind
Zhitao He, Zongwei Lyu, Yi R Fung
cs.CLcs.AIarXiv:2601.15715v32026Mecellem Models: Turkish Models Trained from Scratch and Continually Pre-trained for the Legal Domain
Özgür Uğur, Mahmut Göksu, Mahmut Çimen +6
cs.CLarXiv:2601.16018v12026Embodied Question Answering
Abhishek Das, Samyak Datta, Georgia Gkioxari +3
cs.CVcs.AIcs.CLarXiv:1711.11543v22017ASTRA: Automated Synthesis of agentic Trajectories and Reinforcement Arenas
Xiaoyu Tian, Haotian Wang, Shuaiting Chen +12
cs.CLarXiv:2601.21558v22026Fact or Fiction: Verifying Scientific Claims
David Wadden, Shanchuan Lin, Kyle Lo +4
cs.CLarXiv:2004.14974v62020Marian: Fast Neural Machine Translation in C++
Marcin Junczys-Dowmunt, Roman Grundkiewicz, Tomasz Dwojak +9
cs.CLarXiv:1804.00344v32018Designing and Interpreting Probes with Control Tasks
John Hewitt, Percy Liang
cs.CLarXiv:1909.03368v12019Beyond Correctness: Learning Robust Reasoning via Transfer
Hyunseok Lee, Soheil Abbasloo, Jihoon Tack +1
cs.LGcs.CLarXiv:2602.08489v12026Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
Shengrui Li, Fei Zhao, Kaiyan Zhao +6
cs.CLcs.AIarXiv:2602.00747v32026PolySAE: Modeling Feature Interactions in Sparse Autoencoders via Polynomial Decoding
Panagiotis Koromilas, Andreas D. Demou, James Oldfield +2
cs.LGcs.CLarXiv:2602.01322v22026Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation
Kwun Hang Lau, Fangyuan Zhang, Boyu Ruan +4
cs.CLcs.AIarXiv:2602.01965v12026Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
Ziru Chen, Dongdong Chen, Ruinan Jin +3
cs.LGcs.AIcs.CLarXiv:2602.03806v12026From Data to Behavior: Predicting Unintended Model Behaviors Before Training
Mengru Wang, Zhenqian Xu, Junfeng Fang +4
cs.LGcs.AIcs.CLarXiv:2602.04735v12026FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents
Chiwei Zhu, Benfeng Xu, Mingxuan Du +4
cs.CLarXiv:2602.01566v22026Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards
Kirill Pavlenko, Alexander Golubev, Simon Karasik +1
cs.LGcs.AIcs.CLarXiv:2602.10231v12026MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering
Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu
cs.CLcs.AIcs.LGarXiv:2203.14371v12022Towards Expert-Level Medical Question Answering with Large Language Models
Karan Singhal, Tao Tu, Juraj Gottweis +28
cs.CLcs.AIcs.LGarXiv:2305.09617v12023Proxy Compression for Language Modeling
Lin Zheng, Xinyu Li, Qian Liu +2
cs.CLcs.LGarXiv:2602.04289v22026Few-Step Diffusion Language Models via Trajectory Self-Distillation
Tunyu Zhang, Xinxi Zhang, Ligong Han +10
cs.CLcs.LGarXiv:2602.12262v42026Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review
Lixiang Yan, Lele Sha, Linxuan Zhao +6
cs.CLcs.AIcs.CYarXiv:2303.13379v22023ChatGPT and a New Academic Reality: Artificial Intelligence-Written Research Papers and the Ethics of the Large Language Models in Scholarly Publishing
Brady Lund, Ting Wang, Nishith Reddy Mannuru +3
cs.CLcs.CYarXiv:2303.13367v22023Effective Reasoning Chains Reduce Intrinsic Dimensionality
Archiki Prasad, Mandar Joshi, Kenton Lee +2
cs.CLcs.AIcs.LGarXiv:2602.09276v22026LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space
Jinghui Zhang, Lang Gao, Ao Li +5
cs.CLcs.AIarXiv:2608.23124v12026Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models
Lei Wang, Wanyu Xu, Yihuai Lan +4
cs.CLarXiv:2305.04091v32023MLS: A Large-Scale Multilingual Dataset for Speech Research
Vineel Pratap, Qiantong Xu, Anuroop Sriram +2
eess.AScs.CLcs.SDarXiv:2012.03411v22020Reinforced Attention Learning
Bangzheng Li, Jianmo Ni, Chen Qu +5
cs.CLcs.CVcs.LGarXiv:2602.04884v22026Prism: Spectral-Aware Block-Sparse Attention
Xinghao Wang, Pengyu Wang, Xiaoran Liu +4
cs.CLcs.AIcs.CVarXiv:2602.08426v22026Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory
Hao Zhou, Minlie Huang, Tianyang Zhang +2
cs.CLcs.AIarXiv:1704.01074v42017KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs
Jian Chen, Zhuoran Wang, Jiayu Qin +6
cs.CLarXiv:2602.05929v22026Uncertainty Drives Social Bias Changes in Quantized Large Language Models
Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen
cs.CLarXiv:2602.06181v12026C-Pack: Packed Resources For General Chinese Embeddings
Shitao Xiao, Zheng Liu, Peitian Zhang +3
cs.CLcs.AIcs.IRarXiv:2309.07597v52023PAL: Program-aided Language Models
Luyu Gao, Aman Madaan, Shuyan Zhou +5
cs.CLcs.AIarXiv:2211.10435v22022Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
Luoyang Sun, Jiwen Jiang, Yifeng Ding +9
cs.LGcs.CLarXiv:2602.10377v12026MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation
Taha Koleilat, Hojat Asgariandehkordi, Omid Nejati Manzari +3
cs.CVcs.CLarXiv:2602.20423v12026Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models
Xin Xu, Clive Bai, Kai Yang +7
cs.CLarXiv:2602.12036v22026Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders
Zhongzhi Li, Xuansheng Wu, Yijiang Li +2
cs.CLcs.AIarXiv:2602.10388v42026Weight Decay Improves Language Model Plasticity
Tessa Han, Sebastian Bordt, Hanlin Zhang +1
cs.LGcs.AIcs.CLarXiv:2602.11137v22026ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces
Xin Xu, Tong Yu, Xiang Chen +3
cs.AIcs.CLcs.LGarXiv:2602.11683v12026Robustness of IR Models to Collection Growth
Emmanouil Georgios Lionis, Debasis Ganguly, Sean MacAvaney
cs.IRcs.CLarXiv:2608.23419v12026SelFusion: Self-distillation for Diffusion Language Models
Hyeongsoo Lim, Jinyoung Kim, Eunseo Seo +2
cs.CLarXiv:2608.22898v12026Unsupervised Neural Machine Translation
Mikel Artetxe, Gorka Labaka, Eneko Agirre +1
cs.CLcs.AIcs.LGarXiv:1710.11041v22017MAEB: Massive Audio Embedding Benchmark
Adnan El Assadi, Isaac Chung, Chenghao Xiao +15
cs.SDcs.AIcs.CLarXiv:2602.16008v12026Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models
Yunfei Chu, Jin Xu, Xiaohuan Zhou +5
eess.AScs.CLcs.LGarXiv:2311.07919v22023Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance
Or Biton, Tomer Krichli, Itai Allouche +1
cs.AIcs.CLarXiv:2608.23264v12026Modeling Distinct Human Interaction in Web Agents
Faria Huq, Zora Zhiruo Wang, Zhanqiu Guo +6
cs.CLcs.HCarXiv:2602.17588v42026Sink-Aware Pruning for Diffusion Language Models
Aidar Myrzakhan, Tianyi Li, Bowei Guo +2
cs.CLcs.AIcs.LGarXiv:2602.17664v12026Less is More: ClipBERT for Video-and-Language Learning via Sparse Sampling
Jie Lei, Linjie Li, Luowei Zhou +4
cs.CVcs.CLarXiv:2102.06183v12021Synthetic and Natural Noise Both Break Neural Machine Translation
Yonatan Belinkov, Yonatan Bisk
cs.CLcs.LGarXiv:1711.02173v22017ExpeL: LLM Agents Are Experiential Learners
Andrew Zhao, Daniel Huang, Quentin Xu +3
cs.LGcs.AIcs.CLarXiv:2308.10144v32023On the "Induction Bias" in Sequence Models
M. Reza Ebrahimi, Michaël Defferrard, Sunny Panchal +1
cs.LGcs.CLarXiv:2602.18333v22026Transition-Based Dependency Parsing with Stack Long Short-Term Memory
Chris Dyer, Miguel Ballesteros, Wang Ling +2
cs.CLcs.LGcs.NEarXiv:1505.08075v12015Nacrith: Neural Lossless Compression via Ensemble Context Modeling and High-Precision CDF Coding
Roberto Tacconelli
cs.ITcs.CLarXiv:2602.19626v22026