Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
2,401 to 2,460 of 11,259
AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks
Yifan Zeng, Yiran Wu, Xiao Zhang +2
cs.LGcs.CLcs.CRarXiv:2403.04783v22024No Free Labels: Limitations of LLM-as-a-Judge Without Human Grounding
Michael Krumdick, Charles Lovering, Varshini Reddy +2
cs.CLarXiv:2503.05061v32025Improved Relation Extraction with Feature-Rich Compositional Embedding Models
Matthew R. Gormley, Mo Yu, Mark Dredze
cs.CLcs.AIcs.LGarXiv:1505.02419v32015Which of These Best Describes Multiple Choice Evaluation with LLMs? A) Forced B) Flawed C) Fixable D) All of the Above
Nishant Balepur, Rachel Rudinger, Jordan Lee Boyd-Graber
cs.CLarXiv:2502.14127v22025We're Afraid Language Models Aren't Modeling Ambiguity
Alisa Liu, Zhaofeng Wu, Julian Michael +6
cs.CLarXiv:2304.14399v22023REST: Retrieval-Based Speculative Decoding
Zhenyu He, Zexuan Zhong, Tianle Cai +2
cs.CLcs.AIcs.IRarXiv:2311.08252v22023Evaluating the Diversity and Quality of LLM Generated Content
Alexander Shypula, Shuo Li, Botong Zhang +3
cs.CLcs.AIarXiv:2504.12522v22025NeuReasoner: Towards Explainable, Controllable, and Unified Reasoning via Mixture-of-Neurons
Haonan Dong, Kehan Jiang, Haoran Ye +3
cs.CLarXiv:2604.02972v12026A Coin Flip for Safety: LLM Judges Fail to Reliably Measure Adversarial Robustness
Leo Schwinn, Moritz Ladenburger, Tim Beyer +3
cs.CLcs.AIarXiv:2603.06594v22026Peer-Preservation in Frontier Models
Yujin Potter, Nicholas Crispino, Vincent Siu +2
cs.CLcs.AIcs.MAarXiv:2604.19784v32026Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models
Jinghan Cao, Yu Ma, Xinjin Li +2
cs.CLcs.LGarXiv:2603.21389v12026Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models
Feng Luo, Yu-Neng Chuang, Guanchu Wang +4
cs.CLcs.LGarXiv:2604.08527v12026Ankh: Optimized Protein Language Model Unlocks General-Purpose Modelling
Ahmed Elnaggar, Hazem Essam, Wafaa Salah-Eldin +4
cs.LGcs.CLcs.DCarXiv:2301.06568v12023ASSERT: Anti-Spoofing with Squeeze-Excitation and Residual neTworks
Cheng-I Lai, Nanxin Chen, Jesús Villalba +1
cs.CLcs.LGcs.SDarXiv:1904.01120v12019Token Optimization and Context Window Management in Multi-Agent AI Workflows
Dvir Shamay
cs.CLcs.AIarXiv:2608.17188v12026Arabic Offensive Language on Twitter: Analysis and Experiments
Hamdy Mubarak, Ammar Rashed, Kareem Darwish +2
cs.CLarXiv:2004.02192v32020Zoology: Measuring and Improving Recall in Efficient Language Models
Simran Arora, Sabri Eyuboglu, Aman Timalsina +5
cs.CLcs.LGarXiv:2312.04927v12023Neural Linguistic Steganography
Zachary M. Ziegler, Yuntian Deng, Alexander M. Rush
cs.CLcs.CRcs.LGarXiv:1909.01496v12019Scalable Zero-shot Entity Linking with Dense Entity Retrieval
Ledell Wu, Fabio Petroni, Martin Josifoski +2
cs.CLarXiv:1911.03814v32019Sequential Latent Knowledge Selection for Knowledge-Grounded Dialogue
Byeongchang Kim, Jaewoo Ahn, Gunhee Kim
cs.CLarXiv:2002.07510v22020TrumorGPT: Graph-Based Retrieval-Augmented Large Language Model for Fact-Checking
Ching Nam Hang, Pei-Duo Yu, Chee Wei Tan
cs.CLcs.AIarXiv:2505.07891v22025Decoding ChatGPT: A Taxonomy of Existing Research, Current Challenges, and Possible Future Directions
Shahab Saquib Sohail, Faiza Farhat, Yassine Himeur +5
cs.CLcs.CYarXiv:2307.14107v22023EffiSkill: Agent Skill Based Automated Code Efficiency Optimization
Zimu Wang, Yuling Shi, Mengfan Li +4
cs.SEcs.CLarXiv:2603.27850v12026InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
Ziyun Zhang, Zezhou Wang, Xiaoyi Zhang +4
cs.CLcs.AIcs.CVarXiv:2601.04126v32026Reason Only When Needed: Efficient Generative Reward Modeling via Model-Internal Uncertainty
Chao Xue, Yao Wang, Mengqiao Liu +11
cs.CLarXiv:2604.10072v42026Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
Hieu Trung Nguyen, Bao Nguyen, Wenao Ma +3
cs.LGcs.AIcs.CLarXiv:2602.01601v32026Natural Language Processing for Smart Healthcare
Binggui Zhou, Guanghua Yang, Zheng Shi +1
cs.CLcs.AIarXiv:2110.15803v32021Counting on Consensus: Selecting the Right Inter-annotator Agreement Metric for NLP Annotation and Evaluation
Joseph James
cs.CLarXiv:2603.06865v22026Knowing What Not to Answer: Selective Non-Compliance in Vision-Language Models
Minji Kim, Jihyoung Jang, Hyounghun Kim
cs.CLcs.AIarXiv:2609.04720v12026A Survey on Contextual Embeddings
Qi Liu, Matt J. Kusner, Phil Blunsom
cs.CLcs.AIcs.LGarXiv:2003.07278v22020How LLMs Distort Our Written Language
Marwa Abdulhai, Isadora White, Yanming Wan +4
cs.CLcs.AIarXiv:2603.18161v22026A Systematic Survey of Text Summarization: From Statistical Methods to Large Language Models
Haopeng Zhang, Philip S. Yu, Jiawei Zhang
cs.CLarXiv:2406.11289v12024EvolveRouter: Co-Evolving Routing and Prompt for Multi-Agent Question Answering
Jiatan Huang, Zheyuan Zhang, Kaiwen Shi +2
cs.CLarXiv:2604.05149v12026EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
Zhili Cheng, Yuge Tu, Ran Li +9
cs.CVcs.CLarXiv:2501.11858v22025Conformal Language Modeling
Victor Quach, Adam Fisch, Tal Schuster +4
cs.CLcs.LGarXiv:2306.10193v22023ValueGraph: Value-Signal Guided Graph Pre-training for Contextualized User Representation
Yitong Han, Wei Gao, Yi Zhao +3
cs.CLcs.AIcs.LGarXiv:2609.00057v12026SkillSafetyBench: Evaluating Agent Safety under Skill-Facing Attack Surfaces
Chang Jin, An Wang, Zeming Wei +7
cs.CRcs.AIcs.CLarXiv:2605.12015v32026Do Multimodal LLMs See Before They Read? Diagnosing Contextual Sycophancy
Yi-Cheng Lai, Hen-Hsen Huang
cs.CLcs.AIarXiv:2609.00067v12026Medical Causal Hypothesis Verification with Large Language Models
Safiyyah Ahmed, Abrar Ansari, Md Aminul Islam +1
cs.CLcs.AIarXiv:2609.00063v12026How do LLMs Compute Verbal Confidence
Dharshan Kumaran, Arthur Conmy, Federico Barbero +3
cs.CLcs.AIcs.LGarXiv:2603.17839v32026TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
Kai Li, Xuanqing Yu, Ziyi Ni +9
cs.CLcs.AIarXiv:2601.02845v22026Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS
Shijia Xu, Zhou Wu, Xiaolong Jia +3
cs.CLarXiv:2604.10734v12026Deep convolutional acoustic word embeddings using word-pair side information
Herman Kamper, Weiran Wang, Karen Livescu
cs.CLarXiv:1510.01032v22015SWE-bench Goes Live!
Linghao Zhang, Shilin He, Chaoyun Zhang +12
cs.SEcs.AIcs.CLarXiv:2505.23419v22025PALR: Personalization Aware LLMs for Recommendation
Fan Yang, Zheng Chen, Ziyan Jiang +3
cs.IRcs.AIcs.CLarXiv:2305.07622v32023Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing
Yelysei Bondarenko, Markus Nagel, Tijmen Blankevoort
cs.LGcs.AIcs.CLarXiv:2306.12929v22023StructMem: Structured Memory for Long-Horizon Behavior in LLMs
Buqiang Xu, Yijun Chen, Jizhan Fang +5
cs.CLcs.AIcs.IRarXiv:2604.21748v12026Embracing Domain Differences in Fake News: Cross-domain Fake News Detection using Multi-modal Data
Amila Silva, Ling Luo, Shanika Karunasekera +1
cs.CLcs.IRcs.LGarXiv:2102.06314v42021MathScale: Scaling Instruction Tuning for Mathematical Reasoning
Zhengyang Tang, Xingxing Zhang, Benyou Wang +1
cs.CLcs.AIcs.LGarXiv:2403.02884v12024MatCha: Enhancing Visual Language Pretraining with Math Reasoning and Chart Derendering
Fangyu Liu, Francesco Piccinno, Syrine Krichene +6
cs.CLcs.AIcs.CVarXiv:2212.09662v22022When MOE Meets LLMs: Parameter Efficient Fine-tuning for Multi-task Medical Applications
Qidong Liu, Xian Wu, Xiangyu Zhao +4
cs.CLcs.AIarXiv:2310.18339v22023For the sake of simplicity: Unsupervised extraction of lexical simplifications from Wikipedia
Mark Yatskar, Bo Pang, Cristian Danescu-Niculescu-Mizil +1
cs.CLarXiv:1008.1986v12010Capturing Semantic Similarity for Entity Linking with Convolutional Neural Networks
Matthew Francis-Landau, Greg Durrett, Dan Klein
cs.CLarXiv:1604.00734v12016Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation
Jhen-Ke Lin
cs.AIcs.CLcs.LGarXiv:2608.30044v12026Tweet2Vec: Learning Tweet Embeddings Using Character-level CNN-LSTM Encoder-Decoder
Soroush Vosoughi, Prashanth Vijayaraghavan, Deb Roy
cs.CLcs.AIcs.NEarXiv:1607.07514v12016Adaptive Memory Admission Control for LLM Agents
Guilin Zhang, Wei Jiang, Xiejiashan Wang +5
cs.AIcs.CLcs.MAarXiv:2603.04549v12026Don't Break the Cache: An Evaluation of Prompt Caching for Long-Horizon Agentic Tasks
Elias Lumer, Faheem Nizar, Akshaya Jangiti +4
cs.CLarXiv:2601.06007v22026ImageBind-LLM: Multi-modality Instruction Tuning
Jiaming Han, Renrui Zhang, Wenqi Shao +14
cs.MMcs.CLcs.CVarXiv:2309.03905v22023Automated Researchers Can Mitigate Well-characterized Alignment Failures
Chen Yueh-Han, Jiaxin Wen, Jan Hendrik Kirchner
cs.AIcs.CLarXiv:2608.28945v32026DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference
Fuliang Liu, Xue Li, Ketai Zhao +7
cs.CLarXiv:2601.19278v12026