Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,401 to 2,460 of 11,259

  1. AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks

    Yifan Zeng, Yiran Wu, Xiao Zhang +2

    cs.LGcs.CLcs.CRarXiv:2403.04783v22024
  2. No Free Labels: Limitations of LLM-as-a-Judge Without Human Grounding

    Michael Krumdick, Charles Lovering, Varshini Reddy +2

    cs.CLarXiv:2503.05061v32025
  3. Improved Relation Extraction with Feature-Rich Compositional Embedding Models

    Matthew R. Gormley, Mo Yu, Mark Dredze

    cs.CLcs.AIcs.LGarXiv:1505.02419v32015
  4. Which of These Best Describes Multiple Choice Evaluation with LLMs? A) Forced B) Flawed C) Fixable D) All of the Above

    Nishant Balepur, Rachel Rudinger, Jordan Lee Boyd-Graber

    cs.CLarXiv:2502.14127v22025
  5. We're Afraid Language Models Aren't Modeling Ambiguity

    Alisa Liu, Zhaofeng Wu, Julian Michael +6

    cs.CLarXiv:2304.14399v22023
  6. REST: Retrieval-Based Speculative Decoding

    Zhenyu He, Zexuan Zhong, Tianle Cai +2

    cs.CLcs.AIcs.IRarXiv:2311.08252v22023
  7. Evaluating the Diversity and Quality of LLM Generated Content

    Alexander Shypula, Shuo Li, Botong Zhang +3

    cs.CLcs.AIarXiv:2504.12522v22025
  8. NeuReasoner: Towards Explainable, Controllable, and Unified Reasoning via Mixture-of-Neurons

    Haonan Dong, Kehan Jiang, Haoran Ye +3

    cs.CLarXiv:2604.02972v12026
  9. A Coin Flip for Safety: LLM Judges Fail to Reliably Measure Adversarial Robustness

    Leo Schwinn, Moritz Ladenburger, Tim Beyer +3

    cs.CLcs.AIarXiv:2603.06594v22026
  10. Peer-Preservation in Frontier Models

    Yujin Potter, Nicholas Crispino, Vincent Siu +2

    cs.CLcs.AIcs.MAarXiv:2604.19784v32026
  11. Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models

    Jinghan Cao, Yu Ma, Xinjin Li +2

    cs.CLcs.LGarXiv:2603.21389v12026
  12. Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models

    Feng Luo, Yu-Neng Chuang, Guanchu Wang +4

    cs.CLcs.LGarXiv:2604.08527v12026
  13. Ankh: Optimized Protein Language Model Unlocks General-Purpose Modelling

    Ahmed Elnaggar, Hazem Essam, Wafaa Salah-Eldin +4

    cs.LGcs.CLcs.DCarXiv:2301.06568v12023
  14. ASSERT: Anti-Spoofing with Squeeze-Excitation and Residual neTworks

    Cheng-I Lai, Nanxin Chen, Jesús Villalba +1

    cs.CLcs.LGcs.SDarXiv:1904.01120v12019
  15. Token Optimization and Context Window Management in Multi-Agent AI Workflows

    Dvir Shamay

    cs.CLcs.AIarXiv:2608.17188v12026
  16. Arabic Offensive Language on Twitter: Analysis and Experiments

    Hamdy Mubarak, Ammar Rashed, Kareem Darwish +2

    cs.CLarXiv:2004.02192v32020
  17. Zoology: Measuring and Improving Recall in Efficient Language Models

    Simran Arora, Sabri Eyuboglu, Aman Timalsina +5

    cs.CLcs.LGarXiv:2312.04927v12023
  18. Neural Linguistic Steganography

    Zachary M. Ziegler, Yuntian Deng, Alexander M. Rush

    cs.CLcs.CRcs.LGarXiv:1909.01496v12019
  19. Scalable Zero-shot Entity Linking with Dense Entity Retrieval

    Ledell Wu, Fabio Petroni, Martin Josifoski +2

    cs.CLarXiv:1911.03814v32019
  20. Sequential Latent Knowledge Selection for Knowledge-Grounded Dialogue

    Byeongchang Kim, Jaewoo Ahn, Gunhee Kim

    cs.CLarXiv:2002.07510v22020
  21. TrumorGPT: Graph-Based Retrieval-Augmented Large Language Model for Fact-Checking

    Ching Nam Hang, Pei-Duo Yu, Chee Wei Tan

    cs.CLcs.AIarXiv:2505.07891v22025
  22. Decoding ChatGPT: A Taxonomy of Existing Research, Current Challenges, and Possible Future Directions

    Shahab Saquib Sohail, Faiza Farhat, Yassine Himeur +5

    cs.CLcs.CYarXiv:2307.14107v22023
  23. EffiSkill: Agent Skill Based Automated Code Efficiency Optimization

    Zimu Wang, Yuling Shi, Mengfan Li +4

    cs.SEcs.CLarXiv:2603.27850v12026
  24. InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training

    Ziyun Zhang, Zezhou Wang, Xiaoyi Zhang +4

    cs.CLcs.AIcs.CVarXiv:2601.04126v32026
  25. Reason Only When Needed: Efficient Generative Reward Modeling via Model-Internal Uncertainty

    Chao Xue, Yao Wang, Mengqiao Liu +11

    cs.CLarXiv:2604.10072v42026
  26. Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards

    Hieu Trung Nguyen, Bao Nguyen, Wenao Ma +3

    cs.LGcs.AIcs.CLarXiv:2602.01601v32026
  27. Natural Language Processing for Smart Healthcare

    Binggui Zhou, Guanghua Yang, Zheng Shi +1

    cs.CLcs.AIarXiv:2110.15803v32021
  28. Counting on Consensus: Selecting the Right Inter-annotator Agreement Metric for NLP Annotation and Evaluation

    Joseph James

    cs.CLarXiv:2603.06865v22026
  29. Knowing What Not to Answer: Selective Non-Compliance in Vision-Language Models

    Minji Kim, Jihyoung Jang, Hyounghun Kim

    cs.CLcs.AIarXiv:2609.04720v12026
  30. A Survey on Contextual Embeddings

    Qi Liu, Matt J. Kusner, Phil Blunsom

    cs.CLcs.AIcs.LGarXiv:2003.07278v22020
  31. How LLMs Distort Our Written Language

    Marwa Abdulhai, Isadora White, Yanming Wan +4

    cs.CLcs.AIarXiv:2603.18161v22026
  32. A Systematic Survey of Text Summarization: From Statistical Methods to Large Language Models

    Haopeng Zhang, Philip S. Yu, Jiawei Zhang

    cs.CLarXiv:2406.11289v12024
  33. EvolveRouter: Co-Evolving Routing and Prompt for Multi-Agent Question Answering

    Jiatan Huang, Zheyuan Zhang, Kaiwen Shi +2

    cs.CLarXiv:2604.05149v12026
  34. EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents

    Zhili Cheng, Yuge Tu, Ran Li +9

    cs.CVcs.CLarXiv:2501.11858v22025
  35. Conformal Language Modeling

    Victor Quach, Adam Fisch, Tal Schuster +4

    cs.CLcs.LGarXiv:2306.10193v22023
  36. ValueGraph: Value-Signal Guided Graph Pre-training for Contextualized User Representation

    Yitong Han, Wei Gao, Yi Zhao +3

    cs.CLcs.AIcs.LGarXiv:2609.00057v12026
  37. SkillSafetyBench: Evaluating Agent Safety under Skill-Facing Attack Surfaces

    Chang Jin, An Wang, Zeming Wei +7

    cs.CRcs.AIcs.CLarXiv:2605.12015v32026
  38. Do Multimodal LLMs See Before They Read? Diagnosing Contextual Sycophancy

    Yi-Cheng Lai, Hen-Hsen Huang

    cs.CLcs.AIarXiv:2609.00067v12026
  39. Medical Causal Hypothesis Verification with Large Language Models

    Safiyyah Ahmed, Abrar Ansari, Md Aminul Islam +1

    cs.CLcs.AIarXiv:2609.00063v12026
  40. How do LLMs Compute Verbal Confidence

    Dharshan Kumaran, Arthur Conmy, Federico Barbero +3

    cs.CLcs.AIcs.LGarXiv:2603.17839v32026
  41. TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents

    Kai Li, Xuanqing Yu, Ziyi Ni +9

    cs.CLcs.AIarXiv:2601.02845v22026
  42. Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS

    Shijia Xu, Zhou Wu, Xiaolong Jia +3

    cs.CLarXiv:2604.10734v12026
  43. Deep convolutional acoustic word embeddings using word-pair side information

    Herman Kamper, Weiran Wang, Karen Livescu

    cs.CLarXiv:1510.01032v22015
  44. SWE-bench Goes Live!

    Linghao Zhang, Shilin He, Chaoyun Zhang +12

    cs.SEcs.AIcs.CLarXiv:2505.23419v22025
  45. PALR: Personalization Aware LLMs for Recommendation

    Fan Yang, Zheng Chen, Ziyan Jiang +3

    cs.IRcs.AIcs.CLarXiv:2305.07622v32023
  46. Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing

    Yelysei Bondarenko, Markus Nagel, Tijmen Blankevoort

    cs.LGcs.AIcs.CLarXiv:2306.12929v22023
  47. StructMem: Structured Memory for Long-Horizon Behavior in LLMs

    Buqiang Xu, Yijun Chen, Jizhan Fang +5

    cs.CLcs.AIcs.IRarXiv:2604.21748v12026
  48. Embracing Domain Differences in Fake News: Cross-domain Fake News Detection using Multi-modal Data

    Amila Silva, Ling Luo, Shanika Karunasekera +1

    cs.CLcs.IRcs.LGarXiv:2102.06314v42021
  49. MathScale: Scaling Instruction Tuning for Mathematical Reasoning

    Zhengyang Tang, Xingxing Zhang, Benyou Wang +1

    cs.CLcs.AIcs.LGarXiv:2403.02884v12024
  50. MatCha: Enhancing Visual Language Pretraining with Math Reasoning and Chart Derendering

    Fangyu Liu, Francesco Piccinno, Syrine Krichene +6

    cs.CLcs.AIcs.CVarXiv:2212.09662v22022
  51. When MOE Meets LLMs: Parameter Efficient Fine-tuning for Multi-task Medical Applications

    Qidong Liu, Xian Wu, Xiangyu Zhao +4

    cs.CLcs.AIarXiv:2310.18339v22023
  52. For the sake of simplicity: Unsupervised extraction of lexical simplifications from Wikipedia

    Mark Yatskar, Bo Pang, Cristian Danescu-Niculescu-Mizil +1

    cs.CLarXiv:1008.1986v12010
  53. Capturing Semantic Similarity for Entity Linking with Convolutional Neural Networks

    Matthew Francis-Landau, Greg Durrett, Dan Klein

    cs.CLarXiv:1604.00734v12016
  54. Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation

    Jhen-Ke Lin

    cs.AIcs.CLcs.LGarXiv:2608.30044v12026
  55. Tweet2Vec: Learning Tweet Embeddings Using Character-level CNN-LSTM Encoder-Decoder

    Soroush Vosoughi, Prashanth Vijayaraghavan, Deb Roy

    cs.CLcs.AIcs.NEarXiv:1607.07514v12016
  56. Adaptive Memory Admission Control for LLM Agents

    Guilin Zhang, Wei Jiang, Xiejiashan Wang +5

    cs.AIcs.CLcs.MAarXiv:2603.04549v12026
  57. Don't Break the Cache: An Evaluation of Prompt Caching for Long-Horizon Agentic Tasks

    Elias Lumer, Faheem Nizar, Akshaya Jangiti +4

    cs.CLarXiv:2601.06007v22026
  58. ImageBind-LLM: Multi-modality Instruction Tuning

    Jiaming Han, Renrui Zhang, Wenqi Shao +14

    cs.MMcs.CLcs.CVarXiv:2309.03905v22023
  59. Automated Researchers Can Mitigate Well-characterized Alignment Failures

    Chen Yueh-Han, Jiaxin Wen, Jan Hendrik Kirchner

    cs.AIcs.CLarXiv:2608.28945v32026
  60. DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference

    Fuliang Liu, Xue Li, Ketai Zhao +7

    cs.CLarXiv:2601.19278v12026