Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

8,761 to 8,820 of 11,225

  1. Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation

    Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6

    cs.AIcs.CLarXiv:2601.14691v22026
  2. Active Retrieval Augmented Generation

    Zhengbao Jiang, Frank F. Xu, Luyu Gao +6

    cs.CLcs.LGarXiv:2305.06983v22023
  3. AVMeme Exam: A Multimodal Multilingual Multicultural Benchmark for LLMs' Contextual and Cultural Knowledge and Thinking

    Xilin Jiang, Qiaolin Wang, Junkai Wu +30

    cs.SDcs.CLcs.CVarXiv:2601.17645v12026
  4. Deep Search with Hierarchical Meta-Cognitive Monitoring Inspired by Cognitive Neuroscience

    Zhongxiang Sun, Qipeng Wang, Weijie Yu +3

    cs.CLarXiv:2601.23188v12026
  5. A Comparative Study on Transformer vs RNN in Speech Applications

    Shigeki Karita, Nanxin Chen, Tomoki Hayashi +10

    cs.CLcs.SDeess.ASarXiv:1909.06317v22019
  6. Spanish Pre-trained BERT Model and Evaluation Data

    José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3

    cs.CLcs.AIcs.LGarXiv:2308.02976v12023
  7. SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

    Deyao Hong, Yizhe Chi, Wenyi Li +7

    cs.CLcs.AIcs.SEarXiv:2608.23564v12026
  8. Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains

    Miguel Contreras, Scott Siegel, Subhash Nerella +30

    cs.CLcs.AIarXiv:2608.22622v12026
  9. RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind

    Zhitao He, Zongwei Lyu, Yi R Fung

    cs.CLcs.AIarXiv:2601.15715v32026
  10. Mecellem Models: Turkish Models Trained from Scratch and Continually Pre-trained for the Legal Domain

    Özgür Uğur, Mahmut Göksu, Mahmut Çimen +6

    cs.CLarXiv:2601.16018v12026
  11. Embodied Question Answering

    Abhishek Das, Samyak Datta, Georgia Gkioxari +3

    cs.CVcs.AIcs.CLarXiv:1711.11543v22017
  12. ASTRA: Automated Synthesis of agentic Trajectories and Reinforcement Arenas

    Xiaoyu Tian, Haotian Wang, Shuaiting Chen +12

    cs.CLarXiv:2601.21558v22026
  13. Fact or Fiction: Verifying Scientific Claims

    David Wadden, Shanchuan Lin, Kyle Lo +4

    cs.CLarXiv:2004.14974v62020
  14. Marian: Fast Neural Machine Translation in C++

    Marcin Junczys-Dowmunt, Roman Grundkiewicz, Tomasz Dwojak +9

    cs.CLarXiv:1804.00344v32018
  15. Designing and Interpreting Probes with Control Tasks

    John Hewitt, Percy Liang

    cs.CLarXiv:1909.03368v12019
  16. Beyond Correctness: Learning Robust Reasoning via Transfer

    Hyunseok Lee, Soheil Abbasloo, Jihoon Tack +1

    cs.LGcs.CLarXiv:2602.08489v12026
  17. Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training

    Shengrui Li, Fei Zhao, Kaiyan Zhao +6

    cs.CLcs.AIarXiv:2602.00747v32026
  18. PolySAE: Modeling Feature Interactions in Sparse Autoencoders via Polynomial Decoding

    Panagiotis Koromilas, Andreas D. Demou, James Oldfield +2

    cs.LGcs.CLarXiv:2602.01322v22026
  19. Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation

    Kwun Hang Lau, Fangyuan Zhang, Boyu Ruan +4

    cs.CLcs.AIarXiv:2602.01965v12026
  20. Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation

    Ziru Chen, Dongdong Chen, Ruinan Jin +3

    cs.LGcs.AIcs.CLarXiv:2602.03806v12026
  21. From Data to Behavior: Predicting Unintended Model Behaviors Before Training

    Mengru Wang, Zhenqian Xu, Junfeng Fang +4

    cs.LGcs.AIcs.CLarXiv:2602.04735v12026
  22. FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents

    Chiwei Zhu, Benfeng Xu, Mingxuan Du +4

    cs.CLarXiv:2602.01566v22026
  23. Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards

    Kirill Pavlenko, Alexander Golubev, Simon Karasik +1

    cs.LGcs.AIcs.CLarXiv:2602.10231v12026
  24. MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering

    Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu

    cs.CLcs.AIcs.LGarXiv:2203.14371v12022
  25. Towards Expert-Level Medical Question Answering with Large Language Models

    Karan Singhal, Tao Tu, Juraj Gottweis +28

    cs.CLcs.AIcs.LGarXiv:2305.09617v12023
  26. Proxy Compression for Language Modeling

    Lin Zheng, Xinyu Li, Qian Liu +2

    cs.CLcs.LGarXiv:2602.04289v22026
  27. Few-Step Diffusion Language Models via Trajectory Self-Distillation

    Tunyu Zhang, Xinxi Zhang, Ligong Han +10

    cs.CLcs.LGarXiv:2602.12262v42026
  28. Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review

    Lixiang Yan, Lele Sha, Linxuan Zhao +6

    cs.CLcs.AIcs.CYarXiv:2303.13379v22023
  29. ChatGPT and a New Academic Reality: Artificial Intelligence-Written Research Papers and the Ethics of the Large Language Models in Scholarly Publishing

    Brady Lund, Ting Wang, Nishith Reddy Mannuru +3

    cs.CLcs.CYarXiv:2303.13367v22023
  30. Effective Reasoning Chains Reduce Intrinsic Dimensionality

    Archiki Prasad, Mandar Joshi, Kenton Lee +2

    cs.CLcs.AIcs.LGarXiv:2602.09276v22026
  31. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space

    Jinghui Zhang, Lang Gao, Ao Li +5

    cs.CLcs.AIarXiv:2608.23124v12026
  32. Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models

    Lei Wang, Wanyu Xu, Yihuai Lan +4

    cs.CLarXiv:2305.04091v32023
  33. MLS: A Large-Scale Multilingual Dataset for Speech Research

    Vineel Pratap, Qiantong Xu, Anuroop Sriram +2

    eess.AScs.CLcs.SDarXiv:2012.03411v22020
  34. Reinforced Attention Learning

    Bangzheng Li, Jianmo Ni, Chen Qu +5

    cs.CLcs.CVcs.LGarXiv:2602.04884v22026
  35. Prism: Spectral-Aware Block-Sparse Attention

    Xinghao Wang, Pengyu Wang, Xiaoran Liu +4

    cs.CLcs.AIcs.CVarXiv:2602.08426v22026
  36. Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory

    Hao Zhou, Minlie Huang, Tianyang Zhang +2

    cs.CLcs.AIarXiv:1704.01074v42017
  37. KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs

    Jian Chen, Zhuoran Wang, Jiayu Qin +6

    cs.CLarXiv:2602.05929v22026
  38. Uncertainty Drives Social Bias Changes in Quantized Large Language Models

    Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen

    cs.CLarXiv:2602.06181v12026
  39. C-Pack: Packed Resources For General Chinese Embeddings

    Shitao Xiao, Zheng Liu, Peitian Zhang +3

    cs.CLcs.AIcs.IRarXiv:2309.07597v52023
  40. PAL: Program-aided Language Models

    Luyu Gao, Aman Madaan, Shuyan Zhou +5

    cs.CLcs.AIarXiv:2211.10435v22022
  41. Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs

    Luoyang Sun, Jiwen Jiang, Yifeng Ding +9

    cs.LGcs.CLarXiv:2602.10377v12026
  42. MedCLIPSeg: Probabilistic Vision-Language Adaptation for Data-Efficient and Generalizable Medical Image Segmentation

    Taha Koleilat, Hojat Asgariandehkordi, Omid Nejati Manzari +3

    cs.CVcs.CLarXiv:2602.20423v12026
  43. Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models

    Xin Xu, Clive Bai, Kai Yang +7

    cs.CLarXiv:2602.12036v22026
  44. Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders

    Zhongzhi Li, Xuansheng Wu, Yijiang Li +2

    cs.CLcs.AIarXiv:2602.10388v42026
  45. Weight Decay Improves Language Model Plasticity

    Tessa Han, Sebastian Bordt, Hanlin Zhang +1

    cs.LGcs.AIcs.CLarXiv:2602.11137v22026
  46. ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces

    Xin Xu, Tong Yu, Xiang Chen +3

    cs.AIcs.CLcs.LGarXiv:2602.11683v12026
  47. Robustness of IR Models to Collection Growth

    Emmanouil Georgios Lionis, Debasis Ganguly, Sean MacAvaney

    cs.IRcs.CLarXiv:2608.23419v12026
  48. SelFusion: Self-distillation for Diffusion Language Models

    Hyeongsoo Lim, Jinyoung Kim, Eunseo Seo +2

    cs.CLarXiv:2608.22898v12026
  49. Unsupervised Neural Machine Translation

    Mikel Artetxe, Gorka Labaka, Eneko Agirre +1

    cs.CLcs.AIcs.LGarXiv:1710.11041v22017
  50. MAEB: Massive Audio Embedding Benchmark

    Adnan El Assadi, Isaac Chung, Chenghao Xiao +15

    cs.SDcs.AIcs.CLarXiv:2602.16008v12026
  51. Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

    Yunfei Chu, Jin Xu, Xiaohuan Zhou +5

    eess.AScs.CLcs.LGarXiv:2311.07919v22023
  52. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance

    Or Biton, Tomer Krichli, Itai Allouche +1

    cs.AIcs.CLarXiv:2608.23264v12026
  53. Modeling Distinct Human Interaction in Web Agents

    Faria Huq, Zora Zhiruo Wang, Zhanqiu Guo +6

    cs.CLcs.HCarXiv:2602.17588v42026
  54. Sink-Aware Pruning for Diffusion Language Models

    Aidar Myrzakhan, Tianyi Li, Bowei Guo +2

    cs.CLcs.AIcs.LGarXiv:2602.17664v12026
  55. Less is More: ClipBERT for Video-and-Language Learning via Sparse Sampling

    Jie Lei, Linjie Li, Luowei Zhou +4

    cs.CVcs.CLarXiv:2102.06183v12021
  56. Synthetic and Natural Noise Both Break Neural Machine Translation

    Yonatan Belinkov, Yonatan Bisk

    cs.CLcs.LGarXiv:1711.02173v22017
  57. ExpeL: LLM Agents Are Experiential Learners

    Andrew Zhao, Daniel Huang, Quentin Xu +3

    cs.LGcs.AIcs.CLarXiv:2308.10144v32023
  58. On the "Induction Bias" in Sequence Models

    M. Reza Ebrahimi, Michaël Defferrard, Sunny Panchal +1

    cs.LGcs.CLarXiv:2602.18333v22026
  59. Transition-Based Dependency Parsing with Stack Long Short-Term Memory

    Chris Dyer, Miguel Ballesteros, Wang Ling +2

    cs.CLcs.LGcs.NEarXiv:1505.08075v12015
  60. Nacrith: Neural Lossless Compression via Ensemble Context Modeling and High-Precision CDF Coding

    Roberto Tacconelli

    cs.ITcs.CLarXiv:2602.19626v22026