Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,961 to 4,020 of 11,259
The Model Says Walk: How Surface Heuristics Override Implicit Constraints in LLM Reasoning
Yubo Li, Lu Zhang, Tianchong Jiang +2
cs.CLcs.AIarXiv:2603.29025v32026Omnilingual MT: Machine Translation for 1,600 Languages
Omnilingual MT Team, Belen Alastruey, Niyati Bafna +29
cs.CLarXiv:2603.16309v32026A Unified Mechanistic Analysis of Knowledge- and Safety-Based Refusals
Yuri Son, Seunghee Kim, Hyuhng Joon Kim +1
cs.CLarXiv:2609.00760v12026Aegis2.0: A Diverse AI Safety Dataset and Risks Taxonomy for Alignment of LLM Guardrails
Shaona Ghosh, Prasoon Varshney, Makesh Narsimhan Sreedhar +4
cs.CLarXiv:2501.09004v12025MMTEB: Massive Multilingual Text Embedding Benchmark
Kenneth Enevoldsen, Isaac Chung, Imene Kerboua +83
cs.CLcs.AIcs.IRarXiv:2502.13595v42025Context Length Alone Hurts LLM Performance Despite Perfect Retrieval
Yufeng Du, Minyang Tian, Srikanth Ronanki +7
cs.CLcs.AIarXiv:2510.05381v12025Motivation in Large Language Models
Omer Nahum, Asael Sklar, Ariel Goldstein +1
cs.CLcs.CYarXiv:2603.14347v12026MedMentions: A Large Biomedical Corpus Annotated with UMLS Concepts
Sunil Mohan, Donghui Li
cs.CLcs.LGarXiv:1902.09476v12019ELEPHANT: Measuring and understanding social sycophancy in LLMs
Myra Cheng, Sunny Yu, Cinoo Lee +3
cs.CLcs.AIcs.CYarXiv:2505.13995v22025WebDancer: Towards Autonomous Information Seeking Agency
Jialong Wu, Baixuan Li, Runnan Fang +10
cs.CLarXiv:2505.22648v32025Show, Control and Tell: A Framework for Generating Controllable and Grounded Captions
Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara
cs.CVcs.CLarXiv:1811.10652v32018No Language Left Behind: Scaling Human-Centered Machine Translation
NLLB Team, Marta R. Costa-jussà, James Cross +36
cs.CLcs.AIarXiv:2207.04672v32022Flexible Entropy Control in RLVR with a Gradient-Preserving Perspective
Kun Chen, Peng Shi, Fanfan Liu +4
cs.LGcs.AIcs.CLarXiv:2602.09782v22026Trust The Typical
Debargha Ganguly, Sreehari Sankar, Biyao Zhang +8
cs.CLcs.AIcs.DCarXiv:2602.04581v12026Large Language Model Agent: A Survey on Methodology, Applications and Challenges
Junyu Luo, Weizhi Zhang, Ye Yuan +23
cs.CLarXiv:2503.21460v12025Alternating Reinforcement Learning for Rubric-Based Reward Modeling in Non-Verifiable LLM Post-Training
Ran Xu, Tianci Liu, Zihan Dong +6
cs.CLcs.LGarXiv:2602.01511v22026Multi-agent Architecture Search via Agentic Supernet
Guibin Zhang, Luyang Niu, Junfeng Fang +3
cs.LGcs.CLcs.MAarXiv:2502.04180v22025FineInstructions: Scaling Synthetic Instructions to Pre-Training Scale
Ajay Patel, Colin Raffel, Chris Callison-Burch
cs.CLcs.LGarXiv:2601.22146v32026InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning
Matthew Y. R. Yang, Hao Bai, Ian Wu +3
cs.LGcs.AIcs.CLarXiv:2601.14209v12026Thinking While Speaking: Inference-Time Knowledge Transfer for Responsive and Intelligent Conversational Voice Agents
Vidya Srinivas, Zachary Englhardt, Vikram Iyer +1
cs.CLarXiv:2511.07397v32025Summaries:한국어A Survey on LLM-as-a-Judge
Jiawei Gu, Xuhui Jiang, Zhichao Shi +13
cs.CLcs.AIarXiv:2411.15594v62024Fast-dLLM v2: Efficient Block-Diffusion LLM
Chengyue Wu, Hao Zhang, Shuchen Xue +7
cs.CLarXiv:2509.26328v12025Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing
Zhangchen Xu, Fengqing Jiang, Luyao Niu +4
cs.CLcs.AIarXiv:2406.08464v22024Summaries:한국어Simple and Effective Masked Diffusion Language Models
Subham Sekhar Sahoo, Marianne Arriola, Yair Schiff +5
cs.CLcs.AIcs.LGarXiv:2406.07524v22024Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research
Luca Soldaini, Rodney Kinney, Akshita Bhagia +33
cs.CLarXiv:2402.00159v22024Task-Oriented Dialog Systems that Consider Multiple Appropriate Responses under the Same Context
Yichi Zhang, Zhijian Ou, Zhou Yu
cs.CLcs.AIarXiv:1911.10484v22019The Unlocking Spell on Base LLMs: Rethinking Alignment via In-Context Learning
Bill Yuchen Lin, Abhilasha Ravichander, Ximing Lu +5
cs.CLcs.AIarXiv:2312.01552v12023Towards Understanding Sycophancy in Language Models
Mrinank Sharma, Meg Tong, Tomasz Korbak +16
cs.CLcs.AIcs.LGarXiv:2310.13548v42023T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT
Dongzhi Jiang, Ziyu Guo, Renrui Zhang +6
cs.CVcs.AIcs.CLarXiv:2505.00703v22025How Do Prompt Variations Affect Energy Consumption in On-Device LLMs?
Wei Hu, Xiaolong Tu, Dawei Chen +3
cs.CLarXiv:2609.01798v12026Emergent Introspective Awareness in Large Language Models
Jack Lindsey
cs.CLcs.AIarXiv:2601.01828v12026Multimodal Foundation Models: From Specialists to General-Purpose Assistants
Chunyuan Li, Zhe Gan, Zhengyuan Yang +4
cs.CVcs.CLarXiv:2309.10020v12023A Survey of Large Language Models for Healthcare: from Data, Technology, and Applications to Accountability and Ethics
Kai He, Rui Mao, Qika Lin +4
cs.CLarXiv:2310.05694v32023Identifying the Risks of LM Agents with an LM-Emulated Sandbox
Yangjun Ruan, Honghua Dong, Andrew Wang +6
cs.AIcs.CLcs.LGarXiv:2309.15817v22023AlpaGasus: Training A Better Alpaca with Fewer Data
Lichang Chen, Shiyang Li, Jun Yan +8
cs.CLarXiv:2307.08701v52023Personality Traits in Large Language Models
Greg Serapio-García, Mustafa Safdari, Clément Crepy +6
cs.CLcs.AIcs.CYarXiv:2307.00184v42023How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources
Yizhong Wang, Hamish Ivison, Pradeep Dasigi +8
cs.CLarXiv:2306.04751v22023ChatGPT for Shaping the Future of Dentistry: The Potential of Multi-Modal Large Language Model
Hanyao Huang, Ou Zheng, Dongdong Wang +8
cs.CLcs.AIarXiv:2304.03086v22023WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research
Xinhao Mei, Chutong Meng, Haohe Liu +6
eess.AScs.CLcs.MMarXiv:2303.17395v22023ChatDoctor: A Medical Chat Model Fine-Tuned on a Large Language Model Meta-AI (LLaMA) Using Medical Domain Knowledge
Yunxiang Li, Zihan Li, Kai Zhang +3
cs.CLarXiv:2303.14070v52023Almanac: Retrieval-Augmented Language Models for Clinical Medicine
Cyril Zakka, Akash Chaurasia, Rohan Shad +11
cs.CLcs.AIarXiv:2303.01229v22023Evaluating Large Language Models in Theory of Mind Tasks
Michal Kosinski
cs.CLcs.CYcs.HCarXiv:2302.02083v72023SlideVQA: A Dataset for Document Visual Question Answering on Multiple Images
Ryota Tanaka, Kyosuke Nishida, Kosuke Nishida +3
cs.CLcs.CVarXiv:2301.04883v12023ChatGPT Makes Medicine Easy to Swallow: An Exploratory Case Study on Simplified Radiology Reports
Katharina Jeblick, Balthasar Schachtner, Jakob Dexl +8
cs.CLcs.LGarXiv:2212.14882v12022Dataless Knowledge Fusion by Merging Weights of Language Models
Xisen Jin, Xiang Ren, Daniel Preotiuc-Pietro +1
cs.CLcs.LGarXiv:2212.09849v62022CREPE: Can Vision-Language Foundation Models Reason Compositionally?
Zixian Ma, Jerry Hong, Mustafa Omer Gul +3
cs.CLcs.CVarXiv:2212.07796v32022BioGPT: Generative Pre-trained Transformer for Biomedical Text Generation and Mining
Renqian Luo, Liai Sun, Yingce Xia +4
cs.CLcs.AIarXiv:2210.10341v32022ReAct: Synergizing Reasoning and Acting in Language Models
Shunyu Yao, Jeffrey Zhao, Dian Yu +4
cs.CLcs.AIcs.LGarXiv:2210.03629v32022Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models
Zhipeng Chen, Xiaobo Qin, Youbin Wu +4
cs.LGcs.AIcs.CLarXiv:2508.10751v12025RealTime QA: What's the Answer Right Now?
Jungo Kasai, Keisuke Sakaguchi, Yoichi Takahashi +7
cs.CLarXiv:2207.13332v22022Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs
Jan Betley, Daniel Tan, Niels Warncke +5
cs.CLcs.AIcs.CRarXiv:2502.17424v72025Personalized Speech recognition on mobile devices
Ian McGraw, Rohit Prabhavalkar, Raziel Alvarez +8
cs.CLcs.LGcs.SDarXiv:1603.03185v22016GLIPv2: Unifying Localization and Vision-Language Understanding
Haotian Zhang, Pengchuan Zhang, Xiaowei Hu +7
cs.CVcs.AIcs.CLarXiv:2206.05836v22022MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs
Jiarui Zhang, Mahyar Khayatkhoei, Prateek Chhikara +1
cs.CVcs.AIcs.CLarXiv:2502.17422v12025Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning
Tian Xie, Zitian Gao, Qingnan Ren +7
cs.CLcs.AIarXiv:2502.14768v12025Paper Plain: Making Medical Research Papers Approachable to Healthcare Consumers with Natural Language Processing
Tal August, Lucy Lu Wang, Jonathan Bragg +3
cs.HCcs.CLarXiv:2203.00130v12022VLP: A Survey on Vision-Language Pre-training
Feilong Chen, Duzhen Zhang, Minglun Han +4
cs.CVcs.CLarXiv:2202.09061v42022Speculative Decoding with Big Little Decoder
Sehoon Kim, Karttikeya Mangalam, Suhong Moon +4
cs.CLarXiv:2302.07863v42023Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents
Saaket Agashe, Kyle Wong, Vincent Tu +3
cs.AIcs.CLcs.CVarXiv:2504.00906v12025Qwen2.5-1M Technical Report
An Yang, Bowen Yu, Chengyuan Li +25
cs.CLarXiv:2501.15383v12025