Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,961 to 4,020 of 11,259

  1. The Model Says Walk: How Surface Heuristics Override Implicit Constraints in LLM Reasoning

    Yubo Li, Lu Zhang, Tianchong Jiang +2

    cs.CLcs.AIarXiv:2603.29025v32026
  2. Omnilingual MT: Machine Translation for 1,600 Languages

    Omnilingual MT Team, Belen Alastruey, Niyati Bafna +29

    cs.CLarXiv:2603.16309v32026
  3. A Unified Mechanistic Analysis of Knowledge- and Safety-Based Refusals

    Yuri Son, Seunghee Kim, Hyuhng Joon Kim +1

    cs.CLarXiv:2609.00760v12026
  4. Aegis2.0: A Diverse AI Safety Dataset and Risks Taxonomy for Alignment of LLM Guardrails

    Shaona Ghosh, Prasoon Varshney, Makesh Narsimhan Sreedhar +4

    cs.CLarXiv:2501.09004v12025
  5. MMTEB: Massive Multilingual Text Embedding Benchmark

    Kenneth Enevoldsen, Isaac Chung, Imene Kerboua +83

    cs.CLcs.AIcs.IRarXiv:2502.13595v42025
  6. Context Length Alone Hurts LLM Performance Despite Perfect Retrieval

    Yufeng Du, Minyang Tian, Srikanth Ronanki +7

    cs.CLcs.AIarXiv:2510.05381v12025
  7. Motivation in Large Language Models

    Omer Nahum, Asael Sklar, Ariel Goldstein +1

    cs.CLcs.CYarXiv:2603.14347v12026
  8. MedMentions: A Large Biomedical Corpus Annotated with UMLS Concepts

    Sunil Mohan, Donghui Li

    cs.CLcs.LGarXiv:1902.09476v12019
  9. ELEPHANT: Measuring and understanding social sycophancy in LLMs

    Myra Cheng, Sunny Yu, Cinoo Lee +3

    cs.CLcs.AIcs.CYarXiv:2505.13995v22025
  10. WebDancer: Towards Autonomous Information Seeking Agency

    Jialong Wu, Baixuan Li, Runnan Fang +10

    cs.CLarXiv:2505.22648v32025
  11. Show, Control and Tell: A Framework for Generating Controllable and Grounded Captions

    Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara

    cs.CVcs.CLarXiv:1811.10652v32018
  12. No Language Left Behind: Scaling Human-Centered Machine Translation

    NLLB Team, Marta R. Costa-jussà, James Cross +36

    cs.CLcs.AIarXiv:2207.04672v32022
  13. Flexible Entropy Control in RLVR with a Gradient-Preserving Perspective

    Kun Chen, Peng Shi, Fanfan Liu +4

    cs.LGcs.AIcs.CLarXiv:2602.09782v22026
  14. Trust The Typical

    Debargha Ganguly, Sreehari Sankar, Biyao Zhang +8

    cs.CLcs.AIcs.DCarXiv:2602.04581v12026
  15. Large Language Model Agent: A Survey on Methodology, Applications and Challenges

    Junyu Luo, Weizhi Zhang, Ye Yuan +23

    cs.CLarXiv:2503.21460v12025
  16. Alternating Reinforcement Learning for Rubric-Based Reward Modeling in Non-Verifiable LLM Post-Training

    Ran Xu, Tianci Liu, Zihan Dong +6

    cs.CLcs.LGarXiv:2602.01511v22026
  17. Multi-agent Architecture Search via Agentic Supernet

    Guibin Zhang, Luyang Niu, Junfeng Fang +3

    cs.LGcs.CLcs.MAarXiv:2502.04180v22025
  18. FineInstructions: Scaling Synthetic Instructions to Pre-Training Scale

    Ajay Patel, Colin Raffel, Chris Callison-Burch

    cs.CLcs.LGarXiv:2601.22146v32026
  19. InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning

    Matthew Y. R. Yang, Hao Bai, Ian Wu +3

    cs.LGcs.AIcs.CLarXiv:2601.14209v12026
  20. Thinking While Speaking: Inference-Time Knowledge Transfer for Responsive and Intelligent Conversational Voice Agents

    Vidya Srinivas, Zachary Englhardt, Vikram Iyer +1

    cs.CLarXiv:2511.07397v32025
    Summaries:한국어
  21. A Survey on LLM-as-a-Judge

    Jiawei Gu, Xuhui Jiang, Zhichao Shi +13

    cs.CLcs.AIarXiv:2411.15594v62024
  22. Fast-dLLM v2: Efficient Block-Diffusion LLM

    Chengyue Wu, Hao Zhang, Shuchen Xue +7

    cs.CLarXiv:2509.26328v12025
  23. Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing

    Zhangchen Xu, Fengqing Jiang, Luyao Niu +4

    cs.CLcs.AIarXiv:2406.08464v22024
    Summaries:한국어
  24. Simple and Effective Masked Diffusion Language Models

    Subham Sekhar Sahoo, Marianne Arriola, Yair Schiff +5

    cs.CLcs.AIcs.LGarXiv:2406.07524v22024
  25. Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research

    Luca Soldaini, Rodney Kinney, Akshita Bhagia +33

    cs.CLarXiv:2402.00159v22024
  26. Task-Oriented Dialog Systems that Consider Multiple Appropriate Responses under the Same Context

    Yichi Zhang, Zhijian Ou, Zhou Yu

    cs.CLcs.AIarXiv:1911.10484v22019
  27. The Unlocking Spell on Base LLMs: Rethinking Alignment via In-Context Learning

    Bill Yuchen Lin, Abhilasha Ravichander, Ximing Lu +5

    cs.CLcs.AIarXiv:2312.01552v12023
  28. Towards Understanding Sycophancy in Language Models

    Mrinank Sharma, Meg Tong, Tomasz Korbak +16

    cs.CLcs.AIcs.LGarXiv:2310.13548v42023
  29. T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT

    Dongzhi Jiang, Ziyu Guo, Renrui Zhang +6

    cs.CVcs.AIcs.CLarXiv:2505.00703v22025
  30. How Do Prompt Variations Affect Energy Consumption in On-Device LLMs?

    Wei Hu, Xiaolong Tu, Dawei Chen +3

    cs.CLarXiv:2609.01798v12026
  31. Emergent Introspective Awareness in Large Language Models

    Jack Lindsey

    cs.CLcs.AIarXiv:2601.01828v12026
  32. Multimodal Foundation Models: From Specialists to General-Purpose Assistants

    Chunyuan Li, Zhe Gan, Zhengyuan Yang +4

    cs.CVcs.CLarXiv:2309.10020v12023
  33. A Survey of Large Language Models for Healthcare: from Data, Technology, and Applications to Accountability and Ethics

    Kai He, Rui Mao, Qika Lin +4

    cs.CLarXiv:2310.05694v32023
  34. Identifying the Risks of LM Agents with an LM-Emulated Sandbox

    Yangjun Ruan, Honghua Dong, Andrew Wang +6

    cs.AIcs.CLcs.LGarXiv:2309.15817v22023
  35. AlpaGasus: Training A Better Alpaca with Fewer Data

    Lichang Chen, Shiyang Li, Jun Yan +8

    cs.CLarXiv:2307.08701v52023
  36. Personality Traits in Large Language Models

    Greg Serapio-García, Mustafa Safdari, Clément Crepy +6

    cs.CLcs.AIcs.CYarXiv:2307.00184v42023
  37. How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources

    Yizhong Wang, Hamish Ivison, Pradeep Dasigi +8

    cs.CLarXiv:2306.04751v22023
  38. ChatGPT for Shaping the Future of Dentistry: The Potential of Multi-Modal Large Language Model

    Hanyao Huang, Ou Zheng, Dongdong Wang +8

    cs.CLcs.AIarXiv:2304.03086v22023
  39. WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research

    Xinhao Mei, Chutong Meng, Haohe Liu +6

    eess.AScs.CLcs.MMarXiv:2303.17395v22023
  40. ChatDoctor: A Medical Chat Model Fine-Tuned on a Large Language Model Meta-AI (LLaMA) Using Medical Domain Knowledge

    Yunxiang Li, Zihan Li, Kai Zhang +3

    cs.CLarXiv:2303.14070v52023
  41. Almanac: Retrieval-Augmented Language Models for Clinical Medicine

    Cyril Zakka, Akash Chaurasia, Rohan Shad +11

    cs.CLcs.AIarXiv:2303.01229v22023
  42. Evaluating Large Language Models in Theory of Mind Tasks

    Michal Kosinski

    cs.CLcs.CYcs.HCarXiv:2302.02083v72023
  43. SlideVQA: A Dataset for Document Visual Question Answering on Multiple Images

    Ryota Tanaka, Kyosuke Nishida, Kosuke Nishida +3

    cs.CLcs.CVarXiv:2301.04883v12023
  44. ChatGPT Makes Medicine Easy to Swallow: An Exploratory Case Study on Simplified Radiology Reports

    Katharina Jeblick, Balthasar Schachtner, Jakob Dexl +8

    cs.CLcs.LGarXiv:2212.14882v12022
  45. Dataless Knowledge Fusion by Merging Weights of Language Models

    Xisen Jin, Xiang Ren, Daniel Preotiuc-Pietro +1

    cs.CLcs.LGarXiv:2212.09849v62022
  46. CREPE: Can Vision-Language Foundation Models Reason Compositionally?

    Zixian Ma, Jerry Hong, Mustafa Omer Gul +3

    cs.CLcs.CVarXiv:2212.07796v32022
  47. BioGPT: Generative Pre-trained Transformer for Biomedical Text Generation and Mining

    Renqian Luo, Liai Sun, Yingce Xia +4

    cs.CLcs.AIarXiv:2210.10341v32022
  48. ReAct: Synergizing Reasoning and Acting in Language Models

    Shunyu Yao, Jeffrey Zhao, Dian Yu +4

    cs.CLcs.AIcs.LGarXiv:2210.03629v32022
  49. Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models

    Zhipeng Chen, Xiaobo Qin, Youbin Wu +4

    cs.LGcs.AIcs.CLarXiv:2508.10751v12025
  50. RealTime QA: What's the Answer Right Now?

    Jungo Kasai, Keisuke Sakaguchi, Yoichi Takahashi +7

    cs.CLarXiv:2207.13332v22022
  51. Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs

    Jan Betley, Daniel Tan, Niels Warncke +5

    cs.CLcs.AIcs.CRarXiv:2502.17424v72025
  52. Personalized Speech recognition on mobile devices

    Ian McGraw, Rohit Prabhavalkar, Raziel Alvarez +8

    cs.CLcs.LGcs.SDarXiv:1603.03185v22016
  53. GLIPv2: Unifying Localization and Vision-Language Understanding

    Haotian Zhang, Pengchuan Zhang, Xiaowei Hu +7

    cs.CVcs.AIcs.CLarXiv:2206.05836v22022
  54. MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs

    Jiarui Zhang, Mahyar Khayatkhoei, Prateek Chhikara +1

    cs.CVcs.AIcs.CLarXiv:2502.17422v12025
  55. Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning

    Tian Xie, Zitian Gao, Qingnan Ren +7

    cs.CLcs.AIarXiv:2502.14768v12025
  56. Paper Plain: Making Medical Research Papers Approachable to Healthcare Consumers with Natural Language Processing

    Tal August, Lucy Lu Wang, Jonathan Bragg +3

    cs.HCcs.CLarXiv:2203.00130v12022
  57. VLP: A Survey on Vision-Language Pre-training

    Feilong Chen, Duzhen Zhang, Minglun Han +4

    cs.CVcs.CLarXiv:2202.09061v42022
  58. Speculative Decoding with Big Little Decoder

    Sehoon Kim, Karttikeya Mangalam, Suhong Moon +4

    cs.CLarXiv:2302.07863v42023
  59. Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents

    Saaket Agashe, Kyle Wong, Vincent Tu +3

    cs.AIcs.CLcs.CVarXiv:2504.00906v12025
  60. Qwen2.5-1M Technical Report

    An Yang, Bowen Yu, Chengyuan Li +25

    cs.CLarXiv:2501.15383v12025