Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,261 to 10,320 of 11,278

  1. $τ$-Rec: A Verifiable Benchmark for Agentic Recommender Systems

    Bharath Sivaram Narasimhan, Karthik R Narasimhan

    cs.IRcs.AIcs.CLarXiv:2606.10156v32026
  2. RT-1: Robotics Transformer for Real-World Control at Scale

    Anthony Brohan, Noah Brown, Justice Carbajal +48

    cs.ROcs.AIcs.CLarXiv:2212.06817v22022
  3. Fine-Tuning Language Models from Human Preferences

    Daniel M. Ziegler, Nisan Stiennon, Jeffrey Wu +5

    cs.CLcs.LGstat.MLarXiv:1909.08593v22019
  4. Crowdsourcing a Word-Emotion Association Lexicon

    Saif M. Mohammad, Peter D. Turney

    cs.CLarXiv:1308.6297v12013
  5. Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering

    Todor Mihaylov, Peter Clark, Tushar Khot +1

    cs.CLarXiv:1809.02789v12018
  6. Domain-Specific Language Model Pretraining for Biomedical Natural Language Processing

    Yu Gu, Robert Tinn, Hao Cheng +6

    cs.CLcs.LGarXiv:2007.15779v62020
  7. Unsupervised Data Augmentation for Consistency Training

    Qizhe Xie, Zihang Dai, Eduard Hovy +2

    cs.LGcs.AIcs.CLarXiv:1904.12848v62019
  8. Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering

    Junlin Yang, Che Jiang, Yu Fu +21

    cs.CLarXiv:2607.28568v12026
  9. Aligning Books and Movies: Towards Story-like Visual Explanations by Watching Movies and Reading Books

    Yukun Zhu, Ryan Kiros, Richard Zemel +4

    cs.CVcs.CLarXiv:1506.06724v12015
  10. Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search

    Jialin Lu, Soonho Kong, Rodrigo Stehling +4

    cs.LOcs.AIcs.CLarXiv:2605.20244v22026
  11. Reasoning Arena: Trace Tournaments When Verifiable Rewards Fall Short

    Han Zhou, Adam X. Yang, Laurence Aitchison +2

    cs.LGcs.AIcs.CLarXiv:2606.09380v12026
  12. BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling

    Gianluca Barmina, Annemette Broch Pirchert, Andrea Blasi Núñez +2

    cs.LGcs.CLarXiv:2606.09707v12026
  13. Interpreting and Steering a Text-to-Speech Language Model with Sparse Autoencoders

    Nikita Koriagin, Georgii Aparin, Nikita Balagansky +1

    cs.LGcs.AIcs.CLarXiv:2606.10029v12026
  14. Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States

    Yunho Choi, Jongwon Lim, Woojin Ahn +3

    cs.LGcs.AIcs.CLarXiv:2605.07579v22026
  15. Attention-Based Models for Speech Recognition

    Jan Chorowski, Dzmitry Bahdanau, Dmitriy Serdyuk +2

    cs.CLcs.LGcs.NEarXiv:1506.07503v12015
  16. TRIAGE: Dialectical Reasoning for Explainable Risk Prediction on Irregularly Sampled Medical Time Series with LLMs

    Hyeongwon Jang, Gyouk Chu, Changhun Kim +3

    cs.LGcs.AIcs.CLarXiv:2606.09030v12026
  17. Publicly Available Clinical BERT Embeddings

    Emily Alsentzer, John R. Murphy, Willie Boag +4

    cs.CLarXiv:1904.03323v32019
  18. PsychoSafe: Eliciting Psychologically-Informed Refusals in Large Language Models

    Gianluca Barmina, Federico Torrielli, Sven Harms +7

    cs.CLarXiv:2606.09697v12026
  19. A Diversity-Promoting Objective Function for Neural Conversation Models

    Jiwei Li, Michel Galley, Chris Brockett +2

    cs.CLarXiv:1510.03055v32015
  20. End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF

    Xuezhe Ma, Eduard Hovy

    cs.LGcs.CLstat.MLarXiv:1603.01354v52016
  21. LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling

    Tong Zheng, Haolin Liu, Chengsong Huang +10

    cs.CLarXiv:2605.08083v22026
  22. Beyond Reasoning: Reinforcement Learning Unlocks Parametric Knowledge in LLMs

    Wanli Yang, Hongyu Zang, Junwei Zhang +5

    cs.CLarXiv:2605.07153v12026
  23. A Neural Attention Model for Abstractive Sentence Summarization

    Alexander M. Rush, Sumit Chopra, Jason Weston

    cs.CLcs.AIarXiv:1509.00685v22015
  24. An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion

    Rinon Gal, Yuval Alaluf, Yuval Atzmon +4

    cs.CVcs.CLcs.GRarXiv:2208.01618v12022
  25. LLaVA-OneVision: Easy Visual Task Transfer

    Bo Li, Yuanhan Zhang, Dong Guo +8

    cs.CVcs.AIcs.CLarXiv:2408.03326v32024
  26. The Pile: An 800GB Dataset of Diverse Text for Language Modeling

    Leo Gao, Stella Biderman, Sid Black +9

    cs.CLarXiv:2101.00027v12020
  27. RotatE: Knowledge Graph Embedding by Relational Rotation in Complex Space

    Zhiqing Sun, Zhi-Hong Deng, Jian-Yun Nie +1

    cs.LGcs.CLstat.MLarXiv:1902.10197v12019
  28. Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond

    Ramesh Nallapati, Bowen Zhou, Cicero Nogueira dos santos +2

    cs.CLarXiv:1602.06023v52016
  29. The Embedder's Dilemma: LLMs Are Better, but at What Cost?

    Adnan El Assadi, Niklas Muennighoff, Jinhyuk Lee

    cs.CLarXiv:2608.12875v12026
  30. Self-Attention with Relative Position Representations

    Peter Shaw, Jakob Uszkoreit, Ashish Vaswani

    cs.CLarXiv:1803.02155v22018
  31. Prompt-to-Prompt Image Editing with Cross Attention Control

    Amir Hertz, Ron Mokady, Jay Tenenbaum +3

    cs.CVcs.CLcs.GRarXiv:2208.01626v12022
  32. G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment

    Yang Liu, Dan Iter, Yichong Xu +3

    cs.CLcs.AIarXiv:2303.16634v32023
  33. CLEVR: A Diagnostic Dataset for Compositional Language and Elementary Visual Reasoning

    Justin Johnson, Bharath Hariharan, Laurens van der Maaten +3

    cs.CVcs.CLcs.LGarXiv:1612.06890v12016
  34. Microsoft COCO Captions: Data Collection and Evaluation Server

    Xinlei Chen, Hao Fang, Tsung-Yi Lin +4

    cs.CVcs.CLarXiv:1504.00325v22015
  35. BERTopic: Neural topic modeling with a class-based TF-IDF procedure

    Maarten Grootendorst

    cs.CLarXiv:2203.05794v12022
  36. BLOOM: A 176B-Parameter Open-Access Multilingual Language Model

    BigScience Workshop, :, Teven Le Scao +391

    cs.CLarXiv:2211.05100v42022
  37. LXMERT: Learning Cross-Modality Encoder Representations from Transformers

    Hao Tan, Mohit Bansal

    cs.CLcs.CVcs.LGarXiv:1908.07490v32019
  38. Language Modeling with Gated Convolutional Networks

    Yann N. Dauphin, Angela Fan, Michael Auli +1

    cs.CLarXiv:1612.08083v32016
  39. Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization

    Qian Kou, Xiaofeng Shi, Xiaosong Qiu +1

    cs.CLcs.AIarXiv:2608.20281v12026
  40. Reformer: The Efficient Transformer

    Nikita Kitaev, Łukasz Kaiser, Anselm Levskaya

    cs.LGcs.CLstat.MLarXiv:2001.04451v22020
  41. Efficient Neural Architecture Search via Parameter Sharing

    Hieu Pham, Melody Y. Guan, Barret Zoph +2

    cs.LGcs.CLcs.CVarXiv:1802.03268v22018
  42. Improving Neural Machine Translation Models with Monolingual Data

    Rico Sennrich, Barry Haddow, Alexandra Birch

    cs.CLarXiv:1511.06709v42015
  43. PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents

    Seongjae Kang, Taehyung Yu, Sung Ju Hwang

    cs.AIcs.CLcs.LGarXiv:2608.19861v12026
  44. Cross-lingual Language Model Pretraining

    Guillaume Lample, Alexis Conneau

    cs.CLarXiv:1901.07291v12019
  45. Big Bird: Transformers for Longer Sequences

    Manzil Zaheer, Guru Guruganesh, Avinava Dubey +8

    cs.LGcs.CLstat.MLarXiv:2007.14062v22020
  46. FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving

    Qihang Fan, Huaibo Huang, Zhiying Wu +2

    cs.CLarXiv:2608.19758v12026
  47. SWE-bench Science: Can Coding Agents Resolve Engineering Tasks in Science?

    Zhipeng Xu, Jiahao Lu, Yining Zheng +2

    cs.CLcs.SEarXiv:2608.19799v12026
  48. Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism

    Mohammad Shoeybi, Mostofa Patwary, Raul Puri +3

    cs.CLarXiv:1909.08053v42019
  49. Locating and Editing Factual Associations in GPT

    Kevin Meng, David Bau, Alex Andonian +1

    cs.CLcs.LGarXiv:2202.05262v52022
  50. Figurative and Cultural Knowledge in LLMs: Investigating Cross-Domain Transfer through Fine-Tuning

    Mena Attia, Mona Diab, Thamar Solorio

    cs.CLarXiv:2608.18361v12026
  51. Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

    Michael Ahn, Anthony Brohan, Noah Brown +42

    cs.ROcs.CLcs.LGarXiv:2204.01691v22022
  52. What Makes Software Issue Resolution Tasks Difficult for Agents?

    Ebtesam Al-Haque, Brittany Johnson

    cs.SEcs.AIcs.CLarXiv:2608.18280v12026
  53. Mind the Gap: Understanding the Modality Gap in Multi-modal Contrastive Representation Learning

    Weixin Liang, Yuhui Zhang, Yongchan Kwon +2

    cs.CLcs.AIcs.CVarXiv:2203.02053v22022
    Summaries:한국어
  54. MemFuse: Multi-Source Memory Fusion from Fragmented Observations

    Chao Li, Yuanfa Li, Wenhao Wu +3

    cs.CLcs.AIarXiv:2608.18704v12026
  55. $R^3$-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets

    Peisong Wang, Zhiwei Ma, Bowen Liu +6

    cs.CLarXiv:2608.16033v12026
    Summaries:한국어
  56. Token Distribution versus Data Volume: Domain Balancing in Multi-Domain Meeting Summarisation

    Ashima Sood, Bryan Gardiner, Joan Condell

    cs.CLarXiv:2608.15935v12026
  57. VideoGAIA: A Benchmark for General AI Assistants on Agentic Video Understanding

    Fan Zhang, Guangming Yao, Jinyang Wu +6

    cs.CVcs.CLarXiv:2608.14718v12026
  58. MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement

    Lushi Pu, Weiming Zhang, Xinheng Xie +7

    cs.AIcs.CLarXiv:2608.14221v12026
  59. The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation

    Tianyi Men, Zhuoran Jin, Kang Liu +1

    cs.CLcs.AIcs.LGarXiv:2607.24720v12026
  60. Two-Level Meta-Rubrics for Evaluating Open-Ended Generation: GAMUT, a Benchmark for Factual Completeness

    Xilun Chen, Zhaleh Feizollahi, Ross Goodwin +5

    cs.CLarXiv:2607.19322v22026