Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,321 to 10,380 of 11,332

  1. Unsupervised Data Augmentation for Consistency Training

    Qizhe Xie, Zihang Dai, Eduard Hovy +2

    cs.LGcs.AIcs.CLarXiv:1904.12848v62019
  2. Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering

    Junlin Yang, Che Jiang, Yu Fu +21

    cs.CLarXiv:2607.28568v12026
  3. Aligning Books and Movies: Towards Story-like Visual Explanations by Watching Movies and Reading Books

    Yukun Zhu, Ryan Kiros, Richard Zemel +4

    cs.CVcs.CLarXiv:1506.06724v12015
  4. Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search

    Jialin Lu, Soonho Kong, Rodrigo Stehling +4

    cs.LOcs.AIcs.CLarXiv:2605.20244v22026
  5. Reasoning Arena: Trace Tournaments When Verifiable Rewards Fall Short

    Han Zhou, Adam X. Yang, Laurence Aitchison +2

    cs.LGcs.AIcs.CLarXiv:2606.09380v12026
  6. BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling

    Gianluca Barmina, Annemette Broch Pirchert, Andrea Blasi Núñez +2

    cs.LGcs.CLarXiv:2606.09707v12026
  7. Interpreting and Steering a Text-to-Speech Language Model with Sparse Autoencoders

    Nikita Koriagin, Georgii Aparin, Nikita Balagansky +1

    cs.LGcs.AIcs.CLarXiv:2606.10029v12026
  8. Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States

    Yunho Choi, Jongwon Lim, Woojin Ahn +3

    cs.LGcs.AIcs.CLarXiv:2605.07579v22026
  9. Attention-Based Models for Speech Recognition

    Jan Chorowski, Dzmitry Bahdanau, Dmitriy Serdyuk +2

    cs.CLcs.LGcs.NEarXiv:1506.07503v12015
  10. TRIAGE: Dialectical Reasoning for Explainable Risk Prediction on Irregularly Sampled Medical Time Series with LLMs

    Hyeongwon Jang, Gyouk Chu, Changhun Kim +3

    cs.LGcs.AIcs.CLarXiv:2606.09030v12026
  11. Publicly Available Clinical BERT Embeddings

    Emily Alsentzer, John R. Murphy, Willie Boag +4

    cs.CLarXiv:1904.03323v32019
  12. PsychoSafe: Eliciting Psychologically-Informed Refusals in Large Language Models

    Gianluca Barmina, Federico Torrielli, Sven Harms +7

    cs.CLarXiv:2606.09697v12026
  13. A Diversity-Promoting Objective Function for Neural Conversation Models

    Jiwei Li, Michel Galley, Chris Brockett +2

    cs.CLarXiv:1510.03055v32015
  14. End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF

    Xuezhe Ma, Eduard Hovy

    cs.LGcs.CLstat.MLarXiv:1603.01354v52016
  15. LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling

    Tong Zheng, Haolin Liu, Chengsong Huang +10

    cs.CLarXiv:2605.08083v22026
  16. Beyond Reasoning: Reinforcement Learning Unlocks Parametric Knowledge in LLMs

    Wanli Yang, Hongyu Zang, Junwei Zhang +5

    cs.CLarXiv:2605.07153v12026
  17. A Neural Attention Model for Abstractive Sentence Summarization

    Alexander M. Rush, Sumit Chopra, Jason Weston

    cs.CLcs.AIarXiv:1509.00685v22015
  18. An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion

    Rinon Gal, Yuval Alaluf, Yuval Atzmon +4

    cs.CVcs.CLcs.GRarXiv:2208.01618v12022
  19. LLaVA-OneVision: Easy Visual Task Transfer

    Bo Li, Yuanhan Zhang, Dong Guo +8

    cs.CVcs.AIcs.CLarXiv:2408.03326v32024
  20. The Pile: An 800GB Dataset of Diverse Text for Language Modeling

    Leo Gao, Stella Biderman, Sid Black +9

    cs.CLarXiv:2101.00027v12020
  21. RotatE: Knowledge Graph Embedding by Relational Rotation in Complex Space

    Zhiqing Sun, Zhi-Hong Deng, Jian-Yun Nie +1

    cs.LGcs.CLstat.MLarXiv:1902.10197v12019
  22. Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond

    Ramesh Nallapati, Bowen Zhou, Cicero Nogueira dos santos +2

    cs.CLarXiv:1602.06023v52016
  23. The Embedder's Dilemma: LLMs Are Better, but at What Cost?

    Adnan El Assadi, Niklas Muennighoff, Jinhyuk Lee

    cs.CLarXiv:2608.12875v12026
  24. Self-Attention with Relative Position Representations

    Peter Shaw, Jakob Uszkoreit, Ashish Vaswani

    cs.CLarXiv:1803.02155v22018
  25. Prompt-to-Prompt Image Editing with Cross Attention Control

    Amir Hertz, Ron Mokady, Jay Tenenbaum +3

    cs.CVcs.CLcs.GRarXiv:2208.01626v12022
  26. G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment

    Yang Liu, Dan Iter, Yichong Xu +3

    cs.CLcs.AIarXiv:2303.16634v32023
  27. CLEVR: A Diagnostic Dataset for Compositional Language and Elementary Visual Reasoning

    Justin Johnson, Bharath Hariharan, Laurens van der Maaten +3

    cs.CVcs.CLcs.LGarXiv:1612.06890v12016
  28. Microsoft COCO Captions: Data Collection and Evaluation Server

    Xinlei Chen, Hao Fang, Tsung-Yi Lin +4

    cs.CVcs.CLarXiv:1504.00325v22015
  29. BERTopic: Neural topic modeling with a class-based TF-IDF procedure

    Maarten Grootendorst

    cs.CLarXiv:2203.05794v12022
  30. BLOOM: A 176B-Parameter Open-Access Multilingual Language Model

    BigScience Workshop, :, Teven Le Scao +391

    cs.CLarXiv:2211.05100v42022
  31. LXMERT: Learning Cross-Modality Encoder Representations from Transformers

    Hao Tan, Mohit Bansal

    cs.CLcs.CVcs.LGarXiv:1908.07490v32019
  32. Language Modeling with Gated Convolutional Networks

    Yann N. Dauphin, Angela Fan, Michael Auli +1

    cs.CLarXiv:1612.08083v32016
  33. Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization

    Qian Kou, Xiaofeng Shi, Xiaosong Qiu +1

    cs.CLcs.AIarXiv:2608.20281v12026
  34. Reformer: The Efficient Transformer

    Nikita Kitaev, Łukasz Kaiser, Anselm Levskaya

    cs.LGcs.CLstat.MLarXiv:2001.04451v22020
  35. Efficient Neural Architecture Search via Parameter Sharing

    Hieu Pham, Melody Y. Guan, Barret Zoph +2

    cs.LGcs.CLcs.CVarXiv:1802.03268v22018
  36. Improving Neural Machine Translation Models with Monolingual Data

    Rico Sennrich, Barry Haddow, Alexandra Birch

    cs.CLarXiv:1511.06709v42015
  37. PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents

    Seongjae Kang, Taehyung Yu, Sung Ju Hwang

    cs.AIcs.CLcs.LGarXiv:2608.19861v12026
  38. Cross-lingual Language Model Pretraining

    Guillaume Lample, Alexis Conneau

    cs.CLarXiv:1901.07291v12019
  39. Big Bird: Transformers for Longer Sequences

    Manzil Zaheer, Guru Guruganesh, Avinava Dubey +8

    cs.LGcs.CLstat.MLarXiv:2007.14062v22020
  40. FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving

    Qihang Fan, Huaibo Huang, Zhiying Wu +2

    cs.CLarXiv:2608.19758v12026
  41. SWE-bench Science: Can Coding Agents Resolve Engineering Tasks in Science?

    Zhipeng Xu, Jiahao Lu, Yining Zheng +2

    cs.CLcs.SEarXiv:2608.19799v12026
  42. Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism

    Mohammad Shoeybi, Mostofa Patwary, Raul Puri +3

    cs.CLarXiv:1909.08053v42019
  43. Locating and Editing Factual Associations in GPT

    Kevin Meng, David Bau, Alex Andonian +1

    cs.CLcs.LGarXiv:2202.05262v52022
  44. Figurative and Cultural Knowledge in LLMs: Investigating Cross-Domain Transfer through Fine-Tuning

    Mena Attia, Mona Diab, Thamar Solorio

    cs.CLarXiv:2608.18361v12026
  45. Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

    Michael Ahn, Anthony Brohan, Noah Brown +42

    cs.ROcs.CLcs.LGarXiv:2204.01691v22022
  46. What Makes Software Issue Resolution Tasks Difficult for Agents?

    Ebtesam Al-Haque, Brittany Johnson

    cs.SEcs.AIcs.CLarXiv:2608.18280v12026
  47. Mind the Gap: Understanding the Modality Gap in Multi-modal Contrastive Representation Learning

    Weixin Liang, Yuhui Zhang, Yongchan Kwon +2

    cs.CLcs.AIcs.CVarXiv:2203.02053v22022
    Summaries:한국어
  48. MemFuse: Multi-Source Memory Fusion from Fragmented Observations

    Chao Li, Yuanfa Li, Wenhao Wu +3

    cs.CLcs.AIarXiv:2608.18704v12026
  49. $R^3$-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets

    Peisong Wang, Zhiwei Ma, Bowen Liu +6

    cs.CLarXiv:2608.16033v12026
    Summaries:한국어
  50. Token Distribution versus Data Volume: Domain Balancing in Multi-Domain Meeting Summarisation

    Ashima Sood, Bryan Gardiner, Joan Condell

    cs.CLarXiv:2608.15935v12026
  51. VideoGAIA: A Benchmark for General AI Assistants on Agentic Video Understanding

    Fan Zhang, Guangming Yao, Jinyang Wu +6

    cs.CVcs.CLarXiv:2608.14718v12026
  52. MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement

    Lushi Pu, Weiming Zhang, Xinheng Xie +7

    cs.AIcs.CLarXiv:2608.14221v12026
  53. The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation

    Tianyi Men, Zhuoran Jin, Kang Liu +1

    cs.CLcs.AIcs.LGarXiv:2607.24720v12026
  54. Two-Level Meta-Rubrics for Evaluating Open-Ended Generation: GAMUT, a Benchmark for Factual Completeness

    Xilun Chen, Zhaleh Feizollahi, Ross Goodwin +5

    cs.CLarXiv:2607.19322v22026
  55. UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks

    Zhekai Chen, Chengqi Duan, Kaiyue Sun +4

    cs.CLarXiv:2607.08768v12026
  56. Do Thinking Tokens Help with Safety?

    Narutatsu Ri, Abhishek Panigrahi, Sanjeev Arora

    cs.LGcs.AIcs.CLarXiv:2606.25013v12026
    Summaries:한국어
  57. Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning

    Shiding Zhu, Yudi Qi, Yajie Wang +6

    cs.CLarXiv:2606.24428v12026
  58. MaxProof: Scaling Mathematical Proof with Generative-Verifier RL and Population-Level Test-Time Scaling

    Jiacheng Chen, Xinyu Zhang, Shunkai Zhang +20

    cs.LGcs.AIcs.CLarXiv:2606.13473v12026
  59. Agents' Last Exam

    Yiyou Sun, Xinyang Han, Weichen Zhang +307

    cs.AIcs.CLcs.LGarXiv:2606.05405v22026
  60. TVIR: Building Deep Research Agents Towards Text-Visual Interleaved Report Generation

    Xinkai Ma, Zhiqi Bai, Dingling Zhang +21

    cs.CLarXiv:2606.02320v22026