Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,321 to 10,380 of 11,332
Unsupervised Data Augmentation for Consistency Training
Qizhe Xie, Zihang Dai, Eduard Hovy +2
cs.LGcs.AIcs.CLarXiv:1904.12848v62019Frontis-MA1: Training an AI4AI Model towards Recursive Self-Improvement in Machine Learning Engineering
Junlin Yang, Che Jiang, Yu Fu +21
cs.CLarXiv:2607.28568v12026Aligning Books and Movies: Towards Story-like Visual Explanations by Watching Movies and Reading Books
Yukun Zhu, Ryan Kiros, Richard Zemel +4
cs.CVcs.CLarXiv:1506.06724v12015Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
Jialin Lu, Soonho Kong, Rodrigo Stehling +4
cs.LOcs.AIcs.CLarXiv:2605.20244v22026Reasoning Arena: Trace Tournaments When Verifiable Rewards Fall Short
Han Zhou, Adam X. Yang, Laurence Aitchison +2
cs.LGcs.AIcs.CLarXiv:2606.09380v12026BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling
Gianluca Barmina, Annemette Broch Pirchert, Andrea Blasi Núñez +2
cs.LGcs.CLarXiv:2606.09707v12026Interpreting and Steering a Text-to-Speech Language Model with Sparse Autoencoders
Nikita Koriagin, Georgii Aparin, Nikita Balagansky +1
cs.LGcs.AIcs.CLarXiv:2606.10029v12026Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States
Yunho Choi, Jongwon Lim, Woojin Ahn +3
cs.LGcs.AIcs.CLarXiv:2605.07579v22026Attention-Based Models for Speech Recognition
Jan Chorowski, Dzmitry Bahdanau, Dmitriy Serdyuk +2
cs.CLcs.LGcs.NEarXiv:1506.07503v12015TRIAGE: Dialectical Reasoning for Explainable Risk Prediction on Irregularly Sampled Medical Time Series with LLMs
Hyeongwon Jang, Gyouk Chu, Changhun Kim +3
cs.LGcs.AIcs.CLarXiv:2606.09030v12026Publicly Available Clinical BERT Embeddings
Emily Alsentzer, John R. Murphy, Willie Boag +4
cs.CLarXiv:1904.03323v32019PsychoSafe: Eliciting Psychologically-Informed Refusals in Large Language Models
Gianluca Barmina, Federico Torrielli, Sven Harms +7
cs.CLarXiv:2606.09697v12026A Diversity-Promoting Objective Function for Neural Conversation Models
Jiwei Li, Michel Galley, Chris Brockett +2
cs.CLarXiv:1510.03055v32015End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF
Xuezhe Ma, Eduard Hovy
cs.LGcs.CLstat.MLarXiv:1603.01354v52016LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling
Tong Zheng, Haolin Liu, Chengsong Huang +10
cs.CLarXiv:2605.08083v22026Beyond Reasoning: Reinforcement Learning Unlocks Parametric Knowledge in LLMs
Wanli Yang, Hongyu Zang, Junwei Zhang +5
cs.CLarXiv:2605.07153v12026A Neural Attention Model for Abstractive Sentence Summarization
Alexander M. Rush, Sumit Chopra, Jason Weston
cs.CLcs.AIarXiv:1509.00685v22015An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion
Rinon Gal, Yuval Alaluf, Yuval Atzmon +4
cs.CVcs.CLcs.GRarXiv:2208.01618v12022LLaVA-OneVision: Easy Visual Task Transfer
Bo Li, Yuanhan Zhang, Dong Guo +8
cs.CVcs.AIcs.CLarXiv:2408.03326v32024The Pile: An 800GB Dataset of Diverse Text for Language Modeling
Leo Gao, Stella Biderman, Sid Black +9
cs.CLarXiv:2101.00027v12020RotatE: Knowledge Graph Embedding by Relational Rotation in Complex Space
Zhiqing Sun, Zhi-Hong Deng, Jian-Yun Nie +1
cs.LGcs.CLstat.MLarXiv:1902.10197v12019Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond
Ramesh Nallapati, Bowen Zhou, Cicero Nogueira dos santos +2
cs.CLarXiv:1602.06023v52016The Embedder's Dilemma: LLMs Are Better, but at What Cost?
Adnan El Assadi, Niklas Muennighoff, Jinhyuk Lee
cs.CLarXiv:2608.12875v12026Self-Attention with Relative Position Representations
Peter Shaw, Jakob Uszkoreit, Ashish Vaswani
cs.CLarXiv:1803.02155v22018Prompt-to-Prompt Image Editing with Cross Attention Control
Amir Hertz, Ron Mokady, Jay Tenenbaum +3
cs.CVcs.CLcs.GRarXiv:2208.01626v12022G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment
Yang Liu, Dan Iter, Yichong Xu +3
cs.CLcs.AIarXiv:2303.16634v32023CLEVR: A Diagnostic Dataset for Compositional Language and Elementary Visual Reasoning
Justin Johnson, Bharath Hariharan, Laurens van der Maaten +3
cs.CVcs.CLcs.LGarXiv:1612.06890v12016Microsoft COCO Captions: Data Collection and Evaluation Server
Xinlei Chen, Hao Fang, Tsung-Yi Lin +4
cs.CVcs.CLarXiv:1504.00325v22015BERTopic: Neural topic modeling with a class-based TF-IDF procedure
Maarten Grootendorst
cs.CLarXiv:2203.05794v12022BLOOM: A 176B-Parameter Open-Access Multilingual Language Model
BigScience Workshop, :, Teven Le Scao +391
cs.CLarXiv:2211.05100v42022LXMERT: Learning Cross-Modality Encoder Representations from Transformers
Hao Tan, Mohit Bansal
cs.CLcs.CVcs.LGarXiv:1908.07490v32019Language Modeling with Gated Convolutional Networks
Yann N. Dauphin, Angela Fan, Michael Auli +1
cs.CLarXiv:1612.08083v32016Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization
Qian Kou, Xiaofeng Shi, Xiaosong Qiu +1
cs.CLcs.AIarXiv:2608.20281v12026Reformer: The Efficient Transformer
Nikita Kitaev, Łukasz Kaiser, Anselm Levskaya
cs.LGcs.CLstat.MLarXiv:2001.04451v22020Efficient Neural Architecture Search via Parameter Sharing
Hieu Pham, Melody Y. Guan, Barret Zoph +2
cs.LGcs.CLcs.CVarXiv:1802.03268v22018Improving Neural Machine Translation Models with Monolingual Data
Rico Sennrich, Barry Haddow, Alexandra Birch
cs.CLarXiv:1511.06709v42015PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents
Seongjae Kang, Taehyung Yu, Sung Ju Hwang
cs.AIcs.CLcs.LGarXiv:2608.19861v12026Cross-lingual Language Model Pretraining
Guillaume Lample, Alexis Conneau
cs.CLarXiv:1901.07291v12019Big Bird: Transformers for Longer Sequences
Manzil Zaheer, Guru Guruganesh, Avinava Dubey +8
cs.LGcs.CLstat.MLarXiv:2007.14062v22020FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving
Qihang Fan, Huaibo Huang, Zhiying Wu +2
cs.CLarXiv:2608.19758v12026SWE-bench Science: Can Coding Agents Resolve Engineering Tasks in Science?
Zhipeng Xu, Jiahao Lu, Yining Zheng +2
cs.CLcs.SEarXiv:2608.19799v12026Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism
Mohammad Shoeybi, Mostofa Patwary, Raul Puri +3
cs.CLarXiv:1909.08053v42019Locating and Editing Factual Associations in GPT
Kevin Meng, David Bau, Alex Andonian +1
cs.CLcs.LGarXiv:2202.05262v52022Figurative and Cultural Knowledge in LLMs: Investigating Cross-Domain Transfer through Fine-Tuning
Mena Attia, Mona Diab, Thamar Solorio
cs.CLarXiv:2608.18361v12026Do As I Can, Not As I Say: Grounding Language in Robotic Affordances
Michael Ahn, Anthony Brohan, Noah Brown +42
cs.ROcs.CLcs.LGarXiv:2204.01691v22022What Makes Software Issue Resolution Tasks Difficult for Agents?
Ebtesam Al-Haque, Brittany Johnson
cs.SEcs.AIcs.CLarXiv:2608.18280v12026Mind the Gap: Understanding the Modality Gap in Multi-modal Contrastive Representation Learning
Weixin Liang, Yuhui Zhang, Yongchan Kwon +2
cs.CLcs.AIcs.CVarXiv:2203.02053v22022Summaries:한국어MemFuse: Multi-Source Memory Fusion from Fragmented Observations
Chao Li, Yuanfa Li, Wenhao Wu +3
cs.CLcs.AIarXiv:2608.18704v12026$R^3$-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets
Peisong Wang, Zhiwei Ma, Bowen Liu +6
cs.CLarXiv:2608.16033v12026Summaries:한국어Token Distribution versus Data Volume: Domain Balancing in Multi-Domain Meeting Summarisation
Ashima Sood, Bryan Gardiner, Joan Condell
cs.CLarXiv:2608.15935v12026VideoGAIA: A Benchmark for General AI Assistants on Agentic Video Understanding
Fan Zhang, Guangming Yao, Jinyang Wu +6
cs.CVcs.CLarXiv:2608.14718v12026MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement
Lushi Pu, Weiming Zhang, Xinheng Xie +7
cs.AIcs.CLarXiv:2608.14221v12026The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation
Tianyi Men, Zhuoran Jin, Kang Liu +1
cs.CLcs.AIcs.LGarXiv:2607.24720v12026Two-Level Meta-Rubrics for Evaluating Open-Ended Generation: GAMUT, a Benchmark for Factual Completeness
Xilun Chen, Zhaleh Feizollahi, Ross Goodwin +5
cs.CLarXiv:2607.19322v22026UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks
Zhekai Chen, Chengqi Duan, Kaiyue Sun +4
cs.CLarXiv:2607.08768v12026Do Thinking Tokens Help with Safety?
Narutatsu Ri, Abhishek Panigrahi, Sanjeev Arora
cs.LGcs.AIcs.CLarXiv:2606.25013v12026Summaries:한국어Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning
Shiding Zhu, Yudi Qi, Yajie Wang +6
cs.CLarXiv:2606.24428v12026MaxProof: Scaling Mathematical Proof with Generative-Verifier RL and Population-Level Test-Time Scaling
Jiacheng Chen, Xinyu Zhang, Shunkai Zhang +20
cs.LGcs.AIcs.CLarXiv:2606.13473v12026Agents' Last Exam
Yiyou Sun, Xinyang Han, Weichen Zhang +307
cs.AIcs.CLcs.LGarXiv:2606.05405v22026TVIR: Building Deep Research Agents Towards Text-Visual Interleaved Report Generation
Xinkai Ma, Zhiqi Bai, Dingling Zhang +21
cs.CLarXiv:2606.02320v22026