Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
7,321 to 7,380 of 11,288
Improving Text Embeddings with Large Language Models
Liang Wang, Nan Yang, Xiaolong Huang +3
cs.CLcs.IRarXiv:2401.00368v32023J-Zero: Unified Challenger--Solver--Judge Co-Evolution from Zero Data
Gyouk Chu, Myeongho Jeon, Eunho Yang
cs.LGcs.AIcs.CLarXiv:2608.26582v12026Capabilities of Gemini Models in Medicine
Khaled Saab, Tao Tu, Wei-Hung Weng +64
cs.AIcs.CLcs.CVarXiv:2404.18416v22024TwinKV: A Composable Repair Pass for KV Cache Eviction via Pairwise Key Redundancy
Hong Chen, Yudong Zeng, Yongwei Huang +3
cs.CLarXiv:2608.27128v12026BASE Layers: Simplifying Training of Large, Sparse Models
Mike Lewis, Shruti Bhosale, Tim Dettmers +2
cs.CLarXiv:2103.16716v12021Neural Symbolic Machines: Learning Semantic Parsers on Freebase with Weak Supervision
Chen Liang, Jonathan Berant, Quoc Le +2
cs.CLcs.AIcs.LGarXiv:1611.00020v42016Movie Description
Anna Rohrbach, Atousa Torabi, Marcus Rohrbach +5
cs.CVcs.CLarXiv:1605.03705v12016UniLMv2: Pseudo-Masked Language Models for Unified Language Model Pre-Training
Hangbo Bao, Li Dong, Furu Wei +8
cs.CLarXiv:2002.12804v12020SPEAR: Distilling Domain-Adaptive Reasoning Skeletons via Sequential Symbolic Alignment in Reinforcement Learning
Zhuochun Li, Yuelyu Ji, Yiming Zeng +1
cs.CLarXiv:2608.26550v12026ONION: A Simple and Effective Defense Against Textual Backdoor Attacks
Fanchao Qi, Yangyi Chen, Mukai Li +3
cs.CLcs.CYarXiv:2011.10369v32020HybridQA: A Dataset of Multi-Hop Question Answering over Tabular and Textual Data
Wenhu Chen, Hanwen Zha, Zhiyu Chen +3
cs.CLcs.AIarXiv:2004.07347v32020Cross-Lingual Alignment Without Joint Training: Do Monolingual Language Models Converge on Universal Representations?
Ej Zhou, Suchir Salhan, Catherine Arnett +1
cs.CLarXiv:2608.27115v12026Controllable Text-to-Image Generation
Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz +1
cs.CVcs.CLcs.LGarXiv:1909.07083v22019Prompting Large Language Model for Machine Translation: A Case Study
Biao Zhang, Barry Haddow, Alexandra Birch
cs.CLcs.LGarXiv:2301.07069v22023Wikipedia-based Semantic Interpretation for Natural Language Processing
Evgeniy Gabrilovich, Shaul Markovitch
cs.CLarXiv:1401.5697v12014Calibrated Enough to Know, Not Calibrated to Act: Fabricated Evidence Makes LLM Agents Commit to the Unknowable
Pranav Aggarwal
cs.AIcs.CLarXiv:2608.27167v12026An Embodied Generalist Agent in 3D World
Jiangyong Huang, Silong Yong, Xiaojian Ma +7
cs.CVcs.AIcs.CLarXiv:2311.12871v32023Orca: Progressive Learning from Complex Explanation Traces of GPT-4
Subhabrata Mukherjee, Arindam Mitra, Ganesh Jawahar +3
cs.CLcs.LGarXiv:2306.02707v12023ChatGPT Beyond English: Towards a Comprehensive Evaluation of Large Language Models in Multilingual Learning
Viet Dac Lai, Nghia Trung Ngo, Amir Pouran Ben Veyseh +4
cs.CLcs.AIarXiv:2304.05613v12023Asking Clarifying Questions in Open-Domain Information-Seeking Conversations
Mohammad Aliannejadi, Hamed Zamani, Fabio Crestani +1
cs.CLcs.AIcs.IRarXiv:1907.06554v12019Joint Embedding of Words and Labels for Text Classification
Guoyin Wang, Chunyuan Li, Wenlin Wang +5
cs.CLcs.LGarXiv:1805.04174v12018InternLM2 Technical Report
Zheng Cai, Maosong Cao, Haojiong Chen +97
cs.CLcs.AIarXiv:2403.17297v12024Fast and Accurate Entity Recognition with Iterated Dilated Convolutions
Emma Strubell, Patrick Verga, David Belanger +1
cs.CLarXiv:1702.02098v32017MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention
Huiqiang Jiang, Yucheng Li, Chengruidong Zhang +9
cs.CLcs.LGarXiv:2407.02490v22024Learning to Compress Prompts with Gist Tokens
Jesse Mu, Xiang Lisa Li, Noah Goodman
cs.CLarXiv:2304.08467v32023Efficient and Effective Text Encoding for Chinese LLaMA and Alpaca
Yiming Cui, Ziqing Yang, Xin Yao
cs.CLcs.HCcs.LGarXiv:2304.08177v32023Large Language Models are Better Reasoners with Self-Verification
Yixuan Weng, Minjun Zhu, Fei Xia +6
cs.AIcs.CLarXiv:2212.09561v52022COSMIC: COmmonSense knowledge for eMotion Identification in Conversations
Deepanway Ghosal, Navonil Majumder, Alexander Gelbukh +2
cs.CLarXiv:2010.02795v12020Information-Guided Frontier Decoding: Contextual Utility-Driven Commitment in dMLLMs
Xingyou Fang, Jingxing Zhong, Xiaosong Yuan +1
cs.CLarXiv:2608.26641v12026CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes
Yufan Wu, Yinghui He, Zhengyi Hu +4
cs.CLarXiv:2608.27455v12026SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification
Xupeng Miao, Gabriele Oliaro, Zhihao Zhang +12
cs.CLcs.DCcs.LGarXiv:2305.09781v42023Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions
Federico Bianchi, Mirac Suzgun, Giuseppe Attanasio +4
cs.CLarXiv:2309.07875v32023Recurrent Highway Networks
Julian Georg Zilly, Rupesh Kumar Srivastava, Jan Koutník +1
cs.LGcs.CLcs.NEarXiv:1607.03474v52016Measuring Compositional Generalization: A Comprehensive Method on Realistic Data
Daniel Keysers, Nathanael Schärli, Nathan Scales +11
cs.LGcs.CLstat.MLarXiv:1912.09713v22019Learning Cooperative Visual Dialog Agents with Deep Reinforcement Learning
Abhishek Das, Satwik Kottur, José M. F. Moura +2
cs.CVcs.AIcs.CLarXiv:1703.06585v22017MEGA: Multilingual Evaluation of Generative AI
Kabir Ahuja, Harshita Diddee, Rishav Hada +9
cs.CLarXiv:2303.12528v42023Evaluating Verifiability in Generative Search Engines
Nelson F. Liu, Tianyi Zhang, Percy Liang
cs.CLcs.IRarXiv:2304.09848v22023An Unsupervised Autoregressive Model for Speech Representation Learning
Yu-An Chung, Wei-Ning Hsu, Hao Tang +1
cs.CLcs.LGcs.SDarXiv:1904.03240v22019Improving Automatic Source Code Summarization via Deep Reinforcement Learning
Yao Wan, Zhou Zhao, Min Yang +4
cs.SEcs.CLcs.LGarXiv:1811.07234v12018Teaching Small Language Models to Reason
Lucie Charlotte Magister, Jonathan Mallinson, Jakub Adamek +2
cs.CLcs.LGarXiv:2212.08410v32022How Does NLP Benefit Legal System: A Summary of Legal Artificial Intelligence
Haoxi Zhong, Chaojun Xiao, Cunchao Tu +3
cs.CLarXiv:2004.12158v52020WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models
Hongliang He, Wenlin Yao, Kaixin Ma +5
cs.CLcs.AIarXiv:2401.13919v42024Breaking the Softmax Bottleneck: A High-Rank RNN Language Model
Zhilin Yang, Zihang Dai, Ruslan Salakhutdinov +1
cs.CLcs.LGarXiv:1711.03953v42017Gated Delta Networks: Improving Mamba2 with Delta Rule
Songlin Yang, Jan Kautz, Ali Hatamizadeh
cs.CLcs.LGarXiv:2412.06464v32024PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification
Yinfei Yang, Yuan Zhang, Chris Tar +1
cs.CLarXiv:1908.11828v12019ITL: Interpretable Document Alignment with Structured Reference Frameworks
Raúl Giráldez, Dayrelis Mena, Jesús S. Aguilar--Ruiz
cs.CLarXiv:2608.27031v12026Summaries:한국어De-identification of Patient Notes with Recurrent Neural Networks
Franck Dernoncourt, Ji Young Lee, Ozlem Uzuner +1
cs.CLcs.AIcs.NEarXiv:1606.03475v12016Summaries:한국어FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts
Yichen Gong, Delong Ran, Jinyuan Liu +5
cs.CRcs.AIcs.CLarXiv:2311.05608v32023From Atomic to Agentic: Towards Interpretable Evaluation of LLMs' Agentic Mathematical Capabilities
Jiayi Kuang, Yinghui Li, Yunze Song +11
cs.AIcs.CLarXiv:2608.26950v12026Long-Term Trends in the Public Perception of Artificial Intelligence
Ethan Fast, Eric Horvitz
cs.CLcs.AIcs.CYarXiv:1609.04904v22016Measuring the Reliability of Hate Speech Annotations: The Case of the European Refugee Crisis
Björn Ross, Michael Rist, Guillermo Carbonell +3
cs.CLarXiv:1701.08118v12017AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning
Qingru Zhang, Minshuo Chen, Alexander Bukharin +5
cs.CLcs.LGarXiv:2303.10512v22023Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers
Chenglei Si, Diyi Yang, Tatsunori Hashimoto
cs.CLcs.AIcs.CYarXiv:2409.04109v12024SGM: Sequence Generation Model for Multi-label Classification
Pengcheng Yang, Xu Sun, Wei Li +3
cs.CLarXiv:1806.04822v32018How Good is Your Tokenizer? On the Monolingual Performance of Multilingual Language Models
Phillip Rust, Jonas Pfeiffer, Ivan Vulić +2
cs.CLarXiv:2012.15613v22020Neural Ranking Models with Weak Supervision
Mostafa Dehghani, Hamed Zamani, Aliaksei Severyn +2
cs.IRcs.CLcs.LGarXiv:1704.08803v22017What Makes Good Agentic Data? An ACE Lens on Data Generation for LLM Agents
Xingshan Zeng, Zishan Xu, Boju Zhang +11
cs.AIcs.CLarXiv:2608.27260v12026Summaries:한국어Gated-Attention Readers for Text Comprehension
Bhuwan Dhingra, Hanxiao Liu, Zhilin Yang +2
cs.CLcs.LGarXiv:1606.01549v32016Sentence Simplification with Deep Reinforcement Learning
Xingxing Zhang, Mirella Lapata
cs.CLcs.LGarXiv:1703.10931v22017Transformative Effects of ChatGPT on Modern Education: Emerging Era of AI Chatbots
Sukhpal Singh Gill, Minxian Xu, Panos Patros +18
cs.CYcs.AIcs.CLarXiv:2306.03823v12023