Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,541 to 9,600 of 11,411
OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
Yue Ding, Yiyan Ji, Jungang Li +12
cs.CLarXiv:2602.04804v22026SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks
Gabriel Orlanski, Devjeet Roy, Alexander Yun +7
cs.SEcs.AIcs.CLarXiv:2603.24755v22026MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices
Zhiqing Sun, Hongkun Yu, Xiaodan Song +3
cs.CLcs.LGarXiv:2004.02984v22020A Universal Part-of-Speech Tagset
Slav Petrov, Dipanjan Das, Ryan McDonald
cs.CLarXiv:1104.2086v12011Bilinear Attention Networks
Jin-Hwa Kim, Jaehyun Jun, Byoung-Tak Zhang
cs.CVcs.AIcs.CLarXiv:1805.07932v22018Dr. Kernel: Reinforcement Learning Done Right for Triton Kernel Generations
Wei Liu, Jiawei Xu, Yingru Li +4
cs.LGcs.AIcs.CLarXiv:2602.05885v22026The NarrativeQA Reading Comprehension Challenge
Tomáš Kočiský, Jonathan Schwarz, Phil Blunsom +4
cs.CLcs.AIcs.NEarXiv:1712.07040v12017UniXcoder: Unified Cross-Modal Pre-training for Code Representation
Daya Guo, Shuai Lu, Nan Duan +3
cs.CLcs.PLcs.SEarXiv:2203.03850v12022Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation
Zhuolin Yang, Zihan Liu, Yang Chen +14
cs.CLcs.AIcs.LGarXiv:2603.19220v22026$τ$-Knowledge: Evaluating Conversational Agents over Unstructured Knowledge
Quan Shi, Alexandra Zytek, Pedram Razavi +2
cs.AIcs.CLcs.IRarXiv:2603.04370v12026Generalized End-to-End Loss for Speaker Verification
Li Wan, Quan Wang, Alan Papir +1
eess.AScs.CLcs.LGarXiv:1710.10467v52017Rethinking the Trust Region in LLM Reinforcement Learning
Penghui Qi, Xiangxin Zhou, Zichen Liu +4
cs.LGcs.AIcs.CLarXiv:2602.04879v32026AISHELL-1: An Open-Source Mandarin Speech Corpus and A Speech Recognition Baseline
Hui Bu, Jiayu Du, Xingyu Na +2
cs.CLarXiv:1709.05522v12017FinBERT: Financial Sentiment Analysis with Pre-trained Language Models
Dogu Araci
cs.CLcs.LGarXiv:1908.10063v12019PaperBanana: Automating Academic Illustration for AI Scientists
Dawei Zhu, Rui Meng, Yale Song +4
cs.CLcs.CVarXiv:2601.23265v22026MuSiQue: Multihop Questions via Single-hop Question Composition
Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot +1
cs.CLcs.AIarXiv:2108.00573v32021Anatomy of Agentic Memory: Taxonomy and Empirical Analysis of Evaluation and System Limitations
Dongming Jiang, Yi Li, Songtao Wei +8
cs.CLcs.AIarXiv:2602.19320v22026Large Language Model Reasoning Failures
Peiyang Song, Pengrui Han, Noah Goodman
cs.AIcs.CLcs.LGarXiv:2602.06176v12026Compositional Semantic Parsing on Semi-Structured Tables
Panupong Pasupat, Percy Liang
cs.CLarXiv:1508.00305v12015OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning
Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins +10
cs.AIcs.CLcs.IRarXiv:2603.08655v12026REPLUG: Retrieval-Augmented Black-Box Language Models
Weijia Shi, Sewon Min, Michihiro Yasunaga +5
cs.CLarXiv:2301.12652v42023Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
Ailin Huang, Ang Li, Aobo Kong +213
cs.CLcs.AIarXiv:2602.10604v22026OmniGAIA: Towards Native Omni-Modal AI Agents
Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10
cs.AIcs.CLcs.CVarXiv:2602.22897v32026AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration
Jianhao Ruan, Zhihao Xu, Yiran Peng +9
cs.AIcs.CLarXiv:2602.03786v22026DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
Yinger Zhang, Shutong Jiang, Renhao Li +6
cs.AIcs.CLarXiv:2601.18137v12026HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding
Haowei Zhang, Shudong Yang, Jinlan Fu +2
cs.CVcs.AIcs.CLarXiv:2601.14724v42026AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security
Dongrui Liu, Qihan Ren, Chen Qian +40
cs.AIcs.CCcs.CLarXiv:2601.18491v22026Key-Value Memory Networks for Directly Reading Documents
Alexander Miller, Adam Fisch, Jesse Dodge +3
cs.CLarXiv:1606.03126v22016AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations
Minjun Zhu, Zhen Lin, Yixuan Weng +6
cs.AIcs.CLcs.CVarXiv:2602.03828v22026Online Experiential Learning for Language Models
Tianzhu Ye, Li Dong, Qingxiu Dong +3
cs.CLarXiv:2603.16856v22026A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models
Wenqi Fan, Yujuan Ding, Liangbo Ning +5
cs.CLcs.AIcs.IRarXiv:2405.06211v32024MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification
MiroMind Team, S. Bai, L. Bing +41
cs.CLcs.AIcs.IRarXiv:2603.15726v12026UI-Venus-1.5 Technical Report
Venus Team, Changlong Gao, Zhangxuan Gu +24
cs.CVcs.AIcs.CLarXiv:2602.09082v22026Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
Haoming Meng, Kexin Huang, Shaohang Wei +6
cs.CLcs.AIcs.LGarXiv:2603.22446v12026Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond
Jingfeng Yang, Hongye Jin, Ruixiang Tang +5
cs.CLcs.AIcs.LGarXiv:2304.13712v22023MedCLIP: Contrastive Learning from Unpaired Medical Images and Text
Zifeng Wang, Zhenbang Wu, Dinesh Agarwal +1
cs.CVcs.CLarXiv:2210.10163v12022Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations
Peiyi Wang, Lei Li, Zhihong Shao +6
cs.AIcs.CLcs.LGarXiv:2312.08935v32023IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
Yushi Bai, Qian Dong, Ting Jiang +5
cs.CLcs.LGarXiv:2603.12201v12026EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery
Yougang Lyu, Xi Zhang, Xinhao Yi +9
cs.CLarXiv:2603.08127v12026SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
Yuhang Wang, Yuling Shi, Mo Yang +7
cs.SEcs.CLarXiv:2601.16746v42026In-Context Retrieval-Augmented Language Models
Ori Ram, Yoav Levine, Itay Dalmedigos +4
cs.CLcs.IRarXiv:2302.00083v32023BabyVision: Visual Reasoning Beyond Language
Liang Chen, Weichu Xie, Yiyan Liang +27
cs.CVcs.CLarXiv:2601.06521v22026OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
Peng Wang, An Yang, Rui Men +7
cs.CVcs.CLarXiv:2202.03052v22022Endless Terminals: Scaling RL Environments for Terminal Agents
Kanishk Gandhi, Shivam Garg, Noah D. Goodman +1
cs.LGcs.CLarXiv:2601.16443v32026LayoutLM: Pre-training of Text and Layout for Document Image Understanding
Yiheng Xu, Minghao Li, Lei Cui +3
cs.CLarXiv:1912.13318v52019The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale
Guilherme Penedo, Hynek Kydlíček, Loubna Ben allal +5
cs.CLarXiv:2406.17557v22024Comparative Study of CNN and RNN for Natural Language Processing
Wenpeng Yin, Katharina Kann, Mo Yu +1
cs.CLarXiv:1702.01923v12017OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data
Yuwen Du, Rui Ye, Shuo Tang +4
cs.AIcs.CLarXiv:2603.15594v12026Interactive Attention Networks for Aspect-Level Sentiment Classification
Dehong Ma, Sujian Li, Xiaodong Zhang +1
cs.AIcs.CLarXiv:1709.00893v12017A Survey on Large Language Models for Code Generation
Juyong Jiang, Fan Wang, Jiasi Shen +2
cs.CLcs.AIcs.SEarXiv:2406.00515v22024Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints
Jieyu Zhao, Tianlu Wang, Mark Yatskar +2
cs.AIcs.CLcs.CVarXiv:1707.09457v12017REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents
Zheng Chu, Xiao Wang, Jack Hong +11
cs.AIcs.CLarXiv:2602.14234v12026Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Lai Wei, Liangbo He, Jun Lan +9
cs.CVcs.AIcs.CLarXiv:2602.11858v22026Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
Zhaoyang Wang, Canwen Xu, Boyi Liu +5
cs.AIcs.CLcs.LGarXiv:2602.10090v32026NRC-Canada: Building the State-of-the-Art in Sentiment Analysis of Tweets
Saif M. Mohammad, Svetlana Kiritchenko, Xiaodan Zhu
cs.CLarXiv:1308.6242v12013Large Language Model based Multi-Agents: A Survey of Progress and Challenges
Taicheng Guo, Xiuying Chen, Yaqi Wang +5
cs.CLcs.AIcs.MAarXiv:2402.01680v22024Pre-Trained Models: Past, Present and Future
Xu Han, Zhengyan Zhang, Ning Ding +21
cs.AIcs.CLarXiv:2106.07139v32021How Much Knowledge Can You Pack Into the Parameters of a Language Model?
Adam Roberts, Colin Raffel, Noam Shazeer
cs.CLcs.LGstat.MLarXiv:2002.08910v42020A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces
Mingxuan Du, Benfeng Xu, Chiwei Zhu +4
cs.CLarXiv:2602.03442v12026Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs
Miao Xiong, Zhiyuan Hu, Xinyang Lu +4
cs.CLarXiv:2306.13063v22023