Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,541 to 9,600 of 11,411

  1. OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models

    Yue Ding, Yiyan Ji, Jungang Li +12

    cs.CLarXiv:2602.04804v22026
  2. SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks

    Gabriel Orlanski, Devjeet Roy, Alexander Yun +7

    cs.SEcs.AIcs.CLarXiv:2603.24755v22026
  3. MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices

    Zhiqing Sun, Hongkun Yu, Xiaodan Song +3

    cs.CLcs.LGarXiv:2004.02984v22020
  4. A Universal Part-of-Speech Tagset

    Slav Petrov, Dipanjan Das, Ryan McDonald

    cs.CLarXiv:1104.2086v12011
  5. Bilinear Attention Networks

    Jin-Hwa Kim, Jaehyun Jun, Byoung-Tak Zhang

    cs.CVcs.AIcs.CLarXiv:1805.07932v22018
  6. Dr. Kernel: Reinforcement Learning Done Right for Triton Kernel Generations

    Wei Liu, Jiawei Xu, Yingru Li +4

    cs.LGcs.AIcs.CLarXiv:2602.05885v22026
  7. The NarrativeQA Reading Comprehension Challenge

    Tomáš Kočiský, Jonathan Schwarz, Phil Blunsom +4

    cs.CLcs.AIcs.NEarXiv:1712.07040v12017
  8. UniXcoder: Unified Cross-Modal Pre-training for Code Representation

    Daya Guo, Shuai Lu, Nan Duan +3

    cs.CLcs.PLcs.SEarXiv:2203.03850v12022
  9. Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation

    Zhuolin Yang, Zihan Liu, Yang Chen +14

    cs.CLcs.AIcs.LGarXiv:2603.19220v22026
  10. $τ$-Knowledge: Evaluating Conversational Agents over Unstructured Knowledge

    Quan Shi, Alexandra Zytek, Pedram Razavi +2

    cs.AIcs.CLcs.IRarXiv:2603.04370v12026
  11. Generalized End-to-End Loss for Speaker Verification

    Li Wan, Quan Wang, Alan Papir +1

    eess.AScs.CLcs.LGarXiv:1710.10467v52017
  12. Rethinking the Trust Region in LLM Reinforcement Learning

    Penghui Qi, Xiangxin Zhou, Zichen Liu +4

    cs.LGcs.AIcs.CLarXiv:2602.04879v32026
  13. AISHELL-1: An Open-Source Mandarin Speech Corpus and A Speech Recognition Baseline

    Hui Bu, Jiayu Du, Xingyu Na +2

    cs.CLarXiv:1709.05522v12017
  14. FinBERT: Financial Sentiment Analysis with Pre-trained Language Models

    Dogu Araci

    cs.CLcs.LGarXiv:1908.10063v12019
  15. PaperBanana: Automating Academic Illustration for AI Scientists

    Dawei Zhu, Rui Meng, Yale Song +4

    cs.CLcs.CVarXiv:2601.23265v22026
  16. MuSiQue: Multihop Questions via Single-hop Question Composition

    Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot +1

    cs.CLcs.AIarXiv:2108.00573v32021
  17. Anatomy of Agentic Memory: Taxonomy and Empirical Analysis of Evaluation and System Limitations

    Dongming Jiang, Yi Li, Songtao Wei +8

    cs.CLcs.AIarXiv:2602.19320v22026
  18. Large Language Model Reasoning Failures

    Peiyang Song, Pengrui Han, Noah Goodman

    cs.AIcs.CLcs.LGarXiv:2602.06176v12026
  19. Compositional Semantic Parsing on Semi-Structured Tables

    Panupong Pasupat, Percy Liang

    cs.CLarXiv:1508.00305v12015
  20. OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning

    Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins +10

    cs.AIcs.CLcs.IRarXiv:2603.08655v12026
  21. REPLUG: Retrieval-Augmented Black-Box Language Models

    Weijia Shi, Sewon Min, Michihiro Yasunaga +5

    cs.CLarXiv:2301.12652v42023
  22. Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

    Ailin Huang, Ang Li, Aobo Kong +213

    cs.CLcs.AIarXiv:2602.10604v22026
  23. OmniGAIA: Towards Native Omni-Modal AI Agents

    Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10

    cs.AIcs.CLcs.CVarXiv:2602.22897v32026
  24. AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration

    Jianhao Ruan, Zhihao Xu, Yiran Peng +9

    cs.AIcs.CLarXiv:2602.03786v22026
  25. DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints

    Yinger Zhang, Shutong Jiang, Renhao Li +6

    cs.AIcs.CLarXiv:2601.18137v12026
  26. HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding

    Haowei Zhang, Shudong Yang, Jinlan Fu +2

    cs.CVcs.AIcs.CLarXiv:2601.14724v42026
  27. AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security

    Dongrui Liu, Qihan Ren, Chen Qian +40

    cs.AIcs.CCcs.CLarXiv:2601.18491v22026
  28. Key-Value Memory Networks for Directly Reading Documents

    Alexander Miller, Adam Fisch, Jesse Dodge +3

    cs.CLarXiv:1606.03126v22016
  29. AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations

    Minjun Zhu, Zhen Lin, Yixuan Weng +6

    cs.AIcs.CLcs.CVarXiv:2602.03828v22026
  30. Online Experiential Learning for Language Models

    Tianzhu Ye, Li Dong, Qingxiu Dong +3

    cs.CLarXiv:2603.16856v22026
  31. A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models

    Wenqi Fan, Yujuan Ding, Liangbo Ning +5

    cs.CLcs.AIcs.IRarXiv:2405.06211v32024
  32. MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification

    MiroMind Team, S. Bai, L. Bing +41

    cs.CLcs.AIcs.IRarXiv:2603.15726v12026
  33. UI-Venus-1.5 Technical Report

    Venus Team, Changlong Gao, Zhangxuan Gu +24

    cs.CVcs.AIcs.CLarXiv:2602.09082v22026
  34. Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs

    Haoming Meng, Kexin Huang, Shaohang Wei +6

    cs.CLcs.AIcs.LGarXiv:2603.22446v12026
  35. Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond

    Jingfeng Yang, Hongye Jin, Ruixiang Tang +5

    cs.CLcs.AIcs.LGarXiv:2304.13712v22023
  36. MedCLIP: Contrastive Learning from Unpaired Medical Images and Text

    Zifeng Wang, Zhenbang Wu, Dinesh Agarwal +1

    cs.CVcs.CLarXiv:2210.10163v12022
  37. Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations

    Peiyi Wang, Lei Li, Zhihong Shao +6

    cs.AIcs.CLcs.LGarXiv:2312.08935v32023
  38. IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse

    Yushi Bai, Qian Dong, Ting Jiang +5

    cs.CLcs.LGarXiv:2603.12201v12026
  39. EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery

    Yougang Lyu, Xi Zhang, Xinhao Yi +9

    cs.CLarXiv:2603.08127v12026
  40. SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents

    Yuhang Wang, Yuling Shi, Mo Yang +7

    cs.SEcs.CLarXiv:2601.16746v42026
  41. In-Context Retrieval-Augmented Language Models

    Ori Ram, Yoav Levine, Itay Dalmedigos +4

    cs.CLcs.IRarXiv:2302.00083v32023
  42. BabyVision: Visual Reasoning Beyond Language

    Liang Chen, Weichu Xie, Yiyan Liang +27

    cs.CVcs.CLarXiv:2601.06521v22026
  43. OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    Peng Wang, An Yang, Rui Men +7

    cs.CVcs.CLarXiv:2202.03052v22022
  44. Endless Terminals: Scaling RL Environments for Terminal Agents

    Kanishk Gandhi, Shivam Garg, Noah D. Goodman +1

    cs.LGcs.CLarXiv:2601.16443v32026
  45. LayoutLM: Pre-training of Text and Layout for Document Image Understanding

    Yiheng Xu, Minghao Li, Lei Cui +3

    cs.CLarXiv:1912.13318v52019
  46. The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale

    Guilherme Penedo, Hynek Kydlíček, Loubna Ben allal +5

    cs.CLarXiv:2406.17557v22024
  47. Comparative Study of CNN and RNN for Natural Language Processing

    Wenpeng Yin, Katharina Kann, Mo Yu +1

    cs.CLarXiv:1702.01923v12017
  48. OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data

    Yuwen Du, Rui Ye, Shuo Tang +4

    cs.AIcs.CLarXiv:2603.15594v12026
  49. Interactive Attention Networks for Aspect-Level Sentiment Classification

    Dehong Ma, Sujian Li, Xiaodong Zhang +1

    cs.AIcs.CLarXiv:1709.00893v12017
  50. A Survey on Large Language Models for Code Generation

    Juyong Jiang, Fan Wang, Jiasi Shen +2

    cs.CLcs.AIcs.SEarXiv:2406.00515v22024
  51. Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints

    Jieyu Zhao, Tianlu Wang, Mark Yatskar +2

    cs.AIcs.CLcs.CVarXiv:1707.09457v12017
  52. REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents

    Zheng Chu, Xiao Wang, Jack Hong +11

    cs.AIcs.CLarXiv:2602.14234v12026
  53. Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

    Lai Wei, Liangbo He, Jun Lan +9

    cs.CVcs.AIcs.CLarXiv:2602.11858v22026
  54. Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning

    Zhaoyang Wang, Canwen Xu, Boyi Liu +5

    cs.AIcs.CLcs.LGarXiv:2602.10090v32026
  55. NRC-Canada: Building the State-of-the-Art in Sentiment Analysis of Tweets

    Saif M. Mohammad, Svetlana Kiritchenko, Xiaodan Zhu

    cs.CLarXiv:1308.6242v12013
  56. Large Language Model based Multi-Agents: A Survey of Progress and Challenges

    Taicheng Guo, Xiuying Chen, Yaqi Wang +5

    cs.CLcs.AIcs.MAarXiv:2402.01680v22024
  57. Pre-Trained Models: Past, Present and Future

    Xu Han, Zhengyan Zhang, Ning Ding +21

    cs.AIcs.CLarXiv:2106.07139v32021
  58. How Much Knowledge Can You Pack Into the Parameters of a Language Model?

    Adam Roberts, Colin Raffel, Noam Shazeer

    cs.CLcs.LGstat.MLarXiv:2002.08910v42020
  59. A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces

    Mingxuan Du, Benfeng Xu, Chiwei Zhu +4

    cs.CLarXiv:2602.03442v12026
  60. Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs

    Miao Xiong, Zhiyuan Hu, Xinyang Lu +4

    cs.CLarXiv:2306.13063v22023