Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

7,321 to 7,380 of 11,288

  1. Improving Text Embeddings with Large Language Models

    Liang Wang, Nan Yang, Xiaolong Huang +3

    cs.CLcs.IRarXiv:2401.00368v32023
  2. J-Zero: Unified Challenger--Solver--Judge Co-Evolution from Zero Data

    Gyouk Chu, Myeongho Jeon, Eunho Yang

    cs.LGcs.AIcs.CLarXiv:2608.26582v12026
  3. Capabilities of Gemini Models in Medicine

    Khaled Saab, Tao Tu, Wei-Hung Weng +64

    cs.AIcs.CLcs.CVarXiv:2404.18416v22024
  4. TwinKV: A Composable Repair Pass for KV Cache Eviction via Pairwise Key Redundancy

    Hong Chen, Yudong Zeng, Yongwei Huang +3

    cs.CLarXiv:2608.27128v12026
  5. BASE Layers: Simplifying Training of Large, Sparse Models

    Mike Lewis, Shruti Bhosale, Tim Dettmers +2

    cs.CLarXiv:2103.16716v12021
  6. Neural Symbolic Machines: Learning Semantic Parsers on Freebase with Weak Supervision

    Chen Liang, Jonathan Berant, Quoc Le +2

    cs.CLcs.AIcs.LGarXiv:1611.00020v42016
  7. Movie Description

    Anna Rohrbach, Atousa Torabi, Marcus Rohrbach +5

    cs.CVcs.CLarXiv:1605.03705v12016
  8. UniLMv2: Pseudo-Masked Language Models for Unified Language Model Pre-Training

    Hangbo Bao, Li Dong, Furu Wei +8

    cs.CLarXiv:2002.12804v12020
  9. SPEAR: Distilling Domain-Adaptive Reasoning Skeletons via Sequential Symbolic Alignment in Reinforcement Learning

    Zhuochun Li, Yuelyu Ji, Yiming Zeng +1

    cs.CLarXiv:2608.26550v12026
  10. ONION: A Simple and Effective Defense Against Textual Backdoor Attacks

    Fanchao Qi, Yangyi Chen, Mukai Li +3

    cs.CLcs.CYarXiv:2011.10369v32020
  11. HybridQA: A Dataset of Multi-Hop Question Answering over Tabular and Textual Data

    Wenhu Chen, Hanwen Zha, Zhiyu Chen +3

    cs.CLcs.AIarXiv:2004.07347v32020
  12. Cross-Lingual Alignment Without Joint Training: Do Monolingual Language Models Converge on Universal Representations?

    Ej Zhou, Suchir Salhan, Catherine Arnett +1

    cs.CLarXiv:2608.27115v12026
  13. Controllable Text-to-Image Generation

    Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz +1

    cs.CVcs.CLcs.LGarXiv:1909.07083v22019
  14. Prompting Large Language Model for Machine Translation: A Case Study

    Biao Zhang, Barry Haddow, Alexandra Birch

    cs.CLcs.LGarXiv:2301.07069v22023
  15. Wikipedia-based Semantic Interpretation for Natural Language Processing

    Evgeniy Gabrilovich, Shaul Markovitch

    cs.CLarXiv:1401.5697v12014
  16. Calibrated Enough to Know, Not Calibrated to Act: Fabricated Evidence Makes LLM Agents Commit to the Unknowable

    Pranav Aggarwal

    cs.AIcs.CLarXiv:2608.27167v12026
  17. An Embodied Generalist Agent in 3D World

    Jiangyong Huang, Silong Yong, Xiaojian Ma +7

    cs.CVcs.AIcs.CLarXiv:2311.12871v32023
  18. Orca: Progressive Learning from Complex Explanation Traces of GPT-4

    Subhabrata Mukherjee, Arindam Mitra, Ganesh Jawahar +3

    cs.CLcs.LGarXiv:2306.02707v12023
  19. ChatGPT Beyond English: Towards a Comprehensive Evaluation of Large Language Models in Multilingual Learning

    Viet Dac Lai, Nghia Trung Ngo, Amir Pouran Ben Veyseh +4

    cs.CLcs.AIarXiv:2304.05613v12023
  20. Asking Clarifying Questions in Open-Domain Information-Seeking Conversations

    Mohammad Aliannejadi, Hamed Zamani, Fabio Crestani +1

    cs.CLcs.AIcs.IRarXiv:1907.06554v12019
  21. Joint Embedding of Words and Labels for Text Classification

    Guoyin Wang, Chunyuan Li, Wenlin Wang +5

    cs.CLcs.LGarXiv:1805.04174v12018
  22. InternLM2 Technical Report

    Zheng Cai, Maosong Cao, Haojiong Chen +97

    cs.CLcs.AIarXiv:2403.17297v12024
  23. Fast and Accurate Entity Recognition with Iterated Dilated Convolutions

    Emma Strubell, Patrick Verga, David Belanger +1

    cs.CLarXiv:1702.02098v32017
  24. MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention

    Huiqiang Jiang, Yucheng Li, Chengruidong Zhang +9

    cs.CLcs.LGarXiv:2407.02490v22024
  25. Learning to Compress Prompts with Gist Tokens

    Jesse Mu, Xiang Lisa Li, Noah Goodman

    cs.CLarXiv:2304.08467v32023
  26. Efficient and Effective Text Encoding for Chinese LLaMA and Alpaca

    Yiming Cui, Ziqing Yang, Xin Yao

    cs.CLcs.HCcs.LGarXiv:2304.08177v32023
  27. Large Language Models are Better Reasoners with Self-Verification

    Yixuan Weng, Minjun Zhu, Fei Xia +6

    cs.AIcs.CLarXiv:2212.09561v52022
  28. COSMIC: COmmonSense knowledge for eMotion Identification in Conversations

    Deepanway Ghosal, Navonil Majumder, Alexander Gelbukh +2

    cs.CLarXiv:2010.02795v12020
  29. Information-Guided Frontier Decoding: Contextual Utility-Driven Commitment in dMLLMs

    Xingyou Fang, Jingxing Zhong, Xiaosong Yuan +1

    cs.CLarXiv:2608.26641v12026
  30. CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes

    Yufan Wu, Yinghui He, Zhengyi Hu +4

    cs.CLarXiv:2608.27455v12026
  31. SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification

    Xupeng Miao, Gabriele Oliaro, Zhihao Zhang +12

    cs.CLcs.DCcs.LGarXiv:2305.09781v42023
  32. Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions

    Federico Bianchi, Mirac Suzgun, Giuseppe Attanasio +4

    cs.CLarXiv:2309.07875v32023
  33. Recurrent Highway Networks

    Julian Georg Zilly, Rupesh Kumar Srivastava, Jan Koutník +1

    cs.LGcs.CLcs.NEarXiv:1607.03474v52016
  34. Measuring Compositional Generalization: A Comprehensive Method on Realistic Data

    Daniel Keysers, Nathanael Schärli, Nathan Scales +11

    cs.LGcs.CLstat.MLarXiv:1912.09713v22019
  35. Learning Cooperative Visual Dialog Agents with Deep Reinforcement Learning

    Abhishek Das, Satwik Kottur, José M. F. Moura +2

    cs.CVcs.AIcs.CLarXiv:1703.06585v22017
  36. MEGA: Multilingual Evaluation of Generative AI

    Kabir Ahuja, Harshita Diddee, Rishav Hada +9

    cs.CLarXiv:2303.12528v42023
  37. Evaluating Verifiability in Generative Search Engines

    Nelson F. Liu, Tianyi Zhang, Percy Liang

    cs.CLcs.IRarXiv:2304.09848v22023
  38. An Unsupervised Autoregressive Model for Speech Representation Learning

    Yu-An Chung, Wei-Ning Hsu, Hao Tang +1

    cs.CLcs.LGcs.SDarXiv:1904.03240v22019
  39. Improving Automatic Source Code Summarization via Deep Reinforcement Learning

    Yao Wan, Zhou Zhao, Min Yang +4

    cs.SEcs.CLcs.LGarXiv:1811.07234v12018
  40. Teaching Small Language Models to Reason

    Lucie Charlotte Magister, Jonathan Mallinson, Jakub Adamek +2

    cs.CLcs.LGarXiv:2212.08410v32022
  41. How Does NLP Benefit Legal System: A Summary of Legal Artificial Intelligence

    Haoxi Zhong, Chaojun Xiao, Cunchao Tu +3

    cs.CLarXiv:2004.12158v52020
  42. WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models

    Hongliang He, Wenlin Yao, Kaixin Ma +5

    cs.CLcs.AIarXiv:2401.13919v42024
  43. Breaking the Softmax Bottleneck: A High-Rank RNN Language Model

    Zhilin Yang, Zihang Dai, Ruslan Salakhutdinov +1

    cs.CLcs.LGarXiv:1711.03953v42017
  44. Gated Delta Networks: Improving Mamba2 with Delta Rule

    Songlin Yang, Jan Kautz, Ali Hatamizadeh

    cs.CLcs.LGarXiv:2412.06464v32024
  45. PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification

    Yinfei Yang, Yuan Zhang, Chris Tar +1

    cs.CLarXiv:1908.11828v12019
  46. ITL: Interpretable Document Alignment with Structured Reference Frameworks

    Raúl Giráldez, Dayrelis Mena, Jesús S. Aguilar--Ruiz

    cs.CLarXiv:2608.27031v12026
    Summaries:한국어
  47. De-identification of Patient Notes with Recurrent Neural Networks

    Franck Dernoncourt, Ji Young Lee, Ozlem Uzuner +1

    cs.CLcs.AIcs.NEarXiv:1606.03475v12016
    Summaries:한국어
  48. FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts

    Yichen Gong, Delong Ran, Jinyuan Liu +5

    cs.CRcs.AIcs.CLarXiv:2311.05608v32023
  49. From Atomic to Agentic: Towards Interpretable Evaluation of LLMs' Agentic Mathematical Capabilities

    Jiayi Kuang, Yinghui Li, Yunze Song +11

    cs.AIcs.CLarXiv:2608.26950v12026
  50. Long-Term Trends in the Public Perception of Artificial Intelligence

    Ethan Fast, Eric Horvitz

    cs.CLcs.AIcs.CYarXiv:1609.04904v22016
  51. Measuring the Reliability of Hate Speech Annotations: The Case of the European Refugee Crisis

    Björn Ross, Michael Rist, Guillermo Carbonell +3

    cs.CLarXiv:1701.08118v12017
  52. AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning

    Qingru Zhang, Minshuo Chen, Alexander Bukharin +5

    cs.CLcs.LGarXiv:2303.10512v22023
  53. Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers

    Chenglei Si, Diyi Yang, Tatsunori Hashimoto

    cs.CLcs.AIcs.CYarXiv:2409.04109v12024
  54. SGM: Sequence Generation Model for Multi-label Classification

    Pengcheng Yang, Xu Sun, Wei Li +3

    cs.CLarXiv:1806.04822v32018
  55. How Good is Your Tokenizer? On the Monolingual Performance of Multilingual Language Models

    Phillip Rust, Jonas Pfeiffer, Ivan Vulić +2

    cs.CLarXiv:2012.15613v22020
  56. Neural Ranking Models with Weak Supervision

    Mostafa Dehghani, Hamed Zamani, Aliaksei Severyn +2

    cs.IRcs.CLcs.LGarXiv:1704.08803v22017
  57. What Makes Good Agentic Data? An ACE Lens on Data Generation for LLM Agents

    Xingshan Zeng, Zishan Xu, Boju Zhang +11

    cs.AIcs.CLarXiv:2608.27260v12026
    Summaries:한국어
  58. Gated-Attention Readers for Text Comprehension

    Bhuwan Dhingra, Hanxiao Liu, Zhilin Yang +2

    cs.CLcs.LGarXiv:1606.01549v32016
  59. Sentence Simplification with Deep Reinforcement Learning

    Xingxing Zhang, Mirella Lapata

    cs.CLcs.LGarXiv:1703.10931v22017
  60. Transformative Effects of ChatGPT on Modern Education: Emerging Era of AI Chatbots

    Sukhpal Singh Gill, Minxian Xu, Panos Patros +18

    cs.CYcs.AIcs.CLarXiv:2306.03823v12023