Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,481 to 6,540 of 11,310

  1. MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image

    Alan Arazi, Eilam Shapira, Shoham Grunblat +8

    cs.LGcs.CLcs.CVarXiv:2605.10616v12026
  2. SEIF: Self-Evolving Reinforcement Learning for Instruction Following

    Qingyu Ren, Qianyu He, Jiajie Zhu +7

    cs.CLarXiv:2605.07465v12026
  3. FlowPIE: Test-Time Scientific Idea Evolution with Flow-Guided Literature Exploration

    Qiyao Wang, Hongbo Wang, Longze Chen +6

    cs.AIcs.CLarXiv:2603.29557v12026
  4. SWE-CI: Evaluating Agent Capabilities in Maintaining Codebases via Continuous Integration

    Jialong Chen, Xander Xu, Hu Wei +2

    cs.SEcs.AIcs.CLarXiv:2603.03823v42026
  5. Query-focused and Memory-aware Reranker for Long Context Processing

    Yuqing Li, Jiangnan Li, Mo Yu +5

    cs.CLarXiv:2602.12192v32026
  6. Executable Code Actions Elicit Better LLM Agents

    Xingyao Wang, Yangyi Chen, Lifan Yuan +4

    cs.CLcs.AIarXiv:2402.01030v42024
  7. MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback

    Xingyao Wang, Zihan Wang, Jiateng Liu +4

    cs.CLcs.AIcs.LGarXiv:2309.10691v32023
  8. Tool Learning with Foundation Models

    Yujia Qin, Shengding Hu, Yankai Lin +38

    cs.CLcs.AIcs.LGarXiv:2304.08354v32023
  9. Sparks of Artificial General Intelligence: Early experiments with GPT-4

    Sébastien Bubeck, Varun Chandrasekaran, Ronen Eldan +11

    cs.CLcs.AIarXiv:2303.12712v52023
  10. Emergent Analogical Reasoning in Large Language Models

    Taylor Webb, Keith J. Holyoak, Hongjing Lu

    cs.AIcs.CLarXiv:2212.09196v32022
  11. Overview of the TREC 2020 deep learning track

    Nick Craswell, Bhaskar Mitra, Emine Yilmaz +1

    cs.IRcs.AIcs.CLarXiv:2102.07662v12021
  12. Overview of the TREC 2019 deep learning track

    Nick Craswell, Bhaskar Mitra, Emine Yilmaz +2

    cs.IRcs.CLcs.LGarXiv:2003.07820v22020
  13. TransG : A Generative Mixture Model for Knowledge Graph Embedding

    Han Xiao, Minlie Huang, Yu Hao +1

    cs.CLarXiv:1509.05488v72015
  14. A Survey on Dialogue Systems: Recent Advances and New Frontiers

    Hongshen Chen, Xiaorui Liu, Dawei Yin +1

    cs.CLarXiv:1711.01731v32017
  15. Aspect Sentiment Quad Prediction as Paraphrase Generation

    Wenxuan Zhang, Yang Deng, Xin Li +3

    cs.CLarXiv:2110.00796v12021
  16. Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study

    Shusheng Xu, Wei Fu, Jiaxuan Gao +6

    cs.CLarXiv:2404.10719v32024
  17. Learning to Transduce with Unbounded Memory

    Edward Grefenstette, Karl Moritz Hermann, Mustafa Suleyman +1

    cs.NEcs.CLcs.LGarXiv:1506.02516v32015
  18. Benchmarking Natural Language Understanding Services for building Conversational Agents

    Xingkun Liu, Arash Eshghi, Pawel Swietojanski +1

    cs.CLcs.LGarXiv:1903.05566v32019
  19. StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding

    Wei Wang, Bin Bi, Ming Yan +5

    cs.CLarXiv:1908.04577v32019
  20. Simplify the Usage of Lexicon in Chinese NER

    Ruotian Ma, Minlong Peng, Qi Zhang +1

    cs.CLarXiv:1908.05969v22019
  21. Evaluating the Ripple Effects of Knowledge Editing in Language Models

    Roi Cohen, Eden Biran, Ori Yoran +2

    cs.CLarXiv:2307.12976v22023
  22. AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation

    Junyang Wang, Yuhang Wang, Guohai Xu +8

    cs.CLcs.CVarXiv:2311.07397v22023
  23. Multi-Channel Graph Neural Network for Entity Alignment

    Yixin Cao, Zhiyuan Liu, Chengjiang Li +3

    cs.CLarXiv:1908.09898v12019
  24. Multi-Modal Knowledge Graph Construction and Application: A Survey

    Xiangru Zhu, Zhixu Li, Xiaodan Wang +5

    cs.AIcs.CLcs.CVarXiv:2202.05786v22022
  25. PaLI-X: On Scaling up a Multilingual Vision and Language Model

    Xi Chen, Josip Djolonga, Piotr Padlewski +40

    cs.CVcs.CLcs.LGarXiv:2305.18565v12023
  26. ChipNeMo: Domain-Adapted LLMs for Chip Design

    Mingjie Liu, Teodor-Dumitru Ene, Robert Kirby +39

    cs.CLarXiv:2311.00176v52023
  27. Surface Form Competition: Why the Highest Probability Answer Isn't Always Right

    Ari Holtzman, Peter West, Vered Shwartz +2

    cs.CLarXiv:2104.08315v92021
  28. A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration

    Zijun Liu, Yanzhe Zhang, Peng Li +2

    cs.CLcs.AIcs.MAarXiv:2310.02170v22023
  29. DALL-Eval: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models

    Jaemin Cho, Abhay Zala, Mohit Bansal

    cs.CVcs.AIcs.CLarXiv:2202.04053v32022
  30. DetectLLM: Leveraging Log Rank Information for Zero-Shot Detection of Machine-Generated Text

    Jinyan Su, Terry Yue Zhuo, Di Wang +1

    cs.CLcs.AIarXiv:2306.05540v12023
  31. Improving Multi-hop Knowledge Base Question Answering by Learning Intermediate Supervision Signals

    Gaole He, Yunshi Lan, Jing Jiang +2

    cs.CLcs.AIarXiv:2101.03737v22021
  32. ZeroGen: Efficient Zero-shot Learning via Dataset Generation

    Jiacheng Ye, Jiahui Gao, Qintong Li +5

    cs.CLcs.AIarXiv:2202.07922v22022
  33. Image-embodied Knowledge Representation Learning

    Ruobing Xie, Zhiyuan Liu, Huanbo Luan +1

    cs.CVcs.CLarXiv:1609.07028v22016
  34. SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models

    Ziyi Lin, Chris Liu, Renrui Zhang +13

    cs.CVcs.AIcs.CLarXiv:2311.07575v12023
  35. STC Antispoofing Systems for the ASVspoof2019 Challenge

    Galina Lavrentyeva, Sergey Novoselov, Andzhukaev Tseren +3

    cs.SDcs.CLcs.CRarXiv:1904.05576v12019
  36. Magicoder: Empowering Code Generation with OSS-Instruct

    Yuxiang Wei, Zhe Wang, Jiawei Liu +2

    cs.CLcs.AIcs.SEarXiv:2312.02120v22023
  37. Does Fine-Tuning LLMs on New Knowledge Encourage Hallucinations?

    Zorik Gekhman, Gal Yona, Roee Aharoni +4

    cs.CLarXiv:2405.05904v32024
  38. OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization

    Srinivasan Iyer, Xi Victoria Lin, Ramakanth Pasunuru +15

    cs.CLarXiv:2212.12017v32022
  39. Improving Neural Language Models with a Continuous Cache

    Edouard Grave, Armand Joulin, Nicolas Usunier

    cs.CLcs.LGarXiv:1612.04426v12016
  40. DuReader: a Chinese Machine Reading Comprehension Dataset from Real-world Applications

    Wei He, Kai Liu, Jing Liu +10

    cs.CLarXiv:1711.05073v42017
  41. Few-NERD: A Few-Shot Named Entity Recognition Dataset

    Ning Ding, Guangwei Xu, Yulin Chen +5

    cs.CLcs.AIcs.LGarXiv:2105.07464v62021
  42. What the DAAM: Interpreting Stable Diffusion Using Cross Attention

    Raphael Tang, Linqing Liu, Akshat Pandey +6

    cs.CVcs.CLarXiv:2210.04885v52022
  43. Knowledge-Enriched Transformer for Emotion Detection in Textual Conversations

    Peixiang Zhong, Di Wang, Chunyan Miao

    cs.CLcs.AIcs.LGarXiv:1909.10681v22019
  44. Learning to Exploit Long-term Relational Dependencies in Knowledge Graphs

    Lingbing Guo, Zequn Sun, Wei Hu

    cs.AIcs.CLcs.LGarXiv:1905.04914v12019
  45. ASQA: Factoid Questions Meet Long-Form Answers

    Ivan Stelmakh, Yi Luan, Bhuwan Dhingra +1

    cs.CLarXiv:2204.06092v22022
  46. Advances in Joint CTC-Attention based End-to-End Speech Recognition with a Deep CNN Encoder and RNN-LM

    Takaaki Hori, Shinji Watanabe, Yu Zhang +1

    cs.CLarXiv:1706.02737v12017
  47. Automatic Detection of Machine Generated Text: A Critical Survey

    Ganesh Jawahar, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan

    cs.CLcs.AIarXiv:2011.01314v12020
  48. RECOMP: Improving Retrieval-Augmented LMs with Compression and Selective Augmentation

    Fangyuan Xu, Weijia Shi, Eunsol Choi

    cs.CLarXiv:2310.04408v12023
  49. Deep Learning for Text Style Transfer: A Survey

    Di Jin, Zhijing Jin, Zhiting Hu +2

    cs.CLcs.AIcs.LGarXiv:2011.00416v52020
  50. Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf

    Yuzhuang Xu, Shuo Wang, Peng Li +4

    cs.CLarXiv:2309.04658v22023
  51. Language Conditioned Imitation Learning over Unstructured Data

    Corey Lynch, Pierre Sermanet

    cs.ROcs.AIcs.CLarXiv:2005.07648v22020
  52. Tangled up in BLEU: Reevaluating the Evaluation of Automatic Machine Translation Evaluation Metrics

    Nitika Mathur, Timothy Baldwin, Trevor Cohn

    cs.CLarXiv:2006.06264v22020
  53. Multi-task self-supervised learning for Robust Speech Recognition

    Mirco Ravanelli, Jianyuan Zhong, Santiago Pascual +4

    eess.AScs.CLcs.LGarXiv:2001.09239v22020
  54. Condenser: a Pre-training Architecture for Dense Retrieval

    Luyu Gao, Jamie Callan

    cs.CLcs.IRarXiv:2104.08253v22021
  55. AttentionXML: Label Tree-based Attention-Aware Deep Model for High-Performance Extreme Multi-Label Text Classification

    Ronghui You, Zihan Zhang, Ziye Wang +3

    cs.CLcs.LGarXiv:1811.01727v32018
  56. Towards End-to-End Reinforcement Learning of Dialogue Agents for Information Access

    Bhuwan Dhingra, Lihong Li, Xiujun Li +4

    cs.CLcs.LGarXiv:1609.00777v32016
  57. Fake News Identification on Twitter with Hybrid CNN and RNN Models

    Oluwaseun Ajao, Deepayan Bhowmik, Shahrzad Zargari

    cs.SIcs.CLarXiv:1806.11316v12018
  58. Hash Layers For Large Sparse Models

    Stephen Roller, Sainbayar Sukhbaatar, Arthur Szlam +1

    cs.LGcs.CLarXiv:2106.04426v32021
  59. Multi-Pointer Co-Attention Networks for Recommendation

    Yi Tay, Luu Anh Tuan, Siu Cheung Hui

    cs.CLcs.AIcs.IRarXiv:1801.09251v22018
  60. Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-training

    Hong Liu, Zhiyuan Li, David Hall +2

    cs.LGcs.CLmath.OCarXiv:2305.14342v42023