Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,481 to 6,540 of 11,310
MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image
Alan Arazi, Eilam Shapira, Shoham Grunblat +8
cs.LGcs.CLcs.CVarXiv:2605.10616v12026SEIF: Self-Evolving Reinforcement Learning for Instruction Following
Qingyu Ren, Qianyu He, Jiajie Zhu +7
cs.CLarXiv:2605.07465v12026FlowPIE: Test-Time Scientific Idea Evolution with Flow-Guided Literature Exploration
Qiyao Wang, Hongbo Wang, Longze Chen +6
cs.AIcs.CLarXiv:2603.29557v12026SWE-CI: Evaluating Agent Capabilities in Maintaining Codebases via Continuous Integration
Jialong Chen, Xander Xu, Hu Wei +2
cs.SEcs.AIcs.CLarXiv:2603.03823v42026Query-focused and Memory-aware Reranker for Long Context Processing
Yuqing Li, Jiangnan Li, Mo Yu +5
cs.CLarXiv:2602.12192v32026Executable Code Actions Elicit Better LLM Agents
Xingyao Wang, Yangyi Chen, Lifan Yuan +4
cs.CLcs.AIarXiv:2402.01030v42024MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback
Xingyao Wang, Zihan Wang, Jiateng Liu +4
cs.CLcs.AIcs.LGarXiv:2309.10691v32023Tool Learning with Foundation Models
Yujia Qin, Shengding Hu, Yankai Lin +38
cs.CLcs.AIcs.LGarXiv:2304.08354v32023Sparks of Artificial General Intelligence: Early experiments with GPT-4
Sébastien Bubeck, Varun Chandrasekaran, Ronen Eldan +11
cs.CLcs.AIarXiv:2303.12712v52023Emergent Analogical Reasoning in Large Language Models
Taylor Webb, Keith J. Holyoak, Hongjing Lu
cs.AIcs.CLarXiv:2212.09196v32022Overview of the TREC 2020 deep learning track
Nick Craswell, Bhaskar Mitra, Emine Yilmaz +1
cs.IRcs.AIcs.CLarXiv:2102.07662v12021Overview of the TREC 2019 deep learning track
Nick Craswell, Bhaskar Mitra, Emine Yilmaz +2
cs.IRcs.CLcs.LGarXiv:2003.07820v22020TransG : A Generative Mixture Model for Knowledge Graph Embedding
Han Xiao, Minlie Huang, Yu Hao +1
cs.CLarXiv:1509.05488v72015A Survey on Dialogue Systems: Recent Advances and New Frontiers
Hongshen Chen, Xiaorui Liu, Dawei Yin +1
cs.CLarXiv:1711.01731v32017Aspect Sentiment Quad Prediction as Paraphrase Generation
Wenxuan Zhang, Yang Deng, Xin Li +3
cs.CLarXiv:2110.00796v12021Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study
Shusheng Xu, Wei Fu, Jiaxuan Gao +6
cs.CLarXiv:2404.10719v32024Learning to Transduce with Unbounded Memory
Edward Grefenstette, Karl Moritz Hermann, Mustafa Suleyman +1
cs.NEcs.CLcs.LGarXiv:1506.02516v32015Benchmarking Natural Language Understanding Services for building Conversational Agents
Xingkun Liu, Arash Eshghi, Pawel Swietojanski +1
cs.CLcs.LGarXiv:1903.05566v32019StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding
Wei Wang, Bin Bi, Ming Yan +5
cs.CLarXiv:1908.04577v32019Simplify the Usage of Lexicon in Chinese NER
Ruotian Ma, Minlong Peng, Qi Zhang +1
cs.CLarXiv:1908.05969v22019Evaluating the Ripple Effects of Knowledge Editing in Language Models
Roi Cohen, Eden Biran, Ori Yoran +2
cs.CLarXiv:2307.12976v22023AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation
Junyang Wang, Yuhang Wang, Guohai Xu +8
cs.CLcs.CVarXiv:2311.07397v22023Multi-Channel Graph Neural Network for Entity Alignment
Yixin Cao, Zhiyuan Liu, Chengjiang Li +3
cs.CLarXiv:1908.09898v12019Multi-Modal Knowledge Graph Construction and Application: A Survey
Xiangru Zhu, Zhixu Li, Xiaodan Wang +5
cs.AIcs.CLcs.CVarXiv:2202.05786v22022PaLI-X: On Scaling up a Multilingual Vision and Language Model
Xi Chen, Josip Djolonga, Piotr Padlewski +40
cs.CVcs.CLcs.LGarXiv:2305.18565v12023ChipNeMo: Domain-Adapted LLMs for Chip Design
Mingjie Liu, Teodor-Dumitru Ene, Robert Kirby +39
cs.CLarXiv:2311.00176v52023Surface Form Competition: Why the Highest Probability Answer Isn't Always Right
Ari Holtzman, Peter West, Vered Shwartz +2
cs.CLarXiv:2104.08315v92021A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration
Zijun Liu, Yanzhe Zhang, Peng Li +2
cs.CLcs.AIcs.MAarXiv:2310.02170v22023DALL-Eval: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models
Jaemin Cho, Abhay Zala, Mohit Bansal
cs.CVcs.AIcs.CLarXiv:2202.04053v32022DetectLLM: Leveraging Log Rank Information for Zero-Shot Detection of Machine-Generated Text
Jinyan Su, Terry Yue Zhuo, Di Wang +1
cs.CLcs.AIarXiv:2306.05540v12023Improving Multi-hop Knowledge Base Question Answering by Learning Intermediate Supervision Signals
Gaole He, Yunshi Lan, Jing Jiang +2
cs.CLcs.AIarXiv:2101.03737v22021ZeroGen: Efficient Zero-shot Learning via Dataset Generation
Jiacheng Ye, Jiahui Gao, Qintong Li +5
cs.CLcs.AIarXiv:2202.07922v22022Image-embodied Knowledge Representation Learning
Ruobing Xie, Zhiyuan Liu, Huanbo Luan +1
cs.CVcs.CLarXiv:1609.07028v22016SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models
Ziyi Lin, Chris Liu, Renrui Zhang +13
cs.CVcs.AIcs.CLarXiv:2311.07575v12023STC Antispoofing Systems for the ASVspoof2019 Challenge
Galina Lavrentyeva, Sergey Novoselov, Andzhukaev Tseren +3
cs.SDcs.CLcs.CRarXiv:1904.05576v12019Magicoder: Empowering Code Generation with OSS-Instruct
Yuxiang Wei, Zhe Wang, Jiawei Liu +2
cs.CLcs.AIcs.SEarXiv:2312.02120v22023Does Fine-Tuning LLMs on New Knowledge Encourage Hallucinations?
Zorik Gekhman, Gal Yona, Roee Aharoni +4
cs.CLarXiv:2405.05904v32024OPT-IML: Scaling Language Model Instruction Meta Learning through the Lens of Generalization
Srinivasan Iyer, Xi Victoria Lin, Ramakanth Pasunuru +15
cs.CLarXiv:2212.12017v32022Improving Neural Language Models with a Continuous Cache
Edouard Grave, Armand Joulin, Nicolas Usunier
cs.CLcs.LGarXiv:1612.04426v12016DuReader: a Chinese Machine Reading Comprehension Dataset from Real-world Applications
Wei He, Kai Liu, Jing Liu +10
cs.CLarXiv:1711.05073v42017Few-NERD: A Few-Shot Named Entity Recognition Dataset
Ning Ding, Guangwei Xu, Yulin Chen +5
cs.CLcs.AIcs.LGarXiv:2105.07464v62021What the DAAM: Interpreting Stable Diffusion Using Cross Attention
Raphael Tang, Linqing Liu, Akshat Pandey +6
cs.CVcs.CLarXiv:2210.04885v52022Knowledge-Enriched Transformer for Emotion Detection in Textual Conversations
Peixiang Zhong, Di Wang, Chunyan Miao
cs.CLcs.AIcs.LGarXiv:1909.10681v22019Learning to Exploit Long-term Relational Dependencies in Knowledge Graphs
Lingbing Guo, Zequn Sun, Wei Hu
cs.AIcs.CLcs.LGarXiv:1905.04914v12019ASQA: Factoid Questions Meet Long-Form Answers
Ivan Stelmakh, Yi Luan, Bhuwan Dhingra +1
cs.CLarXiv:2204.06092v22022Advances in Joint CTC-Attention based End-to-End Speech Recognition with a Deep CNN Encoder and RNN-LM
Takaaki Hori, Shinji Watanabe, Yu Zhang +1
cs.CLarXiv:1706.02737v12017Automatic Detection of Machine Generated Text: A Critical Survey
Ganesh Jawahar, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan
cs.CLcs.AIarXiv:2011.01314v12020RECOMP: Improving Retrieval-Augmented LMs with Compression and Selective Augmentation
Fangyuan Xu, Weijia Shi, Eunsol Choi
cs.CLarXiv:2310.04408v12023Deep Learning for Text Style Transfer: A Survey
Di Jin, Zhijing Jin, Zhiting Hu +2
cs.CLcs.AIcs.LGarXiv:2011.00416v52020Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
Yuzhuang Xu, Shuo Wang, Peng Li +4
cs.CLarXiv:2309.04658v22023Language Conditioned Imitation Learning over Unstructured Data
Corey Lynch, Pierre Sermanet
cs.ROcs.AIcs.CLarXiv:2005.07648v22020Tangled up in BLEU: Reevaluating the Evaluation of Automatic Machine Translation Evaluation Metrics
Nitika Mathur, Timothy Baldwin, Trevor Cohn
cs.CLarXiv:2006.06264v22020Multi-task self-supervised learning for Robust Speech Recognition
Mirco Ravanelli, Jianyuan Zhong, Santiago Pascual +4
eess.AScs.CLcs.LGarXiv:2001.09239v22020Condenser: a Pre-training Architecture for Dense Retrieval
Luyu Gao, Jamie Callan
cs.CLcs.IRarXiv:2104.08253v22021AttentionXML: Label Tree-based Attention-Aware Deep Model for High-Performance Extreme Multi-Label Text Classification
Ronghui You, Zihan Zhang, Ziye Wang +3
cs.CLcs.LGarXiv:1811.01727v32018Towards End-to-End Reinforcement Learning of Dialogue Agents for Information Access
Bhuwan Dhingra, Lihong Li, Xiujun Li +4
cs.CLcs.LGarXiv:1609.00777v32016Fake News Identification on Twitter with Hybrid CNN and RNN Models
Oluwaseun Ajao, Deepayan Bhowmik, Shahrzad Zargari
cs.SIcs.CLarXiv:1806.11316v12018Hash Layers For Large Sparse Models
Stephen Roller, Sainbayar Sukhbaatar, Arthur Szlam +1
cs.LGcs.CLarXiv:2106.04426v32021Multi-Pointer Co-Attention Networks for Recommendation
Yi Tay, Luu Anh Tuan, Siu Cheung Hui
cs.CLcs.AIcs.IRarXiv:1801.09251v22018Sophia: A Scalable Stochastic Second-order Optimizer for Language Model Pre-training
Hong Liu, Zhiyuan Li, David Hall +2
cs.LGcs.CLmath.OCarXiv:2305.14342v42023