Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
9,421 to 9,480 of 11,349
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
Ziyang Luo, Can Xu, Pu Zhao +7
cs.CLcs.AIarXiv:2306.08568v22023PaLI: A Jointly-Scaled Multilingual Language-Image Model
Xi Chen, Xiao Wang, Soravit Changpinyo +26
cs.CVcs.CLarXiv:2209.06794v42022Evaluating the Factual Consistency of Abstractive Text Summarization
Wojciech Kryściński, Bryan McCann, Caiming Xiong +1
cs.CLarXiv:1910.12840v12019Forest Before Trees: Latent Superposition for Efficient Visual Reasoning
Yubo Wang, Juntian Zhang, Yichen Wu +3
cs.CLcs.CVarXiv:2601.06803v22026Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems
Wang Ling, Dani Yogatama, Chris Dyer +1
cs.AIcs.CLcs.LGarXiv:1705.04146v32017Automatic Chain of Thought Prompting in Large Language Models
Zhuosheng Zhang, Aston Zhang, Mu Li +1
cs.CLcs.AIarXiv:2210.03493v12022$V_1$: Unifying Generation and Self-Verification for Parallel Reasoners
Harman Singh, Xiuyu Li, Kusha Sareen +14
cs.CLarXiv:2603.04304v12026ERNIE: Enhanced Representation through Knowledge Integration
Yu Sun, Shuohuan Wang, Yukun Li +7
cs.CLarXiv:1904.09223v12019Baichuan 2: Open Large-scale Language Models
Aiyuan Yang, Bin Xiao, Bingning Wang +52
cs.CLarXiv:2309.10305v42023SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training
Huatong Song, Lisheng Huang, Shuang Sun +11
cs.SEcs.CLarXiv:2602.03411v22026TweetEval: Unified Benchmark and Comparative Evaluation for Tweet Classification
Francesco Barbieri, Jose Camacho-Collados, Leonardo Neves +1
cs.CLcs.SIarXiv:2010.12421v22020Accelerating Large Language Model Decoding with Speculative Sampling
Charlie Chen, Sebastian Borgeaud, Geoffrey Irving +3
cs.CLarXiv:2302.01318v12023Diachronic Word Embeddings Reveal Statistical Laws of Semantic Change
William L. Hamilton, Jure Leskovec, Dan Jurafsky
cs.CLarXiv:1605.09096v62016GPT-NeoX-20B: An Open-Source Autoregressive Language Model
Sid Black, Stella Biderman, Eric Hallahan +14
cs.CLarXiv:2204.06745v12022Toward Controlled Generation of Text
Zhiting Hu, Zichao Yang, Xiaodan Liang +2
cs.LGcs.AIcs.CLarXiv:1703.00955v42017What you can cram into a single vector: Probing sentence embeddings for linguistic properties
Alexis Conneau, German Kruszewski, Guillaume Lample +2
cs.CLarXiv:1805.01070v22018Wizard of Wikipedia: Knowledge-Powered Conversational agents
Emily Dinan, Stephen Roller, Kurt Shuster +3
cs.CLarXiv:1811.01241v22018Towards a Human-like Open-Domain Chatbot
Daniel Adiwardana, Minh-Thang Luong, David R. So +8
cs.CLcs.LGcs.NEarXiv:2001.09977v32020LaSER: Internalizing Explicit Reasoning into Latent Space for Dense Retrieval
Jiajie Jin, Yanzhao Zhang, Mingxin Li +4
cs.CLcs.IRarXiv:2603.01425v12026On Using Very Large Target Vocabulary for Neural Machine Translation
Sébastien Jean, Kyunghyun Cho, Roland Memisevic +1
cs.CLarXiv:1412.2007v22014SWE-rebench V2: Language-Agnostic SWE Task Collection at Scale
Ibragim Badertdinov, Maksim Nekrashevich, Anton Shevtsov +1
cs.SEcs.CLarXiv:2602.23866v22026Generating Natural Language Adversarial Examples
Moustafa Alzantot, Yash Sharma, Ahmed Elgohary +3
cs.CLarXiv:1804.07998v22018Hybrid Linear Attention Done Right: Efficient Distillation and Effective Architectures for Extremely Long Contexts
Yingfa Chen, Zhen Leng Thai, Zihan Zhou +6
cs.CLcs.AIcs.LGarXiv:2601.22156v12026Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
Shaotian Yan, Kaiyuan Liu, Chen Shen +6
cs.LGcs.CLarXiv:2601.09088v12026Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models
Yu Zeng, Wenxuan Huang, Zhen Fang +14
cs.CVcs.AIcs.CLarXiv:2602.02185v22026HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe
cs.CLcs.AIcs.DLarXiv:2601.18724v12026DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models
Damai Dai, Chengqi Deng, Chenggang Zhao +14
cs.CLarXiv:2401.06066v12024Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
Yifan Wang, Shiyu Li, Peiming Li +3
cs.CLcs.CVarXiv:2601.14750v42026Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook
Ming Li, Xirui Li, Tianyi Zhou
cs.CLcs.AIcs.CYarXiv:2602.14299v22026Tiny Aya: Bridging Scale and Multilingual Depth
Alejandro R. Salamanca, Diana Abagyan, Daniel D'souza +23
cs.CLarXiv:2603.11510v12026Unsupervised Cross-lingual Representation Learning for Speech Recognition
Alexis Conneau, Alexei Baevski, Ronan Collobert +2
cs.CLcs.LGcs.SDarXiv:2006.13979v22020SWE-World: Building Software Engineering Agents in Docker-Free Environments
Shuang Sun, Huatong Song, Lisheng Huang +11
cs.SEcs.CLarXiv:2602.03419v12026MOSS-TTS Technical Report
Yitian Gong, Botian Jiang, Yiwei Zhao +23
cs.SDcs.AIcs.CLarXiv:2603.18090v22026COMET: Commonsense Transformers for Automatic Knowledge Graph Construction
Antoine Bosselut, Hannah Rashkin, Maarten Sap +3
cs.CLcs.AIarXiv:1906.05317v22019Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes
Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh +6
cs.CLcs.AIcs.LGarXiv:2305.02301v22023Order Matters: Sequence to sequence for sets
Oriol Vinyals, Samy Bengio, Manjunath Kudlur
stat.MLcs.CLcs.LGarXiv:1511.06391v42015Instruction-Following Evaluation for Large Language Models
Jeffrey Zhou, Tianjian Lu, Swaroop Mishra +5
cs.CLcs.AIcs.LGarXiv:2311.07911v12023SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks
Mingqian Feng, Xiaodong Liu, Weiwei Yang +4
cs.CLarXiv:2602.06854v22026Code2World: A GUI World Model via Renderable Code Generation
Yuhao Zheng, Li'an Zhong, Yi Wang +6
cs.CVcs.AIcs.CLarXiv:2602.09856v12026Theory of Space: Can Foundation Models Construct Spatial Beliefs through Active Exploration?
Pingyue Zhang, Zihan Huang, Yue Wang +11
cs.AIcs.CLcs.LGarXiv:2602.07055v12026Med-BERT: pre-trained contextualized embeddings on large-scale structured electronic health records for disease prediction
Laila Rasmy, Yang Xiang, Ziqian Xie +2
cs.CLcs.LGcs.NEarXiv:2005.12833v12020Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
Changze Lv, Jie Zhou, Wentao Zhao +13
cs.CLarXiv:2602.03619v22026From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents
Ling Yue, Kushal Raj Bhandari, Ching-Yun Ko +6
cs.AIcs.CLarXiv:2603.22386v12026SummEval: Re-evaluating Summarization Evaluation
Alexander R. Fabbri, Wojciech Kryściński, Bryan McCann +3
cs.CLarXiv:2007.12626v42020Large Language Models: A Survey
Shervin Minaee, Tomas Mikolov, Narjes Nikzad +4
cs.CLcs.AIarXiv:2402.06196v32024Self-Hinting Language Models Enhance Reinforcement Learning
Baohao Liao, Hanze Dong, Xinxing Xu +2
cs.LGcs.AIcs.CLarXiv:2602.03143v12026LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries
Shijie Lian, Bin Yu, Xiaopeng Lin +6
cs.AIcs.CLcs.CVarXiv:2601.15197v72026Reinforcement World Model Learning for LLM-based Agents
Xiao Yu, Baolin Peng, Ruize Xu +6
cs.CLarXiv:2602.05842v22026Fish Audio S2 Technical Report
Shijia Liao, Yuxuan Wang, Songting Liu +11
cs.SDcs.AIcs.CLarXiv:2603.08823v22026jina-embeddings-v5-text: Task-Targeted Embedding Distillation
Mohammad Kalim Akram, Saba Sturua, Nastia Havriushenko +4
cs.CLarXiv:2602.15547v22026OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent
Bowen Yang, Kaiming Jin, Zhenyu Wu +12
cs.MAcs.AIcs.CLarXiv:2601.07779v12026VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models
Wenlong Huang, Chen Wang, Ruohan Zhang +3
cs.ROcs.AIcs.CLarXiv:2307.05973v22023Can Large Language Models Be an Alternative to Human Evaluations?
Cheng-Han Chiang, Hung-yi Lee
cs.CLcs.HCarXiv:2305.01937v12023Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability
Shobhita Sundaram, John Quan, Ariel Kwiatkowski +3
cs.LGcs.CLarXiv:2601.18778v32026MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use
Mengru Wang, Haozhe Luo, Zhenqian Xu +6
cs.AIcs.CLcs.CYarXiv:2608.20202v12026Large-Scale Terminal Agentic Trajectory Generation from Dockerized Environments
Siwei Wu, Yizhi Li, Yuyang Song +8
cs.CLarXiv:2602.01244v32026Intern-S1-Pro: Scientific Multimodal Foundation Model at Trillion Scale
Yicheng Zou, Dongsheng Zhu, Lin Zhu +174
cs.LGcs.CLcs.CVarXiv:2603.25040v22026Benchmark Test-Time Scaling of General LLM Agents
Xiaochuan Li, Ryan Ming, Pranav Setlur +6
cs.AIcs.CLarXiv:2602.18998v12026OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
Yue Ding, Yiyan Ji, Jungang Li +12
cs.CLarXiv:2602.04804v22026SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks
Gabriel Orlanski, Devjeet Roy, Alexander Yun +7
cs.SEcs.AIcs.CLarXiv:2603.24755v22026