Computation and Language

Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,421 to 9,480 of 11,349

  1. WizardCoder: Empowering Code Large Language Models with Evol-Instruct

    Ziyang Luo, Can Xu, Pu Zhao +7

    cs.CLcs.AIarXiv:2306.08568v22023
  2. PaLI: A Jointly-Scaled Multilingual Language-Image Model

    Xi Chen, Xiao Wang, Soravit Changpinyo +26

    cs.CVcs.CLarXiv:2209.06794v42022
  3. Evaluating the Factual Consistency of Abstractive Text Summarization

    Wojciech Kryściński, Bryan McCann, Caiming Xiong +1

    cs.CLarXiv:1910.12840v12019
  4. Forest Before Trees: Latent Superposition for Efficient Visual Reasoning

    Yubo Wang, Juntian Zhang, Yichen Wu +3

    cs.CLcs.CVarXiv:2601.06803v22026
  5. Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems

    Wang Ling, Dani Yogatama, Chris Dyer +1

    cs.AIcs.CLcs.LGarXiv:1705.04146v32017
  6. Automatic Chain of Thought Prompting in Large Language Models

    Zhuosheng Zhang, Aston Zhang, Mu Li +1

    cs.CLcs.AIarXiv:2210.03493v12022
  7. $V_1$: Unifying Generation and Self-Verification for Parallel Reasoners

    Harman Singh, Xiuyu Li, Kusha Sareen +14

    cs.CLarXiv:2603.04304v12026
  8. ERNIE: Enhanced Representation through Knowledge Integration

    Yu Sun, Shuohuan Wang, Yukun Li +7

    cs.CLarXiv:1904.09223v12019
  9. Baichuan 2: Open Large-scale Language Models

    Aiyuan Yang, Bin Xiao, Bingning Wang +52

    cs.CLarXiv:2309.10305v42023
  10. SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training

    Huatong Song, Lisheng Huang, Shuang Sun +11

    cs.SEcs.CLarXiv:2602.03411v22026
  11. TweetEval: Unified Benchmark and Comparative Evaluation for Tweet Classification

    Francesco Barbieri, Jose Camacho-Collados, Leonardo Neves +1

    cs.CLcs.SIarXiv:2010.12421v22020
  12. Accelerating Large Language Model Decoding with Speculative Sampling

    Charlie Chen, Sebastian Borgeaud, Geoffrey Irving +3

    cs.CLarXiv:2302.01318v12023
  13. Diachronic Word Embeddings Reveal Statistical Laws of Semantic Change

    William L. Hamilton, Jure Leskovec, Dan Jurafsky

    cs.CLarXiv:1605.09096v62016
  14. GPT-NeoX-20B: An Open-Source Autoregressive Language Model

    Sid Black, Stella Biderman, Eric Hallahan +14

    cs.CLarXiv:2204.06745v12022
  15. Toward Controlled Generation of Text

    Zhiting Hu, Zichao Yang, Xiaodan Liang +2

    cs.LGcs.AIcs.CLarXiv:1703.00955v42017
  16. What you can cram into a single vector: Probing sentence embeddings for linguistic properties

    Alexis Conneau, German Kruszewski, Guillaume Lample +2

    cs.CLarXiv:1805.01070v22018
  17. Wizard of Wikipedia: Knowledge-Powered Conversational agents

    Emily Dinan, Stephen Roller, Kurt Shuster +3

    cs.CLarXiv:1811.01241v22018
  18. Towards a Human-like Open-Domain Chatbot

    Daniel Adiwardana, Minh-Thang Luong, David R. So +8

    cs.CLcs.LGcs.NEarXiv:2001.09977v32020
  19. LaSER: Internalizing Explicit Reasoning into Latent Space for Dense Retrieval

    Jiajie Jin, Yanzhao Zhang, Mingxin Li +4

    cs.CLcs.IRarXiv:2603.01425v12026
  20. On Using Very Large Target Vocabulary for Neural Machine Translation

    Sébastien Jean, Kyunghyun Cho, Roland Memisevic +1

    cs.CLarXiv:1412.2007v22014
  21. SWE-rebench V2: Language-Agnostic SWE Task Collection at Scale

    Ibragim Badertdinov, Maksim Nekrashevich, Anton Shevtsov +1

    cs.SEcs.CLarXiv:2602.23866v22026
  22. Generating Natural Language Adversarial Examples

    Moustafa Alzantot, Yash Sharma, Ahmed Elgohary +3

    cs.CLarXiv:1804.07998v22018
  23. Hybrid Linear Attention Done Right: Efficient Distillation and Effective Architectures for Extremely Long Contexts

    Yingfa Chen, Zhen Leng Thai, Zihan Zhou +6

    cs.CLcs.AIcs.LGarXiv:2601.22156v12026
  24. Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning

    Shaotian Yan, Kaiyuan Liu, Chen Shen +6

    cs.LGcs.CLarXiv:2601.09088v12026
  25. Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models

    Yu Zeng, Wenxuan Huang, Zhen Fang +14

    cs.CVcs.AIcs.CLarXiv:2602.02185v22026
  26. HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences

    Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe

    cs.CLcs.AIcs.DLarXiv:2601.18724v12026
  27. DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models

    Damai Dai, Chengqi Deng, Chenggang Zhao +14

    cs.CLarXiv:2401.06066v12024
  28. Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning

    Yifan Wang, Shiyu Li, Peiming Li +3

    cs.CLcs.CVarXiv:2601.14750v42026
  29. Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook

    Ming Li, Xirui Li, Tianyi Zhou

    cs.CLcs.AIcs.CYarXiv:2602.14299v22026
  30. Tiny Aya: Bridging Scale and Multilingual Depth

    Alejandro R. Salamanca, Diana Abagyan, Daniel D'souza +23

    cs.CLarXiv:2603.11510v12026
  31. Unsupervised Cross-lingual Representation Learning for Speech Recognition

    Alexis Conneau, Alexei Baevski, Ronan Collobert +2

    cs.CLcs.LGcs.SDarXiv:2006.13979v22020
  32. SWE-World: Building Software Engineering Agents in Docker-Free Environments

    Shuang Sun, Huatong Song, Lisheng Huang +11

    cs.SEcs.CLarXiv:2602.03419v12026
  33. MOSS-TTS Technical Report

    Yitian Gong, Botian Jiang, Yiwei Zhao +23

    cs.SDcs.AIcs.CLarXiv:2603.18090v22026
  34. COMET: Commonsense Transformers for Automatic Knowledge Graph Construction

    Antoine Bosselut, Hannah Rashkin, Maarten Sap +3

    cs.CLcs.AIarXiv:1906.05317v22019
  35. Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes

    Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh +6

    cs.CLcs.AIcs.LGarXiv:2305.02301v22023
  36. Order Matters: Sequence to sequence for sets

    Oriol Vinyals, Samy Bengio, Manjunath Kudlur

    stat.MLcs.CLcs.LGarXiv:1511.06391v42015
  37. Instruction-Following Evaluation for Large Language Models

    Jeffrey Zhou, Tianjian Lu, Swaroop Mishra +5

    cs.CLcs.AIcs.LGarXiv:2311.07911v12023
  38. SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks

    Mingqian Feng, Xiaodong Liu, Weiwei Yang +4

    cs.CLarXiv:2602.06854v22026
  39. Code2World: A GUI World Model via Renderable Code Generation

    Yuhao Zheng, Li'an Zhong, Yi Wang +6

    cs.CVcs.AIcs.CLarXiv:2602.09856v12026
  40. Theory of Space: Can Foundation Models Construct Spatial Beliefs through Active Exploration?

    Pingyue Zhang, Zihan Huang, Yue Wang +11

    cs.AIcs.CLcs.LGarXiv:2602.07055v12026
  41. Med-BERT: pre-trained contextualized embeddings on large-scale structured electronic health records for disease prediction

    Laila Rasmy, Yang Xiang, Ziqian Xie +2

    cs.CLcs.LGcs.NEarXiv:2005.12833v12020
  42. Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation

    Changze Lv, Jie Zhou, Wentao Zhao +13

    cs.CLarXiv:2602.03619v22026
  43. From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents

    Ling Yue, Kushal Raj Bhandari, Ching-Yun Ko +6

    cs.AIcs.CLarXiv:2603.22386v12026
  44. SummEval: Re-evaluating Summarization Evaluation

    Alexander R. Fabbri, Wojciech Kryściński, Bryan McCann +3

    cs.CLarXiv:2007.12626v42020
  45. Large Language Models: A Survey

    Shervin Minaee, Tomas Mikolov, Narjes Nikzad +4

    cs.CLcs.AIarXiv:2402.06196v32024
  46. Self-Hinting Language Models Enhance Reinforcement Learning

    Baohao Liao, Hanze Dong, Xinxing Xu +2

    cs.LGcs.AIcs.CLarXiv:2602.03143v12026
  47. LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries

    Shijie Lian, Bin Yu, Xiaopeng Lin +6

    cs.AIcs.CLcs.CVarXiv:2601.15197v72026
  48. Reinforcement World Model Learning for LLM-based Agents

    Xiao Yu, Baolin Peng, Ruize Xu +6

    cs.CLarXiv:2602.05842v22026
  49. Fish Audio S2 Technical Report

    Shijia Liao, Yuxuan Wang, Songting Liu +11

    cs.SDcs.AIcs.CLarXiv:2603.08823v22026
  50. jina-embeddings-v5-text: Task-Targeted Embedding Distillation

    Mohammad Kalim Akram, Saba Sturua, Nastia Havriushenko +4

    cs.CLarXiv:2602.15547v22026
  51. OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent

    Bowen Yang, Kaiming Jin, Zhenyu Wu +12

    cs.MAcs.AIcs.CLarXiv:2601.07779v12026
  52. VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models

    Wenlong Huang, Chen Wang, Ruohan Zhang +3

    cs.ROcs.AIcs.CLarXiv:2307.05973v22023
  53. Can Large Language Models Be an Alternative to Human Evaluations?

    Cheng-Han Chiang, Hung-yi Lee

    cs.CLcs.HCarXiv:2305.01937v12023
  54. Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability

    Shobhita Sundaram, John Quan, Ariel Kwiatkowski +3

    cs.LGcs.CLarXiv:2601.18778v32026
  55. MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use

    Mengru Wang, Haozhe Luo, Zhenqian Xu +6

    cs.AIcs.CLcs.CYarXiv:2608.20202v12026
  56. Large-Scale Terminal Agentic Trajectory Generation from Dockerized Environments

    Siwei Wu, Yizhi Li, Yuyang Song +8

    cs.CLarXiv:2602.01244v32026
  57. Intern-S1-Pro: Scientific Multimodal Foundation Model at Trillion Scale

    Yicheng Zou, Dongsheng Zhu, Lin Zhu +174

    cs.LGcs.CLcs.CVarXiv:2603.25040v22026
  58. Benchmark Test-Time Scaling of General LLM Agents

    Xiaochuan Li, Ryan Ming, Pranav Setlur +6

    cs.AIcs.CLarXiv:2602.18998v12026
  59. OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models

    Yue Ding, Yiyan Ji, Jungang Li +12

    cs.CLarXiv:2602.04804v22026
  60. SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasks

    Gabriel Orlanski, Devjeet Roy, Alexander Yun +7

    cs.SEcs.AIcs.CLarXiv:2603.24755v22026