Computation and Language
Papers filed under cs.CL on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,921 to 10,980 of 11,238
Ling and Ring 2.6 Technical Report: Efficient and Instant Agentic Intelligence at Trillion-Parameter Scale
Ang Li, Ben Liu, Bin Han +215
cs.CLcs.AIarXiv:2606.15079v12026Implicit Reasoning for Large Language Model-based Generative Recommendation
Yinhan He, Liam Collins, Bhuvesh Kumar +3
cs.CLcs.AIarXiv:2606.14142v32026RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards
Gaotang Li, Bhavana Dalvi Mishra, Zifeng Wang +9
cs.CLcs.LGarXiv:2605.10899v12026Adaptive Teacher Exposure for Self-Distillation in LLM Reasoning
Zihao Han, Tiangang Zhang, Huaibin Wang +1
cs.AIcs.CLcs.LOarXiv:2605.11458v32026IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation
Shijie Lian, Bin Yu, Xiaopeng Lin +8
cs.ROcs.AIcs.CLarXiv:2605.14712v22026Mint-Agent: Introducing Finance-Native Agentic Foundation Models
Mint-Agent Team, B. Zhang, Yaze Geng +7
cs.CLcs.LGarXiv:2608.16386v12026Is this Citation on Point?
Apurv Verma
cs.DLcs.CLarXiv:2608.12571v12026VTInstructor: Visual Trajectory Prompting for Navigation Instruction Generation in Continuous Environments
Haolin Yang, Yuxing Long, Zihan Yang +1
cs.ROcs.AIcs.CLarXiv:2608.15284v12026RamseyGadgets: A Graph Construction Dataset for LLMs
Zohair Raza Hassan, Deepak Pandita
cs.CLcs.AIarXiv:2608.14999v12026AutoMem: A Text-Gradient Recursive Self-Improvement Framework for Automated Memory Architectures Search
Lin Du, Jie Zhou, Yuxuan Cai +6
cs.CLcs.AIarXiv:2608.14621v12026Tapered Language Models
Reza Bayat, Ali Behrouz, Aaron Courville
cs.LGcs.AIcs.CLarXiv:2606.23670v12026Personalized Auto-Research: Towards a True AI Co-Scientist
Bo Ni, Franck Dernoncourt, Hongjie Chen +5
cs.AIcs.CLarXiv:2608.14881v12026OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents
Jiahao Ying, Boxian Ai, Wei Tang +2
cs.CLarXiv:2605.23657v22026OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
Rui Yang, Qianhui Wu, Yuxi Chen +7
cs.LGcs.AIcs.CLarXiv:2606.02031v22026Poise: Position-Aware One-Instruction Skill Injection for Silent Execution on LLM Agents
Haochang Hao, Dehai Min, Zhifang Zhang +4
cs.CRcs.AIcs.CLarXiv:2606.07943v22026LENS: In-Context Search via Latent Evidence Exploration over Dynamic Raw Documents
Xingjun Wang, Gongsheng Li, Qi Fan +3
cs.CLcs.AIarXiv:2608.16185v12026MMAE: A Massive Multitask Audio Editing Benchmark
Ziyang Ma, Ruiqi Yan, Ruiyang Xu +35
cs.SDcs.CLcs.MMarXiv:2606.07229v12026Prescriptive Scaling Laws for Data Constrained Training
Justin Lovelace, Christian Belardi, Srivatsa Kundurthy +2
cs.LGcs.CLarXiv:2605.01640v12026ClawGym: A Scalable Framework for Building Effective Claw Agents
Fei Bai, Huatong Song, Shuang Sun +11
cs.CLcs.AIcs.LGarXiv:2604.26904v32026T-LLM Compiler: Trusted LLM-based Code Optimization and Verification Framework
Zahra Fazel, Sunanda Gamage, Shayan Shirahmad Gale Bagi +5
cs.AIcs.CLcs.LGarXiv:2608.14953v12026LLM Agents Already Know When to Call Tools -- Even Without Reasoning
Chung-En Sun, Linbo Liu, Ge Yan +2
cs.CLarXiv:2605.09252v22026Summaries:한국어Solve the Loop: Attractor Models for Language and Reasoning
Jacob Fein-Ashley, Paria Rashidinejad
cs.LGcs.AIcs.CLarXiv:2605.12466v12026SIA: Self Improving AI with Harness & Weight Updates
Prannay Hebbar, Yogendra Manawat, Samuel Verboomen +4
cs.AIcs.CLarXiv:2605.27276v22026Toward Generalist Autonomous Research via Hypothesis-Tree Refinement
Jiajie Jin, Yuyang Hu, Kai Qiu +15
cs.CLcs.AIarXiv:2606.11926v12026Listen, Reason, and Segment: Aligning LALMs with Editorial Judgment for Media Chapterization
Tony Alex, Wish Suharitdamrong, Sara Atito +5
cs.SDcs.AIcs.CLarXiv:2608.16539v12026Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling
Yafu Li, Runzhe Zhan, Haoran Zhang +25
cs.AIcs.CLarXiv:2605.13301v12026UniSD: Towards a Unified Self-Distillation Framework for Large Language Models
Yiqiao Jin, Yiyang Wang, Lucheng Fu +7
cs.CLcs.AIcs.LGarXiv:2605.06597v22026Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models
Dehai Min, Giovanni Vaccarino, Huiyi Chen +3
cs.CLarXiv:2605.17672v12026Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
Victor Conchello Vendrell, Arnau Padres Masdemont, Niccolò Grillo +3
cs.CLcs.AIcs.LGarXiv:2605.07721v22026HRM-Text: Efficient Pretraining Beyond Scaling
Guan Wang, Changling Liu, Chenyu Wang +6
cs.CLarXiv:2605.20613v12026Thinking Before Constraining: A Unified Decoding Framework for Large Language Models
Ngoc Trinh Hung Nguyen, Alonso Silva, Laith Zumot +3
cs.CLcs.AIarXiv:2601.07525v22026GrepSeek: Training Search Agents for Direct Corpus Interaction
Alireza Salemi, Chang Zeng, Atharva Nijasure +4
cs.CLcs.AIcs.IRarXiv:2605.29307v12026SG-OPD: Sign-Gated On-Policy Distillation via Sign-Consistency Gating and Phased Teacher Sampling
Haoran Xu, Hongyu Wang, Yifei Gao +3
cs.CLcs.LGarXiv:2606.09304v12026Skill Self-Play: Pushing the Frontier of LLM Capability with Co-Evolving Skills
Siyuan Huang, Pengyu Cheng, Haotian Liu +10
cs.CLarXiv:2607.22529v12026IndicTalk: A Large-Scale Persona-Based Multilingual Conversational Corpus for Indic Languages
Sahil Deepak Gawande, Mayank Singh
cs.CLcs.LGarXiv:2607.23242v12026Do Language Models Dream of Binding Molecules? Benchmarking LLMs under Spatial Constraints
Thomas MacDougall, Maksim Kuznetsov, Roman Schutski +5
cs.LGcs.AIcs.CLarXiv:2607.18144v12026QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks
Jian Xie, Tianhe Lin, Zilu Wang +16
cs.CLarXiv:2605.24218v12026LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents
Xiaoxuan Peng, Kaiqi Zhang, Xinyu Lu +5
cs.CLarXiv:2605.29559v12026EnvFactory: Scaling Tool-Use Agents via Executable Environments Synthesis and Robust RL
Minrui Xu, Zilin Wang, Mengyi DENG +12
cs.CLcs.LGarXiv:2605.18703v12026OpenSeeker-v2: Pushing the Limits of Search Agents with Informative and High-Difficulty Trajectories
Yuwen Du, Rui Ye, Shuo Tang +4
cs.AIcs.CLarXiv:2605.04036v12026ENTLORE: A Graph-Grounded Benchmark for Latent Organizational Reasoning in Enterprise Question Answering
Akrin Zheng, Alexander Wu, Alaia Liu
cs.IRcs.AIcs.CLarXiv:2608.10679v22026Accelerating RL Post-Training Rollouts via System-Integrated Speculative Decoding
Hayate Iso, Tiyasa Mitra, Sudipta Mondal +15
cs.LGcs.CLarXiv:2604.26779v12026MLEvolve: A Self-Evolving Framework for Automated Machine Learning Algorithm Discovery
Shangheng Du, Xiangchao Yan, Jinxin Shi +11
cs.AIcs.CLarXiv:2606.06473v12026CAPO: Critic-Guided Action-Aligned Policy Optimization for Advancing LLM Agent Capabilities
Daoyu Wang, Qingchuan Li, Mingyue Cheng +6
cs.CLarXiv:2604.18401v52026Nemotron 3 Ultra: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning
NVIDIA, :, Aaron Blakeman +571
cs.CLcs.AIcs.LGarXiv:2606.15007v12026Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
Guobin Shen, Xiang Cheng, Chenxiao Zhao +4
cs.LGcs.AIcs.CLarXiv:2605.11609v12026SpecBench: Measuring Reward Hacking in Long-Horizon Coding Agents
Bingchen Zhao, Dhruv Srikanth, Yuxiang Wu +1
cs.SEcs.AIcs.CLarXiv:2605.21384v12026MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory
Minghao Guo, Qingyue Jiao, Zeru Shi +14
cs.CVcs.CLcs.IRarXiv:2605.15128v12026ECHO: Terminal Agents Learn World Models for Free
Vaishnavi Shrivastava, Piero Kauffmann, Ahmed Awadallah +1
cs.LGcs.CLarXiv:2605.24517v12026Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPO
Yu Tian, Jiawei Chen, Lifan Zheng +5
cs.CLarXiv:2604.27488v12026HarnessForge: Joint Harness and Policy Evolution for Adaptive Agent Systems
Mingju Chen, Can Lv, Guibin Zhang +2
cs.CLarXiv:2606.01779v12026From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills
Qiliang Liang, Hansi Wang, Zhong Liang +1
cs.CLcs.AIarXiv:2604.24026v42026ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
Yining Hong, Jiageng Liu, Han Yin +5
cs.CVcs.AIcs.CLarXiv:2605.18746v22026SWE-Explore: Benchmarking How Coding Agents Explore Repositories
Shaoqiu Zhang, Yuhang Wang, Jialiang Liang +8
cs.SEcs.CLarXiv:2606.07297v12026Gathered, Not Admitted: How Attention Brings a Latent Variable into Verbalizable Form
Parsa Mazaheri
cs.AIcs.CLarXiv:2608.15022v12026NARRATE: A Multimodal Real-World Australian Driving Dataset for Human-Centred Explanations in Automated Driving
Ashkan Yousefi Zadeh, Zishuo Zhu, Xiaomeng Li +5
cs.CVcs.AIcs.CLarXiv:2608.14767v12026RecurrentGPT: Expressive Depth through Recurrent Modulation in Transformers
Amr Hegazy, Amr Alanwar, Mostafa Elhoushi
cs.CLcs.LGarXiv:2608.15062v12026Do LLMs Know What to Ask and When? Evaluating Multi-Turn Information Seeking
Yepeng Huang, Jiawen Zhang, Michelle Dai +4
cs.AIcs.CLcs.LGarXiv:2608.14808v12026Evo-Harness: Context-to-Harness Skill Compilation for Self-Evolving Agents
Tianxin Wei, Zhan Shi, Minhua Lin +14
cs.AIcs.CLarXiv:2608.15071v12026Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models
Varvara Arzt, Allan Hanbury, Terra Blevins
cs.CLcs.AIarXiv:2608.15129v12026