Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,781 to 12,840 of 15,427

  1. Investigating Autonomous Agent Contributions in the Wild: Activity Patterns and Code Change over Time

    Razvan Mihai Popescu, David Gros, Andrei Botocan +3

    cs.SEcs.AIcs.LGarXiv:2604.00917v12026
  2. Proactive Agent Research Environment: Simulating Active Users to Evaluate Proactive Assistants

    Deepak Nathani, Cheng Zhang, Chang Huan +7

    cs.AIcs.LGcs.MAarXiv:2604.00842v12026
  3. Do Phone-Use Agents Respect Your Privacy?

    Zhengyang Tang, Ke Ji, Xidong Wang +19

    cs.CRcs.AIcs.CLarXiv:2604.00986v22026
  4. Revision or Re-Solving? Decomposing Second-Pass Gains in Multi-LLM Pipelines

    Jingjie Ning, Xueqi Li, Chengyu Yu

    cs.SEcs.AIcs.CLarXiv:2604.01029v22026
  5. Woosh: A Sound Effects Foundation Model

    Gaëtan Hadjeres, Marc Ferras, Khaled Koutini +7

    cs.SDcs.AIcs.LGarXiv:2604.01929v32026
  6. Executing as You Generate: Hiding Execution Latency in LLM Code Interpreters

    Zhensu Sun, Zhihao Lin, Zhi Chen +4

    cs.PLcs.AIcs.SEarXiv:2604.00491v22026
  7. CORAL: Towards Autonomous Multi-Agent Evolution for Open-Ended Discovery

    Ao Qu, Han Zheng, Zijian Zhou +14

    cs.AIarXiv:2604.01658v22026
  8. Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies

    Zhanzhi Lou, Hui Chen, Yibo Li +2

    cs.LGcs.AIarXiv:2604.00830v32026
  9. AgentSocialBench: Evaluating Privacy Risks in Human-Centered Agentic Social Networks

    Prince Zizhuang Wang, Shuli Jiang

    cs.AIcs.SIarXiv:2604.01487v22026
  10. UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems

    Mingming Ha, Guanchen Wang, Linxun Chen +9

    cs.IRcs.AIarXiv:2604.00590v22026
  11. HippoCamp: Benchmarking Contextual Agents on Personal Computers

    Zhe Yang, Shulin Tian, Kairui Hu +9

    cs.AIcs.CVarXiv:2604.01221v12026
    Summaries:한국어
  12. Paper Reconstruction Evaluation: Evaluating Presentation and Hallucination in AI-written Papers

    Atsuyuki Miyai, Mashiro Toyooka, Zaiying Zhao +3

    cs.CLcs.AIcs.LGarXiv:2604.01128v12026
  13. Brainstacks: Cross-Domain Cognitive Capabilities via Frozen MoE-LoRA Stacks for Continual LLM Learning

    Mohammad R. Abu Ayyash

    cs.CLcs.AIarXiv:2604.01152v12026
  14. ActionParty: Multi-Subject Action Binding in Generative Video Games

    Alexander Pondaven, Ziyi Wu, Igor Gilitschenski +4

    cs.CVcs.AIcs.LGarXiv:2604.02330v22026
  15. Tex3D: Objects as Attack Surfaces via Adversarial 3D Textures for Vision-Language-Action Models

    Jiawei Chen, Simin Huang, Jiawei Du +5

    cs.CVcs.AIarXiv:2604.01618v12026
  16. Omni123: Exploring 3D Native Foundation Models with Limited 3D Data by Unifying Text to 2D and 3D Generation

    Chongjie Ye, Cheng Cao, Chuanyu Pan +4

    cs.CVcs.AIarXiv:2604.02289v12026
  17. Omni-SimpleMem: Autoresearch-Guided Discovery of Lifelong Multimodal Agent Memory

    Jiaqi Liu, Zipeng Ling, Shi Qiu +9

    cs.AIarXiv:2604.01007v22026
  18. GPA: Learning GUI Process Automation from Demonstrations

    Zirui Zhao, Jun Hao Liew, Yan Yang +5

    cs.CVcs.AIcs.SEarXiv:2604.01676v22026
  19. Therefore I am. I Think

    Esakkivel Esakkiraja, Sai Rajeswar, Denis Akhiyarov +1

    cs.AIarXiv:2604.01202v32026
  20. Steerable Visual Representations

    Jona Ruthardt, Manu Gaur, Deva Ramanan +2

    cs.CVcs.AIarXiv:2604.02327v22026
  21. The Latent Space: Foundation, Evolution, Mechanism, Ability, and Outlook

    Xinlei Yu, Zhangquan Chen, Yongbo He +36

    cs.AIarXiv:2604.02029v22026
  22. DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning

    Yang Zhou, Xiaofeng Wang, Hao Shao +8

    cs.CVcs.AIcs.ROarXiv:2604.01765v12026
  23. Unifying Group-Relative and Self-Distillation Policy Optimization via Sample Routing

    Gengsheng Li, Tianyu Yang, Junfeng Fang +6

    cs.LGcs.AIarXiv:2604.02288v12026
  24. ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement

    Difan Jiao, Qianfeng Wen, Blair Yang +2

    cs.AIarXiv:2604.01591v22026
  25. Large Language Models Align with the Human Brain during Creative Thinking

    Mete Ismayilzada, Simone A. Luchini, Abdulkadir Gokce +5

    q-bio.NCcs.AIcs.CLarXiv:2604.03480v22026
  26. BidirLM: From Text to Omnimodal Bidirectional Encoders by Adapting and Composing Causal LLMs

    Nicolas Boizard, Théo Deschamps-Berger, Hippolyte Gisserot-Boukhlef +2

    cs.CLcs.AIarXiv:2604.02045v12026
  27. AgentHazard: A Benchmark for Evaluating Harmful Behavior in Computer-Use Agents

    Yunhao Feng, Yifan Ding, Yingshui Tan +6

    cs.AIarXiv:2604.02947v12026
  28. Born Again Neural Networks

    Tommaso Furlanello, Zachary C. Lipton, Michael Tschannen +2

    stat.MLcs.AIcs.LGarXiv:1805.04770v22018
  29. Lost in Translation? Exploring the Shift in Grammatical Gender from Latin to Occitan

    Ahan Chatterjee, Matthias Schöffel, Matthias Aßenmacher +2

    cs.CLcs.AIarXiv:2605.09156v22026
  30. ClawArena: Benchmarking AI Agents in Evolving Information Environments

    Haonian Ji, Kaiwen Xiong, Siwei Han +9

    cs.LGcs.AIcs.CLarXiv:2604.04202v22026
  31. GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning

    Ornith Team, Xiaoya Li, Guoyin Wang +3

    cs.AIarXiv:2604.02721v32026
  32. Watch Before You Answer: Learning from Visually Grounded Post-Training

    Yuxuan Zhang, EunJeong Hwang, Huaisong Zhang +8

    cs.CVcs.AIcs.CLarXiv:2604.05117v12026
  33. Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems

    Justin Chih-Yao Chen, Archiki Prasad, Zaid Khan +4

    cs.LGcs.AIcs.CLarXiv:2604.04767v12026
  34. SkillX: Automatically Constructing Skill Knowledge Bases for Agents

    Chenxi Wang, Zhuoyun Yu, Xin Xie +8

    cs.CLcs.AIcs.IRarXiv:2604.04804v22026
  35. InCoder-32B-Thinking: Industrial Code World Model for Thinking

    Jian Yang, Wei Zhang, Jiajun Wu +22

    cs.ARcs.AIcs.CLarXiv:2604.03144v12026
  36. Do Audio-Visual Large Language Models Really See and Hear?

    Ramaneswaran Selvakumar, Kaousheik Jayakumar, S Sakshi +3

    cs.AIcs.SDarXiv:2604.02605v12026
  37. Beyond the Assistant Turn: User Turn Generation as a Probe of Interaction Awareness in Language Models

    Sarath Shekkizhar, Romain Cosentino, Adam Earle

    cs.AIarXiv:2604.02315v22026
  38. LightThinker++: From Reasoning Compression to Memory Management

    Yuqi Zhu, Jintian Zhang, Zhenjie Wan +7

    cs.CLcs.AIcs.IRarXiv:2604.03679v12026
  39. Squeez: Task-Conditioned Tool-Output Pruning for Coding Agents

    Ádám Kovács

    cs.SEcs.AIarXiv:2604.04979v12026
  40. Can LLMs Learn to Reason Robustly under Noisy Supervision?

    Shenzhi Yang, Guangcheng Zhu, Bowen Song +7

    cs.LGcs.AIarXiv:2604.03993v12026
  41. Vero: An Open RL Recipe for General Visual Reasoning

    Gabriel Sarch, Linrong Cai, Qunzhong Wang +3

    cs.CVcs.AIcs.CLarXiv:2604.04917v32026
  42. Paper Espresso: From Paper Overload to Research Insight

    Mingzhe Du, Luu Anh Tuan, Dong Huang +1

    cs.DLcs.AIarXiv:2604.04562v12026
  43. Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw

    Zijun Wang, Haoqin Tu, Letian Zhang +11

    cs.CRcs.AIcs.CLarXiv:2604.04759v12026
  44. FileGram: Grounding Agent Personalization in File-System Behavioral Traces

    Shuai Liu, Shulin Tian, Kairui Hu +6

    cs.CVcs.AIarXiv:2604.04901v12026
  45. REAM: Merging Improves Pruning of Experts in LLMs

    Saurav Jha, Maryam Hashemzadeh, Ali Saheb Pasand +3

    cs.AIcs.CLcs.LGarXiv:2604.04356v12026
  46. MedGemma 1.5 Technical Report

    Andrew Sellergren, Chufan Gao, Fereshteh Mahvar +39

    cs.AIarXiv:2604.05081v22026
  47. ClawsBench: Evaluating Capability and Safety of LLM Productivity Agents in Simulated Workspaces

    Xiangyi Li, Kyoung Whan Choe, Yimin Liu +12

    cs.AIarXiv:2604.05172v22026
  48. MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts

    Weiyue Li, Ruizhi Qian, Yi Li +5

    cs.CLcs.AIarXiv:2604.06505v12026
  49. Neural Computers

    Mingchen Zhuge, Changsheng Zhao, Haozhe Liu +16

    cs.LGcs.AIarXiv:2604.06425v22026
  50. FORGE: Fine-grained Multimodal Evaluation for Manufacturing Scenarios

    Xiangru Jian, Hao Xu, Wei Pang +13

    cs.CVcs.AIcs.LGarXiv:2604.07413v22026
  51. SuperLocalMemory V3.3: The Living Brain -- Biologically-Inspired Forgetting, Cognitive Quantization, and Multi-Channel Retrieval for Zero-LLM Agent Memory Systems

    Varun Pratap Bhardwaj

    cs.AIcs.CLcs.IRarXiv:2604.04514v12026
  52. Can Large Language Models Reinvent Foundational Algorithms?

    Jian Zhao, Haoren Luo, Yu Wang +3

    cs.AIarXiv:2604.05716v12026
  53. MMEmb-R1: Reasoning-Enhanced Multimodal Embedding with Pair-Aware Selection and Adaptive Control

    Yuchi Wang, Haiyang Yu, Weikang Bian +4

    cs.CVcs.AIcs.CLarXiv:2604.06156v12026
  54. FactReview: Evidence-Grounded Peer Review with Execution-Based Claim Verification

    Ling Yue, Chaoqian Ouyang, Hang Xu +7

    cs.AIcs.LGarXiv:2604.04074v42026
  55. Rethinking Generalization in Reasoning SFT: A Conditional Analysis on Optimization, Data, and Model Capability

    Qihan Ren, Peng Wang, Ruikun Cai +8

    cs.AIarXiv:2604.06628v22026
  56. Qualixar OS: A Universal Operating System for AI Agent Orchestration

    Varun Pratap Bhardwaj

    cs.AIcs.MAcs.SEarXiv:2604.06392v12026
  57. UniSpace: Unified Visual Representation and Scalable Multimodal Modeling

    Jinbo Yan, Limeng Qiao, Jie Qin +3

    cs.CVcs.AIarXiv:2608.08676v12026
  58. Scientific Graphics Program Synthesis via Dual Self-Consistency Reinforcement Learning

    Juekai Lin, Yun Zhu, Honglin Lin +6

    cs.CVcs.AIarXiv:2604.06079v12026
  59. TRACE: Capability-Targeted Agentic Training

    Hangoo Kang, Tarun Suresh, Jon Saad-Falcon +1

    cs.AIarXiv:2604.05336v22026
  60. The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment

    Rishab Balasubramanian, Pin-Jie Lin, Rituraj Sharma +6

    cs.LGcs.AIarXiv:2604.06377v32026