Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

24,481 to 24,540 of 61,393

  1. SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control

    Zhengyi Luo, Ye Yuan, Tingwu Wang +25

    cs.ROcs.AIcs.CVarXiv:2511.07820v42025
  2. Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

    Sikuan Yan, Xiufeng Yang, Zuchao Huang +10

    cs.CLcs.MAarXiv:2508.19828v52025
  3. GridVQA-X: A Framework for Evaluating Multimodal Explainability Methods

    Sujay Belsare, Sudarshan Nikhil, Sushant Kumar +2

    cs.CVarXiv:2606.14740v12026
  4. Show the Signal, Hide the Noise: Spectral Forcing for Pixel-Space Diffusion

    Weichen Fan, Haiwen Diao, Penghao Wu +1

    cs.CVarXiv:2606.15236v22026
  5. A Stationary (and Therefore Compatible) Representation is All You Need

    Niccolò Biondi, Federico Pernici, Simone Ricci +1

    cs.LGarXiv:2606.12488v12026
  6. AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders

    Zhengxuan Wu, Aryaman Arora, Atticus Geiger +5

    cs.CLcs.AIcs.LGarXiv:2501.17148v32025
  7. Rethinking the Divergence Regularization in LLM RL

    Jiarui Yao, Xiangxin Zhou, Penghui Qi +3

    cs.LGarXiv:2606.09821v12026
  8. Trajectory-Refined Distillation

    Li Jiang, Haoran Xu, Yichuan Ding +1

    cs.AIarXiv:2606.08432v12026
  9. Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions

    Xin Jin, Huanqia Cai, Zhen Li +9

    cs.CVarXiv:2606.09076v32026
  10. AffordanceVLA: A Vision-Language-Action Model Empowering Action Generation through Affordance-Aware Understanding

    Qize Yu, Jiadi You, Yuran Wang +10

    cs.ROcs.CVcs.MMarXiv:2606.06155v12026
  11. Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference

    Wenbo Pan, Shujie Liu, Chin-Yew Lin +5

    cs.AIcs.CLcs.LGarXiv:2606.05922v22026
  12. MAOAM: Unified Object and Material Selection with Vision-Language Models

    Jaden Park, Valentin Deschaintre, Jason Kuen +5

    cs.CVarXiv:2606.04880v12026
  13. GRAIL: Generating Humanoid Loco-Manipulation from 3D Assets and Video Priors

    Tianyi Xie, Haotian Zhang, Jinhyung Park +17

    cs.ROarXiv:2606.05160v12026
  14. Economy of Minds: Emerging Multi-Agent Intelligence with Economic Interactions

    Zhenting Qi, Huangyuan Su, Ao Qu +13

    cs.CLcs.AIcs.MAarXiv:2606.02859v12026
  15. SpeechEditBench: A Bilingual Multi-Attribute Benchmark for Instruction-Guided Speech Editing

    Hanlin Zhang, Daxin Tan, Dehua Tao +3

    eess.AScs.SDarXiv:2606.01804v22026
  16. SOCO: Benchmarking Semantic Object Correspondence in Vision Foundation Models

    Olaf Dünkel, Basavaraj Sunagad, Haoran Wang +3

    cs.CVarXiv:2605.31597v32026
  17. Off-the-Shelf LLMs as Process Scorers: Training-Free Alternative to PRMs for Mathematical Reasoning

    Atoosa Chegini, Soheil Feizi

    cs.CLcs.AIcs.LGarXiv:2606.01682v12026
  18. Personalize-then-Store: Benchmarking and Learning Personalized Memory for Long-horizon Agents

    Yeonjun In, Wonjoong Kim, Sangwu Park +2

    cs.AIarXiv:2605.25535v12026
  19. From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors

    Jiejun Tan, Zhicheng Dou, Xinyu Yang +4

    cs.CRcs.AIcs.CLarXiv:2605.31042v12026
  20. VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion

    Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4

    cs.CVcs.AIarXiv:2605.30351v12026
  21. CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training

    Zhihao Du, Changfeng Gao, Yuxuan Wang +19

    cs.SDcs.AIeess.ASarXiv:2505.17589v22025
  22. AdaState: Self-Evolving Anchors for Streaming Video Generation

    Yusuf Dalva, Pinar Yanardag

    cs.CVarXiv:2605.30349v12026
  23. Discovering Cooperative Pipelines: Autoresearch for Sequential Social Dilemmas

    Víctor Gallego

    cs.MAcs.AIcs.LGarXiv:2605.30003v12026
  24. Beyond Ten Turns: Unlocking Long-Horizon Agentic Search with Large-Scale Asynchronous RL

    Jiaxuan Gao, Wei Fu, Minyang Xie +5

    cs.CLcs.AIarXiv:2508.07976v42025
  25. Simple Regenerating Codes: Network Coding for Cloud Storage

    Dimitris S. Papailiopoulos, Jianqiang Luo, Alexandros G. Dimakis +2

    cs.ITcs.DCcs.NIarXiv:1109.0264v12011
  26. EigeNet: Geometry-Informed Multi-Modal Learning for Few-shot Novel View RIR Prediction

    Chong Jing, Zitong Lan, Junan Zhang +1

    cs.SDcs.AIcs.MMarXiv:2605.28101v12026
  27. $D^2$-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation-Aware Routing

    Aoxi Liu, Yupeng Chen, James Oldfield +5

    cs.AIarXiv:2605.25893v12026
  28. Prosumer Synchronisation Risk: Impacts of Time-Varying Tariffs on Distribution Network Expansion

    Dillon Zadoks, Alfredo Oneto, Carlo Tajoli +4

    eess.SYarXiv:2609.02174v12026
  29. Geo-Align: Video Generation Alignment via Metric Geometry Reward

    Zizun Li, Haoyu Guo, Runzhe Teng +2

    cs.CVarXiv:2605.23903v12026
  30. Registers Matter for Pixel-Space Diffusion Transformers

    Nikita Starodubcev, Ilia Sudakov, Ilya Drobyshevskiy +2

    cs.CVarXiv:2605.16147v22026
  31. Conscientious Classification: A Data Scientist's Guide to Discrimination-Aware Classification

    Brian d'Alessandro, Cathy O'Neil, Tom LaGatta

    stat.MLcs.LGstat.COarXiv:1907.09013v12019
  32. DrawMotion: Generating 3D Human Motions by Freehand Drawing

    Tao Wang, Lei Jin, Zhihua Wu +7

    cs.CVarXiv:2605.20955v12026
  33. UniT: Unified Geometry Learning with Group Autoregressive Transformer

    Haotian Wang, Yusong Huang, Zhaonian Kuang +4

    cs.CVarXiv:2605.21131v12026
  34. SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training

    Komal Kumar, Ankan Deria, Abhishek Basu +3

    cs.CVarXiv:2605.18719v12026
  35. Mega-ASR: Towards In-the-wild^2 Speech Recognition via Scaling up Real-world Acoustic Simulation

    Zhifei Xie, Kaiyu Pang, Haobin Zhang +4

    cs.SDcs.AIcs.CLarXiv:2605.19833v12026
  36. Generative Modeling via Drifting

    Mingyang Deng, He Li, Tianhong Li +2

    cs.LGcs.CVarXiv:2602.04770v22026
  37. Capturing LLM Capabilities via Evidence-Calibrated Query Clustering

    Fangzhou Wu, Sandeep Silwal, Qiuyi Zhang

    cs.AIcs.LGarXiv:2605.17110v22026
  38. On Exposure Bias, Hallucination and Domain Shift in Neural Machine Translation

    Chaojun Wang, Rico Sennrich

    cs.CLarXiv:2005.03642v12020
  39. Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses

    Jiahang Lin, Shichun Liu, Chengjun Pan +8

    cs.CLcs.SEarXiv:2604.25850v42026
  40. Text2Action: Generative Adversarial Synthesis from Language to Action

    Hyemin Ahn, Timothy Ha, Yunho Choi +2

    cs.LGcs.CLcs.ROarXiv:1710.05298v22017
  41. Why Do Reasoning Models Lose Coverage? The Role of Data and Forks in the Road

    Ngoc-Hieu Nguyen, Parshin Shojaee, Phuc Minh Nguyen +4

    cs.LGarXiv:2605.17026v12026
  42. Aligning Latent Geometry for Spherical Flow Matching in Image Generation

    Tuna Han Salih Meral, Kaan Oktay, Hidir Yesiltepe +2

    cs.CVarXiv:2605.15193v12026
  43. ReactiveGWM: Steering NPC in Reactive Game World Models

    Zeqing Wang, Danze Chen, Zhaohu Xing +4

    cs.CVarXiv:2605.15256v12026
  44. Sat3DGen: Comprehensive Street-Level 3D Scene Generation from Single Satellite Image

    Ming Qian, Zimin Xia, Changkun Liu +6

    cs.CVcs.AIarXiv:2605.14984v12026
  45. MMSkills: Towards Multimodal Skills for General Visual Agents

    Kangning Zhang, Shuai Shao, Qingyao Li +8

    cs.AIarXiv:2605.13527v32026
  46. From Generalist to Specialist Representation

    Yujia Zheng, Fan Feng, Yuke Li +3

    cs.LGcs.AIstat.MLarXiv:2605.12733v12026
  47. Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces

    Simon Yu, Derek Chong, Ananjan Nandi +4

    cs.AIcs.PLcs.SEarXiv:2605.10913v32026
  48. A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models

    Hamid Kazemi, Atoosa Chegini, Maria Safi

    cs.CLcs.AIcs.LGarXiv:2605.08513v12026
  49. Geometric Factual Recall in Transformers

    Shauli Ravfogel, Gilad Yehudai, Joan Bruna +1

    cs.CLarXiv:2605.12426v12026
  50. MDN: Parallelizing Stepwise Momentum for Delta Linear Attention

    Yulong Huang, Xiang Liu, Hongxiang Huang +5

    cs.LGcs.NEarXiv:2605.05838v12026
  51. Positivity loss in bandlimited spectral reproduction on spheres

    Hao-Ning Wu

    math.NAmath.CAarXiv:2609.02695v12026
  52. Rebellious Student: Reversing Teacher Signals for Reasoning Exploration with Self-Distilled RLVR

    Jeonghye Kim, Jiwon Jeon, Dongsheng Li +1

    cs.LGcs.CLarXiv:2605.10781v12026
  53. AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems

    Boxuan Zhang, Jianing Zhu, Zeru Shi +2

    cs.CLcs.AIcs.MAarXiv:2605.08715v22026
  54. Roto-Translation Covariant Convolutional Networks for Medical Image Analysis

    Erik J Bekkers, Maxime W Lafarge, Mitko Veta +3

    cs.CVcs.LGmath.GRarXiv:1804.03393v32018
  55. AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation

    Ziyun Liu, Fengmiao Bian, Jian-Feng Cai

    cs.LGcs.AIcs.CLarXiv:2605.08734v12026
  56. Understanding and Enforcing Weight Disentanglement in Task Arithmetic

    Shangge Liu, Yuehan Yin, Lei Wang +5

    cs.AIarXiv:2604.17078v12026
  57. IntentGrasp: A Comprehensive Benchmark for Intent Understanding

    Yuwei Yin, Chuyuan Li, Giuseppe Carenini

    cs.CLcs.AIcs.LGarXiv:2605.06832v12026
  58. MatryoshkaLoRA: Learning Accurate Hierarchical Low-Rank Representations for LLM Fine-Tuning

    Ionut-Vlad Modoranu, Mher Safaryan, Dan Alistarh

    cs.CLcs.AIcs.LGarXiv:2605.07850v12026
  59. End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer

    Wenda Chu, Bingliang Zhang, Jiaqi Han +4

    cs.CVcs.LGarXiv:2605.00503v22026
  60. Hierarchical Abstract Tree for Cross-Document Retrieval-Augmented Generation

    Ziwen Zhao, Menglin Yang

    cs.LGcs.AIcs.IRarXiv:2605.00529v12026