Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
24,481 to 24,540 of 61,393
SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control
Zhengyi Luo, Ye Yuan, Tingwu Wang +25
cs.ROcs.AIcs.CVarXiv:2511.07820v42025Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Sikuan Yan, Xiufeng Yang, Zuchao Huang +10
cs.CLcs.MAarXiv:2508.19828v52025GridVQA-X: A Framework for Evaluating Multimodal Explainability Methods
Sujay Belsare, Sudarshan Nikhil, Sushant Kumar +2
cs.CVarXiv:2606.14740v12026Show the Signal, Hide the Noise: Spectral Forcing for Pixel-Space Diffusion
Weichen Fan, Haiwen Diao, Penghao Wu +1
cs.CVarXiv:2606.15236v22026A Stationary (and Therefore Compatible) Representation is All You Need
Niccolò Biondi, Federico Pernici, Simone Ricci +1
cs.LGarXiv:2606.12488v12026AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders
Zhengxuan Wu, Aryaman Arora, Atticus Geiger +5
cs.CLcs.AIcs.LGarXiv:2501.17148v32025Rethinking the Divergence Regularization in LLM RL
Jiarui Yao, Xiangxin Zhou, Penghui Qi +3
cs.LGarXiv:2606.09821v12026Trajectory-Refined Distillation
Li Jiang, Haoran Xu, Yichuan Ding +1
cs.AIarXiv:2606.08432v12026Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions
Xin Jin, Huanqia Cai, Zhen Li +9
cs.CVarXiv:2606.09076v32026AffordanceVLA: A Vision-Language-Action Model Empowering Action Generation through Affordance-Aware Understanding
Qize Yu, Jiadi You, Yuran Wang +10
cs.ROcs.CVcs.MMarXiv:2606.06155v12026Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference
Wenbo Pan, Shujie Liu, Chin-Yew Lin +5
cs.AIcs.CLcs.LGarXiv:2606.05922v22026MAOAM: Unified Object and Material Selection with Vision-Language Models
Jaden Park, Valentin Deschaintre, Jason Kuen +5
cs.CVarXiv:2606.04880v12026GRAIL: Generating Humanoid Loco-Manipulation from 3D Assets and Video Priors
Tianyi Xie, Haotian Zhang, Jinhyung Park +17
cs.ROarXiv:2606.05160v12026Economy of Minds: Emerging Multi-Agent Intelligence with Economic Interactions
Zhenting Qi, Huangyuan Su, Ao Qu +13
cs.CLcs.AIcs.MAarXiv:2606.02859v12026SpeechEditBench: A Bilingual Multi-Attribute Benchmark for Instruction-Guided Speech Editing
Hanlin Zhang, Daxin Tan, Dehua Tao +3
eess.AScs.SDarXiv:2606.01804v22026SOCO: Benchmarking Semantic Object Correspondence in Vision Foundation Models
Olaf Dünkel, Basavaraj Sunagad, Haoran Wang +3
cs.CVarXiv:2605.31597v32026Off-the-Shelf LLMs as Process Scorers: Training-Free Alternative to PRMs for Mathematical Reasoning
Atoosa Chegini, Soheil Feizi
cs.CLcs.AIcs.LGarXiv:2606.01682v12026Personalize-then-Store: Benchmarking and Learning Personalized Memory for Long-horizon Agents
Yeonjun In, Wonjoong Kim, Sangwu Park +2
cs.AIarXiv:2605.25535v12026From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors
Jiejun Tan, Zhicheng Dou, Xinyu Yang +4
cs.CRcs.AIcs.CLarXiv:2605.31042v12026VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4
cs.CVcs.AIarXiv:2605.30351v12026CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training
Zhihao Du, Changfeng Gao, Yuxuan Wang +19
cs.SDcs.AIeess.ASarXiv:2505.17589v22025AdaState: Self-Evolving Anchors for Streaming Video Generation
Yusuf Dalva, Pinar Yanardag
cs.CVarXiv:2605.30349v12026Discovering Cooperative Pipelines: Autoresearch for Sequential Social Dilemmas
Víctor Gallego
cs.MAcs.AIcs.LGarXiv:2605.30003v12026Beyond Ten Turns: Unlocking Long-Horizon Agentic Search with Large-Scale Asynchronous RL
Jiaxuan Gao, Wei Fu, Minyang Xie +5
cs.CLcs.AIarXiv:2508.07976v42025Simple Regenerating Codes: Network Coding for Cloud Storage
Dimitris S. Papailiopoulos, Jianqiang Luo, Alexandros G. Dimakis +2
cs.ITcs.DCcs.NIarXiv:1109.0264v12011EigeNet: Geometry-Informed Multi-Modal Learning for Few-shot Novel View RIR Prediction
Chong Jing, Zitong Lan, Junan Zhang +1
cs.SDcs.AIcs.MMarXiv:2605.28101v12026$D^2$-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation-Aware Routing
Aoxi Liu, Yupeng Chen, James Oldfield +5
cs.AIarXiv:2605.25893v12026Prosumer Synchronisation Risk: Impacts of Time-Varying Tariffs on Distribution Network Expansion
Dillon Zadoks, Alfredo Oneto, Carlo Tajoli +4
eess.SYarXiv:2609.02174v12026Geo-Align: Video Generation Alignment via Metric Geometry Reward
Zizun Li, Haoyu Guo, Runzhe Teng +2
cs.CVarXiv:2605.23903v12026Registers Matter for Pixel-Space Diffusion Transformers
Nikita Starodubcev, Ilia Sudakov, Ilya Drobyshevskiy +2
cs.CVarXiv:2605.16147v22026Conscientious Classification: A Data Scientist's Guide to Discrimination-Aware Classification
Brian d'Alessandro, Cathy O'Neil, Tom LaGatta
stat.MLcs.LGstat.COarXiv:1907.09013v12019DrawMotion: Generating 3D Human Motions by Freehand Drawing
Tao Wang, Lei Jin, Zhihua Wu +7
cs.CVarXiv:2605.20955v12026UniT: Unified Geometry Learning with Group Autoregressive Transformer
Haotian Wang, Yusong Huang, Zhaonian Kuang +4
cs.CVarXiv:2605.21131v12026SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training
Komal Kumar, Ankan Deria, Abhishek Basu +3
cs.CVarXiv:2605.18719v12026Mega-ASR: Towards In-the-wild^2 Speech Recognition via Scaling up Real-world Acoustic Simulation
Zhifei Xie, Kaiyu Pang, Haobin Zhang +4
cs.SDcs.AIcs.CLarXiv:2605.19833v12026Generative Modeling via Drifting
Mingyang Deng, He Li, Tianhong Li +2
cs.LGcs.CVarXiv:2602.04770v22026Capturing LLM Capabilities via Evidence-Calibrated Query Clustering
Fangzhou Wu, Sandeep Silwal, Qiuyi Zhang
cs.AIcs.LGarXiv:2605.17110v22026On Exposure Bias, Hallucination and Domain Shift in Neural Machine Translation
Chaojun Wang, Rico Sennrich
cs.CLarXiv:2005.03642v12020Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
Jiahang Lin, Shichun Liu, Chengjun Pan +8
cs.CLcs.SEarXiv:2604.25850v42026Text2Action: Generative Adversarial Synthesis from Language to Action
Hyemin Ahn, Timothy Ha, Yunho Choi +2
cs.LGcs.CLcs.ROarXiv:1710.05298v22017Why Do Reasoning Models Lose Coverage? The Role of Data and Forks in the Road
Ngoc-Hieu Nguyen, Parshin Shojaee, Phuc Minh Nguyen +4
cs.LGarXiv:2605.17026v12026Aligning Latent Geometry for Spherical Flow Matching in Image Generation
Tuna Han Salih Meral, Kaan Oktay, Hidir Yesiltepe +2
cs.CVarXiv:2605.15193v12026ReactiveGWM: Steering NPC in Reactive Game World Models
Zeqing Wang, Danze Chen, Zhaohu Xing +4
cs.CVarXiv:2605.15256v12026Sat3DGen: Comprehensive Street-Level 3D Scene Generation from Single Satellite Image
Ming Qian, Zimin Xia, Changkun Liu +6
cs.CVcs.AIarXiv:2605.14984v12026MMSkills: Towards Multimodal Skills for General Visual Agents
Kangning Zhang, Shuai Shao, Qingyao Li +8
cs.AIarXiv:2605.13527v32026From Generalist to Specialist Representation
Yujia Zheng, Fan Feng, Yuke Li +3
cs.LGcs.AIstat.MLarXiv:2605.12733v12026Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces
Simon Yu, Derek Chong, Ananjan Nandi +4
cs.AIcs.PLcs.SEarXiv:2605.10913v32026A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models
Hamid Kazemi, Atoosa Chegini, Maria Safi
cs.CLcs.AIcs.LGarXiv:2605.08513v12026Geometric Factual Recall in Transformers
Shauli Ravfogel, Gilad Yehudai, Joan Bruna +1
cs.CLarXiv:2605.12426v12026MDN: Parallelizing Stepwise Momentum for Delta Linear Attention
Yulong Huang, Xiang Liu, Hongxiang Huang +5
cs.LGcs.NEarXiv:2605.05838v12026Positivity loss in bandlimited spectral reproduction on spheres
Hao-Ning Wu
math.NAmath.CAarXiv:2609.02695v12026Rebellious Student: Reversing Teacher Signals for Reasoning Exploration with Self-Distilled RLVR
Jeonghye Kim, Jiwon Jeon, Dongsheng Li +1
cs.LGcs.CLarXiv:2605.10781v12026AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems
Boxuan Zhang, Jianing Zhu, Zeru Shi +2
cs.CLcs.AIcs.MAarXiv:2605.08715v22026Roto-Translation Covariant Convolutional Networks for Medical Image Analysis
Erik J Bekkers, Maxime W Lafarge, Mitko Veta +3
cs.CVcs.LGmath.GRarXiv:1804.03393v32018AdaPreLoRA: Adafactor Preconditioned Low-Rank Adaptation
Ziyun Liu, Fengmiao Bian, Jian-Feng Cai
cs.LGcs.AIcs.CLarXiv:2605.08734v12026Understanding and Enforcing Weight Disentanglement in Task Arithmetic
Shangge Liu, Yuehan Yin, Lei Wang +5
cs.AIarXiv:2604.17078v12026IntentGrasp: A Comprehensive Benchmark for Intent Understanding
Yuwei Yin, Chuyuan Li, Giuseppe Carenini
cs.CLcs.AIcs.LGarXiv:2605.06832v12026MatryoshkaLoRA: Learning Accurate Hierarchical Low-Rank Representations for LLM Fine-Tuning
Ionut-Vlad Modoranu, Mher Safaryan, Dan Alistarh
cs.CLcs.AIcs.LGarXiv:2605.07850v12026End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer
Wenda Chu, Bingliang Zhang, Jiaqi Han +4
cs.CVcs.LGarXiv:2605.00503v22026Hierarchical Abstract Tree for Cross-Document Retrieval-Augmented Generation
Ziwen Zhao, Menglin Yang
cs.LGcs.AIcs.IRarXiv:2605.00529v12026