Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
59,761 to 59,820 of 61,393
InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning
Ziang Yan, Sheng Xia, Jiashuo Yu +10
cs.CVarXiv:2606.12195v12026Pythagoras-Prover: Advancing Efficient Formal Proving via Augmented Lean Formalisation
Joshua Ong Jun Leang, Zheng Zhao, Mihaela Cătălina Stoian +5
cs.AIarXiv:2606.12594v12026From AGI to ASI
Tim Genewein, Matija Franklin, Alexander Lerchner +11
cs.AIcs.CYcs.LGarXiv:2606.12683v12026LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence
Henok Daniel, Omar Alhussein, Cheng Li +2
cs.NIarXiv:2606.11877v12026Quickest Detection of Hallucination Onset: Delay Bounds and Learned CUSUM Statistics
Igor Itkin
cs.LGcs.AIcs.CLarXiv:2606.12476v32026HYDRA-X: Native Unified Multimodal Models with Holistic Visual Tokenizers
Guozhen Zhang, Xuerui Qiu, Yutao Cui +11
cs.CVcs.AIarXiv:2606.13289v12026LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories
Baochang Ren, Xinjie Liu, Xi Chen +15
cs.CLcs.AIcs.LGarXiv:2606.13578v22026Dense Supervision, Sparse Updates: On the Sparsity and Geometry of On-Policy Distillation
Guo Yu, Wenlin Liu, Yulan Hu +3
cs.LGarXiv:2606.13657v32026ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning
Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5
cs.CVcs.AIcs.CLarXiv:2606.14697v12026IndustryBench-MIPU: Benchmarking Multi-Image Attribute Value Extraction for Industrial Products
Haonan Qi, Jin Cao, Yongqi Zhang +9
cs.CVarXiv:2606.14383v22026Retrieve, Don't Retrain: Extending Vision Language Action Models to New Tasks at Test Time
Jeongeun Park, Juhan Park, Taekyung Kim +3
cs.ROcs.AIarXiv:2606.15631v12026Human Universal Grasping
Kevin Yuanbo Wu, Tianxing Zhou, Isaac Tu +5
cs.ROcs.AIcs.CVarXiv:2606.17054v12026GD$^2$PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization
Haotian Liu, Yihao Liu, Jingwei Ni +11
cs.LGarXiv:2606.16771v12026VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models
Sen Xu, Shixi Liu, Wei Wang +6
cs.AIcs.CLarXiv:2606.16140v12026ACE-Ego-0: Unifying Egocentric Human and Robotic Data for VLA Pretraining
Hao Li, Ganlong Zhao, Yufei Liu +8
cs.ROarXiv:2606.17200v12026Speaking the Language of Science: Toward a General-Purpose Generative Foundation Model for the Natural Sciences
Mingyang Li, Yurou Liu, Jieping Ye +3
cs.CLarXiv:2606.16905v12026LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling
Jian Yang, Shawn Guo, Wei Zhang +16
cs.LGcs.AIarXiv:2606.18023v12026Looped World Models
Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang +28
cs.LGcs.AIcs.CLarXiv:2606.18208v12026SAE Interventions are Unreliable: Post-Intervention Recovery of Suppressed Behavior
Mingyue Cui, Linghui Shen, Xingyi Yang
cs.LGcs.AIarXiv:2606.18322v12026Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness
Zijian Wang, Hanqi Li, Ziyue Yang +17
cs.AIarXiv:2606.18874v32026EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts
Minseo Kim, Minjae Lee, Seunghyuk Oh +7
cs.LGarXiv:2606.18967v12026BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation
Max Van Puyvelde, Ibrahim Gulluk, Wim Van Criekinge +1
cs.AIcs.CVcs.LGarXiv:2606.19651v22026GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents
Zhe Ren, Yibo Yang, Yimeng Chen +7
cs.LGcs.CLarXiv:2606.18829v12026CoinVE-200K: A Large-Scale High-Quality Dataset for Compositional Instruction-Guided Video Editing
Fuchen Long, Cong Wang, Zitao Gao +8
cs.CVarXiv:2608.17566v12026MAIC-UI: Making Interactive Courseware with Generative UI
Shangqing Tu, Yanjia Li, Keyu Chen +7
cs.CLcs.AIcs.HCarXiv:2604.25806v12026Summaries:한국어Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning
Jiayu Yang, Chao Chen, Shengen Wu +6
cs.LGcs.CLarXiv:2606.13106v12026Physics-IQ Verified
Tim Rädsch, Yuki M Asano, Hilde Kuehne +4
cs.CVarXiv:2606.18943v12026T$^2$PO: Uncertainty-Guided Exploration Control for Stable Multi-Turn Agentic Reinforcement Learning
Haixin Wang, Hejie Cui, Chenwei Zhang +7
cs.AIarXiv:2605.02178v12026PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech
Venkata Pushpak Teja Menta
cs.SDcs.CLarXiv:2604.25476v12026Web2BigTable: A Bi-Level Multi-Agent LLM System for Internet-Scale Information Search and Extraction
Yuxuan Huang, Yihang Chen, Zhiyuan He +6
cs.AIarXiv:2604.27221v12026XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
Dasol Choi, Eugenia Kim, Jaewon Noh +14
cs.CLcs.AIarXiv:2605.05662v12026Q-RAG: Long Context Multi-step Retrieval via Value-based Embedder Training
Artyom Sorokin, Nazar Buzun, Alexander Anokhin +7
cs.LGcs.IRarXiv:2511.07328v22025ESARBench: A Benchmark for Agentic UAV Embodied Search and Rescue
Daoxuan Zhang, Ping Chen, Jianyi Zhou +1
cs.ROarXiv:2605.01371v12026FedADB: Class Anchor-Driven Dual-Branch Federated Learning for Mitigating Forgetting
Zhenyan Liu, Hua Zhang, Haoran Gao +6
cs.CRcs.LGarXiv:2608.15310v12026EMO: Pretraining Mixture of Experts for Emergent Modularity
Ryan Wang, Akshita Bhagia, Sewon Min
cs.CLarXiv:2605.06663v22026A$^2$TGPO: Agentic Turn-Group Policy Optimization with Adaptive Turn-level Clipping
Dingwei Chen, Zefang Zong, Zhipeng Ma +5
cs.CLarXiv:2605.06200v12026Continuous-Time Distribution Matching for Few-Step Diffusion Distillation
Tao Liu, Hao Yan, Mengting Chen +8
cs.CVcs.AIarXiv:2605.06376v12026PAS-QFL: Personalized Ansatz Selection for Quantum Federated Learning under Client Data Heterogeneity
Jindi Wu, Qun Li
quant-phcs.AIcs.DCarXiv:2608.14995v12026CPCANet: Deep Unfolding Common Principal Component Analysis for Domain Generalization
Yu-Hsi Chen, Abd-Krim Seghouane
cs.CVarXiv:2605.05136v32026RT-Splatting: Joint Reflection-Transmission Modeling with Gaussian Splatting
Ji Shi, Xianghua Ying, Bowei Xing +2
cs.CVarXiv:2605.18263v12026Swift Sampling: Selecting Temporal Surprises via Taylor Series
Dahye Kim, Bhuvan Sachdeva, Karan Uppal +3
cs.CVcs.AIarXiv:2605.22678v12026NeuROK: Generative 4D Neural Object Kinematics
Chen Geng, Guangzhao He, Yue Gao +3
cs.CVcs.GRarXiv:2605.30347v12026LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know?
HuiMing Fan, Xiao Wang, Zheng Chu +5
cs.AIarXiv:2605.28721v12026VisualThink-VLA: Visual Intermediate Reasoning for Effective and Low-Latency Vision-Language-Action Policies
Mingjian Gao, Wenqiao Zhang, Yuqian Yuan +9
cs.CVcs.AIarXiv:2605.30011v12026K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts
Nahyun Lee, Dongkeun Yoon, Guijin Son +12
cs.CLarXiv:2606.02404v12026ABot-Earth 0.5: Generative 3D Earth Model
Ming Qian, Tianjian Ouyang, Mingchao Sun +25
cs.CVarXiv:2606.09967v12026Dynamic Linear Attention
Xin Wang, Hui Shen, Boyuan Zheng +7
cs.CLcs.AIarXiv:2606.10650v12026Memento: Reconstruct to Remember for Consistent Long Video Generation
Xuan Wei, Longbin Ji, Guan Wang +5
cs.CVarXiv:2606.14667v12026MyPCBench: A Benchmark for Personally Intelligent Computer-Use Agents
Lawrence Keunho Jang, Andrew Keunwoo Jang, Jing Yu Koh +1
cs.LGcs.CLarXiv:2606.16748v12026Why Fine-Tuning Encourages Hallucinations and How to Fix It
Guy Kaplan, Zorik Gekhman, Zhen Zhu +5
cs.CLcs.AIcs.LGarXiv:2604.15574v12026The Last Harness You'll Ever Build
Haebin Seong, Li Yin, Haoran Zhang +1
cs.AIarXiv:2604.21003v32026Diffusion Templates: A Unified Plugin Framework for Controllable Diffusion
Zhongjie Duan, Hong Zhang, Yingda Chen
cs.LGcs.AIcs.CVarXiv:2604.24351v12026Improving Vision-language Models with Perception-centric Process Reward Models
Yingqian Min, Kun Zhou, Yifan Li +6
cs.CVarXiv:2604.24583v12026Step-level Optimization for Efficient Computer-use Agents
Jinbiao Wei, Kangqi Ni, Yilun Zhao +2
cs.AIarXiv:2604.27151v12026EviMem: Evidence-Gap-Driven Iterative Retrieval for Long-Term Conversational Memory
Yuyang Li, Yime He, Zeyu Zhang +1
cs.CVcs.CLarXiv:2604.27695v12026Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning
Chengshuai Shi, Wenzhe Li, Xinran Liang +10
cs.LGcs.AIcs.CLarXiv:2605.00347v12026Agentic AI Systems Should Be Designed as Marginal Token Allocators
Siqi Zhu
cs.AIcs.CYarXiv:2605.01214v12026PianoCoRe: Combined and Refined Piano MIDI Dataset
Ilya Borovik
cs.SDcs.LGarXiv:2605.06627v12026Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation
Bin Wu, Mengqi Huang, Shaojin Wu +4
cs.CVarXiv:2605.03849v12026CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10
cs.AIcs.CLcs.LGarXiv:2605.02910v22026