Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

59,761 to 59,820 of 61,393

  1. InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning

    Ziang Yan, Sheng Xia, Jiashuo Yu +10

    cs.CVarXiv:2606.12195v12026
  2. Pythagoras-Prover: Advancing Efficient Formal Proving via Augmented Lean Formalisation

    Joshua Ong Jun Leang, Zheng Zhao, Mihaela Cătălina Stoian +5

    cs.AIarXiv:2606.12594v12026
  3. From AGI to ASI

    Tim Genewein, Matija Franklin, Alexander Lerchner +11

    cs.AIcs.CYcs.LGarXiv:2606.12683v12026
  4. LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

    Henok Daniel, Omar Alhussein, Cheng Li +2

    cs.NIarXiv:2606.11877v12026
  5. Quickest Detection of Hallucination Onset: Delay Bounds and Learned CUSUM Statistics

    Igor Itkin

    cs.LGcs.AIcs.CLarXiv:2606.12476v32026
  6. HYDRA-X: Native Unified Multimodal Models with Holistic Visual Tokenizers

    Guozhen Zhang, Xuerui Qiu, Yutao Cui +11

    cs.CVcs.AIarXiv:2606.13289v12026
  7. LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories

    Baochang Ren, Xinjie Liu, Xi Chen +15

    cs.CLcs.AIcs.LGarXiv:2606.13578v22026
  8. Dense Supervision, Sparse Updates: On the Sparsity and Geometry of On-Policy Distillation

    Guo Yu, Wenlin Liu, Yulan Hu +3

    cs.LGarXiv:2606.13657v32026
  9. ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning

    Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5

    cs.CVcs.AIcs.CLarXiv:2606.14697v12026
  10. IndustryBench-MIPU: Benchmarking Multi-Image Attribute Value Extraction for Industrial Products

    Haonan Qi, Jin Cao, Yongqi Zhang +9

    cs.CVarXiv:2606.14383v22026
  11. Retrieve, Don't Retrain: Extending Vision Language Action Models to New Tasks at Test Time

    Jeongeun Park, Juhan Park, Taekyung Kim +3

    cs.ROcs.AIarXiv:2606.15631v12026
  12. Human Universal Grasping

    Kevin Yuanbo Wu, Tianxing Zhou, Isaac Tu +5

    cs.ROcs.AIcs.CVarXiv:2606.17054v12026
  13. GD$^2$PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization

    Haotian Liu, Yihao Liu, Jingwei Ni +11

    cs.LGarXiv:2606.16771v12026
  14. VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in Small Language Models

    Sen Xu, Shixi Liu, Wei Wang +6

    cs.AIcs.CLarXiv:2606.16140v12026
  15. ACE-Ego-0: Unifying Egocentric Human and Robotic Data for VLA Pretraining

    Hao Li, Ganlong Zhao, Yufei Liu +8

    cs.ROarXiv:2606.17200v12026
  16. Speaking the Language of Science: Toward a General-Purpose Generative Foundation Model for the Natural Sciences

    Mingyang Li, Yurou Liu, Jieping Ye +3

    cs.CLarXiv:2606.16905v12026
  17. LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling

    Jian Yang, Shawn Guo, Wei Zhang +16

    cs.LGcs.AIarXiv:2606.18023v12026
  18. Looped World Models

    Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang +28

    cs.LGcs.AIcs.CLarXiv:2606.18208v12026
  19. SAE Interventions are Unreliable: Post-Intervention Recovery of Suppressed Behavior

    Mingyue Cui, Linghui Shen, Xingyi Yang

    cs.LGcs.AIarXiv:2606.18322v12026
  20. Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness

    Zijian Wang, Hanqi Li, Ziyue Yang +17

    cs.AIarXiv:2606.18874v32026
  21. EfficientRollout: System-Aware Self-Speculative Decoding for RL Rollouts

    Minseo Kim, Minjae Lee, Seunghyuk Oh +7

    cs.LGarXiv:2606.18967v12026
  22. BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation

    Max Van Puyvelde, Ibrahim Gulluk, Wim Van Criekinge +1

    cs.AIcs.CVcs.LGarXiv:2606.19651v22026
  23. GateMem: Benchmarking Memory Governance in Multi-Principal Shared-Memory Agents

    Zhe Ren, Yibo Yang, Yimeng Chen +7

    cs.LGcs.CLarXiv:2606.18829v12026
  24. CoinVE-200K: A Large-Scale High-Quality Dataset for Compositional Instruction-Guided Video Editing

    Fuchen Long, Cong Wang, Zitao Gao +8

    cs.CVarXiv:2608.17566v12026
  25. MAIC-UI: Making Interactive Courseware with Generative UI

    Shangqing Tu, Yanjia Li, Keyu Chen +7

    cs.CLcs.AIcs.HCarXiv:2604.25806v12026
    Summaries:한국어
  26. Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning

    Jiayu Yang, Chao Chen, Shengen Wu +6

    cs.LGcs.CLarXiv:2606.13106v12026
  27. Physics-IQ Verified

    Tim Rädsch, Yuki M Asano, Hilde Kuehne +4

    cs.CVarXiv:2606.18943v12026
  28. T$^2$PO: Uncertainty-Guided Exploration Control for Stable Multi-Turn Agentic Reinforcement Learning

    Haixin Wang, Hejie Cui, Chenwei Zhang +7

    cs.AIarXiv:2605.02178v12026
  29. PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech

    Venkata Pushpak Teja Menta

    cs.SDcs.CLarXiv:2604.25476v12026
  30. Web2BigTable: A Bi-Level Multi-Agent LLM System for Internet-Scale Information Search and Extraction

    Yuxuan Huang, Yihang Chen, Zhiyuan He +6

    cs.AIarXiv:2604.27221v12026
  31. XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity

    Dasol Choi, Eugenia Kim, Jaewon Noh +14

    cs.CLcs.AIarXiv:2605.05662v12026
  32. Q-RAG: Long Context Multi-step Retrieval via Value-based Embedder Training

    Artyom Sorokin, Nazar Buzun, Alexander Anokhin +7

    cs.LGcs.IRarXiv:2511.07328v22025
  33. ESARBench: A Benchmark for Agentic UAV Embodied Search and Rescue

    Daoxuan Zhang, Ping Chen, Jianyi Zhou +1

    cs.ROarXiv:2605.01371v12026
  34. FedADB: Class Anchor-Driven Dual-Branch Federated Learning for Mitigating Forgetting

    Zhenyan Liu, Hua Zhang, Haoran Gao +6

    cs.CRcs.LGarXiv:2608.15310v12026
  35. EMO: Pretraining Mixture of Experts for Emergent Modularity

    Ryan Wang, Akshita Bhagia, Sewon Min

    cs.CLarXiv:2605.06663v22026
  36. A$^2$TGPO: Agentic Turn-Group Policy Optimization with Adaptive Turn-level Clipping

    Dingwei Chen, Zefang Zong, Zhipeng Ma +5

    cs.CLarXiv:2605.06200v12026
  37. Continuous-Time Distribution Matching for Few-Step Diffusion Distillation

    Tao Liu, Hao Yan, Mengting Chen +8

    cs.CVcs.AIarXiv:2605.06376v12026
  38. PAS-QFL: Personalized Ansatz Selection for Quantum Federated Learning under Client Data Heterogeneity

    Jindi Wu, Qun Li

    quant-phcs.AIcs.DCarXiv:2608.14995v12026
  39. CPCANet: Deep Unfolding Common Principal Component Analysis for Domain Generalization

    Yu-Hsi Chen, Abd-Krim Seghouane

    cs.CVarXiv:2605.05136v32026
  40. RT-Splatting: Joint Reflection-Transmission Modeling with Gaussian Splatting

    Ji Shi, Xianghua Ying, Bowei Xing +2

    cs.CVarXiv:2605.18263v12026
  41. Swift Sampling: Selecting Temporal Surprises via Taylor Series

    Dahye Kim, Bhuvan Sachdeva, Karan Uppal +3

    cs.CVcs.AIarXiv:2605.22678v12026
  42. NeuROK: Generative 4D Neural Object Kinematics

    Chen Geng, Guangzhao He, Yue Gao +3

    cs.CVcs.GRarXiv:2605.30347v12026
  43. LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know?

    HuiMing Fan, Xiao Wang, Zheng Chu +5

    cs.AIarXiv:2605.28721v12026
  44. VisualThink-VLA: Visual Intermediate Reasoning for Effective and Low-Latency Vision-Language-Action Policies

    Mingjian Gao, Wenqiao Zhang, Yuqian Yuan +9

    cs.CVcs.AIarXiv:2605.30011v12026
  45. K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts

    Nahyun Lee, Dongkeun Yoon, Guijin Son +12

    cs.CLarXiv:2606.02404v12026
  46. ABot-Earth 0.5: Generative 3D Earth Model

    Ming Qian, Tianjian Ouyang, Mingchao Sun +25

    cs.CVarXiv:2606.09967v12026
  47. Dynamic Linear Attention

    Xin Wang, Hui Shen, Boyuan Zheng +7

    cs.CLcs.AIarXiv:2606.10650v12026
  48. Memento: Reconstruct to Remember for Consistent Long Video Generation

    Xuan Wei, Longbin Ji, Guan Wang +5

    cs.CVarXiv:2606.14667v12026
  49. MyPCBench: A Benchmark for Personally Intelligent Computer-Use Agents

    Lawrence Keunho Jang, Andrew Keunwoo Jang, Jing Yu Koh +1

    cs.LGcs.CLarXiv:2606.16748v12026
  50. Why Fine-Tuning Encourages Hallucinations and How to Fix It

    Guy Kaplan, Zorik Gekhman, Zhen Zhu +5

    cs.CLcs.AIcs.LGarXiv:2604.15574v12026
  51. The Last Harness You'll Ever Build

    Haebin Seong, Li Yin, Haoran Zhang +1

    cs.AIarXiv:2604.21003v32026
  52. Diffusion Templates: A Unified Plugin Framework for Controllable Diffusion

    Zhongjie Duan, Hong Zhang, Yingda Chen

    cs.LGcs.AIcs.CVarXiv:2604.24351v12026
  53. Improving Vision-language Models with Perception-centric Process Reward Models

    Yingqian Min, Kun Zhou, Yifan Li +6

    cs.CVarXiv:2604.24583v12026
  54. Step-level Optimization for Efficient Computer-use Agents

    Jinbiao Wei, Kangqi Ni, Yilun Zhao +2

    cs.AIarXiv:2604.27151v12026
  55. EviMem: Evidence-Gap-Driven Iterative Retrieval for Long-Term Conversational Memory

    Yuyang Li, Yime He, Zeyu Zhang +1

    cs.CVcs.CLarXiv:2604.27695v12026
  56. Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning

    Chengshuai Shi, Wenzhe Li, Xinran Liang +10

    cs.LGcs.AIcs.CLarXiv:2605.00347v12026
  57. Agentic AI Systems Should Be Designed as Marginal Token Allocators

    Siqi Zhu

    cs.AIcs.CYarXiv:2605.01214v12026
  58. PianoCoRe: Combined and Refined Piano MIDI Dataset

    Ilya Borovik

    cs.SDcs.LGarXiv:2605.06627v12026
  59. Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation

    Bin Wu, Mengqi Huang, Shaojin Wu +4

    cs.CVarXiv:2605.03849v12026
  60. CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing

    Cheng Qian, Hyeonjeong Ha, Jiayu Liu +10

    cs.AIcs.CLcs.LGarXiv:2605.02910v22026