Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

23,221 to 23,280 of 61,117

  1. Sample Selection Using Multi-Task Autoencoders in Federated Learning with Non-IID Data

    Emre Ardıç, Yakup Genç

    cs.CVcs.LGarXiv:2604.26116v12026
  2. Spatial and Spatio-Temporal Log-Gaussian Cox Processes: Extending the Geostatistical Paradigm

    Peter J. Diggle, Paula Moraga, Barry Rowlingson +1

    stat.MEarXiv:1312.6536v12013
  3. R$^3$-SQL: Ranking Reward and Resampling for Text-to-SQL

    Hojae Han, Yeonseok Jeong, Seung-won Hwang +2

    cs.SEcs.AIcs.CLarXiv:2604.25325v12026
  4. Memanto: Typed Semantic Memory with Information-Theoretic Retrieval for Long-Horizon Agents

    Seyed Moein Abtahi, Rasa Rahnema, Hetkumar Patel +3

    cs.AIarXiv:2604.22085v12026
  5. Convergent Evolution: How Different Language Models Learn Similar Number Representations

    Deqing Fu, Tianyi Zhou, Mikhail Belkin +2

    cs.CLcs.AIcs.LGarXiv:2604.20817v22026
  6. On the Robustness of LLM-Based Dense Retrievers: A Systematic Analysis of Generalizability and Stability

    Yongkang Li, Panagiotis Eustratiadis, Yixing Fan +1

    cs.IRcs.CLarXiv:2604.16576v12026
  7. CanViT: Toward Active-Vision Foundation Models

    Yohaï-Eliel Berreby, Sabrina Du, Audrey Durand +1

    cs.CVarXiv:2603.22570v22026
  8. DiPO: Disentangled Perplexity Policy Optimization for Fine-grained Exploration-Exploitation Trade-Off

    Xiaofan Li, Ming Yang, Zhiyuan Ma +9

    cs.LGarXiv:2604.13902v12026
  9. Elucidating the SNR-t Bias of Diffusion Probabilistic Models

    Meng Yu, Lei Sun, Jianhao Zeng +2

    cs.CVarXiv:2604.16044v12026
  10. Bilinear Generalized Approximate Message Passing

    Jason T. Parker, Philip Schniter, Volkan Cevher

    cs.ITarXiv:1310.2632v32013
  11. Reinforcement Learning via Value Gradient Flow

    Haoran Xu, Kaiwen Hu, Somayeh Sojoudi +1

    cs.LGcs.AIarXiv:2604.14265v12026
  12. SpotSound: Enhancing Large Audio-Language Models with Fine-Grained Temporal Grounding

    Luoyi Sun, Xiao Zhou, Zeqian Li +3

    cs.SDcs.MMarXiv:2604.13023v22026
  13. Consistency of spectral clustering in stochastic block models

    Jing Lei, Alessandro Rinaldo

    math.STstat.MLarXiv:1312.2050v32013
  14. ROSE: An Intent-Centered Evaluation Metric for NL2SQL

    Wenqi Pei, Shizheng Hou, Boyan Li +3

    cs.DBcs.AIarXiv:2604.12988v12026
  15. Lightning OPD: Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation

    Yecheng Wu, Song Han, Hai Cai

    cs.LGcs.AIarXiv:2604.13010v22026
  16. Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models

    Li Sun, Zhenhao Huang, Silei Chen +4

    cs.LGarXiv:2603.00618v12026
  17. Steered LLM Activations are Non-Surjective

    Aayush Mishra, Daniel Khashabi, Anqi Liu

    cs.AIcs.LGarXiv:2604.09839v22026
  18. Tunable Soft Equivariance with Guarantees

    Md Ashiqur Rahman, Lim Jun Hao, Jeremiah Jiang +2

    cs.CVcs.LGarXiv:2603.26657v12026
  19. RewardFlow: Generate Images by Optimizing What You Reward

    Onkar Susladkar, Dong-Hwan Jang, Tushar Prakash +7

    cs.CVcs.AIarXiv:2604.08536v12026
  20. $p1$: Better Prompt Optimization with Fewer Prompts

    Zhaolin Gao, Yu, Wang +4

    cs.LGcs.CLarXiv:2604.08801v12026
  21. FIT: A Large-Scale Dataset for Fit-Aware Virtual Try-On

    Johanna Karras, Yuanhao Wang, Yingwei Li +1

    cs.CVcs.GRarXiv:2604.08526v12026
  22. In-Band Full-Duplex Wireless: Challenges and Opportunities

    Ashutosh Sabharwal, Philip Schniter, Dongning Guo +3

    cs.ITarXiv:1311.0456v32013
  23. Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling

    Yongchang Hao, Lili Mou

    cs.LGcs.AImath.OCarXiv:2604.04987v12026
  24. Routes for breaching and protecting genetic privacy

    Yaniv Erlich, Arvind Narayanan

    q-bio.GNcs.CRstat.AParXiv:1310.3197v12013
  25. Learning to Hint for Reinforcement Learning

    Yu Xia, Canwen Xu, Zhewei Yao +2

    cs.LGcs.AIcs.CLarXiv:2604.00698v12026
  26. Efficient and Robust Absolute Pose Estimation via Gravity-Prior-Driven Transformation Decoupling and Pose Refinement

    Hu Cao, Qianyi Yang, Xinyi Li +3

    cs.CVarXiv:2609.00713v12026
  27. Locally Confident, Globally Stuck: The Quality-Exploration Dilemma in Diffusion Language Models

    Liancheng Fang, Aiwei Liu, Henry Peng Zou +7

    cs.CLarXiv:2604.00375v12026
  28. Parametric Social Identity Injection and Diversification in Public Opinion Simulation

    Hexi Wang, Yujia Zhou, Bangde Du +2

    cs.CLarXiv:2603.16142v22026
  29. Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering

    Yanjie Zhang, Yafei Li, Rui Sheng +5

    cs.CVcs.AIcs.MMarXiv:2603.28583v22026
  30. FluidWorld: Reaction-Diffusion Dynamics as a Predictive Substrate for World Models

    Fabien Polly

    cs.LGarXiv:2603.21315v12026
  31. PivotRL: High Accuracy Agentic Post-Training at Low Compute Cost

    Junkeun Yi, Damon Mosk-Aoyama, Baihe Huang +9

    cs.AIarXiv:2603.21383v12026
  32. FeynRules 2.0 - A complete toolbox for tree-level phenomenology

    Adam Alloul, Neil D. Christensen, Celine Degrande +2

    hep-pharXiv:1310.1921v22013
  33. Adaptive Layerwise Perturbation: Unifying Off-Policy Corrections for LLM RL

    Chenlu Ye, Xuanchang Zhang, Yifan Hao +6

    cs.LGcs.AIarXiv:2603.19470v32026
  34. Understanding Behavior Cloning with Action Quantization

    Haoqun Cao, Tengyang Xie

    cs.LGstat.MLarXiv:2603.20538v12026
  35. Structural Abstraction as an Inductive Bias for Non-Stationary Language Model Training

    Elnaz Rahmati, Nona Ghazizadeh, Zhivar Sourati +2

    cs.LGcs.CLarXiv:2603.17198v22026
  36. Believe Your Model: Distribution-Guided Confidence Calibration

    Xizhong Yang, Haotian Zhang, Huiming Wang +1

    cs.LGarXiv:2603.03872v12026
  37. Conservative Offline Robot Policy Learning via Posterior-Transition Reweighting

    Wanpeng Zhang, Hao Luo, Sipeng Zheng +6

    cs.ROarXiv:2603.16542v12026
  38. CAM: Causal additive models, high-dimensional order search and penalized regression

    Peter Bühlmann, Jonas Peters, Jan Ernest

    stat.MEcs.LGstat.MLarXiv:1310.1533v22013
  39. Neural Field Thermal Tomography: A Differentiable Physics Framework for Non-Destructive Evaluation

    Tao Zhong, Yixun Hu, Dongzhe Zheng +2

    cs.LGcond-mat.mtrl-scics.AIarXiv:2603.11045v22026
  40. Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning

    Aozhe Wang, Yuchen Yan, Nan Zhou +5

    cs.CLarXiv:2603.15611v12026
  41. Taming VAEs

    Danilo Jimenez Rezende, Fabio Viola

    stat.MLcs.LGarXiv:1810.00597v12018
  42. VQQA: An Agentic Approach for Video Evaluation and Quality Improvement

    Yiwen Song, Tomas Pfister, Yale Song

    cs.CVcs.AIcs.LGarXiv:2603.12310v12026
  43. Spectrum Matching: a Unified Perspective for Superior Diffusability in Latent Diffusion

    Mang Ning, Mingxiao Li, Le Zhang +4

    cs.CVarXiv:2603.14645v12026
  44. ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation

    Songlin Yang, Zhe Wang, Xuyi Yang +7

    cs.CVarXiv:2603.11421v22026
  45. Stabilizing Reinforcement Learning for Diffusion Language Models

    Jianyuan Zhong, Kaibo Wang, Ding Ding +5

    cs.LGcs.AIarXiv:2603.06743v12026
  46. ReMix: Reinforcement routing for mixtures of LoRAs in LLM finetuning

    Ruizhong Qiu, Hanqing Zeng, Yinglong Xia +15

    cs.LGcs.CLarXiv:2603.10160v12026
  47. $\nabla$-Reasoner: LLM Reasoning via Test-Time Gradient Descent in Latent Space

    Peihao Wang, Ruisi Cai, Zhen Wang +4

    cs.LGarXiv:2603.04948v12026
  48. General Agent Evaluation

    Elron Bandel, Asaf Yehudai, Lilach Eden +12

    cs.AIarXiv:2602.22953v22026
  49. SciDER: Scientific Data-centric End-to-end Researcher

    Ke Lin, Owais Aijaz, Yilin Lu +3

    cs.AIcs.CLarXiv:2603.01421v32026
  50. BandPO: Bridging Trust Regions and Ratio Clipping via Probability-Aware Bounds for LLM Reinforcement Learning

    Yuan Li, Bo Wang, Yufei Gao +4

    cs.LGcs.AIarXiv:2603.04918v12026
  51. Accelerating Reinforcement Learning via MPC Solver-Gradient Guidance for Weights-varying MPC

    Baha Zarrouki, Arslan Thobani, Jasper Hoffmann +6

    cs.ROcs.LGeess.SYarXiv:2609.01061v12026
  52. Truncated Step-Level Sampling with Process Rewards for Retrieval-Augmented Reasoning

    Chris Samarinas, Haw-Shiuan Chang, Hamed Zamani

    cs.CLcs.IRarXiv:2602.23440v42026
  53. Pilot Beam Pattern Design for Channel Estimation in Massive MIMO Systems

    Song Noh, Michael D. Zoltowski, Youngchul Sung +1

    cs.ITarXiv:1309.7430v22013
  54. Overconfident Errors Need Stronger Correction: Asymmetric Confidence Penalties for Reinforcement Learning

    Yuanda Xu, Hejian Sang, Zhengze Zhou +2

    cs.LGcs.AIarXiv:2602.21420v12026
  55. Learning Personalized Agents from Human Feedback

    Kaiqu Liang, Julia Kruk, Shengyi Qian +9

    cs.AIcs.CLcs.LGarXiv:2602.16173v12026
  56. Adam Improves Muon: Adaptive Moment Estimation with Orthogonalized Momentum

    Minxin Zhang, Yuxuan Liu, Hayden Schaeffer

    cs.LGmath.OCarXiv:2602.17080v22026
  57. MolHIT: Advancing Molecular-Graph Generation with Hierarchical Discrete Diffusion Models

    Hojung Jung, Rodrigo Hormazabal, Jaehyeong Jo +5

    cs.AIarXiv:2602.17602v12026
  58. SARAH: Spatially Aware Real-time Agentic Humans

    Evonne Ng, Siwei Zhang, Zhang Chen +2

    cs.CVarXiv:2602.18432v12026
  59. Geometry-Based Vehicle-to-Vehicle Channel Modeling for Large-Scale Simulation

    Mate Boban, Joao Barros, Ozan K. Tonguz

    cs.NIarXiv:1305.0124v32013
  60. STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens

    Shiqi Liu, Zeyu He, Guojian Zhan +10

    cs.CLcs.AIarXiv:2602.15620v52026