Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

52,021 to 52,080 of 61,393

  1. How Merge-Tolerant Are Vision Transformers for Wheat Phenotyping?

    Simon Ravé, Pejman Rasti, David Rousseau

    cs.CVarXiv:2608.23142v12026
  2. MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering

    Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu

    cs.CLcs.AIcs.LGarXiv:2203.14371v12022
  3. Towards Expert-Level Medical Question Answering with Large Language Models

    Karan Singhal, Tao Tu, Juraj Gottweis +28

    cs.CLcs.AIcs.LGarXiv:2305.09617v12023
  4. Aster: Autonomous Scientific Discovery over 20x Faster Than Existing Methods

    Emmett Bicker

    cs.AIarXiv:2602.07040v12026
  5. Small-World Brain Networks Revisited

    Danielle S. Bassett, Edward T. Bullmore

    q-bio.NCarXiv:1608.05665v12016
  6. TransTrack: Multiple Object Tracking with Transformer

    Peize Sun, Jinkun Cao, Yi Jiang +5

    cs.CVarXiv:2012.15460v22020
  7. Guided Riemannian Optimization (GuRO): Bridging Model Predictive Control and Decision Transformers

    Hossein Abdi, Satya Prakash Dash, Mingfei Sun

    cs.ROarXiv:2608.23204v12026
  8. Ref-NeRF: Structured View-Dependent Appearance for Neural Radiance Fields

    Dor Verbin, Peter Hedman, Ben Mildenhall +3

    cs.CVcs.GRarXiv:2112.03907v12021
  9. Adaptive 1D Video Diffusion Autoencoder

    Yao Teng, Minxuan Lin, Xian Liu +3

    cs.CVarXiv:2602.04220v12026
  10. Reinforcement Learning with Augmented Data

    Michael Laskin, Kimin Lee, Adam Stooke +3

    cs.LGstat.MLarXiv:2004.14990v52020
  11. Proxy Compression for Language Modeling

    Lin Zheng, Xinyu Li, Qian Liu +2

    cs.CLcs.LGarXiv:2602.04289v22026
  12. Few-Step Diffusion Language Models via Trajectory Self-Distillation

    Tunyu Zhang, Xinxi Zhang, Ligong Han +10

    cs.CLcs.LGarXiv:2602.12262v42026
  13. When the Edit Changes the Patient: Measuring Identity Preservation in Counterfactual Retinal Images

    Andrea Posada, Wenke Karbole, Bach Ngoc Doan +9

    cs.CVarXiv:2608.23024v12026
  14. RoboRacer Arena: Scaling High-Fidelity Autonomous Racing in Isaac Sim

    Mihaela-Larisa Clement, Agnes Poks, Ezio Bartocci

    cs.ROarXiv:2608.23040v12026
  15. OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis

    Luca Zedda, Andrea Loddo, Cecilia Di Ruberto

    cs.CVcs.AIarXiv:2602.04547v12026
  16. Voxblox: Incremental 3D Euclidean Signed Distance Fields for On-Board MAV Planning

    Helen Oleynikova, Zachary Taylor, Marius Fehr +2

    cs.ROarXiv:1611.03631v22016
  17. Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review

    Lixiang Yan, Lele Sha, Linxuan Zhao +6

    cs.CLcs.AIcs.CYarXiv:2303.13379v22023
  18. No More Strided Convolutions or Pooling: A New CNN Building Block for Low-Resolution Images and Small Objects

    Raja Sunkara, Tie Luo

    cs.CVcs.LGarXiv:2208.03641v12022
  19. The Anonymity Gap: Understanding Real Privacy in Shielded UTXO-based Protocols for DeFi

    Hanze Guo, Stefanos Chaliasos, Yebo Feng +1

    cs.CRarXiv:2608.22987v12026
  20. Cross Attention Network for Few-shot Classification

    Ruibing Hou, Hong Chang, Bingpeng Ma +2

    cs.CVarXiv:1910.07677v12019
  21. DiffDock: Diffusion Steps, Twists, and Turns for Molecular Docking

    Gabriele Corso, Hannes Stärk, Bowen Jing +2

    q-bio.BMcs.LGphysics.bio-pharXiv:2210.01776v22022
  22. ChatGPT and a New Academic Reality: Artificial Intelligence-Written Research Papers and the Ethics of the Large Language Models in Scholarly Publishing

    Brady Lund, Ting Wang, Nishith Reddy Mannuru +3

    cs.CLcs.CYarXiv:2303.13367v22023
  23. Bridging Academia and Industry: A Comprehensive Benchmark for Attributed Graph Clustering

    Yunhui Liu, Pengyu Qiu, Yu Xing +6

    cs.LGarXiv:2602.08519v12026
  24. Effective Reasoning Chains Reduce Intrinsic Dimensionality

    Archiki Prasad, Mandar Joshi, Kenton Lee +2

    cs.CLcs.AIcs.LGarXiv:2602.09276v22026
  25. Human Action Recognition from Various Data Modalities: A Review

    Zehua Sun, Qiuhong Ke, Hossein Rahmani +3

    cs.CVarXiv:2012.11866v52020
  26. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space

    Jinghui Zhang, Lang Gao, Ao Li +5

    cs.CLcs.AIarXiv:2608.23124v12026
  27. ANCHOR: Branch-Point Data Generation for GUI Agents

    Jinbiao Wei, Yilun Zhao, Kangqi Ni +1

    cs.AIarXiv:2602.07153v22026
  28. When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models

    Jiacheng Hou, Yining Sun, Ruochong Jin +4

    cs.CVcs.AIarXiv:2602.10179v22026
  29. From Multimodal Observation to Interpretable Suggestions: Counterfactual Time-Expanded Relational Modeling of Surgical Teams

    Vincenzo Marco De Luca, Antonio Longa, Giovanna Varni +1

    cs.LGarXiv:2608.23254v12026
  30. Object Goal Navigation using Goal-Oriented Semantic Exploration

    Devendra Singh Chaplot, Dhiraj Gandhi, Abhinav Gupta +1

    cs.CVcs.LGcs.ROarXiv:2007.00643v22020
  31. Neighbor-Aware View Synthesis for Restoring Missing Views in Light-Field Camera Arrays

    Sakshi Goel, Ayush Goyal, K S Venkatesh +1

    cs.CVarXiv:2608.23175v12026
  32. Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models

    Lei Wang, Wanyu Xu, Yihuai Lan +4

    cs.CLarXiv:2305.04091v32023
  33. NeST: Neuron Selective Tuning for LLM Safety

    Sasha Behrouzi, Lichao Wu, Mohamadreza Rostami +1

    cs.CRcs.LGarXiv:2602.16835v22026
  34. Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation

    Yan Wang, Yi Han, Lingfei Qian +11

    cs.AIcs.CEarXiv:2602.16990v22026
  35. TreeCUA: Efficiently Scaling GUI Automation with Tree-Structured Verifiable Evolution

    Deyang Jiang, Jing Huang, Xuanle Zhao +6

    cs.CVarXiv:2602.09662v12026
  36. BridgeData V2: A Dataset for Robot Learning at Scale

    Homer Walke, Kevin Black, Abraham Lee +11

    cs.ROcs.LGarXiv:2308.12952v32023
  37. DeepFakes: a New Threat to Face Recognition? Assessment and Detection

    Pavel Korshunov, Sebastien Marcel

    cs.CVarXiv:1812.08685v12018
  38. MLS: A Large-Scale Multilingual Dataset for Speech Research

    Vineel Pratap, Qiantong Xu, Anuroop Sriram +2

    eess.AScs.CLcs.SDarXiv:2012.03411v22020
  39. Reinforced Attention Learning

    Bangzheng Li, Jianmo Ni, Chen Qu +5

    cs.CLcs.CVcs.LGarXiv:2602.04884v22026
  40. FIRST: A Framework for Optimizing Information Quality in Mobile Crowdsensing Systems

    Francesco Restuccia, Pierluca Ferraro, Timothy S. Sanders +3

    cs.NIarXiv:1804.11147v12018
  41. Auto-Encoding Scene Graphs for Image Captioning

    Xu Yang, Kaihua Tang, Hanwang Zhang +1

    cs.CVarXiv:1812.02378v32018
  42. Fast-SAM3D: 3Dfy Anything in Images but Faster

    Weilun Feng, Mingqiang Wu, Zhiliang Chen +10

    cs.CVarXiv:2602.05293v22026
  43. Self-Adaptive Physics-Informed Neural Networks using a Soft Attention Mechanism

    Levi McClenny, Ulisses Braga-Neto

    cs.LGstat.MLarXiv:2009.04544v52020
  44. Prism: Spectral-Aware Block-Sparse Attention

    Xinghao Wang, Pengyu Wang, Xiaoran Liu +4

    cs.CLcs.AIcs.CVarXiv:2602.08426v22026
  45. MotionCrafter: Dense Geometry and Motion Reconstruction with a 4D VAE

    Ruijie Zhu, Jiahao Lu, Wenbo Hu +4

    cs.CVcs.AIcs.CGarXiv:2602.08961v22026
  46. Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory

    Hao Zhou, Minlie Huang, Tianyang Zhang +2

    cs.CLcs.AIarXiv:1704.01074v42017
  47. ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation

    Zihan Yang, Shuyuan Tu, Licheng Zhang +3

    cs.CVcs.AIarXiv:2602.09014v12026
  48. Towards Actionable Surgical Team Dynamics: from Teamwork to Counterfactual Annotations

    Vincenzo Marco De Luca, Antonio Longa, Andrea Passerini

    cs.LGarXiv:2608.23344v12026
  49. KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs

    Jian Chen, Zhuoran Wang, Jiayu Qin +6

    cs.CLarXiv:2602.05929v22026
  50. Uncertainty Drives Social Bias Changes in Quantized Large Language Models

    Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen

    cs.CLarXiv:2602.06181v12026
  51. Joint Optimization Framework for Learning with Noisy Labels

    Daiki Tanaka, Daiki Ikami, Toshihiko Yamasaki +1

    cs.CVcs.LGstat.MLarXiv:1803.11364v12018
  52. Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty

    Changdao He, Yibing Ju, Jonathan Calver +1

    cs.HCcs.AIarXiv:2608.23300v12026
  53. Deep Learning-Based Communication Over the Air

    Sebastian Dörner, Sebastian Cammerer, Jakob Hoydis +1

    stat.MLcs.ITarXiv:1707.03384v12017
  54. SMASH: One-Shot Model Architecture Search through HyperNetworks

    Andrew Brock, Theodore Lim, J. M. Ritchie +1

    cs.LGarXiv:1708.05344v12017
  55. Reasoning-Augmented Representations for Multimodal Retrieval

    Jianrui Zhang, Anirudh Sundara Rajan, Brandon Han +3

    cs.IRcs.AIcs.CVarXiv:2602.07125v12026
  56. Federated Learning for Internet of Things: Recent Advances, Taxonomy, and Open Challenges

    Latif U. Khan, Walid Saad, Zhu Han +2

    cs.NIarXiv:2009.13012v22020
  57. Reinforcement Learning in Healthcare: A Survey

    Chao Yu, Jiming Liu, Shamim Nemati

    cs.LGcs.AIarXiv:1908.08796v42019
  58. VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval

    Issar Tzachor, Dvir Samuel, Rami Ben-Ari

    cs.CVcs.AIarXiv:2602.08099v12026
  59. C-Pack: Packed Resources For General Chinese Embeddings

    Shitao Xiao, Zheng Liu, Peitian Zhang +3

    cs.CLcs.AIcs.IRarXiv:2309.07597v52023
  60. Fine-T2I: An Open, Large-Scale, and Diverse Dataset for High-Quality T2I Fine-Tuning

    Xu Ma, Yitian Zhang, Qihua Dong +1

    cs.CVarXiv:2602.09439v12026