Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
51,721 to 51,780 of 61,108
Attribute2Image: Conditional Image Generation from Visual Attributes
Xinchen Yan, Jimei Yang, Kihyuk Sohn +1
cs.LGcs.AIcs.CVarXiv:1512.00570v22015How Merge-Tolerant Are Vision Transformers for Wheat Phenotyping?
Simon Ravé, Pejman Rasti, David Rousseau
cs.CVarXiv:2608.23142v12026MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering
Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu
cs.CLcs.AIcs.LGarXiv:2203.14371v12022Towards Expert-Level Medical Question Answering with Large Language Models
Karan Singhal, Tao Tu, Juraj Gottweis +28
cs.CLcs.AIcs.LGarXiv:2305.09617v12023Aster: Autonomous Scientific Discovery over 20x Faster Than Existing Methods
Emmett Bicker
cs.AIarXiv:2602.07040v12026Small-World Brain Networks Revisited
Danielle S. Bassett, Edward T. Bullmore
q-bio.NCarXiv:1608.05665v12016TransTrack: Multiple Object Tracking with Transformer
Peize Sun, Jinkun Cao, Yi Jiang +5
cs.CVarXiv:2012.15460v22020Guided Riemannian Optimization (GuRO): Bridging Model Predictive Control and Decision Transformers
Hossein Abdi, Satya Prakash Dash, Mingfei Sun
cs.ROarXiv:2608.23204v12026Ref-NeRF: Structured View-Dependent Appearance for Neural Radiance Fields
Dor Verbin, Peter Hedman, Ben Mildenhall +3
cs.CVcs.GRarXiv:2112.03907v12021Adaptive 1D Video Diffusion Autoencoder
Yao Teng, Minxuan Lin, Xian Liu +3
cs.CVarXiv:2602.04220v12026Reinforcement Learning with Augmented Data
Michael Laskin, Kimin Lee, Adam Stooke +3
cs.LGstat.MLarXiv:2004.14990v52020Proxy Compression for Language Modeling
Lin Zheng, Xinyu Li, Qian Liu +2
cs.CLcs.LGarXiv:2602.04289v22026Few-Step Diffusion Language Models via Trajectory Self-Distillation
Tunyu Zhang, Xinxi Zhang, Ligong Han +10
cs.CLcs.LGarXiv:2602.12262v42026When the Edit Changes the Patient: Measuring Identity Preservation in Counterfactual Retinal Images
Andrea Posada, Wenke Karbole, Bach Ngoc Doan +9
cs.CVarXiv:2608.23024v12026RoboRacer Arena: Scaling High-Fidelity Autonomous Racing in Isaac Sim
Mihaela-Larisa Clement, Agnes Poks, Ezio Bartocci
cs.ROarXiv:2608.23040v12026OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis
Luca Zedda, Andrea Loddo, Cecilia Di Ruberto
cs.CVcs.AIarXiv:2602.04547v12026Voxblox: Incremental 3D Euclidean Signed Distance Fields for On-Board MAV Planning
Helen Oleynikova, Zachary Taylor, Marius Fehr +2
cs.ROarXiv:1611.03631v22016Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review
Lixiang Yan, Lele Sha, Linxuan Zhao +6
cs.CLcs.AIcs.CYarXiv:2303.13379v22023No More Strided Convolutions or Pooling: A New CNN Building Block for Low-Resolution Images and Small Objects
Raja Sunkara, Tie Luo
cs.CVcs.LGarXiv:2208.03641v12022The Anonymity Gap: Understanding Real Privacy in Shielded UTXO-based Protocols for DeFi
Hanze Guo, Stefanos Chaliasos, Yebo Feng +1
cs.CRarXiv:2608.22987v12026Cross Attention Network for Few-shot Classification
Ruibing Hou, Hong Chang, Bingpeng Ma +2
cs.CVarXiv:1910.07677v12019DiffDock: Diffusion Steps, Twists, and Turns for Molecular Docking
Gabriele Corso, Hannes Stärk, Bowen Jing +2
q-bio.BMcs.LGphysics.bio-pharXiv:2210.01776v22022ChatGPT and a New Academic Reality: Artificial Intelligence-Written Research Papers and the Ethics of the Large Language Models in Scholarly Publishing
Brady Lund, Ting Wang, Nishith Reddy Mannuru +3
cs.CLcs.CYarXiv:2303.13367v22023Bridging Academia and Industry: A Comprehensive Benchmark for Attributed Graph Clustering
Yunhui Liu, Pengyu Qiu, Yu Xing +6
cs.LGarXiv:2602.08519v12026Effective Reasoning Chains Reduce Intrinsic Dimensionality
Archiki Prasad, Mandar Joshi, Kenton Lee +2
cs.CLcs.AIcs.LGarXiv:2602.09276v22026Human Action Recognition from Various Data Modalities: A Review
Zehua Sun, Qiuhong Ke, Hossein Rahmani +3
cs.CVarXiv:2012.11866v52020LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space
Jinghui Zhang, Lang Gao, Ao Li +5
cs.CLcs.AIarXiv:2608.23124v12026ANCHOR: Branch-Point Data Generation for GUI Agents
Jinbiao Wei, Yilun Zhao, Kangqi Ni +1
cs.AIarXiv:2602.07153v22026When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
Jiacheng Hou, Yining Sun, Ruochong Jin +4
cs.CVcs.AIarXiv:2602.10179v22026From Multimodal Observation to Interpretable Suggestions: Counterfactual Time-Expanded Relational Modeling of Surgical Teams
Vincenzo Marco De Luca, Antonio Longa, Giovanna Varni +1
cs.LGarXiv:2608.23254v12026Object Goal Navigation using Goal-Oriented Semantic Exploration
Devendra Singh Chaplot, Dhiraj Gandhi, Abhinav Gupta +1
cs.CVcs.LGcs.ROarXiv:2007.00643v22020Neighbor-Aware View Synthesis for Restoring Missing Views in Light-Field Camera Arrays
Sakshi Goel, Ayush Goyal, K S Venkatesh +1
cs.CVarXiv:2608.23175v12026Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models
Lei Wang, Wanyu Xu, Yihuai Lan +4
cs.CLarXiv:2305.04091v32023NeST: Neuron Selective Tuning for LLM Safety
Sasha Behrouzi, Lichao Wu, Mohamadreza Rostami +1
cs.CRcs.LGarXiv:2602.16835v22026Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation
Yan Wang, Yi Han, Lingfei Qian +11
cs.AIcs.CEarXiv:2602.16990v22026TreeCUA: Efficiently Scaling GUI Automation with Tree-Structured Verifiable Evolution
Deyang Jiang, Jing Huang, Xuanle Zhao +6
cs.CVarXiv:2602.09662v12026BridgeData V2: A Dataset for Robot Learning at Scale
Homer Walke, Kevin Black, Abraham Lee +11
cs.ROcs.LGarXiv:2308.12952v32023DeepFakes: a New Threat to Face Recognition? Assessment and Detection
Pavel Korshunov, Sebastien Marcel
cs.CVarXiv:1812.08685v12018MLS: A Large-Scale Multilingual Dataset for Speech Research
Vineel Pratap, Qiantong Xu, Anuroop Sriram +2
eess.AScs.CLcs.SDarXiv:2012.03411v22020Reinforced Attention Learning
Bangzheng Li, Jianmo Ni, Chen Qu +5
cs.CLcs.CVcs.LGarXiv:2602.04884v22026FIRST: A Framework for Optimizing Information Quality in Mobile Crowdsensing Systems
Francesco Restuccia, Pierluca Ferraro, Timothy S. Sanders +3
cs.NIarXiv:1804.11147v12018Auto-Encoding Scene Graphs for Image Captioning
Xu Yang, Kaihua Tang, Hanwang Zhang +1
cs.CVarXiv:1812.02378v32018Fast-SAM3D: 3Dfy Anything in Images but Faster
Weilun Feng, Mingqiang Wu, Zhiliang Chen +10
cs.CVarXiv:2602.05293v22026Self-Adaptive Physics-Informed Neural Networks using a Soft Attention Mechanism
Levi McClenny, Ulisses Braga-Neto
cs.LGstat.MLarXiv:2009.04544v52020Prism: Spectral-Aware Block-Sparse Attention
Xinghao Wang, Pengyu Wang, Xiaoran Liu +4
cs.CLcs.AIcs.CVarXiv:2602.08426v22026MotionCrafter: Dense Geometry and Motion Reconstruction with a 4D VAE
Ruijie Zhu, Jiahao Lu, Wenbo Hu +4
cs.CVcs.AIcs.CGarXiv:2602.08961v22026Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory
Hao Zhou, Minlie Huang, Tianyang Zhang +2
cs.CLcs.AIarXiv:1704.01074v42017ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation
Zihan Yang, Shuyuan Tu, Licheng Zhang +3
cs.CVcs.AIarXiv:2602.09014v12026Towards Actionable Surgical Team Dynamics: from Teamwork to Counterfactual Annotations
Vincenzo Marco De Luca, Antonio Longa, Andrea Passerini
cs.LGarXiv:2608.23344v12026KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs
Jian Chen, Zhuoran Wang, Jiayu Qin +6
cs.CLarXiv:2602.05929v22026Uncertainty Drives Social Bias Changes in Quantized Large Language Models
Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen
cs.CLarXiv:2602.06181v12026Joint Optimization Framework for Learning with Noisy Labels
Daiki Tanaka, Daiki Ikami, Toshihiko Yamasaki +1
cs.CVcs.LGstat.MLarXiv:1803.11364v12018Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty
Changdao He, Yibing Ju, Jonathan Calver +1
cs.HCcs.AIarXiv:2608.23300v12026Deep Learning-Based Communication Over the Air
Sebastian Dörner, Sebastian Cammerer, Jakob Hoydis +1
stat.MLcs.ITarXiv:1707.03384v12017SMASH: One-Shot Model Architecture Search through HyperNetworks
Andrew Brock, Theodore Lim, J. M. Ritchie +1
cs.LGarXiv:1708.05344v12017Reasoning-Augmented Representations for Multimodal Retrieval
Jianrui Zhang, Anirudh Sundara Rajan, Brandon Han +3
cs.IRcs.AIcs.CVarXiv:2602.07125v12026Federated Learning for Internet of Things: Recent Advances, Taxonomy, and Open Challenges
Latif U. Khan, Walid Saad, Zhu Han +2
cs.NIarXiv:2009.13012v22020Reinforcement Learning in Healthcare: A Survey
Chao Yu, Jiming Liu, Shamim Nemati
cs.LGcs.AIarXiv:1908.08796v42019VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval
Issar Tzachor, Dvir Samuel, Rami Ben-Ari
cs.CVcs.AIarXiv:2602.08099v12026C-Pack: Packed Resources For General Chinese Embeddings
Shitao Xiao, Zheng Liu, Peitian Zhang +3
cs.CLcs.AIcs.IRarXiv:2309.07597v52023