Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
2,101 to 2,160 of 15,404
PyramidCLIP: Hierarchical Feature Alignment for Vision-language Model Pretraining
Yuting Gao, Jinfeng Liu, Zihan Xu +4
cs.CVcs.AIarXiv:2204.14095v22022Efficient Hyperparameter Optimization of Deep Learning Algorithms Using Deterministic RBF Surrogates
Ilija Ilievski, Taimoor Akhtar, Jiashi Feng +1
cs.AIcs.LGstat.MLarXiv:1607.08316v22016AI for AI: Optimizing Additional Infrastructure Build-out to Power Artificial Intelligence Data Centers
Alexander Crosier, Kyle Onghai, Ronnie Sircar
q-fin.GNcs.AIecon.GNarXiv:2609.08166v12026Transformer-Based Language Models for Software Vulnerability Detection
Chandra Thapa, Seung Ick Jang, Muhammad Ejaz Ahmed +3
cs.CRcs.AIcs.LGarXiv:2204.03214v22022IGT @ FinMMEval 2026 Task 2: Question-Type Prompting with Targeted Extraction for Multilingual Financial QA
Yuwen Chiu
cs.CLcs.AIarXiv:2609.08139v12026SQLMorph: Query Mutation and Fine-Grained Metrics for Text-to-SQL Evaluation
Mohammadhossein Malekpour, Mohamed Riahi, Maxime Lamothe +1
cs.DBcs.AIarXiv:2609.08950v12026KBBQ: A Predictive Noise Law and the Limits of Spectrum Flattening in FP4 Quantization
Lexington Whalen, Yuki Ito, Ryo Sakamoto
cs.LGcs.AIarXiv:2609.08135v12026Sparse Data Augmentation for Optimization with Provable Guarantees
Behrooz Tahmasebi, Melanie Weber
cs.LGcs.AImath.OCarXiv:2609.08133v12026LANTERN: Language Model Assessment on Noisy and Transformed Tasks for Understanding Error and Robustness Nuances
Vamsi Krishna Kodavali, Rituraj Singh
cs.CLcs.AIarXiv:2609.07309v12026DISEIL: Demonstration Distillation for Sample-Efficient Imitation Learning
Suyog Khanal, Arun Kumar A, Santu Rana
cs.ROcs.AIcs.LGarXiv:2609.08123v12026War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars
Wenyue Hua, Lizhou Fan, Lingyao Li +5
cs.AIcs.CLcs.CYarXiv:2311.17227v22023Structured Scene Memory for Vision-Language Navigation
Hanqing Wang, Wenguan Wang, Wei Liang +2
cs.CVcs.AIarXiv:2103.03454v12021Foundation Models for Generalizable Semantic and Goal-Oriented Communication
Boliang Liu, Wint Yi Poe, Riccardo Trivisonno +1
cs.LGcs.AIcs.ROarXiv:2609.07853v12026Ambient @ EgoProactive 2026 : Proactive Egocentric Assistance with Visually Grounded Supervision
Logesh Kumar Umapathi
cs.CVcs.AIarXiv:2609.07099v12026A Conditional Point Diffusion-Refinement Paradigm for 3D Point Cloud Completion
Zhaoyang Lyu, Zhifeng Kong, Xudong Xu +2
cs.CVcs.AIarXiv:2112.03530v42021TACo: Token-aware Cascade Contrastive Learning for Video-Text Alignment
Jianwei Yang, Yonatan Bisk, Jianfeng Gao
cs.CVcs.AIcs.LGarXiv:2108.09980v12021Scaling Data Generation in Vision-and-Language Navigation
Zun Wang, Jialu Li, Yicong Hong +6
cs.CVcs.AIcs.CLarXiv:2307.15644v22023AV-SafetyBench: A Safety Benchmark for Text-to-Audio-Video Generation
Suah Choi, Tae-Young Lee, Gyeong-Moon Park
cs.CVcs.AIarXiv:2609.06991v12026MSSP: Multi-Scale Spatially-Constrained Partition for Unsupervised Semantic Segmentation of 3D Point Clouds
Zhenghao Zhang, Xinjie Wang, Wei Wang +2
cs.CVcs.AIarXiv:2609.06959v12026Rapid Exploration for Open-World Navigation with Latent Goal Models
Dhruv Shah, Benjamin Eysenbach, Gregory Kahn +2
cs.ROcs.AIcs.LGarXiv:2104.05859v52021Mind the Phase: Effective Rank and Representation Health in Legged Locomotion
Felipe Tommaselli, Thiago H. Segreto, Juliano D. Negri +2
cs.ROcs.AIarXiv:2609.06958v12026Faithful Reasoning Using Large Language Models
Antonia Creswell, Murray Shanahan
cs.AIcs.CLarXiv:2208.14271v12022Quizz: Targeted crowdsourcing with a billion (potential) users
Panagiotis G. Ipeirotis, Evgeniy Gabrilovich
cs.AIcs.HCarXiv:1506.01062v12015PLATOS: A Power and Latency-Aware Task-Oriented Scheduling Strategy for Healthcare IoT in Fog Computing
Mohammed Alaa Ala'anzy, Zulfiqar Ahmad, Zhanar Mukash
cs.DCcs.AIarXiv:2609.07318v12026Transformer-based World Models Are Happy With 100k Interactions
Jan Robine, Marc Höftmann, Tobias Uelwer +1
cs.LGcs.AIstat.MLarXiv:2303.07109v12023Token-level Direct Preference Optimization
Yongcheng Zeng, Guoqing Liu, Weiyu Ma +3
cs.CLcs.AIarXiv:2404.11999v52024REFINE: Trajectory Representation Learning via Closed-Loop Transcription -- Extended Version
Sean Bin Yang, Ying Sun, Jilin Hu +5
cs.LGcs.AIarXiv:2609.07206v12026A Benchmark of Ocular Disease Intelligent Recognition: One Shot for Multi-disease Detection
Ning Li, Tao Li, Chunyu Hu +2
cs.CVcs.AIarXiv:2102.07978v12021Rethinking Sign Language Translation: The Impact of Signer Dependence on Model Evaluation
Keren Artiaga, Sabyasachi Kamila, Haithem Afli +2
cs.CLcs.AIarXiv:2609.07965v12026XYBench: Can LLMs Respond Pragmatically to Queries with Misconceptions?
Akhila Yerukola, Jena D. Hwang, Mingqian Zheng +5
cs.CLcs.AIarXiv:2609.06842v12026WAPP: Safe Learning of Positive Security WAF Policies from Live Traffic
Heba Osama, Zeyad Ahmed, Mohamed Amgad +4
cs.CRcs.AIcs.NIarXiv:2609.06840v12026XIRL: Cross-embodiment Inverse Reinforcement Learning
Kevin Zakka, Andy Zeng, Pete Florence +3
cs.ROcs.AIcs.CVarXiv:2106.03911v32021Typed Federated Artifacts for the Agentic Web:Sharing Tool-Routing Knowledge Across Frozen,Heterogeneous LLM Agents
Abhijit Chakraborty, Ni Trieu, Vivek Gupta
cs.CLcs.AIarXiv:2609.06815v12026ChatScene: Knowledge-Enabled Safety-Critical Scenario Generation for Autonomous Vehicles
Jiawei Zhang, Chejian Xu, Bo Li
cs.AIcs.LGarXiv:2405.14062v12024Comparative Study of Anatomical and Learned Features in AI Models for Structural Brain MRI
Boyang Yu, Miquel Lopez Escoriza, Long Chen +3
cs.CVcs.AIarXiv:2609.06807v12026Achieving Forgetting Prevention and Knowledge Transfer in Continual Learning
Zixuan Ke, Bing Liu, Nianzu Ma +2
cs.CLcs.AIcs.LGarXiv:2112.02706v12021Hardware Trojan Threats to Multi-Chiplet Photonic Neural Network Accelerators
Sudeep Pasricha
cs.ARcs.AIcs.LGarXiv:2609.06796v12026Environment-Independent Task Specifications via GLTL
Michael L. Littman, Ufuk Topcu, Jie Fu +3
cs.AIarXiv:1704.04341v12017AURA-Eval: Evaluation Framework for Acting Under Risk Awareness in LLM Agent Trajectories
Ruoxi Shang, Christina-Maria Androna, Orfeas Menis Mastromichalakis +6
cs.CRcs.AIcs.CLarXiv:2609.06783v12026Super-Human Performance in Gran Turismo Sport Using Deep Reinforcement Learning
Florian Fuchs, Yunlong Song, Elia Kaufmann +2
cs.AIcs.LGcs.ROarXiv:2008.07971v22020Ordinary, Reasonable Chatbots: Do AI Models Track Human Legal Judgments?
Nirav Patel, Emily Wenger, Christopher Buccafusco
cs.CYcs.AIarXiv:2609.06769v12026Event Interaction in Low-Rank Bottlenecks for Temporal Relation Extraction
Wei Sun, Tingyu Qu, Jesse Davis +1
cs.CLcs.AIarXiv:2609.06731v12026Answers Unite! Unsupervised Metrics for Reinforced Summarization Models
Thomas Scialom, Sylvain Lamprier, Benjamin Piwowarski +1
cs.CLcs.AIcs.IRarXiv:1909.01610v12019Learning to Reconstruct Shapes from Unseen Classes
Xiuming Zhang, Zhoutong Zhang, Chengkai Zhang +3
cs.CVcs.AIarXiv:1812.11166v12018Shifts: A Dataset of Real Distributional Shift Across Multiple Large-Scale Tasks
Andrey Malinin, Neil Band, Ganshin +15
cs.LGcs.AIstat.MLarXiv:2107.07455v32021Widget Captioning: Generating Natural Language Description for Mobile User Interface Elements
Yang Li, Gang Li, Luheng He +3
cs.LGcs.AIcs.CLarXiv:2010.04295v12020Exploiting Contextual Independence In Probabilistic Inference
D. Poole, N. L. Zhang
cs.AIarXiv:1106.4864v12011Tracking the Moving Frontier: Long-Short Term Advantage Estimator
Xinhao Yao, Lu Yu, Changhao Wang +5
cs.LGcs.AIarXiv:2609.06671v12026FSAN: Flow State Attention Network for Aerodynamic Prediction
Wenxuan Jin, Jianguo Yao, Haibing Guan +1
cs.CVcs.AIarXiv:2609.06660v12026ECOKV: Geometry-Aware KV Cache Eviction via Complementary Diversity Metrics
Chin Ting Hsu, Yu-Syuan Xu, Ling Zou +2
cs.CLcs.AIcs.CVarXiv:2609.06663v12026PokaiTrainer: Scaling Belief-State Search to Competitive Pokémon VGC
Max Yu
cs.LGcs.AIcs.GTarXiv:2608.29197v12026Robust Training under Label Noise by Over-parameterization
Sheng Liu, Zhihui Zhu, Qing Qu +1
cs.LGcs.AIcs.CVarXiv:2202.14026v22022A Trustworthy Watermarking Framework for LLM-Generated Food Safety Content
Zhongli Fang, Yiran Chen, Lingyun Zhang +4
cs.CRcs.AIarXiv:2609.06708v12026Companion-style QA Assistance in Ego-Vision
Hangyu Qin, Junbin Xiao, Shenglang Zhang +1
cs.CVcs.AIarXiv:2609.06721v12026Counterfactual Tests for Measuring Chain-of-Thought Faithfulness in Visual Language Models
Bayar Menzat, Maximilian Süss, Ruizhi Wang +3
cs.CVcs.AIcs.CLarXiv:2609.06704v12026Attention-Enhanced Deep Features with Heterogeneous Ensemble Learning for Glaucoma Detection
Abdullah Al Shafi, Nishat Sadaf Lira, Abrar Hasan +2
cs.CVcs.AIcs.LGarXiv:2609.06699v12026Detokenization Leaks: Reconstructing Local LLM Outputs From Cache Traces
Roy Weiss, Benyamin Konstantinov, Eitam Sheetrit +2
cs.CRcs.AIarXiv:2609.06674v12026DIFFormer: Scalable (Graph) Transformers Induced by Energy Constrained Diffusion
Qitian Wu, Chenxiao Yang, Wentao Zhao +3
cs.LGcs.AIarXiv:2301.09474v42023Improving the Performance of Unimodal Dynamic Hand-Gesture Recognition with Multimodal Training
Mahdi Abavisani, Hamid Reza Vaezi Joze, Vishal M. Patel
cs.CVcs.AIcs.HCarXiv:1812.06145v22018Deep Barycentric Regression for Optimal Transport Map Estimation and its Statistical Optimality
Kunwoong Kim, Insung Kong, Yongdai Kim
cs.LGcs.AIstat.MLarXiv:2609.06598v12026