Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,101 to 2,160 of 15,404

  1. PyramidCLIP: Hierarchical Feature Alignment for Vision-language Model Pretraining

    Yuting Gao, Jinfeng Liu, Zihan Xu +4

    cs.CVcs.AIarXiv:2204.14095v22022
  2. Efficient Hyperparameter Optimization of Deep Learning Algorithms Using Deterministic RBF Surrogates

    Ilija Ilievski, Taimoor Akhtar, Jiashi Feng +1

    cs.AIcs.LGstat.MLarXiv:1607.08316v22016
  3. AI for AI: Optimizing Additional Infrastructure Build-out to Power Artificial Intelligence Data Centers

    Alexander Crosier, Kyle Onghai, Ronnie Sircar

    q-fin.GNcs.AIecon.GNarXiv:2609.08166v12026
  4. Transformer-Based Language Models for Software Vulnerability Detection

    Chandra Thapa, Seung Ick Jang, Muhammad Ejaz Ahmed +3

    cs.CRcs.AIcs.LGarXiv:2204.03214v22022
  5. IGT @ FinMMEval 2026 Task 2: Question-Type Prompting with Targeted Extraction for Multilingual Financial QA

    Yuwen Chiu

    cs.CLcs.AIarXiv:2609.08139v12026
  6. SQLMorph: Query Mutation and Fine-Grained Metrics for Text-to-SQL Evaluation

    Mohammadhossein Malekpour, Mohamed Riahi, Maxime Lamothe +1

    cs.DBcs.AIarXiv:2609.08950v12026
  7. KBBQ: A Predictive Noise Law and the Limits of Spectrum Flattening in FP4 Quantization

    Lexington Whalen, Yuki Ito, Ryo Sakamoto

    cs.LGcs.AIarXiv:2609.08135v12026
  8. Sparse Data Augmentation for Optimization with Provable Guarantees

    Behrooz Tahmasebi, Melanie Weber

    cs.LGcs.AImath.OCarXiv:2609.08133v12026
  9. LANTERN: Language Model Assessment on Noisy and Transformed Tasks for Understanding Error and Robustness Nuances

    Vamsi Krishna Kodavali, Rituraj Singh

    cs.CLcs.AIarXiv:2609.07309v12026
  10. DISEIL: Demonstration Distillation for Sample-Efficient Imitation Learning

    Suyog Khanal, Arun Kumar A, Santu Rana

    cs.ROcs.AIcs.LGarXiv:2609.08123v12026
  11. War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World Wars

    Wenyue Hua, Lizhou Fan, Lingyao Li +5

    cs.AIcs.CLcs.CYarXiv:2311.17227v22023
  12. Structured Scene Memory for Vision-Language Navigation

    Hanqing Wang, Wenguan Wang, Wei Liang +2

    cs.CVcs.AIarXiv:2103.03454v12021
  13. Foundation Models for Generalizable Semantic and Goal-Oriented Communication

    Boliang Liu, Wint Yi Poe, Riccardo Trivisonno +1

    cs.LGcs.AIcs.ROarXiv:2609.07853v12026
  14. Ambient @ EgoProactive 2026 : Proactive Egocentric Assistance with Visually Grounded Supervision

    Logesh Kumar Umapathi

    cs.CVcs.AIarXiv:2609.07099v12026
  15. A Conditional Point Diffusion-Refinement Paradigm for 3D Point Cloud Completion

    Zhaoyang Lyu, Zhifeng Kong, Xudong Xu +2

    cs.CVcs.AIarXiv:2112.03530v42021
  16. TACo: Token-aware Cascade Contrastive Learning for Video-Text Alignment

    Jianwei Yang, Yonatan Bisk, Jianfeng Gao

    cs.CVcs.AIcs.LGarXiv:2108.09980v12021
  17. Scaling Data Generation in Vision-and-Language Navigation

    Zun Wang, Jialu Li, Yicong Hong +6

    cs.CVcs.AIcs.CLarXiv:2307.15644v22023
  18. AV-SafetyBench: A Safety Benchmark for Text-to-Audio-Video Generation

    Suah Choi, Tae-Young Lee, Gyeong-Moon Park

    cs.CVcs.AIarXiv:2609.06991v12026
  19. MSSP: Multi-Scale Spatially-Constrained Partition for Unsupervised Semantic Segmentation of 3D Point Clouds

    Zhenghao Zhang, Xinjie Wang, Wei Wang +2

    cs.CVcs.AIarXiv:2609.06959v12026
  20. Rapid Exploration for Open-World Navigation with Latent Goal Models

    Dhruv Shah, Benjamin Eysenbach, Gregory Kahn +2

    cs.ROcs.AIcs.LGarXiv:2104.05859v52021
  21. Mind the Phase: Effective Rank and Representation Health in Legged Locomotion

    Felipe Tommaselli, Thiago H. Segreto, Juliano D. Negri +2

    cs.ROcs.AIarXiv:2609.06958v12026
  22. Faithful Reasoning Using Large Language Models

    Antonia Creswell, Murray Shanahan

    cs.AIcs.CLarXiv:2208.14271v12022
  23. Quizz: Targeted crowdsourcing with a billion (potential) users

    Panagiotis G. Ipeirotis, Evgeniy Gabrilovich

    cs.AIcs.HCarXiv:1506.01062v12015
  24. PLATOS: A Power and Latency-Aware Task-Oriented Scheduling Strategy for Healthcare IoT in Fog Computing

    Mohammed Alaa Ala'anzy, Zulfiqar Ahmad, Zhanar Mukash

    cs.DCcs.AIarXiv:2609.07318v12026
  25. Transformer-based World Models Are Happy With 100k Interactions

    Jan Robine, Marc Höftmann, Tobias Uelwer +1

    cs.LGcs.AIstat.MLarXiv:2303.07109v12023
  26. Token-level Direct Preference Optimization

    Yongcheng Zeng, Guoqing Liu, Weiyu Ma +3

    cs.CLcs.AIarXiv:2404.11999v52024
  27. REFINE: Trajectory Representation Learning via Closed-Loop Transcription -- Extended Version

    Sean Bin Yang, Ying Sun, Jilin Hu +5

    cs.LGcs.AIarXiv:2609.07206v12026
  28. A Benchmark of Ocular Disease Intelligent Recognition: One Shot for Multi-disease Detection

    Ning Li, Tao Li, Chunyu Hu +2

    cs.CVcs.AIarXiv:2102.07978v12021
  29. Rethinking Sign Language Translation: The Impact of Signer Dependence on Model Evaluation

    Keren Artiaga, Sabyasachi Kamila, Haithem Afli +2

    cs.CLcs.AIarXiv:2609.07965v12026
  30. XYBench: Can LLMs Respond Pragmatically to Queries with Misconceptions?

    Akhila Yerukola, Jena D. Hwang, Mingqian Zheng +5

    cs.CLcs.AIarXiv:2609.06842v12026
  31. WAPP: Safe Learning of Positive Security WAF Policies from Live Traffic

    Heba Osama, Zeyad Ahmed, Mohamed Amgad +4

    cs.CRcs.AIcs.NIarXiv:2609.06840v12026
  32. XIRL: Cross-embodiment Inverse Reinforcement Learning

    Kevin Zakka, Andy Zeng, Pete Florence +3

    cs.ROcs.AIcs.CVarXiv:2106.03911v32021
  33. Typed Federated Artifacts for the Agentic Web:Sharing Tool-Routing Knowledge Across Frozen,Heterogeneous LLM Agents

    Abhijit Chakraborty, Ni Trieu, Vivek Gupta

    cs.CLcs.AIarXiv:2609.06815v12026
  34. ChatScene: Knowledge-Enabled Safety-Critical Scenario Generation for Autonomous Vehicles

    Jiawei Zhang, Chejian Xu, Bo Li

    cs.AIcs.LGarXiv:2405.14062v12024
  35. Comparative Study of Anatomical and Learned Features in AI Models for Structural Brain MRI

    Boyang Yu, Miquel Lopez Escoriza, Long Chen +3

    cs.CVcs.AIarXiv:2609.06807v12026
  36. Achieving Forgetting Prevention and Knowledge Transfer in Continual Learning

    Zixuan Ke, Bing Liu, Nianzu Ma +2

    cs.CLcs.AIcs.LGarXiv:2112.02706v12021
  37. Hardware Trojan Threats to Multi-Chiplet Photonic Neural Network Accelerators

    Sudeep Pasricha

    cs.ARcs.AIcs.LGarXiv:2609.06796v12026
  38. Environment-Independent Task Specifications via GLTL

    Michael L. Littman, Ufuk Topcu, Jie Fu +3

    cs.AIarXiv:1704.04341v12017
  39. AURA-Eval: Evaluation Framework for Acting Under Risk Awareness in LLM Agent Trajectories

    Ruoxi Shang, Christina-Maria Androna, Orfeas Menis Mastromichalakis +6

    cs.CRcs.AIcs.CLarXiv:2609.06783v12026
  40. Super-Human Performance in Gran Turismo Sport Using Deep Reinforcement Learning

    Florian Fuchs, Yunlong Song, Elia Kaufmann +2

    cs.AIcs.LGcs.ROarXiv:2008.07971v22020
  41. Ordinary, Reasonable Chatbots: Do AI Models Track Human Legal Judgments?

    Nirav Patel, Emily Wenger, Christopher Buccafusco

    cs.CYcs.AIarXiv:2609.06769v12026
  42. Event Interaction in Low-Rank Bottlenecks for Temporal Relation Extraction

    Wei Sun, Tingyu Qu, Jesse Davis +1

    cs.CLcs.AIarXiv:2609.06731v12026
  43. Answers Unite! Unsupervised Metrics for Reinforced Summarization Models

    Thomas Scialom, Sylvain Lamprier, Benjamin Piwowarski +1

    cs.CLcs.AIcs.IRarXiv:1909.01610v12019
  44. Learning to Reconstruct Shapes from Unseen Classes

    Xiuming Zhang, Zhoutong Zhang, Chengkai Zhang +3

    cs.CVcs.AIarXiv:1812.11166v12018
  45. Shifts: A Dataset of Real Distributional Shift Across Multiple Large-Scale Tasks

    Andrey Malinin, Neil Band, Ganshin +15

    cs.LGcs.AIstat.MLarXiv:2107.07455v32021
  46. Widget Captioning: Generating Natural Language Description for Mobile User Interface Elements

    Yang Li, Gang Li, Luheng He +3

    cs.LGcs.AIcs.CLarXiv:2010.04295v12020
  47. Exploiting Contextual Independence In Probabilistic Inference

    D. Poole, N. L. Zhang

    cs.AIarXiv:1106.4864v12011
  48. Tracking the Moving Frontier: Long-Short Term Advantage Estimator

    Xinhao Yao, Lu Yu, Changhao Wang +5

    cs.LGcs.AIarXiv:2609.06671v12026
  49. FSAN: Flow State Attention Network for Aerodynamic Prediction

    Wenxuan Jin, Jianguo Yao, Haibing Guan +1

    cs.CVcs.AIarXiv:2609.06660v12026
  50. ECOKV: Geometry-Aware KV Cache Eviction via Complementary Diversity Metrics

    Chin Ting Hsu, Yu-Syuan Xu, Ling Zou +2

    cs.CLcs.AIcs.CVarXiv:2609.06663v12026
  51. PokaiTrainer: Scaling Belief-State Search to Competitive Pokémon VGC

    Max Yu

    cs.LGcs.AIcs.GTarXiv:2608.29197v12026
  52. Robust Training under Label Noise by Over-parameterization

    Sheng Liu, Zhihui Zhu, Qing Qu +1

    cs.LGcs.AIcs.CVarXiv:2202.14026v22022
  53. A Trustworthy Watermarking Framework for LLM-Generated Food Safety Content

    Zhongli Fang, Yiran Chen, Lingyun Zhang +4

    cs.CRcs.AIarXiv:2609.06708v12026
  54. Companion-style QA Assistance in Ego-Vision

    Hangyu Qin, Junbin Xiao, Shenglang Zhang +1

    cs.CVcs.AIarXiv:2609.06721v12026
  55. Counterfactual Tests for Measuring Chain-of-Thought Faithfulness in Visual Language Models

    Bayar Menzat, Maximilian Süss, Ruizhi Wang +3

    cs.CVcs.AIcs.CLarXiv:2609.06704v12026
  56. Attention-Enhanced Deep Features with Heterogeneous Ensemble Learning for Glaucoma Detection

    Abdullah Al Shafi, Nishat Sadaf Lira, Abrar Hasan +2

    cs.CVcs.AIcs.LGarXiv:2609.06699v12026
  57. Detokenization Leaks: Reconstructing Local LLM Outputs From Cache Traces

    Roy Weiss, Benyamin Konstantinov, Eitam Sheetrit +2

    cs.CRcs.AIarXiv:2609.06674v12026
  58. DIFFormer: Scalable (Graph) Transformers Induced by Energy Constrained Diffusion

    Qitian Wu, Chenxiao Yang, Wentao Zhao +3

    cs.LGcs.AIarXiv:2301.09474v42023
  59. Improving the Performance of Unimodal Dynamic Hand-Gesture Recognition with Multimodal Training

    Mahdi Abavisani, Hamid Reza Vaezi Joze, Vishal M. Patel

    cs.CVcs.AIcs.HCarXiv:1812.06145v22018
  60. Deep Barycentric Regression for Optimal Transport Map Estimation and its Statistical Optimality

    Kunwoong Kim, Insung Kong, Yongdai Kim

    cs.LGcs.AIstat.MLarXiv:2609.06598v12026