Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,901 to 6,960 of 15,305

  1. HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing

    Mude Hui, Siwei Yang, Bingchen Zhao +5

    cs.CVcs.AIarXiv:2404.09990v12024
  2. Rethinking the Bounds of LLM Reasoning: Are Multi-Agent Discussions the Key?

    Qineng Wang, Zihao Wang, Ying Su +2

    cs.CLcs.AIarXiv:2402.18272v12024
  3. Optimization-based Prompt Injection Attack to LLM-as-a-Judge

    Jiawen Shi, Zenghui Yuan, Yinuo Liu +4

    cs.CRcs.AIarXiv:2403.17710v52024
  4. CEM: Commonsense-aware Empathetic Response Generation

    Sahand Sabour, Chujie Zheng, Minlie Huang

    cs.CLcs.AIarXiv:2109.05739v22021
  5. GlossoGen: Emergent Language in Complex Multi-Agent LLM Interactions

    Elias Stengel-Eskin, Newton Sander, Carlos Bonetti +4

    cs.CLcs.AIcs.MAarXiv:2609.01491v12026
  6. LLaMA-Omni: Seamless Speech Interaction with Large Language Models

    Qingkai Fang, Shoutao Guo, Yan Zhou +3

    cs.CLcs.AIcs.SDarXiv:2409.06666v22024
  7. TextGrad: Automatic "Differentiation" via Text

    Mert Yuksekgonul, Federico Bianchi, Joseph Boen +4

    cs.CLcs.AIcs.LGarXiv:2406.07496v12024
  8. Agent-as-a-Judge: Evaluate Agents with Agents

    Mingchen Zhuge, Changsheng Zhao, Dylan Ashley +10

    cs.AIarXiv:2410.10934v22024
  9. Explainable Artificial Intelligence: A Survey of Needs, Techniques, Applications, and Future Direction

    Melkamu Mersha, Khang Lam, Joseph Wood +2

    cs.AIcs.CLcs.CYarXiv:2409.00265v22024
  10. ContractNLI: A Dataset for Document-level Natural Language Inference for Contracts

    Yuta Koreeda, Christopher D. Manning

    cs.CLcs.AIcs.LGarXiv:2110.01799v12021
  11. VoiceBench: Benchmarking LLM-Based Voice Assistants

    Yiming Chen, Xianghu Yue, Chen Zhang +3

    cs.CLcs.AIcs.SDarXiv:2410.17196v32024
  12. Machine Learning in the Air

    Deniz Gunduz, Paul de Kerret, Nicholas D. Sidiropoulos +3

    cs.ITcs.AIcs.LGarXiv:1904.12385v12019
  13. Cross-Domain Gradient Discrepancy Minimization for Unsupervised Domain Adaptation

    Zhekai Du, Jingjing Li, Hongzu Su +2

    cs.CVcs.AIcs.LGarXiv:2106.04151v12021
  14. Fundamental Limitations of Alignment in Large Language Models

    Yotam Wolf, Noam Wies, Oshri Avnery +2

    cs.CLcs.AIarXiv:2304.11082v62023
  15. Eco2AI: carbon emissions tracking of machine learning models as the first step towards sustainable AI

    Semen Budennyy, Vladimir Lazarev, Nikita Zakharenko +9

    cs.LGcs.AIcs.CEarXiv:2208.00406v22022
  16. Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning

    Yuexiang Zhai, Hao Bai, Zipeng Lin +8

    cs.AIcs.CLcs.CVarXiv:2405.10292v32024
  17. ViP-LLaVA: Making Large Multimodal Models Understand Arbitrary Visual Prompts

    Mu Cai, Haotian Liu, Dennis Park +4

    cs.CVcs.AIcs.CLarXiv:2312.00784v22023
  18. One Explanation Does Not Fit All: The Promise of Interactive Explanations for Machine Learning Transparency

    Kacper Sokol, Peter Flach

    cs.LGcs.AIstat.MLarXiv:2001.09734v12020
  19. Pretrained Language Models for Text Generation: A Survey

    Junyi Li, Tianyi Tang, Wayne Xin Zhao +1

    cs.CLcs.AIarXiv:2105.10311v22021
  20. The Turing Trap: The Promise & Peril of Human-Like Artificial Intelligence

    Erik Brynjolfsson

    econ.GNcs.AIcs.CYarXiv:2201.04200v12022
  21. Autonomous GIS: the next-generation AI-powered GIS

    Zhenlong Li, Huan Ning

    cs.AIcs.HCarXiv:2305.06453v42023
  22. Multi-Head Attention for Multi-Modal Joint Vehicle Motion Forecasting

    Jean Mercat, Thomas Gilles, Nicole El Zoghby +3

    cs.LGcs.AIcs.ROarXiv:1910.03650v32019
  23. InfraPatch: Cross-Task Targeted Grayscale Patch Attacks on Infrared-Adapted Vision-Language Models

    Chengyin Hu, Dingyi Lu, Jiaju Han +5

    cs.CVcs.AIarXiv:2609.02233v12026
  24. Differentiable Prompt Makes Pre-trained Language Models Better Few-shot Learners

    Ningyu Zhang, Luoqiu Li, Xiang Chen +5

    cs.CLcs.AIcs.CVarXiv:2108.13161v72021
  25. Competitive Market Behavior of LLMs

    Pawel Struski, Jakub Swistak, Inez Okulska +1

    cs.MAcs.AIecon.GNarXiv:2609.02580v12026
  26. Data Fusion by Matrix Factorization

    Marinka Žitnik, Blaž Zupan

    cs.LGcs.AIcs.DBarXiv:1307.0803v22013
  27. DeepAffinity: Long-Term Aspect Preference Prediction in eCommerce using Small Language Models

    Yotam Eshel, Guy Hadad, Guy Feigenblat +3

    cs.LGcs.AIarXiv:2609.02468v12026
  28. PolERo: Studying Political Evasion in Romanian

    Gabriel Stefan, Sergiu Nisioi

    cs.CLcs.AIarXiv:2609.02391v12026
  29. LiveBench: A Challenging, Contamination-Limited LLM Benchmark

    Colin White, Samuel Dooley, Manley Roberts +15

    cs.CLcs.AIcs.LGarXiv:2406.19314v22024
  30. Differentially Private Paired Table-Image Multimodal Synthesis

    Kai Chen, Josephine Lamp, Somesh Jha +1

    cs.CRcs.AIcs.CVarXiv:2609.00708v12026
  31. Diversity with Cooperation: Ensemble Methods for Few-Shot Classification

    Nikita Dvornik, Cordelia Schmid, Julien Mairal

    cs.CVcs.AIarXiv:1903.11341v22019
  32. Collective Constitutional AI: Aligning a Language Model with Public Input

    Saffron Huang, Divya Siddarth, Liane Lovitt +4

    cs.AIcs.CLcs.HCarXiv:2406.07814v12024
  33. Variational Option Discovery Algorithms

    Joshua Achiam, Harrison Edwards, Dario Amodei +1

    cs.AIarXiv:1807.10299v12018
  34. ROUGE 2.0: Updated and Improved Measures for Evaluation of Summarization Tasks

    Kavita Ganesan

    cs.IRcs.AIcs.CLarXiv:1803.01937v12018
  35. Selective Amnesia: A Continual Learning Approach to Forgetting in Deep Generative Models

    Alvin Heng, Harold Soh

    cs.LGcs.AIarXiv:2305.10120v22023
  36. Adaptive Factorization Network: Learning Adaptive-Order Feature Interactions

    Weiyu Cheng, Yanyan Shen, Linpeng Huang

    cs.LGcs.AIcs.IRarXiv:1909.03276v22019
  37. Temporal Graph Benchmark for Machine Learning on Temporal Graphs

    Shenyang Huang, Farimah Poursafaei, Jacob Danovitch +7

    cs.LGcs.AIarXiv:2307.01026v22023
  38. SenseFi: A Library and Benchmark on Deep-Learning-Empowered WiFi Human Sensing

    Jianfei Yang, Xinyan Chen, Dazhuo Wang +4

    cs.LGcs.AIeess.SParXiv:2207.07859v32022
  39. Near-Optimal Bayesian Active Learning with Noisy Observations

    Daniel Golovin, Andreas Krause, Debajyoti Ray

    cs.LGcs.AIcs.DSarXiv:1010.3091v22010
  40. Reasoning with Sarcasm by Reading In-between

    Yi Tay, Luu Anh Tuan, Siu Cheung Hui +1

    cs.CLcs.AIcs.IRarXiv:1805.02856v12018
  41. AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs

    Xiaogeng Liu, Peiran Li, Edward Suh +7

    cs.CRcs.AIcs.LGarXiv:2410.05295v42024
  42. Latent Space Policies for Hierarchical Reinforcement Learning

    Tuomas Haarnoja, Kristian Hartikainen, Pieter Abbeel +1

    cs.LGcs.AIstat.MLarXiv:1804.02808v22018
  43. Artificial Intelligence and Robotics

    Javier Andreu-Perez, Fani Deligianni, Daniele Ravi +1

    cs.AIarXiv:1803.10813v12018
  44. Applications of Artificial Neural Networks in Microorganism Image Analysis: A Comprehensive Review from Conventional Multilayer Perceptron to Popular Convolutional Neural Network and Potential Visual Transformer

    Jinghua Zhang, Chen Li, Yimin Yin +2

    cs.CVcs.AIarXiv:2108.00358v32021
  45. Artificial Intelligence-Based Methods for Fusion of Electronic Health Records and Imaging Data

    Farida Mohsen, Hazrat Ali, Nady El Hajj +1

    cs.LGcs.AIcs.CVarXiv:2210.13462v12022
  46. Disease Burden over Skin Tone: Decomposing the Dermatology-AI Generalization Gap

    Nirajan Kunwor, Sanjaya Poudel, Quoc-Huy Trinh +2

    cs.CVcs.AIcs.LGarXiv:2609.02111v12026
  47. Promptify: Text-to-Image Generation through Interactive Prompt Exploration with Large Language Models

    Stephen Brade, Bryan Wang, Mauricio Sousa +2

    cs.HCcs.AIcs.MMarXiv:2304.09337v12023
  48. LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation

    Ziyao Zhang, Yanlin Wang, Chong Wang +2

    cs.SEcs.AIcs.CLarXiv:2409.20550v22024
  49. Graph-Based Spatial-Temporal Convolutional Network for Vehicle Trajectory Prediction in Autonomous Driving

    Zihao Sheng, Yunwen Xu, Shibei Xue +1

    cs.LGcs.AIcs.ROarXiv:2109.12764v12021
  50. Explainable Intrusion Detection Systems (X-IDS): A Survey of Current Methods, Challenges, and Opportunities

    Subash Neupane, Jesse Ables, William Anderson +4

    cs.CRcs.AIarXiv:2207.06236v12022
  51. MASkills: Continual Skills Optimization for Multi-Agent LLM Systems

    Huaiyuan Yao, Xiaoou Liu, Charles Fleming +2

    cs.AIcs.CLarXiv:2609.02094v12026
  52. Adversarial Generation of Natural Language

    Sai Rajeswar, Sandeep Subramanian, Francis Dutil +2

    cs.CLcs.AIcs.NEarXiv:1705.10929v12017
  53. From Tokens to Semantics: Leveraging Complementary Signals for Hallucination Detection in Black-Box LLMs

    Urja Pawar, Rajitha Ramanayake, Owen O'Neill +4

    cs.CLcs.AIarXiv:2609.02679v12026
  54. AGI Maze Prediction Datasets: A Compact Benchmark for Learning World Dynamics with Transformers

    Alexey Potapov

    cs.LGcs.AIarXiv:2609.02339v12026
  55. MeanField Surrogate Modeling for Scalable Runtime Scheduling of Concurrent Heterogeneous AI Inference on Shared GPUs

    Youssef Ennouri, Soonhoi Ha

    cs.DCcs.AIarXiv:2609.02109v12026
  56. Agile Earth observation satellite scheduling over 20 years: formulations, methods and future directions

    Xinwei Wang, Guohua Wu, Lining Xing +1

    astro-ph.IMcs.AIeess.SParXiv:2003.06169v12020
  57. Loom: Weaving Diagnostic Strands into Free-Text Consensus via Embedding-Space Reweighting

    Ron Begleiter, Katya Egert Berg, Gilad Saban +1

    cs.AIcs.CLcs.LGarXiv:2609.02649v12026
  58. Improving Evaluation Realism with Inference-Time Compute and Deployment Scaffolds

    Axel Ahlqvist, Richard Guan, Juan-Pablo Rivera +6

    cs.AIcs.CLcs.LGarXiv:2609.02302v12026
  59. Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents

    Pranav Putta, Edmund Mills, Naman Garg +4

    cs.AIcs.LGarXiv:2408.07199v12024
  60. READY or Not: Reliable Enterprise Agent Deployment

    Veronica Chatrath, Bryan Zhu, Jingxuan Fan +15

    cs.AIarXiv:2609.02095v12026