Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,661 to 9,720 of 15,235

  1. RAVEN: A Dataset for Relational and Analogical Visual rEasoNing

    Chi Zhang, Feng Gao, Baoxiong Jia +2

    cs.CVcs.AIcs.LGarXiv:1903.02741v12019
  2. SpinNet: Learning a General Surface Descriptor for 3D Point Cloud Registration

    Sheng Ao, Qingyong Hu, Bo Yang +2

    cs.CVcs.AIcs.LGarXiv:2011.12149v22020
  3. AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents

    Christopher Rawles, Sarah Clinckemaillie, Yifan Chang +12

    cs.AIcs.LGarXiv:2405.14573v52024
  4. RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution

    Junjie Zhang, Hui Liu, Kecheng Chen +3

    cs.CRcs.AIarXiv:2608.27439v12026
  5. FOCUS & RePAIR: Mitigating Text Degeneration via Token-Level Guidance for Pruned Large Language Models

    Junyoung Lee, Sehyeon Park, Shinhyoung Jang +5

    cs.CLcs.AIcs.LGarXiv:2608.26676v12026
  6. FLDetector: Defending Federated Learning Against Model Poisoning Attacks via Detecting Malicious Clients

    Zaixi Zhang, Xiaoyu Cao, Jinyuan Jia +1

    cs.CRcs.AIarXiv:2207.09209v42022
  7. Stratified Transformer for 3D Point Cloud Segmentation

    Xin Lai, Jianhui Liu, Li Jiang +5

    cs.CVcs.AIarXiv:2203.14508v12022
  8. MEDITRON-70B: Scaling Medical Pretraining for Large Language Models

    Zeming Chen, Alejandro Hernández Cano, Angelika Romanou +17

    cs.CLcs.AIcs.LGarXiv:2311.16079v12023
  9. Multi-Hop Knowledge Graph Reasoning with Reward Shaping

    Xi Victoria Lin, Richard Socher, Caiming Xiong

    cs.AIcs.CLcs.LGarXiv:1808.10568v22018
  10. Light Field Networks: Neural Scene Representations with Single-Evaluation Rendering

    Vincent Sitzmann, Semon Rezchikov, William T. Freeman +2

    cs.CVcs.AIcs.GRarXiv:2106.02634v22021
  11. The Values Encoded in Machine Learning Research

    Abeba Birhane, Pratyusha Kalluri, Dallas Card +3

    cs.LGcs.AIcs.CYarXiv:2106.15590v22021
  12. Model-Agnostic Counterfactual Explanations for Consequential Decisions

    Amir-Hossein Karimi, Gilles Barthe, Borja Balle +1

    cs.LGcs.AIcs.LOarXiv:1905.11190v52019
  13. Stochastic Gradient Push for Distributed Deep Learning

    Mahmoud Assran, Nicolas Loizou, Nicolas Ballas +1

    cs.LGcs.AIcs.DCarXiv:1811.10792v32018
  14. Batch Policy Learning under Constraints

    Hoang M. Le, Cameron Voloshin, Yisong Yue

    cs.LGcs.AImath.OCarXiv:1903.08738v12019
  15. SpeechGym: An Audio-Native Gym for Training Voice Agents via Reinforcement Learning

    Jiajun Fan, Jingyuan Li, Prashanth Gurunath Shivakumar +6

    cs.SDcs.AIcs.CLarXiv:2608.26432v12026
  16. Neural Optimizer Search with Reinforcement Learning

    Irwan Bello, Barret Zoph, Vijay Vasudevan +1

    cs.AIcs.LGstat.MLarXiv:1709.07417v22017
  17. Funnel Libraries for Real-Time Robust Feedback Motion Planning

    Anirudha Majumdar, Russ Tedrake

    cs.ROcs.AIeess.SYarXiv:1601.04037v32016
  18. Dataset Security for Machine Learning: Data Poisoning, Backdoor Attacks, and Defenses

    Micah Goldblum, Dimitris Tsipras, Chulin Xie +6

    cs.LGcs.AIcs.CRarXiv:2012.10544v42020
  19. Mastering Complex Control in MOBA Games with Deep Reinforcement Learning

    Deheng Ye, Zhao Liu, Mingfei Sun +15

    cs.AIcs.LGarXiv:1912.09729v32019
  20. Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack

    Mark Russinovich, Ahmed Salem, Ronen Eldan

    cs.CRcs.AIarXiv:2404.01833v32024
  21. Bayesian Optimization is Superior to Random Search for Machine Learning Hyperparameter Tuning: Analysis of the Black-Box Optimization Challenge 2020

    Ryan Turner, David Eriksson, Michael McCourt +4

    cs.LGcs.AIstat.MLarXiv:2104.10201v22021
  22. Continual Learning of Context-dependent Processing in Neural Networks

    Guanxiong Zeng, Yang Chen, Bo Cui +1

    cs.LGcs.AIcs.CVarXiv:1810.01256v32018
  23. Compositionality decomposed: how do neural networks generalise?

    Dieuwke Hupkes, Verna Dankers, Mathijs Mul +1

    cs.CLcs.AIcs.LGarXiv:1908.08351v22019
  24. Visualizing and Understanding Atari Agents

    Sam Greydanus, Anurag Koul, Jonathan Dodge +1

    cs.AIarXiv:1711.00138v52017
  25. A Survey on Anomaly Detection for Technical Systems using LSTM Networks

    Benjamin Lindemann, Benjamin Maschler, Nada Sahlab +1

    cs.LGcs.AIstat.MLarXiv:2105.13810v12021
  26. Melding the Data-Decisions Pipeline: Decision-Focused Learning for Combinatorial Optimization

    Bryan Wilder, Bistra Dilkina, Milind Tambe

    cs.LGcs.AIstat.MLarXiv:1809.05504v22018
  27. Text2Motion: From Natural Language Instructions to Feasible Plans

    Kevin Lin, Christopher Agia, Toki Migimatsu +2

    cs.ROcs.AIcs.LGarXiv:2303.12153v52023
  28. Vid2Seq: Large-Scale Pretraining of a Visual Language Model for Dense Video Captioning

    Antoine Yang, Arsha Nagrani, Paul Hongsuck Seo +5

    cs.CVcs.AIcs.CLarXiv:2302.14115v22023
  29. Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents

    Chenhao Wu, Haoxuan Jia, Yang Liu +11

    cs.CRcs.AIarXiv:2608.27141v12026
  30. Emotional Preferences as Goal-Priority Regulation

    Shiqi Liu, Yihua Tan, Hu Fu +1

    cs.LGcs.AIarXiv:2608.27072v12026
  31. Robots That Ask For Help: Uncertainty Alignment for Large Language Model Planners

    Allen Z. Ren, Anushri Dixit, Alexandra Bodrova +11

    cs.ROcs.AIstat.AParXiv:2307.01928v22023
  32. Multi-Person Human Motion Forecasting in Complex Scenes

    Serdar Ozsoy, Lars Doorenbos, Juergen Gall

    cs.CVcs.AIarXiv:2608.27039v12026
  33. AudioGPT: Understanding and Generating Speech, Music, Sound, and Talking Head

    Rongjie Huang, Mingze Li, Dongchao Yang +10

    cs.CLcs.AIcs.SDarXiv:2304.12995v12023
  34. The Platonic Representation Hypothesis

    Minyoung Huh, Brian Cheung, Tongzhou Wang +1

    cs.LGcs.AIcs.CVarXiv:2405.07987v52024
  35. Improving Semantic Segmentation via Video Propagation and Label Relaxation

    Yi Zhu, Karan Sapra, Fitsum A. Reda +4

    cs.CVcs.AIcs.MMarXiv:1812.01593v32018
  36. Mapping the Landscape of Artificial Intelligence Applications against COVID-19

    Joseph Bullock, Alexandra Luccioni, Katherine Hoffmann Pham +2

    cs.CYcs.AIcs.LGarXiv:2003.11336v32020
  37. MHFormer: Multi-Hypothesis Transformer for 3D Human Pose Estimation

    Wenhao Li, Hong Liu, Hao Tang +2

    cs.CVcs.AIcs.LGarXiv:2111.12707v42021
  38. 3D Hand Shape and Pose from Images in the Wild

    Adnane Boukhayma, Rodrigo de Bem, Philip H. S. Torr

    cs.CVcs.AIcs.LGarXiv:1902.03451v12019
  39. Aequitas: A Bias and Fairness Audit Toolkit

    Pedro Saleiro, Benedict Kuester, Loren Hinkson +5

    cs.LGcs.AIcs.CYarXiv:1811.05577v22018
  40. PRECOG: PREdiction Conditioned On Goals in Visual Multi-Agent Settings

    Nicholas Rhinehart, Rowan McAllister, Kris Kitani +1

    cs.CVcs.AIcs.LGarXiv:1905.01296v32019
  41. PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization

    Yidong Wang, Zhuohao Yu, Zhengran Zeng +10

    cs.CLcs.AIarXiv:2306.05087v22023
  42. Vision-and-Dialog Navigation

    Jesse Thomason, Michael Murray, Maya Cakmak +1

    cs.CLcs.AIcs.CVarXiv:1907.04957v32019
  43. FaulT-Bench: Towards Benchmarking Network Troubleshooting LLM Agents under Unreliable User Tickets

    Kuan-Hao Tseng, Niruth Bogahawatta, Yasod Ginige +3

    cs.NIcs.AIarXiv:2608.27021v12026
  44. Geometric Deep Learning on Molecular Representations

    Kenneth Atz, Francesca Grisoni, Gisbert Schneider

    physics.chem-phcs.AIcs.LGarXiv:2107.12375v42021
  45. RepoBench: Benchmarking Repository-Level Code Auto-Completion Systems

    Tianyang Liu, Canwen Xu, Julian McAuley

    cs.CLcs.AIcs.SEarXiv:2306.03091v22023
  46. How Do LLM Agents Actually Get the Flag? Trace-Level Provenance for Agentic Offensive Security Evaluation

    Kimberly Milner, Minghao Shao, Nanda Rani +8

    cs.CRcs.AIarXiv:2608.26237v12026
  47. TSMixer: Lightweight MLP-Mixer Model for Multivariate Time Series Forecasting

    Vijay Ekambaram, Arindam Jati, Nam Nguyen +2

    cs.LGcs.AIarXiv:2306.09364v42023
  48. Modality Maturity Index: A benchmark for assessing multimodal capabilities of omni models

    Rohit Patel, Dieuwke Hupkes, Sloan Strader

    cs.CVcs.AIcs.MMarXiv:2608.26317v12026
  49. NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models

    Zeqian Ju, Yuancheng Wang, Kai Shen +16

    eess.AScs.AIcs.CLarXiv:2403.03100v32024
  50. Decay-Region Group Delay as a Forensic Cue for AI-Generated Impulsive Sounds

    JaeHyeong Chang, Chengzhe Sun, Siwei Lyu

    cs.SDcs.AIarXiv:2608.26346v12026
  51. Risk-Sensitive and Robust Decision-Making: a CVaR Optimization Approach

    Yinlam Chow, Aviv Tamar, Shie Mannor +1

    cs.AImath.OCarXiv:1506.02188v12015
  52. Co-Evolving Structured Knowledge and Reasoning in Language Models

    Ryan Thomas Noonan, Linxi Zhao, Menghan Xu +6

    cs.CLcs.AIcs.LGarXiv:2608.26386v12026
  53. Efficient Online Reinforcement Learning with Offline Data

    Philip J. Ball, Laura Smith, Ilya Kostrikov +1

    cs.LGcs.AIarXiv:2302.02948v42023
  54. Training behavior of deep neural network in frequency domain

    Zhi-Qin John Xu, Yaoyu Zhang, Yanyang Xiao

    cs.LGcs.AIcs.ITarXiv:1807.01251v62018
  55. Understanding and Robustifying Differentiable Architecture Search

    Arber Zela, Thomas Elsken, Tonmoy Saikia +3

    cs.LGcs.AIcs.CVarXiv:1909.09656v22019
  56. Imitation from Observation: Learning to Imitate Behaviors from Raw Video via Context Translation

    YuXuan Liu, Abhishek Gupta, Pieter Abbeel +1

    cs.LGcs.AIcs.CVarXiv:1707.03374v22017
  57. BrailleBench: Investigating Multi-Criteria Braille Comprehension in Large Language Models

    Jinghan Zhang, Fengran Mo, Zhiyu Chen +3

    cs.AIcs.CLcs.HCarXiv:2608.27268v12026
  58. LiveVVT: High-Fidelity Video Virtual Try-On in Real Time

    Yushe Cao, Shikun Feng, Ruxiang Duan +4

    cs.CVcs.AIarXiv:2608.26714v12026
  59. PEBBLE: Feedback-Efficient Interactive Reinforcement Learning via Relabeling Experience and Unsupervised Pre-training

    Kimin Lee, Laura Smith, Pieter Abbeel

    cs.LGcs.AIarXiv:2106.05091v12021
  60. Multimodal Large Language Models: A Survey

    Jiayang Wu, Wensheng Gan, Zefeng Chen +2

    cs.AIarXiv:2311.13165v12023