Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,321 to 4,380 of 15,269

  1. Neuro-Symbolic AI in 2024: A Systematic Review

    Brandon C. Colelough, William Regli

    cs.AIarXiv:2501.05435v22025
  2. Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation

    Theophile Gervet, Zhou Xian, Nikolaos Gkanatsios +1

    cs.ROcs.AIcs.LGarXiv:2306.17817v22023
  3. Towards Agentic Cloud Engineering: Graph and Loop Engineering with a Zero-Trust Agent Harness

    Sagar Srinivas Sakhinana, Venkataramana Runkana

    cs.SEcs.AIcs.LGarXiv:2609.00050v12026
  4. SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis

    Shuang Sun, Huatong Song, Yuhao Wang +10

    cs.CLcs.AIcs.IRarXiv:2505.16834v32025
  5. Horizon Reduction Makes RL Scalable

    Seohong Park, Kevin Frans, Deepinder Mann +3

    cs.LGcs.AIarXiv:2506.04168v32025
  6. Facts Without Rules: Boundary Metadata Collapse in Multi-Agent LLM Handoffs

    Yian Wang, Agam Goyal, Eshwar Chandrasekharan +1

    cs.AIarXiv:2608.29028v12026
  7. Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL

    Songjun Tu, Jiahao Lin, Qichao Zhang +4

    cs.CLcs.AIarXiv:2505.10832v32025
  8. Analyzing Differentiable Fuzzy Logic Operators

    Emile van Krieken, Erman Acar, Frank van Harmelen

    cs.AIcs.LGcs.LOarXiv:2002.06100v22020
  9. You Impress Me: Dialogue Generation via Mutual Persona Perception

    Qian Liu, Yihong Chen, Bei Chen +4

    cs.CLcs.AIarXiv:2004.05388v12020
  10. Assistance or Disruption? Exploring and Evaluating the Design and Trade-offs of Proactive AI Programming Support

    Kevin Pu, Daniel Lazaro, Ian Arawjo +4

    cs.HCcs.AIcs.SEarXiv:2502.18658v42025
  11. ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning

    Ziyu Wan, Yunxiang Li, Xiaoyu Wen +8

    cs.AIcs.CLcs.LGarXiv:2503.09501v32025
  12. AgentLogs: A Dataset for Opening the Black Box of GitHub's Cloud Agent

    Jonan Richards, Kosei Horikawa, Youmei Fan +2

    cs.SEcs.AIarXiv:2608.29204v12026
  13. Sycophantic Chatbots Cause Delusional Spiraling, Even in Ideal Bayesians

    Kartik Chandra, Max Kleiman-Weiner, Jonathan Ragan-Kelley +1

    cs.AIcs.CYcs.HCarXiv:2602.19141v12026
  14. Building and better understanding vision-language models: insights and future directions

    Hugo Laurençon, Andrés Marafioti, Victor Sanh +1

    cs.CVcs.AIarXiv:2408.12637v12024
  15. DexMachina: Functional Retargeting for Bimanual Dexterous Manipulation

    Zhao Mandi, Yifan Hou, Dieter Fox +3

    cs.ROcs.AIcs.LGarXiv:2505.24853v12025
  16. AutoHarness: improving LLM agents by automatically synthesizing a code harness

    Xinghua Lou, Miguel Lázaro-Gredilla, Antoine Dedieu +3

    cs.CLcs.AIarXiv:2603.03329v12026
  17. TwiBot-22: Towards Graph-Based Twitter Bot Detection

    Shangbin Feng, Zhaoxuan Tan, Herun Wan +19

    cs.SIcs.AIarXiv:2206.04564v62022
  18. UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical Expression

    Jiaqi Chen, Tong Li, Jinghui Qin +4

    cs.AIcs.LGarXiv:2212.02746v12022
  19. Ideation Arena: Evaluating LLM Generated Research Ideas with Battle-style Human Expert Assessment

    Zhiyu Chen, Keyu Zhao, Jigao Fu +8

    cs.AIarXiv:2608.29696v12026
  20. KVCache Cache in the Wild: Characterizing and Optimizing KVCache Cache at a Large Cloud Provider

    Jiahao Wang, Jinbo Han, Xingda Wei +6

    cs.DCcs.AIarXiv:2506.02634v52025
  21. Training-Free Action Correction for VLA Model Failures via Language Feedback

    Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1

    cs.ROcs.AIarXiv:2608.29967v12026
  22. MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance

    Quanhao Li, Zhen Xing, Rui Wang +3

    cs.CVcs.AIcs.LGarXiv:2503.16421v32025
  23. BRIGHT: A globally distributed multimodal building damage assessment dataset with very-high-resolution for all-weather disaster response

    Hongruixuan Chen, Jian Song, Olivier Dietrich +9

    cs.CVcs.AIeess.IVarXiv:2501.06019v42025
  24. Logic Attention Based Neighborhood Aggregation for Inductive Knowledge Graph Embedding

    Peifeng Wang, Jialong Han, Chenliang Li +1

    cs.AIcs.CLarXiv:1811.01399v22018
  25. ITBench: Evaluating AI Agents across Diverse Real-World IT Automation Tasks

    Saurabh Jha, Rohan Arora, Yuji Watanabe +40

    cs.AIcs.DCcs.MAarXiv:2502.05352v12025
  26. In-context Autoencoder for Context Compression in a Large Language Model

    Tao Ge, Jing Hu, Lei Wang +3

    cs.CLcs.AIcs.LGarXiv:2307.06945v42023
  27. Reasoning Over Semantic-Level Graph for Fact Checking

    Wanjun Zhong, Jingjing Xu, Duyu Tang +5

    cs.CLcs.AIarXiv:1909.03745v32019
  28. A Survey of Personalized Large Language Models: Progress and Future Directions

    Jiahong Liu, Zexuan Qiu, Zhongyang Li +7

    cs.AIarXiv:2502.11528v22025
  29. Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models

    Yiran Guo, Lijie Xu, Jie Liu +2

    cs.LGcs.AIcs.CLarXiv:2505.23564v22025
  30. Educational impacts of generative artificial intelligence on learning and performance of engineering students in China

    Lei Fan, Kunyang Deng, Fangxue Liu

    cs.HCcs.AIarXiv:2505.09208v12025
  31. MedSegBenchmarker: A Raw-Count-First Framework for Controlled 2D Medical Image Segmentation Benchmarks

    Vanessa Borst, Lukas Horn, Daniel Grillmeyer +2

    cs.CVcs.AIarXiv:2608.29677v12026
  32. Real-Time Decision-Making for Digital Twin in Additive Manufacturing with Model Predictive Control using Time-Series Deep Neural Networks

    Yi-Ping Chen, Vispi Karkaria, Ying-Kuan Tsai +5

    cs.LGcs.AIeess.SYarXiv:2501.07601v52025
  33. Overcoming Catastrophic Forgetting in Graph Neural Networks

    Huihui Liu, Yiding Yang, Xinchao Wang

    cs.LGcs.AIarXiv:2012.06002v12020
  34. Toward Latent Language Model Skills Steering and Optimization: An Empirical Study

    Xunyi Jiang, Junda Wu, Yuxin Xiong +6

    cs.AIarXiv:2608.29459v12026
  35. Agentic Web: Weaving the Next Web with AI Agents

    Yingxuan Yang, Mulei Ma, Yuxuan Huang +15

    cs.AIcs.LGarXiv:2507.21206v12025
  36. GUI-G$^2$: Gaussian Reward Modeling for GUI Grounding

    Fei Tang, Zhangxuan Gu, Zhengxi Lu +9

    cs.LGcs.AIcs.CLarXiv:2507.15846v32025
  37. Adv-BNN: Improved Adversarial Defense through Robust Bayesian Neural Network

    Xuanqing Liu, Yao Li, Chongruo Wu +1

    cs.LGcs.AIcs.CRarXiv:1810.01279v22018
  38. Frequency Dynamic Convolution for Dense Image Prediction

    Linwei Chen, Lin Gu, Liang Li +2

    cs.CVcs.AIarXiv:2503.18783v22025
  39. Forward-Deployed Full-Stack Engineering for Autonomous Cloud MLOps

    Sagar Srinivas Sakhinana, Venkataramana Runkana

    cs.MAcs.AIcs.LGarXiv:2608.29615v12026
  40. MiniCPM4: Ultra-Efficient LLMs on End Devices

    MiniCPM Team, Chaojun Xiao, Yuxuan Li +80

    cs.CLcs.AIarXiv:2506.07900v22025
  41. Prompt for Extraction? PAIE: Prompting Argument Interaction for Event Argument Extraction

    Yubo Ma, Zehao Wang, Yixin Cao +4

    cs.CLcs.AIarXiv:2202.12109v22022
  42. CoT-Kinetics: A Theoretical Modeling Assessing LRM Reasoning Process

    Jinhe Bi, Danqi Yan, Yifan Wang +8

    cs.AIcs.CLarXiv:2505.13408v12025
  43. Exploring the Roles of Large Language Models in Reshaping Transportation Systems: A Survey, Framework, and Roadmap

    Tong Nie, Jian Sun, Wei Ma

    cs.AIarXiv:2503.21411v22025
  44. Back to MLP: A Simple Baseline for Human Motion Prediction

    Wen Guo, Yuming Du, Xi Shen +3

    cs.CVcs.AIarXiv:2207.01567v32022
  45. A Modification of the Halpern-Pearl Definition of Causality

    Joseph Y. Halpern

    cs.AIarXiv:1505.00162v12015
  46. RePro: Proof-Verified Benchmark Rewriting for Reliable Evaluation of LLM Mathematical Problem Solving

    Xiyuan Zhou, Zhuoqi Li, Xinlei Wang +6

    cs.CLcs.AIarXiv:2609.00062v12026
  47. Task-Specific Prompt with Global Context for Multi-Task Graph Pre-Training

    Zhiyang Qiu, Yangtao Wang, Xiaocui Li +3

    cs.LGcs.AIarXiv:2609.00047v12026
  48. Enterprise-Grade Security for the Model Context Protocol (MCP): Frameworks and Mitigation Strategies

    Vineeth Sai Narajala, Idan Habler

    cs.CRcs.AIarXiv:2504.08623v22025
  49. d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation

    Yu-Yang Qian, Junda Su, Lanxiang Hu +4

    cs.LGcs.AIarXiv:2601.07568v32026
  50. BEST-Route: Adaptive LLM Routing with Test-Time Optimal Compute

    Dujian Ding, Ankur Mallick, Shaokun Zhang +7

    cs.LGcs.AIcs.CLarXiv:2506.22716v12025
  51. Step-3 is Large yet Affordable: Model-system Co-design for Cost-effective Decoding

    StepFun, :, Bin Wang +197

    cs.LGcs.AIarXiv:2507.19427v12025
  52. Prompt Flow Integrity to Prevent Privilege Escalation in LLM Agents

    Juhee Kim, Woohyuk Choi, Byoungyoung Lee

    cs.CRcs.AIcs.MAarXiv:2503.15547v22025
  53. Deep Learning Inversion of Electrical Resistivity Data

    Bin Liu, Qian Guo, Shucai Li +6

    cs.CVcs.AIphysics.geo-pharXiv:1904.05265v22019
  54. AgentRx: Diagnosing AI Agent Failures from Execution Trajectories

    Shraddha Barke, Arnav Goyal, Alind Khare +3

    cs.AIarXiv:2602.02475v22026
  55. Eagle 2: Building Post-Training Data Strategies from Scratch for Frontier Vision-Language Models

    Zhiqi Li, Guo Chen, Shilong Liu +24

    cs.CVcs.AIcs.LGarXiv:2501.14818v12025
  56. ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?

    Zhun Wang, Nico Schiller, Hongwei Li +13

    cs.CRcs.AIcs.LGarXiv:2605.11086v12026
  57. CyberGym: Evaluating AI Agents' Real-World Cybersecurity Capabilities at Scale

    Zhun Wang, Tianneng Shi, Jingxuan He +3

    cs.CRcs.AIcs.LGarXiv:2506.02548v32025
  58. DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving

    Anqing Jiang, Yu Gao, Zhigang Sun +11

    cs.AIcs.CVcs.ROarXiv:2505.19381v42025
  59. MAGMA: A Multi-Graph based Agentic Memory Architecture for AI Agents

    Dongming Jiang, Yi Li, Guanpeng Li +1

    cs.AIarXiv:2601.03236v22026
  60. ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models

    Chonghan Qin, Xiachong Feng, Weitao Ma +2

    cs.AIarXiv:2604.08064v22026