Score: 0

Q-Policy: Quantum-Enhanced Policy Evaluation for Scalable Reinforcement Learning

Published: May 17, 2025 | arXiv ID: 2505.11862v2

By: Kalyan Cherukuri, Aarav Lala, Yash Yardi

Potential Business Impact:

Makes computers learn faster using quantum power.

Business Areas:

Quantum Computing Science and Engineering

We propose Q-Policy, a hybrid quantum-classical reinforcement learning (RL) framework that mathematically accelerates policy evaluation and optimization by exploiting quantum computing primitives. Q-Policy encodes value functions in quantum superposition, enabling simultaneous evaluation of multiple state-action pairs via amplitude encoding and quantum parallelism. We introduce a quantum-enhanced policy iteration algorithm with provable polynomial reductions in sample complexity for the evaluation step, under standard assumptions. To demonstrate the technical feasibility and theoretical soundness of our approach, we validate Q-Policy on classical emulations of small discrete control tasks. Due to current hardware and simulation limitations, our experiments focus on showcasing proof-of-concept behavior rather than large-scale empirical evaluation. Our results support the potential of Q-Policy as a theoretical foundation for scalable RL on future quantum devices, addressing RL scalability challenges beyond classical approaches.

From Classical Data to Quantum Advantage -- Quantum Policy Evaluation on Quantum Hardware

Quantum Physics

Computers learn faster by using quantum tricks.

9 Sep 2025 1

88%

Quantum-Enhanced Reinforcement Learning for Power Grid Security Assessment

Systems and Control

Makes power grids safer using quantum computers.

19 Apr 2025 0

88%

Quantum-Enhanced Hybrid Reinforcement Learning Framework for Dynamic Path Planning in Autonomous Systems

Machine Learning (CS)

Teaches robots to navigate tricky places faster.

29 Apr 2025 0

View PDF Login to Bookmark

Page Count

29 pages

Q-Policy: Quantum-Enhanced Policy Evaluation for Scalable Reinforcement Learning

Makes computers learn faster using quantum power.

Technical Abstract

From Classical Data to Quantum Advantage -- Quantum Policy Evaluation on Quantum Hardware

Quantum-Enhanced Reinforcement Learning for Power Grid Security Assessment

Quantum-Enhanced Hybrid Reinforcement Learning Framework for Dynamic Path Planning in Autonomous Systems