Score: 0

Quantum Reinforcement Learning with Dynamic-Circuit Qubit Reuse and Grover-Based Trajectory Optimization

Published: September 19, 2025 | arXiv ID: 2509.16002v1

By: Thet Htar Su, Shaswot Shresthamali, Masaaki Kondo

Potential Business Impact:

Teaches computers to learn faster using quantum tricks.

Business Areas:

Quantum Computing Science and Engineering

A fully quantum reinforcement learning framework is developed that integrates a quantum Markov decision process, dynamic circuit-based qubit reuse, and Grover's algorithm for trajectory optimization. The framework encodes states, actions, rewards, and transitions entirely within the quantum domain, enabling parallel exploration of state-action sequences through superposition and eliminating classical subroutines. Dynamic circuit operations, including mid-circuit measurement and reset, allow reuse of the same physical qubits across multiple agent-environment interactions, reducing qubit requirements from 7*T to 7 for T time steps while preserving logical continuity. Quantum arithmetic computes trajectory returns, and Grover's search is applied to the superposition of these evaluated trajectories to amplify the probability of measuring those with the highest return, thereby accelerating the identification of the optimal policy. Simulations demonstrate that the dynamic-circuit-based implementation preserves trajectory fidelity while reducing qubit usage by 66 percent relative to the static design. Experimental deployment on IBM Heron-class quantum hardware confirms that the framework operates within the constraints of current quantum processors and validates the feasibility of fully quantum multi-step reinforcement learning under noisy intermediate-scale quantum conditions. This framework advances the scalability and practical application of quantum reinforcement learning for large-scale sequential decision-making tasks.

Quantum-Enhanced Hybrid Reinforcement Learning Framework for Dynamic Path Planning in Autonomous Systems

Machine Learning (CS)

Teaches robots to navigate tricky places faster.

29 Apr 2025 0

89%

Optimizing Quantum Circuits via ZX Diagrams using Reinforcement Learning and Graph Neural Networks

Machine Learning (CS)

Makes quantum computers work better and faster.

4 Apr 2025 1

88%

Quantum Machine Learning and Grover's Algorithm for Quantum Optimization of Robotic Manipulators

Robotics

Quantum computers help robots move better, faster.

8 Sep 2025 1

View PDF Login to Bookmark

Page Count

17 pages

Quantum Reinforcement Learning with Dynamic-Circuit Qubit Reuse and Grover-Based Trajectory Optimization

Teaches computers to learn faster using quantum tricks.

Technical Abstract

Quantum-Enhanced Hybrid Reinforcement Learning Framework for Dynamic Path Planning in Autonomous Systems

Optimizing Quantum Circuits via ZX Diagrams using Reinforcement Learning and Graph Neural Networks

Quantum Machine Learning and Grover's Algorithm for Quantum Optimization of Robotic Manipulators