1.
Tang Q, Zhang Y, Gao Y. Q-learning and Policy Gradient-Based Reinforcement Learning Method to Decision Making of Phased Array Radar Jamming. Informatica. 2025;49(27). doi:10.31449/inf.v49i27.7369