[1]
Q. Tang, Y. Zhang, and Y. Gao, “Q-learning and Policy Gradient-Based Reinforcement Learning Method to Decision Making of Phased Array Radar Jamming”, Informatica, vol. 49, no. 27, Dec. 2025, doi: 10.31449/inf.v49i27.7369.