Gao, Xinyue. “Safety Alignment of Large Language Models: The Offensive-Defensive Game Mechanism under Multi-Round Adversarial Prompting”. CPS Digital Library - Series of Conferences, vol. 1, July 2026, pp. 33-37, https://seriesofconference.com/index.php/SCJ/article/view/266.