Gao, X. (2026) “Safety Alignment of Large Language Models: The Offensive-Defensive Game Mechanism under Multi-round Adversarial Prompting”, CPS Digital Library - Series of Conferences, 1, pp. 33–37. Available at: https://seriesofconference.com/index.php/SCJ/article/view/266 (Accessed: 31 August 2026).