Gao, X. (2026). Safety Alignment of Large Language Models: The Offensive-Defensive Game Mechanism under Multi-round Adversarial Prompting. CPS Digital Library - Series of Conferences, 1, 33–37. Retrieved from https://seriesofconference.com/index.php/SCJ/article/view/266