Gao, Xinyue. “Safety Alignment of Large Language Models: The Offensive-Defensive Game Mechanism under Multi-Round Adversarial Prompting”. CPS Digital Library - Series of Conferences 1 (July 12, 2026): 33–37. Accessed August 31, 2026. https://seriesofconference.com/index.php/SCJ/article/view/266.