1.
Gao X. Safety Alignment of Large Language Models: The Offensive-Defensive Game Mechanism under Multi-round Adversarial Prompting. SCJ [Internet]. 2026 Jul. 12 [cited 2026 Aug. 31];1:33-7. Available from: https://seriesofconference.com/index.php/SCJ/article/view/266