D
Data
Text
A Method for Enhancing the Safety of Large Model Generation Based on Multi-dimensional Attack and
Proposes a data-centric method for improving the safety of large language models by building a safety-alignment supervised fine-tuning (SFT) dataset. Adversarial 'attack' instructions drawn from Chin…