SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal Behaviors This is the project page of the paper: SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal Behaviors