Table 4.

Datasets and benchmarks for LLM safety research

DatasetYearSize#Times
RealToxicityPrompts (Gehman et al., 2020)2020100K135
TruthfulQA (Lin et al., 2022)2021817213
AdvGLUE (Wang et al., 2021)20215,71612
SafetyPrompts (Sun et al., 2023a)2023100K15
DoNotAnswer (Wang et al., 2024q)20239396
AdvBench (Zou et al., 2023)202352052
CVALUES (Xu et al., 2023)20232,10010
FINE (Wang et al., 2024o)20239014
FLAMES (Huang et al., 2024c)20242,25117
SORRYBench (Xie et al., 2024)20244508
SafetyBench (Zhang et al., 2024x)202411,43521
SALAD-Bench (Li et al., 2024j)202430K36
BackdoorLLM (Li et al., 2024w)202486
JailBreakV-28K (Luo et al., 2024c)202428K10
STRONGREJECT (Souly et al., 2024)20243134
Libra-Leaderboard (Li et al., 2024e)20245726
Aegis 2.0 (Ghosh et al., 2025)202534K17
CASE-Bench (Sun et al., 2025)2025450

or Create an Account

Close Modal
Close Modal