Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Defense against adversarial prompts on Sneaky (test)
Loading...
45.16
Attack Success Rate
SDv1.5
-1.8064
10.3868
22.58
34.7732
Jul 1, 2026
Attack Success Rate
Updated 23d ago
Evaluation Results
Method
Method
Links
Attack Success Rate
SDv1.5
Base Model=SDv1.5, Eva...
2026.07
45.16
SPM
Base Model=SDv1.5, Eva...
2026.07
33.06
SLD-strong
Base Model=SDv1.5, Eva...
2026.07
27.42
Microsoft
Base Model=SDv1.5, Eva...
2026.07
18.21
OpenAI
Base Model=SDv1.5, Eva...
2026.07
18.21
SAFREE
Base Model=SDv1.5, Eva...
2026.07
10.48
Latent Guard
Base Model=SDv1.5, Eva...
2026.07
8.76
UCE
Base Model=SDv1.5, Eva...
2026.07
6.45
GuardT2I
Base Model=SDv1.5, Eva...
2026.07
4.47
GLoCE
Base Model=SDv1.5, Eva...
2026.07
2.42
AdvUnlearn
Base Model=SDv1.5, Eva...
2026.07
1.61
ESD
Base Model=SDv1.5, Eva...
2026.07
0.81
SalUn
Base Model=SDv1.5, Eva...
2026.07
0
DES
Base Model=SDv1.5, Eva...
2026.07
0
SAGE
Base Model=SDv1.5, Eva...
2026.07
0
Feedback
Search any
task
Search any
task