Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

GB Essay

Benchmarks

Task NameDataset NameSOTA ResultTrend
LLM-Generated Text DetectionGB Essay Deepseek V3 (test)
AUROC99.881
5
LLM-Generated Text DetectionGB Essay Claude (test)
AUROC95.988
5
LLM-Generated Text DetectionGB Essay GPT4o (test)
AUROC99.365
5
LLM-Generated Text DetectionGB Essay ChatGPT (test)
AUROC99.81
5
LLM Generated Content DetectionGB Essay Deepseek V3
F1 Score94.689
5
LLM Generated Content DetectionGB Essay Claude
F1 Score88.829
5
LLM Generated Content DetectionGB Essay GPT4o
F1 Score93.922
5
LLM Generated Content DetectionGB Essay ChatGPT
F1 Score94.317
5
Showing 8 of 8 rows