Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

TweetQA

Benchmarks

Task NameDataset NameSOTA ResultTrend
Question AnsweringTweetQA (val)
BLEU-172
10
Question AnsweringTweetQA (eval)
Clean F180.81
6
Generative QATweetQA Cyrillic noise (test)
F1 Score41.2
5
Generative QATweetQA Keyboard-Char noise (test)
F1 Score50.6
5
Generative QATweetQA Clean (test)
F1 Score67.2
5
Question AnsweringTweetQA
Accuracy77.17
1
Showing 6 of 6 rows