Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Visual-Language Model Inference on VILA RTX 4090
Loading...
168.1
Throughput (tokens/sec)
VILA-7B-AWQ
54.116
83.708
113.3
142.892
Jun 1, 2023
Throughput (tokens/sec)
Updated 2mo ago
Evaluation Results
Method
Method
Links
Throughput (tokens/sec)
VILA-7B-AWQ
Precision=W4A16
2023.06
168.1
VILA-13B-AWQ
Precision=W4A16
2023.06
99
VILA-7B
Precision=FP16
2023.06
58.5
Feedback
Search any
task
Search any
task