Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Xiaomi: MiMo-V2-Omni

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-05-01

Metrik GPT-5.3 Chat GPT-5.3 Chat none Rilis: 2026-03-03 MiMo-V2-Omni MiMo-V2-Omni medium Rilis: 2026-03-18
Skor 7.9 7.7
Peringkat #42 #49
Keandalan T/A T/A
Konsistensi 8.6 9.9
Tes benar
Tingkat lulus per percobaan 74.1% 61.1%
Tes tidak stabil 3 0
Total Run 54 20
Biaya per hasil 2.826 1.383
Total Biaya $0.340 $0.153
Harga input $1.750 / 1M $0.400 / 1M
Harga output $14.000 / 1M $2.000 / 1M
Token output 20,784 928
Token penalaran 0 72,661
Waktu respons (rata-rata) 5.88s 16.76s
Waktu respons (maks) 18.33s 158.78s
Waktu respons (total) 105.90s 301.61s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.11s 112 402
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
MiMo-V2-Omni 4.0 7.9 0.0% 0 68.55s 265 33,660
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 19.29s 131 2,807
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.29s 87 323
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 55.12s 13 33,279
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.86s 58 202
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.29s 1,455 0
MiMo-V2-Omni 8.3 10.0 50.0% 0 4.92s 35 201
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
MiMo-V2-Omni 6.5 10.0 33.3% 0 3.88s 126 481
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 11.07s 101 1,306

Perbandingan Cepat

Ganti Pasangan Perbandingan