Navigasi
AI BENCHY
Your ad here

AI BENCHY Compare

HY3 Preview vs Grok 4.20 Beta

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-04-26

Metrik HY3 Preview HY3 Preview high Rilis: 2026-04-22 Tersedia gratis Grok 4.20 Beta Grok 4.20 Beta none Rilis: 2026-03-12
Skor 8.5 5.3
Peringkat #11 #93
Keandalan T/A T/A
Konsistensi 8.8 9.2
Tes benar
Tingkat lulus per percobaan 81.5% 29.6%
Tes tidak stabil 3 2
Total Run 50 52
Biaya per hasil 0.000 2.255
Total Biaya $0.000 $0.091
Harga input $0.000 / 1M $0.000 / 1M
Harga output $0.000 / 1M $0.000 / 1M
Token output 238,920 1,591
Token penalaran 0 0
Waktu respons (rata-rata) 55.19s 1.19s
Waktu respons (maks) 149.94s 6.48s
Waktu respons (total) 938.23s 21.37s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 10.0 10.0 100.0% 0 32.69s 26,550 0
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 251 0
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 10.0 10.0 100.0% 0 99.76s 38,167 0
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 74 0
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 10.0 10.0 100.0% 0 113.09s 31,319 0
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 6.5 10.0 50.0% 0 12.11s 4,323 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 5.3 7.2 44.4% 1 109.04s 87,559 0
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 10.0 10.0 100.0% 0 24.31s 5,490 0
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 8.5 6.8 83.3% 1 34.02s 13,331 0
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 9.0 7.9 88.9% 1 28.07s 21,811 0
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
HY3 Preview 10.0 10.0 100.0% 0 78.83s 10,370 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

Perbandingan Cepat

Ganti Pasangan Perbandingan