Navigasi
AI BENCHY
Advertise here

AI BENCHY Compare

Elephant Alpha vs Z.ai: GLM 4.7 Flash

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-05-29

Metrik Elephant Alpha Elephant Alpha none Rilis: 2026-04-14 GLM 4.7 Flash GLM 4.7 Flash medium Rilis: 2026-01-19
Skor 5.2 4.5
Peringkat #136 #154
Keandalan T/A 10.0
Konsistensi 9.6 6.7
Tes benar
Tingkat lulus per percobaan 29.8% 35.0%
Tes tidak stabil 1 8
Total Run 60 60
Biaya per hasil 0.000 1.337
Total Biaya $0.000 $0.054
Harga input $0.000 / 1M $0.060 / 1M
Harga output $0.000 / 1M $0.400 / 1M
Token output 2,573 43,754
Token penalaran 0 89,079
Waktu respons (rata-rata) 1.22s 35.10s
Waktu respons (maks) 3.81s 174.55s
Waktu respons (total) 22.03s 456.24s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 6.6 10.0 50.0% 0 963ms 610 0
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 1,122 6,110
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 4.7 6.7 33.3% 1 1.39s 375 0
GLM 4.7 Flash 3.4 6.0 16.7% 1 55.33s 4,981 22,387
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 3.0 10.0 0.0% 0 3.81s 731 0
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 2,585 20,648
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 6.5 10.0 50.0% 0 1.04s 246 0
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 584 2,755
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 3.0 10.0 0.0% 0 927ms 24 0
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 33,000 25,394
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 4.0 10.0 0.0% 0 854ms 106 0
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 18 2,138
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 9.8 10.0 100.0% 0 1.03s 81 0
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 388 2,181
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 4.2 10.0 0.0% 0 807ms 170 0
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.93s 781 5,255
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 3.0 10.0 0.0% 0 2.79s 230 0
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 224 1,014
Pengetahuan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Elephant Alpha 0.0 0.0 0.0% 0 0ms 0 0
GLM 4.7 Flash 3.0 10.0 0.0% 0 11.13s 71 1,197

Perbandingan Cepat

Ganti Pasangan Perbandingan