AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#82

Grok Build 0.1

X AI Rilis: 2026-05-21 Diuji pada: 2026-05-21 12:40 x-ai/grok-build-0.1::none
~300B total (~30B aktif)MoETertutupPerkiraan
(medium) (none)

Ringkasan

Grok Build 0.1 mendapat skor 6.6 di AI BENCHY dan berada di peringkat #82. Model ini memiliki reliabilitas 10.0, tingkat keberhasilan 60.4%, total biaya $0.547, dan waktu respons rata-rata 28.69s.

Yang membuat Grok Build 0.1 unik: Model ini paling menonjol di Pemrograman, dengan peringkat #1, sementara Gabungan adalah area terlemahnya di #17.

Model diarsipkan: model ini tidak lagi diperbarui atau diuji pada pengujian baru.

Fakta model

Ditelaah pada 2026-08-12

Perkiraan
Parameter
~300B total (~30B aktif)
Arsitektur
MoE
Ketersediaan
Tertutup
Lisensi
-

Perkiraan terbaik berdasarkan bukti publik; penyedia tidak mengungkapkan semua nilai.

Skor

6.6

Konsistensi

8.0

Keandalan

10.0

Total token output

267,275

Total token input

0

Harga input

$1.000 / 1M

Harga output

$2.000 / 1M

Tes benar

Tes Salah: 9

Tingkat lulus per percobaan: 60.4%

Tes tidak stabil

4

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

28.69s

Waktu respons (maks): 138.35s

Waktu respons (total): 459.00s

Riwayat run

Diuji pada Skor Keandalan Tes benar Total Biaya Bandingkan
2026-05-21 12:40 Uji ulang 4.0 10.0 $0.547 Bandingkan
2026-05-21 12:40 Uji ulang 4.0 10.0 $0.547 Bandingkan
2026-05-21 12:40 Uji ulang 6.0 10.0 $0.547 Bandingkan
2026-05-21 12:40 Uji ulang 6.6 10.0 $0.547 Run saat ini

Perbandingan run

RunCakupan benchmarkSkorKonsistensiKeandalanTes benarTes tidak stabilTotal token outputTotal token inputTotal BiayaWaktu respons (rata-rata)
2026-05-21 12:40 · Uji ulang57/57 percobaan6.68.010.07/164267,2750$0.54728.69s
2026-05-21 12:40 · Uji ulang57/57 percobaan4.07.210.07/194267,27511,793$0.54728.69s
Selisih+2.7+0.80.0+300-11793$0.0000ms

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 8.7 7.9
Pemrograman 10.0 10.0
Gabungan 0.0 0.0
Parsing dan ekstraksi data 4.7 1.6
Spesifik domain 3.6 7.2
Kecerdasan umum 4.3 10.0
Kepatuhan instruksi 9.8 10.0
Pemecahan teka-teki 6.4 7.7
Pemanggilan alat 0.0 0.0
Pengetahuan umum 3.0 10.0

Model yang Dibandingkan