AI BENCHY
Advertise here
#85

Grok 4.1 Fast

X AI Rilis: 2025-11-19 Diuji pada: 2026-05-08 13:52 x-ai/grok-4.1-fast::medium
~500B total (~50B aktif)MoETertutupPerkiraan
(medium) (none)

Ringkasan

Grok 4.1 Fast mendapat skor 6.5 di AI BENCHY dan berada di peringkat #85. Model ini memiliki reliabilitas 10.0, tingkat keberhasilan 61.4%, total biaya $0.058, dan waktu respons rata-rata 24.01s.

Yang membuat Grok 4.1 Fast unik: Model ini paling menonjol di Trik anti-AI, dengan peringkat #3, sementara Pemrograman adalah area terlemahnya di #17.

Model diarsipkan: model ini tidak lagi diperbarui atau diuji pada pengujian baru.

Fakta model

Ditelaah pada 2026-08-12

Perkiraan
Parameter
~500B total (~50B aktif)
Arsitektur
MoE
Ketersediaan
Tertutup
Lisensi
-

Perkiraan terbaik berdasarkan bukti publik; penyedia tidak mengungkapkan semua nilai.

Skor

6.5

Konsistensi

7.3

Keandalan

10.0

Total token output

98,704

Total token input

0

Harga input

$0.000 / 1M

Harga output

$0.000 / 1M

Tes benar

Tes Salah: 10

Tingkat lulus per percobaan: 61.4%

Tes tidak stabil

6

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

24.01s

Waktu respons (maks): 121.79s

Waktu respons (total): 288.18s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Grok 4.1 Fast

medium
Grok 4.1 Fast is deprecated. xAI recommends switching to Grok 4.3 (https://openrouter.ai/x-ai/grok-4.3)
Biaya
$0.000
Waktu
0.1s
Token
0 tok

Riwayat run

Diuji pada Skor Keandalan Tes benar Total Biaya Bandingkan
2026-05-08 13:52 Uji ulang 4.7 10.0 $0.069 Bandingkan
2026-05-08 13:52 Uji ulang 4.7 10.0 $0.069 Bandingkan
2026-05-08 13:52 Uji ulang 6.5 10.0 $0.069 Bandingkan
2026-05-08 13:52 Uji ulang 6.5 10.0 $0.058 Bandingkan
2026-05-08 13:52 Suite berubah 6.5 10.0 $0.058 Run saat ini
2026-04-11 01:44 Run pertama yang tercatat 6.7 T/A $0.056 Bandingkan

Run ini menggunakan suite benchmark yang berbeda. Perhatikan perubahan suite saat membaca pergerakan historis.

Perbandingan run

RunCakupan benchmarkSkorKonsistensiKeandalanTes benarTes tidak stabilTotal token outputTotal token inputTotal BiayaWaktu respons (rata-rata)
2026-05-08 13:52 · Suite berubah57/57 percobaan6.57.310.09/19698,7040$0.05824.01s
2026-05-08 13:52 · Uji ulang57/57 percobaan4.76.310.09/19698,34042,845$0.06923.85s
Selisih+1.7+1.00.000+364-42845-$0.011+168ms

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 8.7 7.9
Pemrograman 2.3 1.1
Gabungan 10.0 10.0
Parsing dan ekstraksi data 10.0 10.0
Spesifik domain 5.8 4.4
Kecerdasan umum 4.2 9.9
Kepatuhan instruksi 6.5 10.0
Pemecahan teka-teki 5.3 7.2
Pemanggilan alat 2.8 1.6
Pengetahuan umum 3.0 10.0

Model yang Dibandingkan