AI BENCHY
Advertise here
#108

Hunter Alpha

OpenRouter Rilis: 2026-03-11 Diuji pada: 2026-05-06 14:09 openrouter/hunter-alpha::none
(medium) (none)

Ringkasan

Hunter Alpha mendapat skor 5.7 di AI BENCHY dan berada di peringkat #108. Model ini memiliki reliabilitas T/A, tingkat keberhasilan 46.3%, total biaya $0.000, dan waktu respons rata-rata 4.58s.

Yang membuat Hunter Alpha unik: Model ini paling menonjol di Kecerdasan umum, dengan peringkat #3, sementara Trik anti-AI adalah area terlemahnya di #15. Total biaya benchmark-nya sangat rendah untuk kisaran skornya. Model ini terasa cepat dibandingkan model serupa.

Model diarsipkan: model ini tidak lagi diperbarui atau diuji pada pengujian baru.

Catatan identitas

Hunter Alpha adalah versi stealth dari Xiaomi: MiMo-V2-Pro.

Skor

5.7

Konsistensi

8.2

Keandalan

T/A

Total token output

2,278

Total token input

0

Harga input

$0.000 / 1M

Harga output

$0.000 / 1M

Tes benar

Tes Salah: 12

Tingkat lulus per percobaan: 46.3%

Tes tidak stabil

4

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

4.58s

Waktu respons (maks): 15.17s

Waktu respons (total): 77.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 Hunter Alpha

none
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
Biaya
$0.000
Waktu
0.0s
Token
0 tok

Riwayat run

Diuji pada Skor Keandalan Tes benar Total Biaya Bandingkan
2026-05-06 14:09 Uji ulang 4.2 T/A $0.000 Bandingkan
2026-05-06 14:09 Uji ulang 5.7 T/A $0.000 Bandingkan
2026-05-06 14:09 Uji ulang 5.7 T/A $0.000 Bandingkan
2026-05-06 14:09 Uji ulang 5.7 T/A $0.000 Bandingkan
2026-05-06 14:09 Suite berubah 5.7 T/A $0.000 Run saat ini
2026-04-11 00:35 Run pertama yang tercatat 5.7 T/A $0.000 Bandingkan

Run ini menggunakan suite benchmark yang berbeda. Perhatikan perubahan suite saat membaca pergerakan historis.

Perbandingan run

RunSkorKonsistensiKeandalanTes benarTes tidak stabilTotal token outputTotal token inputTotal BiayaWaktu respons (rata-rata)
2026-05-06 14:09 · Suite berubah5.78.2T/A6/1842,2780$0.0004.58s
2026-05-06 14:09 · Uji ulang5.78.2T/A6/1842,2780$0.0004.58s
Selisih0.00.00000$0.0000ms

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 3.5 8.0
Pemrograman 3.0 10.0
Gabungan 3.0 10.0
Parsing dan ekstraksi data 10.0 10.0
Spesifik domain 5.3 10.0
Kecerdasan umum 6.1 3.1
Kepatuhan instruksi 6.4 10.0
Pemecahan teka-teki 5.8 4.4
Pemanggilan alat 10.0 10.0

Model yang Dibandingkan