AI BENCHY
Advertise here
#150

LFM2-24B-A2B

Liquid Rilis: 2026-02-24 Diuji pada: 2026-05-06 14:04 liquid/lfm-2-24b-a2b::none
24B total (2.3B aktif)MoEBobot tersedia

Ringkasan

LFM2-24B-A2B mendapat skor 4.2 di AI BENCHY dan berada di peringkat #150. Model ini memiliki reliabilitas T/A, tingkat keberhasilan 18.8%, total biaya $0.001, dan waktu respons rata-rata 811ms.

Yang membuat LFM2-24B-A2B unik: Total biaya benchmark-nya sangat rendah untuk kisaran skornya. Model ini terasa cepat dibandingkan model serupa.

Model diarsipkan: model ini tidak lagi diperbarui atau diuji pada pengujian baru.

Fakta model

Ditelaah pada 2026-08-12

Dilaporkan
Parameter
24B total (2.3B aktif)
Arsitektur
MoE
Ketersediaan
Bobot tersedia
Lisensi
LFM-1.0

Skor

4.2

Konsistensi

9.0

Keandalan

T/A

Total token output

1,185

Total token input

0

Harga input

$0.030 / 1M

Harga output

$0.120 / 1M

Tes benar

Tes Salah: 14

Tingkat lulus per percobaan: 18.8%

Tes tidak stabil

2

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

811ms

Waktu respons (maks): 2.88s

Waktu respons (total): 11.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 LiquidAI: LFM2-24B-A2B

none
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

Riwayat run

Diuji pada Skor Keandalan Tes benar Total Biaya Bandingkan
2026-05-06 14:04 Uji ulang 2.2 T/A $0.001 Bandingkan
2026-05-06 14:04 Uji ulang 2.2 T/A $0.001 Bandingkan
2026-05-06 14:04 Uji ulang 4.2 T/A $0.001 Bandingkan
2026-05-06 14:04 Uji ulang 4.2 T/A $0.001 Bandingkan
2026-05-06 14:04 Suite berubah 4.2 T/A $0.001 Run saat ini
2026-04-10 23:27 Run pertama yang tercatat 4.1 T/A $0.001 Bandingkan

Run ini menggunakan suite benchmark yang berbeda. Perhatikan perubahan suite saat membaca pergerakan historis.

Perbandingan run

RunCakupan benchmarkSkorKonsistensiKeandalanTes benarTes tidak stabilTotal token outputTotal token inputTotal BiayaWaktu respons (rata-rata)
2026-05-06 14:04 · Suite berubah48/48 percobaan4.29.0T/A2/1621,1850$0.001811ms
2026-05-06 14:04 · Uji ulang48/48 percobaan2.26.9T/A2/1611,17310,771$0.001782ms
Selisih+2.0+2.10+1+12-10771+$0.001+29ms

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 3.3 9.8
Gabungan 3.0 10.0
Parsing dan ekstraksi data 3.0 10.0
Spesifik domain 5.9 7.2
Kecerdasan umum 4.0 10.0
Kepatuhan instruksi 6.3 10.0
Pemecahan teka-teki 3.7 7.7
Pemanggilan alat 3.0 10.0

Model yang Dibandingkan