AI BENCHY
Advertise here
#42

Qwen3.8 27B

Qwen Rilis: 2026-08-14 Diuji pada: 2026-08-15 04:08 qwen/qwen3.8-27b::high
27.3BLainnyaBobot tersedia

Ringkasan

Qwen3.8 27B mendapat skor 8.4 di AI BENCHY dan berada di peringkat #42. Model ini memiliki reliabilitas 9.6, tingkat keberhasilan 77.3%, total biaya T/A, dan waktu respons rata-rata 167.89s.

Yang membuat Qwen3.8 27B unik: Model ini memakai token reasoning yang sangat tinggi, yang bisa menjelaskan run yang lebih lambat atau lebih mahal.

Fakta model

Ditelaah pada 2026-08-14

Dilaporkan
Parameter
27.3B
Arsitektur
Lainnya
Ketersediaan
Bobot tersedia
Lisensi
Apache-2.0

Skor

8.4

Konsistensi

9.2

Keandalan

9.6

Total biaya (harga saat ini)

T/A

Total token output

656,635

Total token input

100,179

Harga input

T/A

Harga output

T/A

Tes benar

Tes Salah: 6

Tingkat lulus per percobaan: 77.3%

Tes tidak stabil

2

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

167.89s

Waktu respons (maks): 640.85s

Waktu respons (total): 3693.54s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Biaya
T/A
Waktu
270.1s
Token
18,963 tok

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Perbandingan Cepat

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 10.0 10.0
Pemrograman 8.1 7.0
Gabungan 10.0 10.0
Parsing dan ekstraksi data 10.0 10.0
Spesifik domain 5.3 10.0
Kecerdasan umum 5.0 10.0
Kepatuhan instruksi 9.8 10.0
Pemecahan teka-teki 7.6 7.2
Pemanggilan alat 10.0 10.0
Pengetahuan umum 3.0 10.0

Model yang Dibandingkan