#37

Qwen3.6 27B

Qwen Lansare: 2026-04-20 Testat la: 2026-04-27 21:31 qwen/qwen3.6-27b::medium

(medium) (none)

Rezumat

Qwen3.6 27B obține 7.9 pe AI BENCHY și este pe #37. Are fiabilitate 10.0, rată de reușită 77.8%, cost total $0.043 și timp mediu de răspuns 25.56s.

Ce face Qwen3.6 27B unic: Costul total al benchmarkului este neobișnuit de mic pentru acest nivel de scor.

Scor

7.9

Consistență

8.5

Fiabilitate

10.0

Cost total (preț curent)

$0.043

Total tokenuri de ieșire

21,553

Total tokenuri de intrare

Preț de intrare

$0.500 / 1M

Preț de ieșire

$2.000 / 1M

Teste corecte

Teste greșite: 2

Rată de trecere pe încercare: 77.8%

Teste instabile

Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).

Timp de răspuns (mediu)

25.56s

Timp de răspuns (maxim): 47.48s

Timp de răspuns (total): 153.33s

Fără răspuns: 1 Răspuns greșit: 1

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 Qwen3.6 27B

medium

Cost: $0.009
Timp: 39.6s
Tokenuri: 3,090 tok

Istoric rulări

Testat la	Scor	Fiabilitate	Cost total	Compară
2026-07-16 22:13 Test nou adăugat	6.5	10.0	$0.779 ↑	Compară
2026-06-04 13:21 Test nou adăugat	6.8	10.0	$0.444 ↑	Compară
2026-05-21 23:59 Suită modificată	6.6	9.9	$0.272	Compară
2026-04-27 21:48 Test nou adăugat	7.0	10.0	$0.209	Compară
2026-04-27 21:31 Prima rulare înregistrată	7.9	10.0	$0.043	Rularea curentă

Comparație între rulări

Rulare	Scor	Consistență	Fiabilitate	Teste corecte	Teste instabile	Total tokenuri de ieșire	Cost total	Timp de răspuns (mediu)
2026-04-27 21:31 · Prima rulare înregistrată	7.9	8.5	10.0	4/6	1	21,553	$0.043	25.56s
2026-04-27 21:48 · Test nou adăugat	7.0	7.9	10.0	9/18	5	99,362	$0.209	50.53s
Diferență	+0.9	+0.6	0.0	-5	-4	-77809	-$0.166	-24972ms