AI BENCHY Compare

OpenAI: GPT-5 Mini vs Qwen: Qwen3.5-9B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-12

Metrică	GPT-5 Mini GPT-5 Mini medium Lansare: 2025-08-07	Qwen3.5-9B Qwen3.5-9B none Lansare: 2026-03-02

Metrică	GPT-5 Mini GPT-5 Mini medium Lansare: 2025-08-07	Qwen3.5-9B Qwen3.5-9B none Lansare: 2026-03-02
Rang	#34	#60
Scor mediu	6.0	3.4
Consistență	8.9	10.0
Cost per rezultat	1.457	0.111
Cost total	$0.117	$0.005
Teste corecte
Rată de trecere pe încercare	58.3%	25.0%
Teste instabile	2	0
Rulări totale	48	48
Tokenuri de ieșire	5,826	2,939
Tokenuri de raționament	48,768	0
Timp de răspuns (mediu)	25.14s	1.06s
Timp de răspuns (maxim)	88.15s	5.91s
Timp de răspuns (total)	402.29s	16.95s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor mediu vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor mediu vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	7.0	9.6	66.7%	0		16.45s	1,645	5,824
Qwen3.5-9B	10.0	9.9	0.0%	0		1.02s	576	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	10.0	10.0	100.0%	0		88.15s	754	11,520
Qwen3.5-9B	10.0	10.0	0.0%	0		5.91s	1,255	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	9.9	10.0	100.0%	0		12.58s	453	3,200
Qwen3.5-9B	9.9	10.0	100.0%	0		847ms	249	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	10.0	7.2	22.2%	1		44.63s	293	14,016
Qwen3.5-9B	10.0	10.0	0.0%	0		464ms	24	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	4.0	10.0	0.0%	0		13.50s	349	1,856
Qwen3.5-9B	3.0	9.9	0.0%	0		552ms	99	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	7.5	6.6	83.3%	1		15.66s	318	4,992
Qwen3.5-9B	5.5	10.0	50.0%	0		514ms	75	0

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	4.3	9.8	33.3%	0		14.09s	1,527	5,760
Qwen3.5-9B	10.0	9.9	0.0%	0		683ms	388	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5 Mini	10.0	10.0	100.0%	0		18.64s	487	1,600
Qwen3.5-9B	10.0	10.0	100.0%	0		1.27s	273	0

Comparație rapidă

Schimbă perechea de comparație

GPT-5 MinimediumvsGLM 5none GPT-5 MinimediumvsQwen3.5 Plus 2026-02-15none Qwen3.5-9BnonevsGLM 4.7 Flashmedium DeepSeek V3.2nonevsGPT-5 Minimedium Claude Sonnet 4.6nonevsGPT-5 Minimedium GPT-5 MinimediumvsQwen3.5-Flashnone Gemini 2.5 FlashnonevsGPT-5 Minimedium GPT-5 MinimediumvsQwen3.5-122B-A10Bnone Gemini 3.1 Flash Lite PreviewnonevsGPT-5 Minimedium Seed-2.0-LitenonevsGPT-5 Minimedium GPT-5 MinimediumvsQwen3.5-27Bnone Gemini 3 Flash PreviewnonevsGPT-5 Minimedium