AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.5-9B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-17

Metrică	Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16	Qwen3.5-9B Qwen3.5-9B none Lansare: 2026-03-02

Metrică	Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16	Qwen3.5-9B Qwen3.5-9B none Lansare: 2026-03-02
Rang	#55	#67
Scor	5.6	4.8
Consistență	7.0	10.0
Cost per rezultat	0.502	0.111
Cost total	$0.026	$0.005
Teste corecte
Rată de trecere pe încercare	49.0%	23.5%
Teste instabile	6	0
Rulări totale	51	51
Tokenuri de ieșire	12,288	2,945
Tokenuri de raționament	28,112	0
Timp de răspuns (mediu)	4.18s	1.22s
Timp de răspuns (maxim)	25.25s	5.91s
Timp de răspuns (total)	71.03s	20.74s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	4,055	4,778
Qwen3.5-9B	3.1	9.9	0.0%	0		1.71s	582	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	3.0	10.0	0.0%	0		25.25s	2,612	10,700
Qwen3.5-9B	3.0	10.0	0.0%	0		5.91s	1,255	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	335	723
Qwen3.5-9B	10.0	10.0	100.0%	0		847ms	249	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	2,621	6,904
Qwen3.5-9B	3.0	10.0	0.0%	0		464ms	24	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	821	828
Qwen3.5-9B	4.4	9.9	0.0%	0		552ms	99	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	540	1,031
Qwen3.5-9B	6.5	10.0	50.0%	0		514ms	75	0

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	3.4	9.7	0.0%	0		2.00s	983	2,338
Qwen3.5-9B	3.2	9.9	0.0%	0		683ms	388	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	321	810
Qwen3.5-9B	10.0	10.0	100.0%	0		1.27s	273	0

Comparație rapidă

Schimbă perechea de comparație

Mistral Small 4mediumvsGLM 5 Turbonone Mistral Small 4mediumvsGLM 4.7 Flashnone Mistral Small 4mediumvsQwen3.5-27Bnone Mistral Small 4mediumvsGPT-5.4none Qwen3.5-9BnonevsGLM 4.7 Flashmedium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsGrok 4.20 Betanone Mistral Small 4mediumvsKimi K2.5none Mistral Small 4mediumvsHunter Alphanone Trinity Large PreviewnoneDisponibil gratuitvsMistral Small 4medium Mistral Small 4mediumvsQwen3.5-35B-A3Bnone Gemini 2.5 FlashnonevsMistral Small 4medium