AI BENCHY Compare

IBM: Granite 4.1 8B vs Mistral: Mistral Small 4

Rezumat

Comparație benchmark Granite 4.1 8B vs Mistral Small 4: Mistral Small 4 conduce la scorul mediu cu 5.1 vs 4.0. Granite 4.1 8B are costul de benchmark mai mic, $0.003 vs $0.068. Granite 4.1 8B este mai rapid cu 728ms vs 9.40s, cu rate de reușită de 9.5% vs 44.4%.

Model recomandat: Granite 4.1 8B - Oferă cel mai bun compromis per total: scor competitiv (4.0), cost mai mic decât Mistral Small 4 și timp de răspuns echilibrat.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică	Granite 4.1 8B Granite 4.1 8B none Lansare: 2026-05-01	Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16

Metrică	Granite 4.1 8B Granite 4.1 8B none Lansare: 2026-05-01	Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16
Scor	4.0	5.1
Rang	#163	#138
Fiabilitate	10.0	10.0
Consistență	10.0	6.9
Teste corecte
Rată de trecere pe încercare	9.5%	44.4%
Teste instabile	0	8
Rulări totale	63	63
Cost per rezultat	0.131	1.344
Cost total	$0.003	$0.068
Preț de intrare	$0.050 / 1M	$0.150 / 1M
Preț de ieșire	$0.100 / 1M	$0.600 / 1M
Total tokenuri de intrare	46,285	42,576
Tokenuri de ieșire	2,911	24,184
Tokenuri de raționament	0	84,678
Timp de răspuns (mediu)	728ms	9.40s
Timp de răspuns (maxim)	2.17s	59.15s
Timp de răspuns (total)	15.29s	197.39s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 IBM: Granite 4.1 8B

none

Cost: $0.001
Time: 3.2s
Tokens: 491 tok

#138 Mistral Small 4

medium

Cost: $0.006
Time: 47.9s
Tokens: 9,857 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.9	10.0	25.0%	0		844ms	645	903	0
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	708	4,055	4,778

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.5	10.0	0.0%	0		775ms	8,344	525	0
Mistral Small 4	4.4	5.1	33.3%	2		39.98s	7,636	11,635	54,715

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		1.88s	19,089	396	0
Mistral Small 4	3.0	10.0	0.0%	0		25.25s	18,706	2,612	10,700

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		575ms	7,617	195	0
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	6,171	335	723

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		357ms	768	24	0
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	742	2,621	6,904

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.0	10.0	0.0%	0		499ms	528	115	0
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	519	821	828

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.6	9.9	0.0%	0		344ms	687	66	0
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	729	540	1,031

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.2	10.0	0.0%	0		608ms	672	432	0
Mistral Small 4	3.4	9.7	0.0%	0		2.17s	735	1,226	2,632

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	10.0	10.0	100.0%	0		2.17s	7,719	243	0
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	6,420	321	810

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		306ms	216	12	0
Mistral Small 4	3.0	10.0	0.0%	0		5.92s	210	18	1,557

Comparație rapidă

Schimbă perechea de comparație

Mistral Small 4mediumvsMiMo-V2.5none Mistral Small 4mediumvsQwen3.5-9Bnone Mistral Small 4mediumvsQwen3 Coder Nextnone Mistral Small 4mediumvsQwen3.6 35B A3Bnone Trinity Large PreviewnonevsMistral Small 4medium Mistral Small 4mediumvsGPT-4o-mininone DeepSeek V3.2nonevsMistral Small 4medium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsGPT-5.4 Mininone Mistral Small 4mediumvsGrok 4.20none Granite 4.1 8BnonevsQwen3.5-9Bmedium Mistral Small 4mediumvsGLM 5 Turbonone