AI BENCHY Compare

IBM: Granite 4.1 8B vs Qwen: Qwen3.5-122B-A10B

Rezumat

Comparație benchmark Granite 4.1 8B vs Qwen3.5-122B-A10B: Qwen3.5-122B-A10B conduce la scorul mediu cu 5.3 vs 4.0. Granite 4.1 8B are costul de benchmark mai mic, $0.003 vs $0.020. Granite 4.1 8B este mai rapid cu 728ms vs 3.41s, cu rate de reușită de 9.5% vs 31.8%.

Model recomandat: Granite 4.1 8B - Oferă cel mai bun compromis per total: scor competitiv (4.0), cost mai mic decât Qwen3.5-122B-A10B și timp de răspuns echilibrat.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică	Granite 4.1 8B Granite 4.1 8B none Lansare: 2026-05-01	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24

Metrică	Granite 4.1 8B Granite 4.1 8B none Lansare: 2026-05-01	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24
Scor	4.0	5.3
Rang	#163	#132
Fiabilitate	10.0	10.0
Consistență	10.0	9.6
Teste corecte
Rată de trecere pe încercare	9.5%	31.8%
Teste instabile	0	1
Rulări totale	63	63
Cost per rezultat	0.131	0.393
Cost total	$0.003	$0.020
Preț de intrare	$0.050 / 1M	$0.260 / 1M
Preț de ieșire	$0.100 / 1M	$2.080 / 1M
Total tokenuri de intrare	46,285	47,735
Tokenuri de ieșire	2,911	3,383
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	728ms	3.41s
Timp de răspuns (maxim)	2.17s	46.00s
Timp de răspuns (total)	15.29s	71.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 IBM: Granite 4.1 8B

none

Cost: $0.001
Time: 3.2s
Tokens: 491 tok

#132 Qwen3.5-122B-A10B

none

Cost: $0.016
Time: 44.5s
Tokens: 6,431 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.9	10.0	25.0%	0		844ms	645	903	0
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.5	10.0	0.0%	0		775ms	8,344	525	0
Qwen3.5-122B-A10B	3.7	7.0	22.2%	1		2.77s	7,913	693	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		1.88s	19,089	396	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		575ms	7,617	195	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		357ms	768	24	0
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	4.0	10.0	0.0%	0		499ms	528	115	0
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.6	9.9	0.0%	0		344ms	687	66	0
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.2	10.0	0.0%	0		608ms	672	432	0
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	10.0	10.0	100.0%	0		2.17s	7,719	243	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Granite 4.1 8B	3.0	10.0	0.0%	0		306ms	216	12	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0

Comparație rapidă

Schimbă perechea de comparație

MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Granite 4.1 8BnonevsQwen3.5-9Bmedium Granite 4.1 8BnonevsGLM 4.7 Flashmedium CobuddymediumvsQwen3.5-122B-A10Bnone MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone Granite 4.1 8BnonevsQwen3 Coder Nextmedium Granite 4.1 8BnonevsMiniMax M2.5medium Gemini 3.1 Flash LiteminimalvsQwen3.5-122B-A10Bnone CobuddymediumvsGranite 4.1 8Bnone DeepSeek V4 ProhighvsQwen3.5-122B-A10Bnone Qwen3.5-122B-A10BnonevsGLM 4.7 Flashmedium