Granite 4.1 8B vs Grok 4.20

Empfohlenes Modell Grok 4.20

Es hat die stärkste Punktzahl in diesem Vergleich (4.1) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.

Detaillierter Vergleich

Metrik	Granite 4.1 8B Granite 4.1 8B none Veröffentlichung: 2026-05-01	Grok 4.20 Grok 4.20 none Veröffentlichung: 2026-03-31

Metrik	Granite 4.1 8B Granite 4.1 8B none Veröffentlichung: 2026-05-01	Grok 4.20 Grok 4.20 none Veröffentlichung: 2026-03-31
Punktzahl	4.0	4.1
Rang	#224	#220
Zuverlässigkeit	10.0	k. A.
Konsistenz	10.0	8.1
Korrekte Tests
Erfolgsquote pro Versuch	9.1%	27.3%
Instabile Tests	0	0
Gesamtläufe	66	54
Kosten pro Ergebnis	0.315	1.570
Gesamtkosten	$0.007	$0.057
Eingabepreis	$0.050 / 1M	$1.250 / 1M
Ausgabepreis	$0.100 / 1M	$2.500 / 1M
Gesamte Eingabe-Token	113,827	41,313
Ausgabe-Token	5,996	1,923
Denk-Token	0	0
Antwortzeit (Durchschnitt)	1.45s	1.11s
Antwortzeit (Maximum)	16.67s	6.04s
Antwortzeit (Gesamt)	31.96s	19.96s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

none

none

Kategorie:

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	4.9	10.0	25.0%	0		844ms	645	903	0
Grok 4.20	4.8	10.0	25.0%	0		501ms	1,986	267	0

Programmierung	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	4.5	10.0	0.0%	0		775ms	8,344	525	0
Grok 4.20	1.1	3.1	0.0%	0		1.22s	1,074	312	0

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.0	10.0	0.0%	0		9.28s	86,631	3,481	0
Grok 4.20	1.5	5.0	0.0%	0		6.04s	17,673	282	0

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.0	10.0	0.0%	0		575ms	7,617	195	0
Grok 4.20	10.0	10.0	100.0%	0		522ms	7,749	207	0

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.0	10.0	0.0%	0		357ms	768	24	0
Grok 4.20	3.0	10.0	0.0%	0		687ms	1,746	325	0

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	4.0	10.0	0.0%	0		499ms	528	115	0
Grok 4.20	4.8	10.0	0.0%	0		659ms	819	83	0

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.6	9.9	0.0%	0		344ms	687	66	0
Grok 4.20	6.3	10.0	50.0%	0		445ms	1,350	60	0

Rätsellösen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.2	10.0	0.0%	0		608ms	672	432	0
Grok 4.20	5.3	10.0	33.3%	0		473ms	1,671	198	0

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	10.0	10.0	100.0%	0		2.17s	7,719	243	0
Grok 4.20	10.0	10.0	100.0%	0		4.63s	7,245	189	0

Allgemeinwissen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Granite 4.1 8B	3.0	10.0	0.0%	0		306ms	216	12	0
Grok 4.20	0.0	0.0	0.0%	0		0ms	0	0	0

Vergleichspaar wechseln