Qwen3.7 Max vs GLM 5 (medium)

Empfohlenes Modell Qwen3.7 Max

Die Punktzahl bleibt nah an der besten hier (7.4 vs 7.7) und es kostet etwa 1.6x weniger als GLM 5 (medium).

Detaillierter Vergleich

Metrik	Qwen3.7 Max Qwen3.7 Max none Veröffentlichung: 2026-05-22	GLM 5 GLM 5 medium Veröffentlichung: 2026-02-12

Metrik	Qwen3.7 Max Qwen3.7 Max none Veröffentlichung: 2026-05-22	GLM 5 GLM 5 medium Veröffentlichung: 2026-02-12
Punktzahl	7.4	7.7
Rang	#67	#49
Zuverlässigkeit	9.9	10.0
Konsistenz	10.0	8.1
Korrekte Tests
Erfolgsquote pro Versuch	68.2%	78.8%
Instabile Tests	0	4
Gesamtläufe	66	63
Kosten pro Ergebnis	1.582	1.668
Gesamtkosten	$0.197	$0.307
Eingabepreis	$1.475 / 1M	$0.950 / 1M
Ausgabepreis	$4.425 / 1M	$2.551 / 1M
Gesamte Eingabe-Token	95,983	35,224
Ausgabe-Token	12,446	21,570
Denk-Token	0	102,996
Antwortzeit (Durchschnitt)	4.52s	33.54s
Antwortzeit (Maximum)	72.30s	99.85s
Antwortzeit (Gesamt)	99.52s	435.99s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

none

medium

Kategorie:

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	696	242	0
GLM 5	10.0	10.0	100.0%	0		23.66s	555	480	7,056

Programmierung	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	5.5	10.0	33.3%	0		1.35s	7,911	582	0
GLM 5	10.0	10.0	100.0%	0		74.30s	7,254	2,997	52,930

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	6.5	10.0	50.0%	0		37.23s	68,425	10,623	0
GLM 5	5.0	5.0	50.0%	0		28.96s	12,804	662	3,242

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	7,794	243	0
GLM 5	7.1	5.6	83.3%	1		8.90s	5,508	567	3,734

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	789	15	0
GLM 5	3.5	4.4	33.3%	2		0ms	260	13,176	14,137

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	522	120	0
GLM 5	6.1	3.1	66.7%	1		14.69s	477	2,020	2,248

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	711	72	0
GLM 5	10.0	10.0	100.0%	0		7.25s	636	1,001	2,129

Rätsellösen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	714	314	0
GLM 5	10.0	10.0	100.0%	0		11.33s	609	33	4,076

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	8,211	222	0
GLM 5	10.0	10.0	100.0%	0		15.93s	6,935	233	994

Allgemeinwissen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	210	13	0
GLM 5	3.0	10.0	0.0%	0		67.37s	186	401	12,450

Vergleichspaar wechseln