AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.7 Max

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-05-22

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Veröffentlichung: 2026-05-08	Qwen3.7 Max Qwen3.7 Max medium Veröffentlichung: 2026-05-22

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Veröffentlichung: 2026-05-08	Qwen3.7 Max Qwen3.7 Max medium Veröffentlichung: 2026-05-22
Punktzahl	7.4	9.0
Rang	#51	#5
Zuverlässigkeit	10.0	10.0
Konsistenz	9.2	9.6
Korrekte Tests
Erfolgsquote pro Versuch	65.0%	88.3%
Instabile Tests	2	1
Gesamtläufe	60	60
Kosten pro Ergebnis	0.217	5.540
Gesamtkosten	$0.026	$0.942
Eingabepreis	$0.250 / 1M	$2.500 / 1M
Ausgabepreis	$1.500 / 1M	$7.500 / 1M
Ausgabe-Token	2,726	2,109
Denk-Token	8,951	110,285
Antwortzeit (Durchschnitt)	1.92s	13.83s
Antwortzeit (Maximum)	5.66s	33.37s
Antwortzeit (Gesamt)	38.45s	276.53s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	7.3	6.2	75.0%	2		1.84s	1,013	1,548
Qwen3.7 Max	10.0	10.0	100.0%	0		6.36s	222	8,742

Programmierung	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	6.8	10.0	50.0%	0		1.71s	465	763
Qwen3.7 Max	10.0	10.0	100.0%	0		22.98s	403	22,134

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		4.48s	348	975
Qwen3.7 Max	10.0	10.0	100.0%	0		19.60s	366	8,405

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.44s	291	697
Qwen3.7 Max	10.0	10.0	100.0%	0		8.80s	270	6,254

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	5.3	10.0	33.3%	0		1.52s	15	1,214
Qwen3.7 Max	5.9	7.2	55.6%	1		24.94s	61	31,793

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		1.37s	69	438
Qwen3.7 Max	10.0	10.0	100.0%	0		11.70s	135	4,457

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.52s	72	760
Qwen3.7 Max	10.0	10.0	100.0%	0		7.46s	102	5,452

Rätsellösen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.40s	210	1,191
Qwen3.7 Max	10.0	10.0	100.0%	0		8.84s	259	8,908

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		5.66s	234	945
Qwen3.7 Max	10.0	10.0	100.0%	0		6.63s	267	1,220

Allgemeinwissen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		1.46s	9	420
Qwen3.7 Max	3.0	10.0	0.0%	0		33.37s	24	12,920

Schnellvergleich

Vergleichspaar wechseln

Gemini 3.1 Flash LitelowvsGLM 5.1medium Gemini 3.1 Flash LitelowvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsKimi K2.6medium DeepSeek V4 FlashhighKostenlos verfügbarvsGemini 3.1 Flash Litelow Gemini 3.1 Flash LitelowvsQwen3.5-Flashmedium Gemini 3.1 Flash LitelowvsGPT-5.2medium Gemini 3.1 Flash LitelowvsStep 3.5 Flashmedium Gemini 3.1 Flash LitelowvsQwen3.6 Flashmedium Gemini 3.1 Flash LitelowvsGLM 5V Turbomedium Gemini 3.5 FlashnonevsQwen3.7 Maxmedium Claude Sonnet 4.6mediumvsGemini 3.1 Flash Litelow Gemini 3.1 Flash LitelowvsGrok Build 0.1medium