AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.6 Plus

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-05-10

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Veröffentlichung: 2026-05-08	Qwen3.6 Plus Qwen3.6 Plus medium Veröffentlichung: 2026-04-20

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Veröffentlichung: 2026-05-08	Qwen3.6 Plus Qwen3.6 Plus medium Veröffentlichung: 2026-04-20
Punktzahl	7.6	7.9
Rang	#44	#28
Zuverlässigkeit	10.0	10.0
Konsistenz	9.2	9.6
Korrekte Tests
Erfolgsquote pro Versuch	68.4%	70.2%
Instabile Tests	2	1
Gesamtläufe	57	57
Kosten pro Ergebnis	0.203	0.118
Gesamtkosten	$0.025	$0.016
Eingabepreis	$0.250 / 1M	$0.325 / 1M
Ausgabepreis	$1.500 / 1M	$1.950 / 1M
Ausgabe-Token	2,702	1,784
Denk-Token	8,596	91,543
Antwortzeit (Durchschnitt)	1.92s	17.06s
Antwortzeit (Maximum)	5.66s	47.51s
Antwortzeit (Gesamt)	36.49s	307.07s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	7.3	6.2	75.0%	2		1.84s	1,013	1,548
Qwen3.6 Plus	10.0	10.0	100.0%	0		9.90s	207	7,557

Programmierung	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.46s	441	408
Qwen3.6 Plus	3.0	10.0	0.0%	0		0ms	0	0

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		4.48s	348	975
Qwen3.6 Plus	10.0	10.0	100.0%	0		34.95s	452	13,073

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.44s	291	697
Qwen3.6 Plus	10.0	10.0	100.0%	0		14.95s	270	10,706

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	5.3	10.0	33.3%	0		1.52s	15	1,214
Qwen3.6 Plus	2.9	7.2	11.1%	1		29.59s	56	33,464

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		1.37s	69	438
Qwen3.6 Plus	5.1	10.0	0.0%	0		27.05s	111	5,232

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.52s	72	760
Qwen3.6 Plus	10.0	10.0	100.0%	0		7.54s	102	5,552

Rätsellösen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.40s	210	1,191
Qwen3.6 Plus	10.0	10.0	100.0%	0		6.11s	298	6,868

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		5.66s	234	945
Qwen3.6 Plus	10.0	10.0	100.0%	0		5.87s	267	1,330

Allgemeinwissen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		1.46s	9	420
Qwen3.6 Plus	3.0	10.0	0.0%	0		47.51s	21	7,761

Schnellvergleich

Vergleichspaar wechseln

Gemini 3.1 Flash LitelowvsStep 3.5 Flashmedium Gemini 3.1 Flash LitelowvsQwen3.5-Flashmedium Gemini 3.1 Flash LitelowvsKimi K2.6medium Gemini 3.1 Flash LitelowvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsGPT-5.2 Chatnone Gemini 3 Flash PreviewnonevsQwen3.6 Plusmedium Gemini 3.1 Flash LitelowvsGLM 5.1medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 Plusmedium DeepSeek V4 FlashhighvsGemini 3.1 Flash Litelow Gemini 3.1 Flash LitelowvsGLM 5V Turbomedium Gemini 3.1 Flash LitelowvsQwen3.6 Flashmedium Gemini 3.1 Flash LitelowvsMiMo-V2-Promedium