Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Qwen3.6 Plus Preview

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-30

Metriek Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Releasedatum: 2026-03-03 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Releasedatum: Onbekende releasedatum Gratis beschikbaar
Score 8.0 8.5
Rang #18 #6
Consistentie 10.0 10.0
Correcte tests
Slaagpercentage per poging 70.6% 76.5%
Instabiele tests 0 0
Totaal runs 51 49
Kosten per resultaat 0.168 0.000
Totale kosten $0.021 $0.000
Invoerprijs $0.250 / 1M $0.000 / 1M
Uitvoerprijs $1.500 / 1M $0.000 / 1M
Uitvoer-tokens 1,617 1,756
Redeneer-tokens 7,686 77,213
Responstijd (gem.) 3.28s 13.94s
Responstijd (max) 11.91s 43.55s
Responstijd (totaal) 55.80s 237.01s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 9.90s 207 7,557
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
Qwen3.6 Plus Preview 5.1 10.0 0.0% 0 27.05s 111 5,232
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.54s 102 5,552
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 6.11s 298 6,868
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330

Snelle vergelijking

Vergelijkingspaar wisselen