Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs Qwen: Qwen3.5 Plus 2026-04-20

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-29

Metriek Qwen3.5-Flash Qwen3.5-Flash medium Releasedatum: 2026-02-24 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Releasedatum: 2026-04-20
Score 7.6 7.7
Rang #51 #40
Betrouwbaarheid 10.0 10.0
Consistentie 8.0 8.7
Correcte tests
Slaagpercentage per poging 75.0% 71.7%
Instabiele tests 5 3
Totaal runs 60 60
Kosten per resultaat 0.821 2.789
Totale kosten $0.099 $0.363
Invoerprijs $0.065 / 1M $0.300 / 1M
Uitvoerprijs $0.260 / 1M $1.800 / 1M
Uitvoer-tokens 2,074 2,259
Redeneer-tokens 272,063 150,249
Responstijd (gem.) 63.04s 43.65s
Responstijd (max) 234.29s 189.38s
Responstijd (totaal) 1197.71s 872.90s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 215 7,748
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 4.1 5.8 33.3% 1 54.23s 288 67,546
Qwen3.5 Plus 2026-04-20 6.6 6.0 66.7% 1 137.55s 287 42,318
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 483 17,490
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 270 14,668
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 63 28,414
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 125 4,792
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 103 7,689
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 89 12,457
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.67s 338 9,800
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 348 2,164
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 32 37,037
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 27 15,166

Snelle vergelijking

Vergelijkingspaar wisselen