Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-04-20 vs xAI: Grok 4.3

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-22

Metriek Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Releasedatum: 2026-04-20 Grok 4.3 Grok 4.3 medium Releasedatum: 2026-05-01
Score 7.6 7.8
Rang #42 #31
Betrouwbaarheid 9.6 10.0
Consistentie 8.7 8.4
Correcte tests
Slaagpercentage per poging 71.7% 75.0%
Instabiele tests 3 4
Totaal runs 60 60
Kosten per resultaat 2.789 4.562
Totale kosten $0.363 $0.593
Invoerprijs $0.300 / 1M $1.250 / 1M
Uitvoerprijs $1.800 / 1M $2.500 / 1M
Uitvoer-tokens 2,245 1,485
Redeneer-tokens 150,235 214,928
Responstijd (gem.) 43.63s 49.23s
Responstijd (max) 189.38s 216.69s
Responstijd (totaal) 872.61s 984.54s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 215 7,748
Grok 4.3 10.0 10.0 100.0% 0 8.83s 88 8,207
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 5.4 6.0 66.7% 1 137.55s 287 42,318
Grok 4.3 7.4 6.5 66.7% 1 55.26s 532 24,554
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 483 17,490
Grok 4.3 10.0 10.0 100.0% 0 63.99s 234 15,301
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 270 14,668
Grok 4.3 10.0 10.0 100.0% 0 18.97s 180 9,546
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 63 28,414
Grok 4.3 5.3 7.2 44.4% 1 181.74s 14 111,300
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 125 4,792
Grok 4.3 5.4 2.5 66.7% 1 24.70s 70 5,020
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 103 7,689
Grok 4.3 9.8 10.0 100.0% 0 18.58s 57 8,713
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.58s 324 9,786
Grok 4.3 5.9 7.2 55.6% 1 22.53s 128 14,686
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 348 2,164
Grok 4.3 10.0 10.0 100.0% 0 17.66s 168 4,615
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 27 15,166
Grok 4.3 3.0 10.0 0.0% 0 44.47s 14 12,986

Snelle vergelijking

Vergelijkingspaar wisselen