Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs xAI: Grok 4.20

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-02

Metriek Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Releasedatum: 2026-02-24 Grok 4.20 Grok 4.20 medium Releasedatum: 2026-03-31
Score 7.3 7.1
Rang #37 #40
Consistentie 6.6 8.2
Correcte tests
Slaagpercentage per poging 78.4% 66.7%
Instabiele tests 7 4
Totaal runs 51 51
Kosten per resultaat 3.877 7.358
Totale kosten $0.349 $0.663
Invoerprijs $0.163 / 1M $2.000 / 1M
Uitvoerprijs $1.300 / 1M $6.000 / 1M
Uitvoer-tokens 5,864 1,494
Redeneer-tokens 175,683 97,078
Responstijd (gem.) 42.48s 9.50s
Responstijd (max) 106.00s 29.87s
Responstijd (totaal) 722.12s 161.54s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 6.4 4.4 77.8% 2 31.58s 3,589 32,206
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620

Snelle vergelijking

Vergelijkingspaar wisselen