Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 35B A3B

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-10

Metriek GPT-5.5 GPT-5.5 low Releasedatum: 2026-04-24 Qwen3.6 35B A3B Qwen3.6 35B A3B medium Releasedatum: 2026-04-20
Score 8.9 8.0
Rang #6 #21
Betrouwbaarheid 10.0 9.8
Consistentie 10.0 9.1
Correcte tests
Slaagpercentage per poging 84.2% 74.5%
Instabiele tests 0 2
Totaal runs 57 57
Kosten per resultaat 4.412 0.959
Totale kosten $0.706 $0.116
Invoerprijs $5.000 / 1M $0.150 / 1M
Uitvoerprijs $30.000 / 1M $1.000 / 1M
Uitvoer-tokens 2,008 15,018
Redeneer-tokens 16,914 108,331
Responstijd (gem.) 8.80s 13.22s
Responstijd (max) 56.19s 45.02s
Responstijd (totaal) 167.26s 224.66s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.43s 246 1,011
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 6.02s 1,154 12,385
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 32.58s 3,294 15,116
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
Qwen3.6 35B A3B 0.0 0.0 0.0% 0 0ms 0 0
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 12.99s 2,591 9,968
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Qwen3.6 35B A3B 5.3 7.2 44.4% 1 22.50s 6,193 39,116
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 7.14s 146 170
Qwen3.6 35B A3B 4.4 9.9 0.0% 0 8.66s 129 4,569
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
Qwen3.6 35B A3B 10.0 10.0 100.0% 0 7.50s 219 7,404
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.94s 274 895
Qwen3.6 35B A3B 7.9 7.5 77.8% 1 5.98s 676 9,447
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
Qwen3.6 35B A3B 0.0 0.0 0.0% 0 0ms 0 0
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 3.0 10.0 0.0% 0 10.06s 30 840
Qwen3.6 35B A3B 3.0 10.0 0.0% 0 32.90s 762 10,326

Snelle vergelijking

Vergelijkingspaar wisselen