Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Plus

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-10

Metriek GPT-5.5 GPT-5.5 low Releasedatum: 2026-04-24 Qwen3.6 Plus Qwen3.6 Plus medium Releasedatum: 2026-04-20
Score 8.9 7.9
Rang #6 #28
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 9.6
Correcte tests
Slaagpercentage per poging 84.2% 70.2%
Instabiele tests 0 1
Totaal runs 57 57
Kosten per resultaat 4.412 0.118
Totale kosten $0.706 $0.016
Invoerprijs $5.000 / 1M $0.325 / 1M
Uitvoerprijs $30.000 / 1M $1.950 / 1M
Uitvoer-tokens 2,008 1,784
Redeneer-tokens 16,914 91,543
Responstijd (gem.) 8.80s 17.06s
Responstijd (max) 56.19s 47.51s
Responstijd (totaal) 167.26s 307.07s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.43s 246 1,011
Qwen3.6 Plus 10.0 10.0 100.0% 0 9.90s 207 7,557
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
Qwen3.6 Plus 3.0 10.0 0.0% 0 0ms 0 0
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
Qwen3.6 Plus 10.0 10.0 100.0% 0 34.95s 452 13,073
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
Qwen3.6 Plus 10.0 10.0 100.0% 0 14.95s 270 10,706
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Qwen3.6 Plus 2.9 7.2 11.1% 1 29.59s 56 33,464
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 7.14s 146 170
Qwen3.6 Plus 5.1 10.0 0.0% 0 27.05s 111 5,232
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
Qwen3.6 Plus 10.0 10.0 100.0% 0 7.54s 102 5,552
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.94s 274 895
Qwen3.6 Plus 10.0 10.0 100.0% 0 6.11s 298 6,868
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
Qwen3.6 Plus 10.0 10.0 100.0% 0 5.87s 267 1,330
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 3.0 10.0 0.0% 0 10.06s 30 840
Qwen3.6 Plus 3.0 10.0 0.0% 0 47.51s 21 7,761

Snelle vergelijking

Vergelijkingspaar wisselen