Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Flash

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-27

Metriek GPT-5.5 GPT-5.5 medium Releasedatum: 2026-04-24 Qwen3.6 Flash Qwen3.6 Flash medium Releasedatum: 2026-04-20
Score 9.0 8.1
Rang #6 #24
Betrouwbaarheid n.v.t. 10.0
Consistentie 9.2 8.2
Correcte tests
Slaagpercentage per poging 87.0% 79.6%
Instabiele tests 2 4
Totaal runs 54 54
Kosten per resultaat 19.226 1.449
Totale kosten $2.884 $0.174
Invoerprijs $5.000 / 1M $0.250 / 1M
Uitvoerprijs $30.000 / 1M $1.500 / 1M
Uitvoer-tokens 1,920 2,804
Redeneer-tokens 89,632 107,210
Responstijd (gem.) 32.75s 9.90s
Responstijd (max) 332.10s 26.85s
Responstijd (totaal) 589.59s 178.26s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 624 14,024
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 9.09s 318 1,391
Qwen3.6 Flash 6.7 3.5 66.7% 1 25.84s 435 17,044
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 483 13,839
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 270 13,155
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 60 24,409
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 140 5,445
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 102 7,423
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 8.6 7.9 77.8% 1 6.78s 250 2,254
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.17s 355 10,683
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 335 1,188

Snelle vergelijking

Vergelijkingspaar wisselen