Navigatie
Advertise here

Claude Haiku 5.5 (low) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) leidt in gemiddelde score met 8.7 vs 8.6. Claude Haiku 5.5 (low) heeft lagere benchmarkkosten met $0.061 vs ~$0.298. Claude Haiku 5.5 (low) is sneller met 7.51s vs 166.34s, met slagingspercentages van 76.8% vs 78.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#64
Totaal aantal uitvoer-tokens
61,650
Responstijd (gem.)
7.51s
Totale kosten
$0.061
Rang
#56
Totaal aantal uitvoer-tokens
677,080
Responstijd (gem.)
166.34s
Totale kosten
~$0.298
Aanbevolen model Claude Haiku 5.5 (low)

De score blijft dicht bij de beste score hier (8.6 vs 8.7) en het kost ongeveer 4.9x minder dan Qwen3.8 27B (high).

Gedetailleerde vergelijking

Metriek Claude Haiku 5.5 Claude Haiku 5.5 low Releasedatum: 2026-10-07 Qwen3.8 27B Qwen3.8 27B high Releasedatum: 2026-08-14 Gratis beschikbaar
Score 8.6 8.7
Rang #64 #56
Betrouwbaarheid 10.0 9.7
Consistentie 8.9 9.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 76.8% 78.3%
Instabiele tests 3 2
Totaal runs 69 69
Kosten per resultaat 0.378 ~1.751
Totale kosten $0.061 ~$0.298
Invoerprijs $0.100 / 1M n.v.t.
Uitvoerprijs $0.500 / 1M n.v.t.
Prijs voor cachelezen $0.010 / 1M n.v.t.
Prijs voor cacheschrijven $0.125 / 1M n.v.t.
Totaal aantal invoer-tokens 296,301 348,967
Uitvoer-tokens 10,672 1,005
Redeneer-tokens 50,978 676,075
Responstijd (gem.) 7.51s 166.34s
Responstijd (max) 44.43s 640.85s
Responstijd (totaal) 172.74s 3825.81s
Parameters ~50B 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
Kosten
$0.001
Tijd
7.4s
Tokens
1,851 tok

#56 Qwen3.8 27B

high
Kosten
~$0.008
Tijd
270.1s
Tokens
18,963 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Haiku 5.5 7.9 7.5 77.8% 1 7.30s 10,608 531 11,618
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

Vergelijkingspaar wisselen

GPT-5.2mediumvsQwen3.8 27BhighGratis beschikbaarQwen3.8 27BhighGratis beschikbaarvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighGratis beschikbaarGPT-6 SollowvsQwen3.8 27BhighGratis beschikbaarClaude Haiku 5.5lowvsGrok 4.6highDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighGratis beschikbaarClaude Haiku 5.5lowvsDeepSeek V4.1 FlashmaxMuse Spark 1.2lowvsQwen3.8 27BhighGratis beschikbaarClaude Haiku 5.5lowvsQwen3.7 MaxmediumDeepSeek V4.1 FlashmediumvsQwen3.8 27BhighGratis beschikbaarMuse Spark 1.1lowvsQwen3.8 27BhighGratis beschikbaarClaude Haiku 5.5lowvsSeed 2.1 Turbomedium