Navigatie
Advertise here

Mistral Large 4 (high) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) leidt in gemiddelde score met 7.6 vs 7.5. Qwen3.8 27B (low) heeft lagere benchmarkkosten met ~$0.089 vs $1.391. Qwen3.8 27B (low) is sneller met 46.60s vs 263.69s, met slagingspercentages van 65.2% vs 68.1%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-06

Vergeleken modellen

Rang
#126
Totaal aantal uitvoer-tokens
590,306
Responstijd (gem.)
263.69s
Totale kosten
$1.391
Rang
#122
Totaal aantal uitvoer-tokens
209,143
Responstijd (gem.)
46.60s
Totale kosten
~$0.089
Aanbevolen model Qwen3.8 27B (low)

Het heeft hier de beste score (7.6) en kost ongeveer 15.7x minder dan Mistral Large 4 (high).

Gedetailleerde vergelijking

Metriek Mistral Large 4 Mistral Large 4 high Releasedatum: 2026-10-06 Qwen3.8 27B Qwen3.8 27B low Releasedatum: 2026-08-14 Gratis beschikbaar
Score 7.5 7.6
Rang #126 #122
Betrouwbaarheid 9.0 10.0
Consistentie 7.9 9.7
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 65.2% 68.1%
Instabiele tests 6 1
Totaal runs 69 69
Kosten per resultaat 11.590 ~0.589
Totale kosten $1.391 ~$0.089
Invoerprijs $0.680 / 1M n.v.t.
Uitvoerprijs $2.090 / 1M n.v.t.
Prijs voor cachelezen $0.070 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 230,895 315,290
Uitvoer-tokens 161,281 1,607
Redeneer-tokens 510,655 207,536
Responstijd (gem.) 263.69s 46.60s
Responstijd (max) 1727.29s 376.04s
Responstijd (totaal) 6064.89s 1071.83s
Parameters 1.05T totaal (49B actief) 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
Kosten
$0.007
Tijd
53.3s
Tokens
3,333 tok

#122 Qwen3.8 27B

low
Kosten
~$0.003
Tijd
92.8s
Tokens
6,902 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

Snelle vergelijking

Vergelijkingspaar wisselen

Seed-2.0-MinimediumvsMistral Large 4highQwen3.8 27BlowGratis beschikbaarvsSpace Bunny AlphahighQwen3.8 27BlowGratis beschikbaarvsGLM 5.1mediumMistral Large 4highvsGLM 5.1mediumSeed-2.0-MinimediumvsQwen3.8 27BlowGratis beschikbaarMistral Large 4highvsGPT-6 LunalowMistral Large 4highvsQwen3.8 Flash NextmediumMistral Large 4highvsGPT-5.6 LunamediumMistral Large 4highvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsMistral Large 4highSeed-2.0-CodehighvsQwen3.8 27BlowGratis beschikbaarSeed-2.0-CodemediumvsMistral Large 4high