Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Lite (medium) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) leidt in gemiddelde score met 7.9 vs 7.8. De kosten van de lokale hardware zijn niet gemeten. Daarom zijn kostenvergelijkingen niet beschikbaar. Qwen3.8 27B (low) is sneller met 39.11s vs 47.94s, met slagingspercentages van 69.7% vs 68.2%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-15

Rang
#69
Totaal aantal uitvoer-tokens
101,296
Responstijd (gem.)
47.94s
Totale kosten
$0.236
Rang
#61
Totaal aantal uitvoer-tokens
169,329
Responstijd (gem.)
39.11s
Totale kosten
n.v.t.
Aanbevolen model Seed-2.0-Lite (medium)

Het heeft in deze vergelijking de beste balans tussen score, betrouwbaarheid, kosten en responstijd.

Gedetailleerde vergelijking

Metriek Seed-2.0-Lite Seed-2.0-Lite medium Releasedatum: 2026-02-14 Qwen3.8 27B Qwen3.8 27B low Releasedatum: 2026-08-14
Score 7.8 7.9
Rang #69 #61
Betrouwbaarheid 10.0 10.0
Consistentie 8.6 10.0
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 69.7% 68.2%
Instabiele tests 4 0
Totaal runs 66 66
Kosten per resultaat 1.809 n.v.t.
Totale kosten $0.236 n.v.t.
Invoerprijs $0.250 / 1M n.v.t.
Uitvoerprijs $2.000 / 1M n.v.t.
Totaal aantal invoer-tokens 129,906 99,705
Uitvoer-tokens 12,530 1,545
Redeneer-tokens 88,766 167,784
Responstijd (gem.) 47.94s 39.11s
Responstijd (max) 254.92s 376.04s
Responstijd (totaal) 1054.57s 860.51s
Parameters ~200B totaal (~20B actief) 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
Kosten
$0.005
Tijd
86.7s
Tokens
2,354 tok

#61 Qwen3.8 27B

low
Kosten
n.v.t.
Tijd
92.8s
Tokens
6,902 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

Snelle vergelijking

Vergelijkingspaar wisselen

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2high