Navigatie
Advertise here

DeepSeek V4.1 Flash (low) vs Qwen3.8 Flash Next (low)

DeepSeek V4.1 Flash (low) leidt in gemiddelde score met 8.0 vs 8.0. Qwen3.8 Flash Next (low) heeft lagere benchmarkkosten met ~$0.045 vs $0.526. Qwen3.8 Flash Next (low) is sneller met 23.66s vs 28.04s, met slagingspercentages van 73.9% vs 79.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-05

Vergeleken modellen

Rang
#91
Totaal aantal uitvoer-tokens
371,547
Responstijd (gem.)
28.04s
Totale kosten
$0.526
Rang
#96
Totaal aantal uitvoer-tokens
135,295
Responstijd (gem.)
23.66s
Totale kosten
~$0.045
Aanbevolen model Qwen3.8 Flash Next (low)

De score blijft dicht bij de beste score hier (8.0 vs 8.0) en het kost ongeveer 11.7x minder dan DeepSeek V4.1 Flash (low).

Gedetailleerde vergelijking

Metriek DeepSeek V4.1 Flash DeepSeek V4.1 Flash low Releasedatum: 2026-09-10 Qwen3.8 Flash Next Qwen3.8 Flash Next low Releasedatum: 2026-10-04
Score 8.0 8.0
Rang #91 #96
Betrouwbaarheid 9.6 10.0
Consistentie 8.7 8.0
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 73.9% 79.7%
Instabiele tests 4 6
Totaal runs 69 69
Kosten per resultaat 1.576 ~0.299
Totale kosten $0.526 ~$0.045
Invoerprijs $0.003 / 1M n.v.t.
Uitvoerprijs $2.400 / 1M n.v.t.
Prijs voor cachelezen $0.003 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 266,849 342,163
Uitvoer-tokens 8,284 1,518
Redeneer-tokens 363,263 133,777
Responstijd (gem.) 28.04s 23.66s
Responstijd (max) 149.84s 166.72s
Responstijd (totaal) 645.03s 544.16s
Parameters 748B totaal (16B actief) 180B totaal (6B actief)
Beschikbaarheid Open-source Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 DeepSeek V4.1 Flash

low
Kosten
$0.017
Tijd
43.6s
Tokens
14,069 tok

#96 Qwen3.8 Flash Next

low
Kosten
~$0.002
Tijd
47.2s
Tokens
5,270 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 40.66s 7,509 378 81,978
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

Snelle vergelijking

Vergelijkingspaar wisselen

Gemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowDeepSeek V4.1 FlashlowvsGPT-5.6 LunahighQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumGratis beschikbaarvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsNemotron 3 UltramediumGratis beschikbaarGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsGPT-5.4 NanomediumDeepSeek V4.1 FlashlowvsGemini 3.8 Flashmedium