Navigare
Advertise here

DeepSeek V4.1 Flash vs Qwen3.8 Flash Next

Scorul mediu este practic egal la 5.8 vs 5.8. Qwen3.8 Flash Next are costul de benchmark mai mic, ~$0.011 vs $0.453. Qwen3.8 Flash Next este mai rapid cu 5.71s vs 16.63s, cu rate de reușită de 36.2% vs 43.5%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-05

Modele comparate

Rang
#260
Total tokenuri de ieșire
292,779
Timp de răspuns (mediu)
16.63s
Cost total
$0.453
Rang
#258
Total tokenuri de ieșire
9,077
Timp de răspuns (mediu)
5.71s
Cost total
~$0.011
Model recomandat Qwen3.8 Flash Next

Are cel mai bun scor aici (5.8) și costă de aproximativ 41.8x mai puțin decât DeepSeek V4.1 Flash.

Comparație detaliată

Metrică DeepSeek V4.1 Flash DeepSeek V4.1 Flash none Lansare: 2026-09-10 Qwen3.8 Flash Next Qwen3.8 Flash Next none Lansare: 2026-10-04
Scor 5.8 5.8
Rang #260 #258
Fiabilitate 9.7 10.0
Consistență 9.1 9.0
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 36.2% 43.5%
Teste instabile 3 3
Rulări totale 69 69
Cost per rezultat 2.806 ~0.136
Cost total $0.453 ~$0.011
Preț de intrare $0.003 / 1M N/D
Preț de ieșire $2.400 / 1M N/D
Preț citire cache $0.003 / 1M N/D
Preț scriere cache N/D N/D
Total tokenuri de intrare 337,756 266,004
Tokenuri de ieșire 292,779 9,077
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 16.63s 5.71s
Timp de răspuns (maxim) 247.66s 65.25s
Timp de răspuns (total) 382.53s 131.36s
Parametri 748B în total (16B activi) 180B în total (6B activi)
Disponibilitate Sursă deschisă Ponderi disponibile

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#260 DeepSeek V4.1 Flash

none
Cost
$0.021
Timp
55.4s
Tokenuri
17,181 tok

#258 Qwen3.8 Flash Next

none
Cost
~$0.001
Timp
27.5s
Tokenuri
2,983 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4.1 Flash 5.5 10.0 33.3% 0 83.66s 7,284 263,438 0
Qwen3.8 Flash Next 5.5 10.0 33.3% 0 1.64s 7,911 669 0

Comparație rapidă

Schimbă perechea de comparație

DeepSeek V4.1 FlashnonevsLing 3.0 FlashhighDeepSeek V4.1 FlashnonevsRing 2.6 1tmediumTrinity Large ThinkinghighvsDeepSeek V4.1 FlashnoneDeepSeek V4.1 FlashnonevsGPT-5 NanomediumLing 3.0 FlashhighvsQwen3.8 Flash Nextnonegpt-oss-120bmediumvsQwen3.8 Flash NextnoneDeepSeek V4.1 FlashnonevsDots 3 Note PreviewmediumDisponibil gratuitRing 2.6 1tmediumvsQwen3.8 Flash NextnoneTrinity Large ThinkinghighvsQwen3.8 Flash NextnoneGemini 3.1 Flash LiteminimalvsQwen3.8 Flash NextnoneGPT-5 NanomediumvsQwen3.8 Flash NextnoneDeepSeek V4.1 FlashnonevsSpace Bunny Alphalow