Navigare
Advertise here

Ling 3.1 Flash (high) vs Step 3.7 Flash (medium)

Scorul mediu este practic egal la 7.9 vs 7.8. Ling 3.1 Flash (high) are costul de benchmark mai mic, $0.000 vs $0.571. Step 3.7 Flash (medium) este mai rapid cu 26.57s vs 87.39s, cu rate de reușită de 69.6% vs 68.1%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-03

Modele comparate

Rang
#105
Total tokenuri de ieșire
687,692
Timp de răspuns (mediu)
87.39s
Cost total
$0.000
Rang
#108
Total tokenuri de ieșire
440,835
Timp de răspuns (mediu)
26.57s
Cost total
$0.571
Model recomandat Step 3.7 Flash (medium)

Are cel mai bun scor aici (7.8) și răspunde de aproximativ 3.3x mai rapid decât Ling 3.1 Flash (high).

Comparație detaliată

Metrică Ling 3.1 Flash Ling 3.1 Flash high Lansare: 2026-10-03 Step 3.7 Flash Step 3.7 Flash medium Lansare: 2026-05-29
Scor 7.9 7.8
Rang #105 #108
Fiabilitate 9.8 10.0
Consistență 9.3 8.7
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 69.6% 68.1%
Teste instabile 2 4
Rulări totale 69 69
Cost per rezultat 0.000 4.392
Cost total $0.000 $0.571
Preț de intrare $0.000 / 1M $0.200 / 1M
Preț de ieșire $0.000 / 1M $1.150 / 1M
Preț citire cache N/D $0.040 / 1M
Preț scriere cache N/D N/D
Total tokenuri de intrare 324,691 319,524
Tokenuri de ieșire 181,251 440,835
Tokenuri de raționament 506,441 0
Timp de răspuns (mediu) 87.39s 26.57s
Timp de răspuns (maxim) 665.85s 152.83s
Timp de răspuns (total) 2010.08s 611.09s
Parametri 560B în total (25B activi) 198B în total (11B activi)
Disponibilitate Închis Sursă deschisă

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#105 Ling 3.1 Flash

high
Cost
$0.000
Timp
181.1s
Tokenuri
21,073 tok

#108 Step 3.7 Flash

medium
Cost
$0.006
Timp
46.2s
Tokenuri
4,466 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling 3.1 Flash 8.2 7.2 88.9% 1 83.41s 8,298 17,470 54,626
Step 3.7 Flash 8.8 7.8 88.9% 1 27.42s 7,437 44,797 0

Comparație rapidă

Schimbă perechea de comparație