Navigatie
Advertise here

Ling 3.1 Flash (low) vs Grok 4.20 (medium)

De gemiddelde score is vrijwel gelijk met 6.3 vs 6.3. Ling 3.1 Flash (low) heeft lagere benchmarkkosten met $0.000 vs $1.246. Grok 4.20 (medium) is sneller met 36.73s vs 85.22s, met slagingspercentages van 66.7% vs 58.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#222
Totaal aantal uitvoer-tokens
704,170
Responstijd (gem.)
85.22s
Totale kosten
$0.000
Rang
#228
Totaal aantal uitvoer-tokens
302,087
Responstijd (gem.)
36.73s
Totale kosten
$1.246
Aanbevolen model Grok 4.20 (medium)

Het heeft hier de beste score (6.3) en reageert ongeveer 2.3x sneller dan Ling 3.1 Flash (low).

Gedetailleerde vergelijking

Metriek Ling 3.1 Flash Ling 3.1 Flash low Releasedatum: 2026-10-03 Grok 4.20 Grok 4.20 medium Releasedatum: 2026-03-31
Score 6.3 6.3
Rang #222 #228
Betrouwbaarheid 9.7 10.0
Consistentie 7.8 8.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 66.7% 58.0%
Instabiele tests 6 5
Totaal runs 69 69
Kosten per resultaat 0.000 14.374
Totale kosten $0.000 $1.246
Invoerprijs $0.000 / 1M $1.250 / 1M
Uitvoerprijs $0.000 / 1M $2.500 / 1M
Prijs voor cachelezen n.v.t. $0.200 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 271,890 392,127
Uitvoer-tokens 190,841 7,754
Redeneer-tokens 513,329 294,333
Responstijd (gem.) 85.22s 36.73s
Responstijd (max) 432.81s 199.66s
Responstijd (totaal) 1960.12s 844.68s
Parameters 560B totaal (25B actief) ~1T totaal (~100B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Ling 3.1 Flash

low
Kosten
$0.000
Tijd
133.5s
Tokens
12,950 tok

#228 SpaceXAI: Grok 4.20

medium
Kosten
$0.041
Tijd
110.3s
Tokens
16,336 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ling 3.1 Flash 5.6 4.2 66.7% 2 107.30s 8,298 20,816 86,330
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

Snelle vergelijking

Vergelijkingspaar wisselen