Navigatie
Advertise here

Ling 3.0 Tiny (medium) vs Decider V1.1 27B (default)

Ling 3.0 Tiny (medium) leidt in gemiddelde score met 3.6 vs 2.6. Ling 3.0 Tiny (medium) heeft lagere benchmarkkosten met $0.000 vs $0.002. Decider V1.1 27B (default) is sneller met 320ms vs 64.99s, met slagingspercentages van 23.2% vs 17.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#375
Totaal aantal uitvoer-tokens
911,748
Responstijd (gem.)
64.99s
Totale kosten
$0.000
Rang
#395
Totaal aantal uitvoer-tokens
69
Responstijd (gem.)
320ms
Totale kosten
$0.002
Aanbevolen model Ling 3.0 Tiny (medium)

Het heeft de hoogste score in deze vergelijking (3.6) en de beste balans tussen kosten en responstijd van de 2 modellen.

Gedetailleerde vergelijking

Metriek Ling 3.0 Tiny Ling 3.0 Tiny medium Releasedatum: 2026-08-07 Decider V1.1 27B Decider V1.1 27B default Releasedatum: 2026-10-07
Score 3.6 2.6
Rang #375 #395
Betrouwbaarheid 9.6 10.0
Consistentie 8.9 5.2
Pogingen 69/69 36/69
Correcte tests
Slaagpercentage per poging 23.2% 17.4%
Instabiele tests 3 0
Totaal runs 69 36
Kosten per resultaat 0.000 0.037
Totale kosten $0.000 $0.002
Invoerprijs $0.000 / 1M $0.020 / 1M
Uitvoerprijs $0.000 / 1M $0.000 / 1M
Prijs voor cachelezen n.v.t. n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 103,898 73,557
Uitvoer-tokens 148,304 69
Redeneer-tokens 774,972 0
Responstijd (gem.) 64.99s 320ms
Responstijd (max) 262.20s 491ms
Responstijd (totaal) 1429.68s 3.84s
Parameters 7.9B totaal (1.3B actief) 27B
Beschikbaarheid Open-source Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#375 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
Kosten
$0.000
Tijd
177.4s
Tokens
6,873 tok

#395 Decider V1.1 27B

default
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Vergelijkingspaar wisselen