Navigatie
Advertise here

Ling 3.0 Tiny (low) vs Decider V1.1 27B (default)

Ling 3.0 Tiny (low) leidt in gemiddelde score met 3.7 vs 2.6. Ling 3.0 Tiny (low) heeft lagere benchmarkkosten met $0.000 vs $0.002. Decider V1.1 27B (default) is sneller met 320ms vs 63.15s, met slagingspercentages van 18.8% vs 17.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#374
Totaal aantal uitvoer-tokens
868,004
Responstijd (gem.)
63.15s
Totale kosten
$0.000
Rang
#395
Totaal aantal uitvoer-tokens
69
Responstijd (gem.)
320ms
Totale kosten
$0.002
Aanbevolen model Ling 3.0 Tiny (low)

Het heeft de hoogste score in deze vergelijking (3.7) en de beste balans tussen kosten en responstijd van de 2 modellen.

Gedetailleerde vergelijking

Metriek Ling 3.0 Tiny Ling 3.0 Tiny low Releasedatum: 2026-08-07 Decider V1.1 27B Decider V1.1 27B default Releasedatum: 2026-10-07
Score 3.7 2.6
Rang #374 #395
Betrouwbaarheid 9.6 10.0
Consistentie 9.7 5.2
Pogingen 69/69 36/69
Correcte tests
Slaagpercentage per poging 18.8% 17.4%
Instabiele tests 1 0
Totaal runs 69 36
Kosten per resultaat 0.000 0.037
Totale kosten $0.000 $0.002
Invoerprijs $0.000 / 1M $0.020 / 1M
Uitvoerprijs $0.000 / 1M $0.000 / 1M
Prijs voor cachelezen n.v.t. n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 99,662 73,557
Uitvoer-tokens 146,555 69
Redeneer-tokens 732,977 0
Responstijd (gem.) 63.15s 320ms
Responstijd (max) 252.08s 491ms
Responstijd (totaal) 1389.35s 3.84s
Parameters 7.9B totaal (1.3B actief) 27B
Beschikbaarheid Open-source Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#374 Ling 3.0 Tiny

low
No output was saved. The original provider response or failure reason is unavailable.
Kosten
$0.000
Tijd
200.0s
Tokens
5,030 tok

#395 Decider V1.1 27B

default
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ling 3.0 Tiny 2.9 10.0 0.0% 0 170.73s 7,619 56,012 170,220
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Vergelijkingspaar wisselen