Navigatie
Advertise here

Ling 3.0 Tiny (high) vs gpt-oss-120b

Ling 3.0 Tiny (high) leidt in gemiddelde score met 3.8 vs 3.7. Ling 3.0 Tiny (high) heeft lagere benchmarkkosten met $0.000 vs $0.033. gpt-oss-120b is sneller met 21.61s vs 75.68s, met slagingspercentages van 24.2% vs 33.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-22

Vergeleken modellen

Rang
#332
Totaal aantal uitvoer-tokens
950,683
Responstijd (gem.)
75.68s
Totale kosten
$0.000
Rang
#338
Totaal aantal uitvoer-tokens
51,664
Responstijd (gem.)
21.61s
Totale kosten
$0.033
Aanbevolen model gpt-oss-120b

De score blijft dicht bij de beste score hier (3.7 vs 3.8) en het reageert ongeveer 3.5x sneller dan Ling 3.0 Tiny (high).

Gedetailleerde vergelijking

Metriek Ling 3.0 Tiny Ling 3.0 Tiny high Releasedatum: 2026-08-07 gpt-oss-120b gpt-oss-120b none Releasedatum: 2025-08-05 Gratis beschikbaar
Score 3.8 3.7
Rang #332 #338
Betrouwbaarheid 10.0 10.0
Consistentie 8.8 7.8
Pogingen 66/66 57/66
Correcte tests
Slaagpercentage per poging 24.2% 33.3%
Instabiele tests 3 2
Totaal runs 66 57
Kosten per resultaat 0.000 0.168
Totale kosten $0.000 $0.033
Invoerprijs $0.000 / 1M $0.150 / 1M
Uitvoerprijs $0.000 / 1M $0.600 / 1M
Totaal aantal invoer-tokens 115,314 9,081
Uitvoer-tokens 133,965 51,664
Redeneer-tokens 816,718 0
Responstijd (gem.) 75.68s 21.61s
Responstijd (max) 345.15s 113.71s
Responstijd (totaal) 1589.20s 345.79s
Parameters 7.9B totaal (1.3B actief) 117B totaal (5.1B actief)
Beschikbaarheid Open-source Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#332 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
Kosten
$0.000
Tijd
169.5s
Tokens
5,252 tok

#338 gpt-oss-120b

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Snelle vergelijking

Vergelijkingspaar wisselen