Navigare
AI BENCHY
Advertise here

Ling 3.0 Tiny (medium) vs gpt-oss-120b

Scorul mediu este practic egal la 3.8 vs 3.7. Ling 3.0 Tiny (medium) are costul de benchmark mai mic, $0.000 vs $0.010. gpt-oss-120b este mai rapid cu 21.61s vs 68.74s, cu rate de reușită de 24.2% vs 33.3%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-08-07

Rang
#244
Total tokenuri de ieșire
1,021,580
Timp de răspuns (mediu)
68.74s
Cost total
$0.000
Rang
#246
Total tokenuri de ieșire
51,664
Timp de răspuns (mediu)
21.61s
Cost total
$0.010
Model recomandat gpt-oss-120b

Are cel mai bun scor aici (3.7) și răspunde de aproximativ 3.2x mai rapid decât Ling 3.0 Tiny (medium).

Comparație detaliată

Metrică Ling 3.0 Tiny Ling 3.0 Tiny medium Lansare: 2026-08-07 Disponibil gratuit gpt-oss-120b gpt-oss-120b none Lansare: 2025-08-05 Disponibil gratuit
Scor 3.8 3.7
Rang #244 #246
Fiabilitate 9.7 10.0
Consistență 8.9 7.8
Acoperire benchmark 22/22 teste · 66/66 încercări 19/22 teste · 57/66 încercări
Teste corecte
Rată de trecere pe încercare 24.2% 33.3%
Teste instabile 3 2
Rulări totale 66 57
Cost per rezultat 0.000 0.168
Cost total $0.000 $0.010
Preț de intrare $0.000 / 1M $0.037 / 1M
Preț de ieșire $0.000 / 1M $0.170 / 1M
Total tokenuri de intrare 104,078 9,081
Tokenuri de ieșire 153,908 51,664
Tokenuri de raționament 867,672 0
Timp de răspuns (mediu) 68.74s 21.61s
Timp de răspuns (maxim) 262.20s 113.71s
Timp de răspuns (total) 1512.22s 345.79s

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#244 Ling 3.0 Tiny

medium
SVG invalid
Cost
$0.000
Timp
177.4s
Tokenuri
6,873 tok

#246 gpt-oss-120b

none
Nu s-a generat încă niciun rezultat de prezentare pentru acest model.
Cost
$0.000
Timp
-
Tokenuri
0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Comparație rapidă

Schimbă perechea de comparație

gpt-oss-120bnoneDisponibil gratuitvsQwen3.5-9BmediumLing 3.0 TinylowDisponibil gratuitvsgpt-oss-120bnoneDisponibil gratuitLing 3.0 TinyhighDisponibil gratuitvsgpt-oss-120bnoneDisponibil gratuitGranite 4.1 8BnonevsLing 3.0 TinymediumDisponibil gratuitLing 3.0 TinymediumDisponibil gratuitvsGrok 4.20nonegpt-oss-120bnoneDisponibil gratuitvsGLM 4.7 FlashmediumLing 3.0 TinymediumDisponibil gratuitvsLaguna S 2.1noneDisponibil gratuitMiniMax M2.5mediumvsgpt-oss-120bnoneDisponibil gratuitMercury 2nonevsLing 3.0 TinymediumDisponibil gratuitCobuddymediumvsgpt-oss-120bnoneDisponibil gratuitgpt-oss-120bnoneDisponibil gratuitvsQwen3 Coder NextmediumTrinity Large PreviewnonevsLing 3.0 TinymediumDisponibil gratuit