Navigatie
Advertise here

gpt-oss-120b vs Qwen3 Coder Next (medium)

Qwen3 Coder Next (medium) leidt in gemiddelde score met 4.6 vs 3.7. gpt-oss-120b heeft lagere benchmarkkosten met $0.033 vs $0.034. Qwen3 Coder Next (medium) is sneller met 9.07s vs 21.61s, met slagingspercentages van 33.3% vs 25.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-18

Vergeleken modellen

Rang
#325
Totaal aantal uitvoer-tokens
51,664
Responstijd (gem.)
21.61s
Totale kosten
$0.033
Rang
#300
Totaal aantal uitvoer-tokens
19,069
Responstijd (gem.)
9.07s
Totale kosten
$0.034
Aanbevolen model Qwen3 Coder Next (medium)

Het heeft hier de beste score (4.6) en reageert ongeveer 2.4x sneller dan gpt-oss-120b.

Gedetailleerde vergelijking

Metriek gpt-oss-120b gpt-oss-120b none Releasedatum: 2025-08-05 Gratis beschikbaar Qwen3 Coder Next Qwen3 Coder Next medium Releasedatum: 2026-02-03
Score 3.7 4.6
Rang #325 #300
Betrouwbaarheid 10.0 10.0
Consistentie 7.8 8.6
Pogingen 57/66 66/66
Correcte tests
Slaagpercentage per poging 33.3% 25.8%
Instabiele tests 2 4
Totaal runs 57 66
Kosten per resultaat 0.168 1.058
Totale kosten $0.033 $0.034
Invoerprijs $0.150 / 1M $0.120 / 1M
Uitvoerprijs $0.600 / 1M $0.800 / 1M
Totaal aantal invoer-tokens 9,081 148,203
Uitvoer-tokens 51,664 19,069
Redeneer-tokens 0 0
Responstijd (gem.) 21.61s 9.07s
Responstijd (max) 113.71s 81.80s
Responstijd (totaal) 345.79s 154.19s
Parameters 117B totaal (5.1B actief) 80B totaal (3B actief)
Beschikbaarheid Open-source Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#325 gpt-oss-120b

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

#300 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

Snelle vergelijking

Vergelijkingspaar wisselen