Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs Qwen3 Coder Next (medium)

Trinity Large Thinking (high) leidt in gemiddelde score met 4.8 vs 4.6. Qwen3 Coder Next (medium) heeft lagere benchmarkkosten met $0.034 vs $0.592. Qwen3 Coder Next (medium) is sneller met 9.07s vs 75.86s, met slagingspercentages van 39.4% vs 25.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-10

Vergeleken modellen

Rang
#288
Totaal aantal uitvoer-tokens
932,619
Responstijd (gem.)
75.86s
Totale kosten
$0.592
Rang
#299
Totaal aantal uitvoer-tokens
19,069
Responstijd (gem.)
9.07s
Totale kosten
$0.034
Aanbevolen model Qwen3 Coder Next (medium)

De score blijft dicht bij de beste score hier (4.6 vs 4.8) en het kost ongeveer 17.9x minder dan Trinity Large Thinking (high).

Gedetailleerde vergelijking

Metriek Trinity Large Thinking Trinity Large Thinking high Releasedatum: 2026-07-28 Qwen3 Coder Next Qwen3 Coder Next medium Releasedatum: 2026-02-03
Score 4.8 4.6
Rang #288 #299
Betrouwbaarheid 10.0 10.0
Consistentie 7.2 8.6
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 39.4% 25.8%
Instabiele tests 8 4
Totaal runs 66 66
Kosten per resultaat 12.473 1.058
Totale kosten $0.592 $0.034
Invoerprijs $0.250 / 1M $0.120 / 1M
Uitvoerprijs $0.800 / 1M $0.800 / 1M
Totaal aantal invoer-tokens 101,776 148,203
Uitvoer-tokens 276,367 19,069
Redeneer-tokens 656,252 0
Responstijd (gem.) 75.86s 9.07s
Responstijd (max) 510.21s 81.80s
Responstijd (totaal) 1668.93s 154.19s
Parameters 398B totaal (13B actief) 80B totaal (3B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 Trinity Large Thinking

high
Kosten
$0.028
Tijd
130.1s
Tokens
34,387 tok

#299 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

Snelle vergelijking

Vergelijkingspaar wisselen