Navigatie
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs Qwen3.5-35B-A3B (medium)

Qwen3.5-35B-A3B (medium) leidt in gemiddelde score met 6.1 vs 6.0. Trinity Large Thinking (low) heeft lagere benchmarkkosten met $0.658 vs $1.140. Trinity Large Thinking (low) is sneller met 96.61s vs 110.84s, met slagingspercentages van 47.0% vs 65.2%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-20

Rang
#181
Totaal aantal uitvoer-tokens
818,359
Responstijd (gem.)
96.61s
Totale kosten
$0.658
Rang
#170
Totaal aantal uitvoer-tokens
893,463
Responstijd (gem.)
110.84s
Totale kosten
$1.140
Aanbevolen model Trinity Large Thinking (low)

De score blijft dicht bij de beste score hier (6.0 vs 6.1) en het kost ongeveer 1.7x minder dan Qwen3.5-35B-A3B (medium).

Gedetailleerde vergelijking

Metriek Trinity Large Thinking Trinity Large Thinking low Releasedatum: 2026-07-28 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Releasedatum: 2026-02-24
Score 6.0 6.1
Rang #181 #170
Betrouwbaarheid 10.0 10.0
Consistentie 8.3 7.6
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 47.0% 65.2%
Instabiele tests 5 6
Totaal runs 66 66
Kosten per resultaat 8.221 9.806
Totale kosten $0.658 $1.140
Invoerprijs $0.220 / 1M $0.250 / 1M
Uitvoerprijs $0.850 / 1M $1.250 / 1M
Totaal aantal invoer-tokens 122,854 130,450
Uitvoer-tokens 119,810 54,857
Redeneer-tokens 698,549 838,606
Responstijd (gem.) 96.61s 110.84s
Responstijd (max) 540.96s 950.25s
Responstijd (totaal) 2125.51s 2438.58s
Parameters 398B totaal (13B actief) 35B totaal (3B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Trinity Large Thinking

low
Kosten
$0.021
Tijd
173.2s
Tokens
24,586 tok

#170 Qwen3.5-35B-A3B

medium
Kosten
$0.009
Tijd
71.4s
Tokens
8,631 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

Snelle vergelijking

Vergelijkingspaar wisselen