Navigation
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs North Mini Code (medium)

Trinity Large Thinking (low) führt beim Durchschnittsscore mit 6.0 vs 5.9. North Mini Code (medium) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.656. Trinity Large Thinking (low) ist schneller mit 96.78s vs 137.11s, mit Erfolgsraten von 48.5% vs 48.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-28

Rang
#145
Gesamte Ausgabe-Token
815,220
Antwortzeit (Durchschnitt)
96.78s
Gesamtkosten
$0.656
Rang
#154
Gesamte Ausgabe-Token
1,766,801
Antwortzeit (Durchschnitt)
137.11s
Gesamtkosten
$0.000
Empfohlenes Modell Trinity Large Thinking (low)

Es hat die stärkste Punktzahl in diesem Vergleich (6.0) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.

Detaillierter Vergleich

Metrik Trinity Large Thinking Trinity Large Thinking low Veröffentlichung: 2026-07-28 North Mini Code North Mini Code medium Veröffentlichung: 2026-06-18 Kostenlos verfügbar
Punktzahl 6.0 5.9
Rang #145 #154
Zuverlässigkeit 9.7 8.6
Konsistenz 7.9 8.5
Korrekte Tests
Erfolgsquote pro Versuch 48.5% 48.5%
Instabile Tests 6 4
Gesamtläufe 66 58
Kosten pro Ergebnis 8.199 0.000
Gesamtkosten $0.656 $0.000
Eingabepreis $0.220 / 1M $0.000 / 1M
Ausgabepreis $0.850 / 1M $0.000 / 1M
Gesamte Eingabe-Token 122,845 81,813
Ausgabe-Token 117,704 424,772
Denk-Token 697,516 1,342,029
Antwortzeit (Durchschnitt) 96.78s 137.11s
Antwortzeit (Maximum) 540.96s 786.72s
Antwortzeit (Gesamt) 2129.13s 3016.42s

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
Kosten
$0.021
Zeit
173.2s
Token
24,586 tok

#154 North Mini Code

medium
Kosten
$0.000
Zeit
51.8s
Token
12,460 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569

Schnellvergleich

Vergleichspaar wechseln