Navigation
Advertise here

Trinity Large Preview vs Mercury 2.5 Preview (low)

Mercury 2.5 Preview (low) führt beim Durchschnittsscore mit 5.0 vs 4.8. Trinity Large Preview hat die niedrigeren Benchmark-Kosten mit $0.008 vs $0.011. Mercury 2.5 Preview (low) ist schneller mit 1.31s vs 2.98s, mit Erfolgsraten von 21.2% vs 47.0%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-09-22

Verglichene Modelle

Rang
#306
Gesamte Ausgabe-Token
2,169
Antwortzeit (Durchschnitt)
2.98s
Gesamtkosten
$0.008
Rang
#290
Gesamte Ausgabe-Token
31,975
Antwortzeit (Durchschnitt)
1.31s
Gesamtkosten
$0.011
Empfohlenes Modell Mercury 2.5 Preview (low)

Es hat hier die beste Punktzahl (5.0) und antwortet etwa 2.3x schneller als Trinity Large Preview.

Detaillierter Vergleich

Metrik Trinity Large Preview Trinity Large Preview none Veröffentlichung: 2026-01-27 Mercury 2.5 Preview Mercury 2.5 Preview low Veröffentlichung: 2026-09-02
Punktzahl 4.8 5.0
Rang #306 #290
Zuverlässigkeit 10.0 10.0
Konsistenz 8.9 7.0
Versuche 63/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 21.2% 47.0%
Instabile Tests 2 8
Gesamtläufe 63 66
Kosten pro Ergebnis 0.017 0.169
Gesamtkosten $0.008 $0.011
Eingabepreis $0.243 / 1M $0.040 / 1M
Ausgabepreis $0.243 / 1M $0.150 / 1M
Gesamte Eingabe-Token 29,828 133,525
Ausgabe-Token 2,169 7,259
Denk-Token 0 24,716
Antwortzeit (Durchschnitt) 2.98s 1.31s
Antwortzeit (Maximum) 14.34s 7.29s
Antwortzeit (Gesamt) 56.57s 28.77s
Parameter 398B insgesamt (13B aktiv) ~100B
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#306 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
Kosten
$0.000
Zeit
0.0s
Token
0 tok

#290 Mercury 2.5 Preview

low
Kosten
$0.001
Zeit
1.5s
Token
1,169 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Mercury 2.5 Preview 5.5 10.0 33.3% 0 972ms 7,794 695 2,263

Schnellvergleich

Vergleichspaar wechseln