- Rang
- #232
- Gesamte Ausgabe-Token
- 1,033,971
- Antwortzeit (Durchschnitt)
- 84.01s
- Gesamtkosten
- $0.820
Trinity Large Thinking (medium) vs Inkling
Der Durchschnittsscore ist mit 6.1 vs 6.1 praktisch gleichauf. Inkling hat die niedrigeren Benchmark-Kosten mit $0.304 vs $0.820. Inkling ist schneller mit 5.30s vs 84.01s, mit Erfolgsraten von 49.3% vs 31.9%.
Verglichene Modelle
- Rang
- #233
- Gesamte Ausgabe-Token
- 16,536
- Antwortzeit (Durchschnitt)
- 5.30s
- Gesamtkosten
- $0.304
Empfohlenes Modell
Inkling
Es hat hier die beste Punktzahl (6.1) und kostet etwa 2.7x weniger als Trinity Large Thinking (medium).
Detaillierter Vergleich
| Metrik | Trinity Large Thinking Trinity Large Thinking medium | Inkling Inkling none Kostenlos verfügbar |
|---|---|---|
| Punktzahl | 6.1 | 6.1 |
| Rang | #232 | #233 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 7.7 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 49.3% | 31.9% |
| Instabile Tests | 7 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 10.772 | 4.337 |
| Gesamtkosten | $0.820 | $0.304 |
| Eingabepreis | $0.250 / 1M | $1.000 / 1M |
| Ausgabepreis | $0.800 / 1M | $4.050 / 1M |
| Gesamte Eingabe-Token | 319,352 | 236,599 |
| Ausgabe-Token | 158,447 | 16,536 |
| Denk-Token | 875,524 | 0 |
| Antwortzeit (Durchschnitt) | 84.01s | 5.30s |
| Antwortzeit (Maximum) | 525.14s | 48.02s |
| Antwortzeit (Gesamt) | 1932.24s | 121.91s |
| Parameter | 398B insgesamt (13B aktiv) | 975B insgesamt (41B aktiv) |
| Verfügbarkeit | Gewichte verfügbar | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#232 Trinity Large Thinking
medium- Kosten
- $0.016
- Zeit
- 75.9s
- Token
- 19,401 tok
#233 Thinking Machines: Inkling
none
Provider returned error
- Kosten
- $0.000
- Zeit
- 5.3s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.1 | 3.1 | 66.7% | 1 | 52.50s | 200,866 | 2,281 | 14,905 | |
| Inkling | 10.0 | 10.0 | 100.0% | 0 | 45.64s | 132,479 | 5,982 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.8 | 9.8 | 50.0% | 0 | 5.11s | 663 | 1,531 | 6,078 | |
| Inkling | 4.8 | 10.0 | 25.0% | 0 | 1.43s | 678 | 261 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.5 | 10.0 | 66.7% | 0 | 179.02s | 7,248 | 7,413 | 351,155 | |
| Inkling | 4.5 | 10.0 | 0.0% | 0 | 1.01s | 7,356 | 436 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 6.0 | 16.7% | 1 | 382.70s | 93,292 | 35,814 | 269,745 | |
| Inkling | 2.9 | 5.8 | 16.7% | 1 | 25.74s | 80,195 | 8,777 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 16.38s | 6,906 | 475 | 11,153 | |
| Inkling | 10.0 | 10.0 | 100.0% | 0 | 1.14s | 7,056 | 279 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 7.2 | 44.4% | 1 | 124.17s | 756 | 99,334 | 172,018 | |
| Inkling | 5.3 | 10.0 | 33.3% | 0 | 1.18s | 786 | 45 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 32.22s | 501 | 7,035 | 7,774 | |
| Inkling | 5.0 | 10.0 | 0.0% | 0 | 859ms | 495 | 156 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.9 | 16.7% | 1 | 3.99s | 684 | 77 | 3,798 | |
| Inkling | 6.3 | 10.0 | 50.0% | 0 | 1.72s | 696 | 72 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 5.4 | 44.5% | 2 | 2.90s | 678 | 2,508 | 3,231 | |
| Inkling | 5.6 | 9.9 | 33.3% | 0 | 931ms | 696 | 291 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.26s | 7,551 | 299 | 1,372 | |
| Inkling | 3.0 | 10.0 | 0.0% | 0 | 2.50s | 5,949 | 213 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 97.44s | 207 | 1,680 | 34,295 | |
| Inkling | 3.0 | 10.0 | 0.0% | 0 | 670ms | 213 | 24 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Trinity Large ThinkingmediumvsQwen3.5 Plus 2026-04-20noneGranite 4.2 8BmediumvsInklingnoneKostenlos verfügbarTrinity Large ThinkingmediumvsGemini 3.5 FlashnoneTrinity Large ThinkingmediumvsKAT-Coder-Pro V2.5noneClaude Fable 5.1lowvsTrinity Large ThinkingmediumClaude Fable 5.1lowvsInklingnoneKostenlos verfügbarTrinity Large ThinkingmediumvsGemini 3.1 Flash Lite PreviewnoneTrinity Large ThinkingmediumvsDeepSeek V4 Flash 0731noneInklingnoneKostenlos verfügbarvsGLM 5.3 FlashXlowTrinity Large ThinkingmediumvsGLM 5.3 FlashXlowTrinity Large ThinkingmediumvsSpace Bunny AlphaxhighTrinity Large ThinkingmediumvsMiMo-V2.6-Pronone