- Rang
- #222
- Gesamte Ausgabe-Token
- 842,200
- Antwortzeit (Durchschnitt)
- 95.16s
- Gesamtkosten
- $0.700
Trinity Large Thinking (low) vs Gemini 3.1 Flash Lite Preview
Trinity Large Thinking (low) führt beim Durchschnittsscore mit 6.3 vs 6.2. Gemini 3.1 Flash Lite Preview hat die niedrigeren Benchmark-Kosten mit $0.090 vs $0.700. Gemini 3.1 Flash Lite Preview ist schneller mit 3.60s vs 95.16s, mit Erfolgsraten von 47.8% vs 55.1%.
Verglichene Modelle
- Rang
- #229
- Gesamte Ausgabe-Token
- 15,760
- Antwortzeit (Durchschnitt)
- 3.60s
- Gesamtkosten
- $0.090
Empfohlenes Modell
Gemini 3.1 Flash Lite Preview
Die Punktzahl bleibt nah an der besten hier (6.2 vs 6.3) und es kostet etwa 7.8x weniger als Trinity Large Thinking (low).
Detaillierter Vergleich
| Metrik | Trinity Large Thinking Trinity Large Thinking low | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none |
|---|---|---|
| Punktzahl | 6.3 | 6.2 |
| Rang | #222 | #229 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.1 | 9.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 47.8% | 55.1% |
| Instabile Tests | 6 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 9.163 | 0.743 |
| Gesamtkosten | $0.700 | $0.090 |
| Eingabepreis | $0.250 / 1M | $0.250 / 1M |
| Ausgabepreis | $0.800 / 1M | $1.500 / 1M |
| Gesamte Eingabe-Token | 347,980 | 261,962 |
| Ausgabe-Token | 121,898 | 15,760 |
| Denk-Token | 720,302 | 0 |
| Antwortzeit (Durchschnitt) | 95.16s | 3.60s |
| Antwortzeit (Maximum) | 540.96s | 48.59s |
| Antwortzeit (Gesamt) | 2188.74s | 82.91s |
| Parameter | 398B insgesamt (13B aktiv) | ~150B insgesamt (~10B aktiv) |
| Verfügbarkeit | Gewichte verfügbar | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#222 Trinity Large Thinking
low- Kosten
- $0.021
- Zeit
- 173.2s
- Token
- 24,586 tok
#229 Gemini 3.1 Flash Lite Preview
none- Kosten
- $0.003
- Zeit
- 4.7s
- Token
- 1,827 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.4 | 3.8 | 66.7% | 1 | 63.23s | 225,126 | 2,088 | 21,753 | |
| Gemini 3.1 Flash Lite Preview | 5.0 | 10.0 | 0.0% | 0 | 48.59s | 141,007 | 1,599 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 8.3 | 10.0 | 75.0% | 0 | 5.70s | 663 | 1,451 | 5,431 | |
| Gemini 3.1 Flash Lite Preview | 7.5 | 8.4 | 66.7% | 1 | 1.04s | 504 | 1,092 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 10.0 | 33.3% | 0 | 344.45s | 5,441 | 27,039 | 217,241 | |
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 967ms | 8,128 | 670 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 6.0 | 33.3% | 1 | 291.02s | 99,467 | 9,848 | 234,039 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 6.23s | 96,386 | 9,084 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.3 | 5.8 | 83.3% | 1 | 14.30s | 6,906 | 459 | 9,451 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.22s | 7,550 | 399 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 140.26s | 756 | 72,049 | 217,598 | |
| Gemini 3.1 Flash Lite Preview | 5.3 | 10.0 | 33.3% | 0 | 811ms | 654 | 437 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 501 | 5,138 | 5,695 | |
| Gemini 3.1 Flash Lite Preview | 4.0 | 10.0 | 0.0% | 0 | 741ms | 488 | 69 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.8 | 16.7% | 1 | 4.07s | 684 | 45 | 3,710 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.13s | 623 | 574 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 7.9 | 44.4% | 1 | 3.28s | 678 | 2,625 | 3,077 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 900ms | 570 | 1,045 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.19s | 7,551 | 299 | 1,430 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.39s | 5,894 | 782 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 2.10s | 207 | 857 | 877 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 814ms | 158 | 9 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Trinity Large ThinkinglowvsDeepSeek V3.2mediumTrinity Large ThinkinglowvsSpace Bunny AlphamediumClaude Fable 5.1lowvsGemini 3.1 Flash Lite PreviewnoneTrinity Large ThinkinglowvsDeepSeek V4 Flash 0423noneTrinity Large ThinkinglowvsGrok 4.20mediumTrinity Large ThinkinglowvsQwen3.5 Plus 2026-02-15noneTrinity Large ThinkinglowvsSolar Pro 4highGemini 3.1 Flash Lite PreviewnonevsKAT-Coder-Pro V2.5mediumGemini 3.1 Flash Lite PreviewnonevsSpace Bunny AlphaxhighTrinity Large ThinkinglowvsSpace Bunny AlphaxhighTrinity Large ThinkinglowvsQwen3.6 27BnoneTrinity Large ThinkinglowvsKAT-Coder-Pro V2.5medium