- Rang
- #288
- Gesamte Ausgabe-Token
- 932,619
- Antwortzeit (Durchschnitt)
- 75.86s
- Gesamtkosten
- $0.592
Trinity Large Thinking (high) vs Qwen3 Coder Next (medium)
Trinity Large Thinking (high) führt beim Durchschnittsscore mit 4.8 vs 4.6. Qwen3 Coder Next (medium) hat die niedrigeren Benchmark-Kosten mit $0.034 vs $0.592. Qwen3 Coder Next (medium) ist schneller mit 9.07s vs 75.86s, mit Erfolgsraten von 39.4% vs 25.8%.
Verglichene Modelle
- Rang
- #299
- Gesamte Ausgabe-Token
- 19,069
- Antwortzeit (Durchschnitt)
- 9.07s
- Gesamtkosten
- $0.034
Empfohlenes Modell
Qwen3 Coder Next (medium)
Die Punktzahl bleibt nah an der besten hier (4.6 vs 4.8) und es kostet etwa 17.9x weniger als Trinity Large Thinking (high).
Detaillierter Vergleich
| Metrik | Trinity Large Thinking Trinity Large Thinking high | Qwen3 Coder Next Qwen3 Coder Next medium |
|---|---|---|
| Punktzahl | 4.8 | 4.6 |
| Rang | #288 | #299 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 7.2 | 8.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 39.4% | 25.8% |
| Instabile Tests | 8 | 4 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 12.473 | 1.058 |
| Gesamtkosten | $0.592 | $0.034 |
| Eingabepreis | $0.250 / 1M | $0.120 / 1M |
| Ausgabepreis | $0.800 / 1M | $0.800 / 1M |
| Gesamte Eingabe-Token | 101,776 | 148,203 |
| Ausgabe-Token | 276,367 | 19,069 |
| Denk-Token | 656,252 | 0 |
| Antwortzeit (Durchschnitt) | 75.86s | 9.07s |
| Antwortzeit (Maximum) | 510.21s | 81.80s |
| Antwortzeit (Gesamt) | 1668.93s | 154.19s |
| Parameter | 398B insgesamt (13B aktiv) | 80B insgesamt (3B aktiv) |
| Verfügbarkeit | Gewichte verfügbar | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 Trinity Large Thinking
high- Kosten
- $0.028
- Zeit
- 130.1s
- Token
- 34,387 tok
#299 Qwen3 Coder Next
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.7 | 8.1 | 58.3% | 1 | 4.13s | 663 | 3,108 | 7,565 | |
| Qwen3 Coder Next | 3.5 | 8.1 | 16.7% | 1 | 8.64s | 645 | 1,252 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.7 | 4.7 | 33.3% | 2 | 245.04s | 7,204 | 83,616 | 266,836 | |
| Qwen3 Coder Next | 3.7 | 7.2 | 22.2% | 1 | 924ms | 7,185 | 336 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 262.39s | 76,626 | 14,706 | 149,243 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 14.65s | 121,413 | 16,067 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 13.98s | 6,906 | 580 | 9,338 | |
| Qwen3 Coder Next | 6.5 | 10.0 | 50.0% | 0 | 81.80s | 7,758 | 246 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 66.94s | 756 | 163,364 | 166,091 | |
| Qwen3 Coder Next | 3.6 | 7.2 | 22.2% | 1 | 570ms | 762 | 25 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.5 | 3.4 | 66.7% | 1 | 12.90s | 501 | 5,700 | 5,942 | |
| Qwen3 Coder Next | 6.3 | 3.4 | 66.7% | 1 | 1.39s | 498 | 142 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 10.0 | 50.0% | 0 | 4.12s | 684 | 88 | 2,853 | |
| Qwen3 Coder Next | 6.3 | 10.0 | 50.0% | 0 | 7.49s | 684 | 63 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.7 | 5.2 | 33.3% | 2 | 3.84s | 678 | 2,566 | 3,368 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 1.25s | 678 | 671 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.96s | 7,551 | 282 | 1,440 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 2.64s | 8,364 | 255 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 125.13s | 207 | 2,357 | 43,576 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 399ms | 216 | 12 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Trinity Large ThinkinghighvsGPT-5.4 NanononeTrinity Large ThinkinghighvsNemotron 3.5 LightninglowKostenlos verfügbarGranite 4.2 8BhighvsQwen3 Coder NextmediumTrinity Large ThinkinghighvsRing-2.6-1TnoneTrinity Large ThinkinghighvsKAT-Coder-Air V2.5noneTrinity Large ThinkinghighvsHy4 previewnoneTrinity Large ThinkinghighvsGLM 4.7 FlashnoneTrinity Large ThinkinghighvsNemotron 3 SupernoneKostenlos verfügbarLaguna S 2.1noneKostenlos verfügbarvsQwen3 Coder NextmediumTrinity Large ThinkinghighvsLing-2.6-flashnoneMercury 2nonevsQwen3 Coder NextmediumTrinity Large ThinkinghighvsCobuddymedium