- Peringkat
- #288
- Total token output
- 932,619
- Waktu respons (rata-rata)
- 75.86s
- Total Biaya
- $0.592
Trinity Large Thinking (high) vs Qwen3 Coder Next (medium)
Trinity Large Thinking (high) unggul dalam skor rata-rata dengan 4.8 vs 4.6. Qwen3 Coder Next (medium) memiliki biaya benchmark lebih rendah di $0.034 vs $0.592. Qwen3 Coder Next (medium) lebih cepat di 9.07s vs 75.86s, dengan tingkat keberhasilan 39.4% vs 25.8%.
Model yang Dibandingkan
- Peringkat
- #299
- Total token output
- 19,069
- Waktu respons (rata-rata)
- 9.07s
- Total Biaya
- $0.034
Model yang direkomendasikan
Qwen3 Coder Next (medium)
Its score stays close to the best score here (4.6 vs 4.8), while costing about 17.9x less than Trinity Large Thinking (high).
Perbandingan terperinci
| Metrik | Trinity Large Thinking Trinity Large Thinking high | Qwen3 Coder Next Qwen3 Coder Next medium |
|---|---|---|
| Skor | 4.8 | 4.6 |
| Peringkat | #288 | #299 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 7.2 | 8.6 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 39.4% | 25.8% |
| Tes tidak stabil | 8 | 4 |
| Total Run | 66 | 66 |
| Biaya per hasil | 12.473 | 1.058 |
| Total Biaya | $0.592 | $0.034 |
| Harga input | $0.250 / 1M | $0.120 / 1M |
| Harga output | $0.800 / 1M | $0.800 / 1M |
| Total token input | 101,776 | 148,203 |
| Token output | 276,367 | 19,069 |
| Token penalaran | 656,252 | 0 |
| Waktu respons (rata-rata) | 75.86s | 9.07s |
| Waktu respons (maks) | 510.21s | 81.80s |
| Waktu respons (total) | 1668.93s | 154.19s |
| Parameter | 398B total (13B aktif) | 80B total (3B aktif) |
| Ketersediaan | Bobot tersedia | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 Trinity Large Thinking
high- Biaya
- $0.028
- Waktu
- 130.1s
- Token
- 34,387 tok
#299 Qwen3 Coder Next
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Biaya
- $0.000
- Waktu
- 300.0s
- Token
- 0 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.7 | 8.1 | 58.3% | 1 | 4.13s | 663 | 3,108 | 7,565 | |
| Qwen3 Coder Next | 3.5 | 8.1 | 16.7% | 1 | 8.64s | 645 | 1,252 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.7 | 4.7 | 33.3% | 2 | 245.04s | 7,204 | 83,616 | 266,836 | |
| Qwen3 Coder Next | 3.7 | 7.2 | 22.2% | 1 | 924ms | 7,185 | 336 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 262.39s | 76,626 | 14,706 | 149,243 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 14.65s | 121,413 | 16,067 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 13.98s | 6,906 | 580 | 9,338 | |
| Qwen3 Coder Next | 6.5 | 10.0 | 50.0% | 0 | 81.80s | 7,758 | 246 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 66.94s | 756 | 163,364 | 166,091 | |
| Qwen3 Coder Next | 3.6 | 7.2 | 22.2% | 1 | 570ms | 762 | 25 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.5 | 3.4 | 66.7% | 1 | 12.90s | 501 | 5,700 | 5,942 | |
| Qwen3 Coder Next | 6.3 | 3.4 | 66.7% | 1 | 1.39s | 498 | 142 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 10.0 | 50.0% | 0 | 4.12s | 684 | 88 | 2,853 | |
| Qwen3 Coder Next | 6.3 | 10.0 | 50.0% | 0 | 7.49s | 684 | 63 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.7 | 5.2 | 33.3% | 2 | 3.84s | 678 | 2,566 | 3,368 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 1.25s | 678 | 671 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.96s | 7,551 | 282 | 1,440 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 2.64s | 8,364 | 255 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 125.13s | 207 | 2,357 | 43,576 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 399ms | 216 | 12 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Trinity Large ThinkinghighvsGPT-5.4 NanononeTrinity Large ThinkinghighvsNemotron 3.5 LightninglowTersedia gratisGranite 4.2 8BhighvsQwen3 Coder NextmediumTrinity Large ThinkinghighvsRing-2.6-1TnoneTrinity Large ThinkinghighvsKAT-Coder-Air V2.5noneTrinity Large ThinkinghighvsHy4 previewnoneTrinity Large ThinkinghighvsGLM 4.7 FlashnoneTrinity Large ThinkinghighvsNemotron 3 SupernoneTersedia gratisLaguna S 2.1noneTersedia gratisvsQwen3 Coder NextmediumTrinity Large ThinkinghighvsLing-2.6-flashnoneMercury 2nonevsQwen3 Coder NextmediumTrinity Large ThinkinghighvsCobuddymedium