- Peringkat
- #232
- Total token output
- 1,016,785
- Waktu respons (rata-rata)
- 85.44s
- Total Biaya
- $0.756
Trinity Large Thinking (medium) vs Gemini 2.5 Flash
Trinity Large Thinking (medium) unggul dalam skor rata-rata dengan 6.1 vs 6.0. Gemini 2.5 Flash memiliki biaya benchmark lebih rendah di $0.017 vs $0.756. Gemini 2.5 Flash lebih cepat di 6.19s vs 85.44s, dengan tingkat keberhasilan 48.5% vs 39.4%.
Model yang Dibandingkan
- Peringkat
- #238
- Total token output
- 1,890
- Waktu respons (rata-rata)
- 6.19s
- Total Biaya
- $0.017
Model yang direkomendasikan
Gemini 2.5 Flash
Its score stays close to the best score here (6.0 vs 6.1), while costing about 45.3x less than Trinity Large Thinking (medium).
Perbandingan terperinci
| Metrik | Trinity Large Thinking Trinity Large Thinking medium | Gemini 2.5 Flash Gemini 2.5 Flash none |
|---|---|---|
| Skor | 6.1 | 6.0 |
| Peringkat | #232 | #238 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 7.9 | 9.6 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 48.5% | 39.4% |
| Tes tidak stabil | 6 | 1 |
| Total Run | 66 | 66 |
| Biaya per hasil | 9.972 | 0.209 |
| Total Biaya | $0.756 | $0.017 |
| Harga input | $0.250 / 1M | $0.300 / 1M |
| Harga output | $0.800 / 1M | $2.500 / 1M |
| Total token input | 118,486 | 39,886 |
| Token output | 156,166 | 1,890 |
| Token penalaran | 860,619 | 0 |
| Waktu respons (rata-rata) | 85.44s | 6.19s |
| Waktu respons (maks) | 525.14s | 118.00s |
| Waktu respons (total) | 1879.75s | 136.23s |
| Parameter | 398B total (13B aktif) | ~350B total (~20B aktif) |
| Ketersediaan | Bobot tersedia | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#232 Trinity Large Thinking
medium- Biaya
- $0.016
- Waktu
- 75.9s
- Token
- 19,401 tok
#238 Gemini 2.5 Flash
none
SVG tidak valid
- Biaya
- $0.164
- Waktu
- 215.5s
- Token
- 65,659 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.8 | 9.8 | 50.0% | 0 | 5.11s | 663 | 1,531 | 6,078 | |
| Gemini 2.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 582ms | 492 | 102 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.5 | 10.0 | 66.7% | 0 | 179.02s | 7,248 | 7,413 | 351,155 | |
| Gemini 2.5 Flash | 5.5 | 10.0 | 33.3% | 0 | 736ms | 8,122 | 483 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 6.0 | 16.7% | 1 | 382.70s | 93,292 | 35,814 | 269,745 | |
| Gemini 2.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 61.19s | 16,470 | 486 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 16.38s | 6,906 | 475 | 11,153 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 652ms | 7,257 | 279 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 7.2 | 44.4% | 1 | 124.17s | 756 | 99,334 | 172,018 | |
| Gemini 2.5 Flash | 3.6 | 7.2 | 22.2% | 1 | 449ms | 642 | 12 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 32.22s | 501 | 7,035 | 7,774 | |
| Gemini 2.5 Flash | 5.0 | 10.0 | 0.0% | 0 | 615ms | 486 | 78 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.9 | 16.7% | 1 | 3.99s | 684 | 77 | 3,798 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 590ms | 615 | 72 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 5.4 | 44.5% | 2 | 2.90s | 678 | 2,508 | 3,231 | |
| Gemini 2.5 Flash | 7.7 | 10.0 | 66.7% | 0 | 604ms | 558 | 132 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.26s | 7,551 | 299 | 1,372 | |
| Gemini 2.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 1.91s | 5,088 | 234 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 97.44s | 207 | 1,680 | 34,295 | |
| Gemini 2.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 1.15s | 156 | 12 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Trinity Large ThinkingmediumvsQwen3.6 FlashnoneTrinity Large ThinkingmediumvsGemma 4 31BnoneTersedia gratisTrinity Large ThinkingmediumvsInklinglowTrinity Large ThinkinglowvsGemini 2.5 FlashnoneTrinity Large ThinkingmediumvsGemini 3.1 Flash LitenoneTrinity Large ThinkingmediumvsQwen3.7 FlashnoneTrinity Large ThinkingmediumvsQwen3.5 Plus 2026-04-20noneTrinity Large ThinkingmediumvsGemini 3.1 Flash LiteminimalTrinity Large ThinkingmediumvsNemotron 3 UltranoneTersedia gratisClaude Sonnet 5nonevsTrinity Large ThinkingmediumTrinity Large ThinkingmediumvsGPT-5.6 LunalowGemini 2.5 FlashnonevsGPT-5 Nanomedium