- Peringkat
- #222
- Total token output
- 842,200
- Waktu respons (rata-rata)
- 95.16s
- Total Biaya
- $0.700
Trinity Large Thinking (low) vs Gemini 3.1 Flash Lite Preview
Trinity Large Thinking (low) unggul dalam skor rata-rata dengan 6.3 vs 6.2. Gemini 3.1 Flash Lite Preview memiliki biaya benchmark lebih rendah di $0.090 vs $0.700. Gemini 3.1 Flash Lite Preview lebih cepat di 3.60s vs 95.16s, dengan tingkat keberhasilan 47.8% vs 55.1%.
Model yang Dibandingkan
- Peringkat
- #229
- Total token output
- 15,760
- Waktu respons (rata-rata)
- 3.60s
- Total Biaya
- $0.090
Model yang direkomendasikan
Gemini 3.1 Flash Lite Preview
Its score stays close to the best score here (6.2 vs 6.3), while costing about 7.8x less than Trinity Large Thinking (low).
Perbandingan terperinci
| Metrik | Trinity Large Thinking Trinity Large Thinking low | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none |
|---|---|---|
| Skor | 6.3 | 6.2 |
| Peringkat | #222 | #229 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 8.1 | 9.7 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 47.8% | 55.1% |
| Tes tidak stabil | 6 | 1 |
| Total Run | 69 | 69 |
| Biaya per hasil | 9.163 | 0.743 |
| Total Biaya | $0.700 | $0.090 |
| Harga input | $0.250 / 1M | $0.250 / 1M |
| Harga output | $0.800 / 1M | $1.500 / 1M |
| Total token input | 347,980 | 261,962 |
| Token output | 121,898 | 15,760 |
| Token penalaran | 720,302 | 0 |
| Waktu respons (rata-rata) | 95.16s | 3.60s |
| Waktu respons (maks) | 540.96s | 48.59s |
| Waktu respons (total) | 2188.74s | 82.91s |
| Parameter | 398B total (13B aktif) | ~150B total (~10B aktif) |
| Ketersediaan | Bobot tersedia | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#222 Trinity Large Thinking
low- Biaya
- $0.021
- Waktu
- 173.2s
- Token
- 24,586 tok
#229 Gemini 3.1 Flash Lite Preview
none- Biaya
- $0.003
- Waktu
- 4.7s
- Token
- 1,827 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.4 | 3.8 | 66.7% | 1 | 63.23s | 225,126 | 2,088 | 21,753 | |
| Gemini 3.1 Flash Lite Preview | 5.0 | 10.0 | 0.0% | 0 | 48.59s | 141,007 | 1,599 | 0 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 8.3 | 10.0 | 75.0% | 0 | 5.70s | 663 | 1,451 | 5,431 | |
| Gemini 3.1 Flash Lite Preview | 7.5 | 8.4 | 66.7% | 1 | 1.04s | 504 | 1,092 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 10.0 | 33.3% | 0 | 344.45s | 5,441 | 27,039 | 217,241 | |
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 967ms | 8,128 | 670 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 6.0 | 33.3% | 1 | 291.02s | 99,467 | 9,848 | 234,039 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 6.23s | 96,386 | 9,084 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.3 | 5.8 | 83.3% | 1 | 14.30s | 6,906 | 459 | 9,451 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.22s | 7,550 | 399 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 140.26s | 756 | 72,049 | 217,598 | |
| Gemini 3.1 Flash Lite Preview | 5.3 | 10.0 | 33.3% | 0 | 811ms | 654 | 437 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 501 | 5,138 | 5,695 | |
| Gemini 3.1 Flash Lite Preview | 4.0 | 10.0 | 0.0% | 0 | 741ms | 488 | 69 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.8 | 16.7% | 1 | 4.07s | 684 | 45 | 3,710 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.13s | 623 | 574 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 7.9 | 44.4% | 1 | 3.28s | 678 | 2,625 | 3,077 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 900ms | 570 | 1,045 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.19s | 7,551 | 299 | 1,430 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.39s | 5,894 | 782 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 2.10s | 207 | 857 | 877 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 814ms | 158 | 9 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Trinity Large ThinkinglowvsDeepSeek V3.2mediumTrinity Large ThinkinglowvsSpace Bunny AlphamediumClaude Fable 5.1lowvsGemini 3.1 Flash Lite PreviewnoneTrinity Large ThinkinglowvsDeepSeek V4 Flash 0423noneTrinity Large ThinkinglowvsGrok 4.20mediumTrinity Large ThinkinglowvsQwen3.5 Plus 2026-02-15noneTrinity Large ThinkinglowvsSolar Pro 4highGemini 3.1 Flash Lite PreviewnonevsKAT-Coder-Pro V2.5mediumGemini 3.1 Flash Lite PreviewnonevsSpace Bunny AlphaxhighTrinity Large ThinkinglowvsSpace Bunny AlphaxhighTrinity Large ThinkinglowvsQwen3.6 27BnoneTrinity Large ThinkinglowvsKAT-Coder-Pro V2.5medium