Navigation
Advertise here

Trinity Large Thinking — low vs medium

medium mène au score moyen avec 6.1 vs 6.0. low a le coût de benchmark le plus bas avec $0.625 vs $0.756. medium est plus rapide avec 85.44s vs 96.61s, avec des taux de réussite de 47.0% vs 48.5%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-09-10

Modèles comparés

Rang
#208
Total des jetons de sortie
818,359
Temps de réponse (moy.)
96.61s
Coût total
$0.625
Rang
#203
Total des jetons de sortie
1,016,785
Temps de réponse (moy.)
85.44s
Coût total
$0.756
Modèle recommandé low

Il offre le meilleur compromis global: score compétitif (6.0), coût inférieur à Trinity Large Thinking (medium) et temps de réponse équilibré.

Comparaison détaillée

Métrique Trinity Large Thinking Trinity Large Thinking low Sortie: 2026-07-28 Trinity Large Thinking Trinity Large Thinking medium Sortie: 2026-07-28
Score 6.0 6.1
Rang #208 #203
Fiabilité 10.0 10.0
Cohérence 8.3 7.9
Tentatives 66/66 66/66
Tests corrects
Taux de réussite par tentative 47.0% 48.5%
Tests instables 5 6
Exécutions totales 66 66
Coût par résultat 8.221 9.972
Coût total $0.625 $0.756
Prix d'entrée $0.250 / 1M $0.250 / 1M
Prix de sortie $0.800 / 1M $0.800 / 1M
Total des jetons d'entrée 122,854 118,486
Jetons de sortie 119,810 156,166
Jetons de raisonnement 698,549 860,619
Temps de réponse (moy.) 96.61s 85.44s
Temps de réponse (max) 540.96s 525.14s
Temps de réponse (total) 2125.51s 1879.75s
Paramètres 398B au total (13B actifs) 398B au total (13B actifs)
Disponibilité Poids disponibles Poids disponibles

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Trinity Large Thinking

low
Coût
$0.021
Temps
173.2s
Tokens
24,586 tok

#203 Trinity Large Thinking

medium
Coût
$0.016
Temps
75.9s
Tokens
19,401 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Comparaison rapide

Changer la paire de comparaison