Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 5.5 (low) vs Trinity Large Thinking (medium)

Claude Sonnet 5.5 (low) mène au score moyen avec 6.2 vs 6.1. Claude Sonnet 5.5 (low) a le coût de benchmark le plus bas avec $0.620 vs $0.756. Claude Sonnet 5.5 (low) est plus rapide avec 5.68s vs 85.44s, avec des taux de réussite de 43.9% vs 48.5%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-09-29

Modèles comparés

Rang
#232
Total des jetons de sortie
28,630
Temps de réponse (moy.)
5.68s
Coût total
$0.620
Rang
#241
Total des jetons de sortie
1,016,785
Temps de réponse (moy.)
85.44s
Coût total
$0.756
Modèle recommandé Claude Sonnet 5.5 (low)

Il obtient le meilleur score ici (6.2) et répond environ 15.1x plus vite que Trinity Large Thinking (medium).

Comparaison détaillée

Métrique Claude Sonnet 5.5 Claude Sonnet 5.5 low Sortie: 2026-09-29 Trinity Large Thinking Trinity Large Thinking medium Sortie: 2026-07-28
Score 6.2 6.1
Rang #232 #241
Fiabilité 10.0 10.0
Cohérence 9.4 7.9
Tentatives 66/66 66/66
Tests corrects
Taux de réussite par tentative 43.9% 48.5%
Tests instables 2 6
Exécutions totales 66 66
Coût par résultat 6.880 9.972
Coût total $0.620 $0.756
Prix d'entrée $2.000 / 1M $0.250 / 1M
Prix de sortie $10.000 / 1M $0.800 / 1M
Total des jetons d'entrée 166,418 118,486
Jetons de sortie 21,456 156,166
Jetons de raisonnement 7,174 860,619
Temps de réponse (moy.) 5.68s 85.44s
Temps de réponse (max) 22.74s 525.14s
Temps de réponse (total) 124.87s 1879.75s
Paramètres ~1T au total (~100B actifs) 398B au total (13B actifs)
Disponibilité Source fermée Poids disponibles

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#232 Claude Sonnet 5.5

low
Coût
$0.020
Temps
15.3s
Tokens
2,077 tok

#241 Trinity Large Thinking

medium
Coût
$0.016
Temps
75.9s
Tokens
19,401 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Comparaison rapide

Changer la paire de comparaison