Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (low) vs Trinity Large Thinking (medium)

Claude Fable 5.1 (low) mène au score moyen avec 6.2 vs 6.1. Trinity Large Thinking (medium) a le coût de benchmark le plus bas avec $0.820 vs $3.395. Claude Fable 5.1 (low) est plus rapide avec 11.40s vs 84.01s, avec des taux de réussite de 55.1% vs 49.3%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-10-01

Modèles comparés

Rang
#230
Total des jetons de sortie
26,073
Temps de réponse (moy.)
11.40s
Coût total
$3.395
Rang
#232
Total des jetons de sortie
1,033,971
Temps de réponse (moy.)
84.01s
Coût total
$0.820
Modèle recommandé Claude Fable 5.1 (low)

Il obtient le meilleur score ici (6.2) et répond environ 7.4x plus vite que Trinity Large Thinking (medium).

Comparaison détaillée

Métrique Claude Fable 5.1 Claude Fable 5.1 low Sortie: 2026-09-02 Trinity Large Thinking Trinity Large Thinking medium Sortie: 2026-07-28
Score 6.2 6.1
Rang #230 #232
Fiabilité 10.0 10.0
Cohérence 8.9 7.7
Tentatives 69/69 69/69
Tests corrects
Taux de réussite par tentative 55.1% 49.3%
Tests instables 3 7
Exécutions totales 69 69
Coût par résultat 30.862 10.772
Coût total $3.395 $0.820
Prix d'entrée $10.000 / 1M $0.250 / 1M
Prix de sortie $50.000 / 1M $0.800 / 1M
Total des jetons d'entrée 209,116 319,352
Jetons de sortie 10,031 158,447
Jetons de raisonnement 16,042 875,524
Temps de réponse (moy.) 11.40s 84.01s
Temps de réponse (max) 34.77s 525.14s
Temps de réponse (total) 262.14s 1932.24s
Paramètres ~9.5T au total (~878B actifs) 398B au total (13B actifs)
Disponibilité Source fermée Poids disponibles

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#230 Claude Fable 5.1

low
Coût
$0.126
Temps
28.5s
Tokens
2,652 tok

#232 Trinity Large Thinking

medium
Coût
$0.016
Temps
75.9s
Tokens
19,401 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Comparaison rapide

Changer la paire de comparaison