Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Trinity Large Preview vs OpenAI: gpt-oss-120b

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-03

Métrique Trinity Large Preview Trinity Large Preview none Sortie: 2026-01-27 gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement
Score 4.7 5.9
Rang #148 #103
Fiabilité 10.0 10.0
Cohérence 9.3 7.9
Tests corrects
Taux de réussite par tentative 23.3% 50.0%
Tests instables 2 5
Exécutions totales 60 60
Coût par résultat 0.017 0.151
Coût total $0.008 $0.012
Prix d'entrée $0.243 / 1M $0.039 / 1M
Prix de sortie $0.243 / 1M $0.180 / 1M
Total des jetons d'entrée 29,828 36,355
Jetons de sortie 2,169 17,495
Jetons de raisonnement 0 46,878
Temps de réponse (moy.) 2.98s 22.41s
Temps de réponse (max) 14.34s 68.16s
Temps de réponse (total) 56.57s 291.35s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
gpt-oss-120b 3.9 5.6 33.3% 1 47.24s 5,053 847 8,618
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

Comparaison rapide

Changer la paire de comparaison