Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs OpenAI: GPT-5.5

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-05-28

Métrique Claude Opus 4.8 Claude Opus 4.8 medium Sortie: 2026-05-28 GPT-5.5 GPT-5.5 medium Sortie: 2026-04-24
Score 8.7 8.7
Rang #12 #11
Fiabilité 10.0 10.0
Cohérence 9.6 8.8
Tests corrects
Taux de réussite par tentative 83.3% 86.7%
Tests instables 1 3
Exécutions totales 60 60
Coût par résultat 6.285 21.884
Coût total $1.006 $3.502
Prix d'entrée $5.000 / 1M $5.000 / 1M
Prix de sortie $25.000 / 1M $30.000 / 1M
Jetons de sortie 23,201 1,964
Jetons de raisonnement 5,901 109,481
Temps de réponse (moy.) 9.34s 37.88s
Temps de réponse (max) 38.03s 332.10s
Temps de réponse (total) 186.84s 757.66s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 1,179 478
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 14.97s 6,651 1,381
GPT-5.5 8.2 6.7 83.3% 1 69.68s 341 19,515
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 9.8 10.0 100.0% 0 38.03s 5,260 1,588
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 7.1 5.6 83.3% 1 12.29s 481 312
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 5.3 10.0 33.3% 0 14.15s 7,477 900
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 2.46s 237 0
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 3.32s 373 320
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 791 483
GPT-5.5 10.0 10.0 100.0% 0 6.76s 241 2,225
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 10.0 10.0 100.0% 0 8.96s 301 225
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.8 3.0 10.0 0.0% 0 6.14s 451 214
GPT-5.5 2.8 1.6 33.3% 1 37.86s 30 1,754

Comparaison rapide

Changer la paire de comparaison