Navigation
AI BENCHY
Advertise here

Modèles comparés

Comparaison benchmark GPT-5.4 (medium) vs GPT-5.3-Codex (medium) vs GPT-5.2 (medium): GPT-5.3-Codex (medium) mène sur Score avec 8.9. GPT-5.4 (medium) mène sur Fiabilité avec 10.0. GPT-5.3-Codex (medium) a le Coût total le plus bas à $0.920. GPT-5.3-Codex (medium) est le plus rapide à 16.96s.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-08-07

Rang
#29
Total des jetons de sortie
88,670
Temps de réponse (moy.)
23.10s
Coût total
$1.533
Rang
#18
Total des jetons de sortie
55,525
Temps de réponse (moy.)
16.96s
Coût total
$0.920
Rang
#33
Total des jetons de sortie
54,782
Temps de réponse (moy.)
22.62s
Coût total
$0.951
Modèle recommandé GPT-5.3-Codex (medium)

Il obtient le meilleur score de cette comparaison (8.9) et le meilleur équilibre global entre coût et temps de réponse sur les 3 modèles.

Comparaison détaillée

Métrique GPT-5.4 GPT-5.4 medium Sortie: 2026-03-05 GPT-5.3-Codex GPT-5.3-Codex medium Sortie: 2026-02-05 GPT-5.2 GPT-5.2 medium Sortie: 2025-12-11
Score 8.5 8.9 8.4
Rang #29 #18 #33
Fiabilité 10.0 10.0 10.0
Cohérence 8.6 8.6 8.5
Couverture du benchmark 22/22 tests · 66/66 tentatives 22/22 tests · 66/66 tentatives 22/22 tests · 66/66 tentatives
Tests corrects
Taux de réussite par tentative 77.3% 83.3% 72.7%
Tests instables 4 4 4
Exécutions totales 66 66 66
Coût par résultat 10.220 5.748 6.791
Coût total $1.533 $0.920 $0.951
Prix d'entrée $2.500 / 1M $1.750 / 1M $1.750 / 1M
Prix de sortie $15.000 / 1M $14.000 / 1M $14.000 / 1M
Total des jetons d'entrée 81,127 81,268 105,004
Jetons de sortie 6,155 6,251 9,914
Jetons de raisonnement 82,515 49,274 44,868
Temps de réponse (moy.) 23.10s 16.96s 22.62s
Temps de réponse (max) 100.41s 100.93s 102.93s
Temps de réponse (total) 508.26s 373.19s 339.28s

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GPT-5.4

medium
Coût
$0.214
Temps
199.6s
Tokens
14,349 tok

#18 GPT-5.3-Codex

medium
Coût
$0.049
Temps
54.9s
Tokens
3,580 tok

#33 GPT-5.2

medium
Coût
$0.047
Temps
49.2s
Tokens
3,396 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

Comparaison rapide

Changer la paire de comparaison