Navigation
Advertise here

GPT-5.2 Chat vs GLM 5.3 FlashX (medium)

GLM 5.3 FlashX (medium) mène au score moyen avec 7.1 vs 7.0. GLM 5.3 FlashX (medium) a le coût de benchmark le plus bas avec $0.114 vs $0.594. GLM 5.3 FlashX (medium) est plus rapide avec 7.37s vs 7.43s, avec des taux de réussite de 66.7% vs 69.6%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-10-01

Modèles comparés

Rang
#153
Total des jetons de sortie
29,742
Temps de réponse (moy.)
7.43s
Coût total
$0.594
Rang
#150
Total des jetons de sortie
30,048
Temps de réponse (moy.)
7.37s
Coût total
$0.114
Modèle recommandé GLM 5.3 FlashX (medium)

Il obtient le meilleur score ici (7.1) tout en coûtant environ 5.2x moins que GPT-5.2 Chat.

Comparaison détaillée

Métrique GPT-5.2 Chat GPT-5.2 Chat none Sortie: 2025-12-11 GLM 5.3 FlashX GLM 5.3 FlashX medium Sortie: 2026-09-21
Score 7.0 7.1
Rang #153 #150
Fiabilité 10.0 10.0
Cohérence 8.7 7.1
Tentatives 69/69 69/69
Tests corrects
Taux de réussite par tentative 66.7% 69.6%
Tests instables 4 8
Exécutions totales 69 69
Coût par résultat 4.564 0.946
Coût total $0.594 $0.114
Prix d'entrée $1.750 / 1M $0.370 / 1M
Prix de sortie $14.000 / 1M $1.250 / 1M
Total des jetons d'entrée 101,104 205,100
Jetons de sortie 29,742 8,639
Jetons de raisonnement 0 21,409
Temps de réponse (moy.) 7.43s 7.37s
Temps de réponse (max) 38.52s 74.39s
Temps de réponse (total) 163.35s 169.54s
Paramètres ~400B au total (~17B actifs) 320B au total (18B actifs)
Disponibilité Source fermée Source fermée

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 GPT-5.2 Chat

none
Coût
$0.010
Temps
15.3s
Tokens
797 tok

#150 GLM 5.3 FlashX

medium
Coût
$0.002
Temps
8.1s
Tokens
1,480 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
GLM 5.3 FlashX 6.0 4.6 66.7% 2 6.37s 7,317 384 5,562

Comparaison rapide

Changer la paire de comparaison