Comparaison benchmark Qwen3.5-122B-A10B vs GLM 5V Turbo : GLM 5V Turbo mène au score moyen avec 5.9 vs 5.3. Qwen3.5-122B-A10B a le coût de benchmark le plus bas avec $0.020 vs $0.052. GLM 5V Turbo est plus rapide avec 2.99s vs 3.41s, avec des taux de réussite de 31.8% vs 38.1%.
Modèle recommandé: Qwen3.5-122B-A10B - Son score reste proche du meilleur score ici (5.3 vs 5.9) tout en coûtant environ 2.7x moins que GLM 5V Turbo.
Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18
GLM 5V TurboGLM 5V TurbononeModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.Sortie: 2026-04-01
Score
5.3Score moyen sur l’ensemble des tests de benchmark.…
5.9Score moyen sur l’ensemble des tests de benchmark.…
Rang
#125
#105
Fiabilité
10.0Score de réussite au premier essai : 10.0 signifie aucun échec réessayable de l'API cible ou de limite de débit avant les appels réussis ; les échecs suivis réduisent le score.…
10.0Score de réussite au premier essai : 10.0 signifie aucun échec réessayable de l'API cible ou de limite de débit avant les appels réussis ; les échecs suivis réduisent le score.…
Cohérence
9.6Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
Tests corrects
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 13N'a pas suivi les instructions: 2Temps de réponse (moy.)3.41sTemps de réponse (max)46.00sTemps de réponse (total)71.59sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 11N'a pas suivi les instructions: 2Temps de réponse (moy.)2.99sTemps de réponse (max)6.51sTemps de réponse (total)62.74sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
Taux de réussite par tentative
31.8%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
38.1%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
Tests instables
1Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Exécutions totales
63Exécutions totales…
63Exécutions totales…
Coût par résultat
0.393Affiche le coût moyen par réponse correcte du benchmark, en centimes (plus bas est meilleur).…
0.645Affiche le coût moyen par réponse correcte du benchmark, en centimes (plus bas est meilleur).…
Coût total
$0.020Coût total (prix actuel)…
$0.052Coût total (prix actuel)…
Prix d'entrée
$0.260 / 1MPrix d'entrée…
$1.200 / 1MPrix d'entrée…
Prix de sortie
$2.080 / 1MPrix de sortie…
$4.000 / 1MPrix de sortie…
Total des jetons d'entrée
47,735Total des jetons d'entrée…
37,100Total des jetons d'entrée…
Jetons de sortie
3,383Jetons de sortie…
1,766Jetons de sortie…
Jetons de raisonnement
0Jetons de raisonnement…
0Jetons de raisonnement…
Temps de réponse (moy.)
3.41sTemps de réponse (moy.)…
2.99sTemps de réponse (moy.)…
Temps de réponse (max)
46.00sTemps de réponse (max)…
6.51sTemps de réponse (max)…
Temps de réponse (total)
71.59sTemps de réponse (total)…
62.74sTemps de réponse (total)…
Génération showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
4.8Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
25.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 3Temps de réponse (moy.)1.59sTemps de réponse (max)3.60sTemps de réponse (total)6.38sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
1.59sTemps de réponse (moy.)…
696Total des jetons d'entrée…
312Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
4.8Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
25.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 3Temps de réponse (moy.)3.13sTemps de réponse (max)5.90sTemps de réponse (total)12.50sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
3.7Score moyen sur l’ensemble des tests de benchmark.…
7.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
22.2%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
1Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 3Temps de réponse (moy.)2.77sTemps de réponse (max)4.03sTemps de réponse (total)8.32sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
2.77sTemps de réponse (moy.)…
7,913Total des jetons d'entrée…
693Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
5.5Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
33.3%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 2Temps de réponse (moy.)3.13sTemps de réponse (max)5.30sTemps de réponse (total)9.40sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
3.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)46.00sTemps de réponse (max)46.00sTemps de réponse (total)46.00sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
46.00sTemps de réponse (moy.)…
20,175Total des jetons d'entrée…
1,137Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
3.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)6.51sTemps de réponse (max)6.51sTemps de réponse (total)6.51sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
10.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
100.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Aucune réponse échouée.Temps de réponse (moy.)1.01sTemps de réponse (max)1.06sTemps de réponse (total)2.02sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
1.01sTemps de réponse (moy.)…
7,794Total des jetons d'entrée…
243Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
10.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
100.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Aucune réponse échouée.Temps de réponse (moy.)3.81sTemps de réponse (max)5.69sTemps de réponse (total)7.62sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
5.3Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
33.3%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 2Temps de réponse (moy.)465msTemps de réponse (max)492msTemps de réponse (total)1.39sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
465msTemps de réponse (moy.)…
789Total des jetons d'entrée…
15Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
5.3Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
33.3%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 2Temps de réponse (moy.)2.09sTemps de réponse (max)2.39sTemps de réponse (total)6.26sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
5.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.N'a pas suivi les instructions: 1Temps de réponse (moy.)1.12sTemps de réponse (max)1.12sTemps de réponse (total)1.12sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
1.12sTemps de réponse (moy.)…
522Total des jetons d'entrée…
66Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
4.6Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.N'a pas suivi les instructions: 1Temps de réponse (moy.)2.22sTemps de réponse (max)2.22sTemps de réponse (total)2.22sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
6.3Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
50.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)513msTemps de réponse (max)570msTemps de réponse (total)1.03sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
513msTemps de réponse (moy.)…
711Total des jetons d'entrée…
69Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
6.5Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
50.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)1.97sTemps de réponse (max)2.43sTemps de réponse (total)3.93sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
3.8Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 2N'a pas suivi les instructions: 1Temps de réponse (moy.)1.00sTemps de réponse (max)1.41sTemps de réponse (total)3.00sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
1.00sTemps de réponse (moy.)…
714Total des jetons d'entrée…
575Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
5.3Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
33.3%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.N'a pas suivi les instructions: 1Mauvaise réponse: 1Temps de réponse (moy.)2.40sTemps de réponse (max)3.81sTemps de réponse (total)7.21sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
10.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
100.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Aucune réponse échouée.Temps de réponse (moy.)2.04sTemps de réponse (max)2.04sTemps de réponse (total)2.04sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
2.04sTemps de réponse (moy.)…
8,211Total des jetons d'entrée…
264Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
10.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
100.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Aucune réponse échouée.Temps de réponse (moy.)4.86sTemps de réponse (max)4.86sTemps de réponse (total)4.86sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
3.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)295msTemps de réponse (max)295msTemps de réponse (total)295msUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…
295msTemps de réponse (moy.)…
210Total des jetons d'entrée…
9Jetons de sortie…
0Jetons de raisonnement…
GLM 5V TurboModèle archivé : ce modèle n'est plus mis à jour ni testé sur de nouveaux tests.
3.0Score moyen sur l’ensemble des tests de benchmark.…
10.0Le score de cohérence reflète la stabilité entre exécutions (10 = très cohérent, même si constamment faux).…
0.0%Taux de réussite par tentative = tentatives réussies / tentatives totales sur toutes les exécutions.…
0Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).…
Un test est entièrement réussi uniquement si toutes ses exécutions réussissent.Mauvaise réponse: 1Temps de réponse (moy.)2.23sTemps de réponse (max)2.23sTemps de réponse (total)2.23sUn test est entièrement réussi uniquement si toutes ses exécutions réussissent.…