Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modèles comparés

Comparaison benchmark Kimi K2.6 (medium) vs Kimi K2.5 (medium) vs GLM 5 (medium) vs Claude Opus 4.7 (medium): Claude Opus 4.7 (medium) mène sur Score avec 8.7. Kimi K2.6 (medium) mène sur Fiabilité avec 10.0. GLM 5 (medium) a le Coût total le plus bas à $0.228. Claude Opus 4.7 (medium) est le plus rapide à 7.62s.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-09-10

Modèles comparés

Rang
#128
Total des jetons de sortie
347,519
Temps de réponse (moy.)
115.89s
Coût total
$1.247
Rang
#147
Total des jetons de sortie
220,942
Temps de réponse (moy.)
98.19s
Coût total
$0.479
Rang
#92
Total des jetons de sortie
124,566
Temps de réponse (moy.)
33.54s
Coût total
$0.228
Rang
#43
Total des jetons de sortie
29,990
Temps de réponse (moy.)
7.62s
Coût total
$1.476
Modèle recommandé Claude Opus 4.7 (medium)

Il obtient le meilleur score ici (8.7) et répond environ 10.8x plus vite que les autres modèles de cette comparaison.

Comparaison détaillée

Métrique Kimi K2.6 Kimi K2.6 medium Sortie: 2026-04-20 Kimi K2.5 Kimi K2.5 medium Sortie: 2026-01-27 GLM 5 GLM 5 medium Sortie: 2026-02-12 Claude Opus 4.7 Claude Opus 4.7 medium Sortie: 2026-04-16
Score 7.2 7.0 7.7 8.7
Rang #128 #147 #92 #43
Fiabilité 10.0 10.0 10.0 10.0
Cohérence 8.3 7.0 8.1 9.6
Tentatives 66/66 66/66 63/66 66/66
Tests corrects
Taux de réussite par tentative 63.6% 63.6% 78.8% 83.3%
Tests instables 4 8 4 1
Exécutions totales 66 66 63 66
Coût par résultat 10.029 4.849 1.668 8.200
Coût total $1.247 $0.479 $0.228 $1.476
Prix d'entrée $0.950 / 1M $0.450 / 1M $0.600 / 1M $5.000 / 1M
Prix de sortie $4.000 / 1M $2.250 / 1M $1.920 / 1M $25.000 / 1M
Total des jetons d'entrée 68,913 118,496 35,224 145,249
Jetons de sortie 64,654 53,522 21,570 24,948
Jetons de raisonnement 282,865 167,420 102,996 5,042
Temps de réponse (moy.) 115.89s 98.19s 33.54s 7.62s
Temps de réponse (max) 876.20s 281.00s 99.85s 65.40s
Temps de réponse (total) 2433.66s 1571.05s 435.99s 159.94s
Paramètres 1T au total (32B actifs) 1T au total (32B actifs) 744B au total (40B actifs) ~5T au total (~500B actifs)
Disponibilité Poids disponibles Poids disponibles Open source Source fermée

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 MoonshotAI: Kimi K2.6

medium
Coût
$0.013
Temps
103.4s
Tokens
3,620 tok

#147 MoonshotAI: Kimi K2.5

medium
Coût
$0.030
Temps
58.6s
Tokens
8,683 tok

#92 GLM 5

medium
Coût
$0.005
Temps
20.7s
Tokens
2,068 tok

#43 Claude Opus 4.7

medium
Coût
$0.059
Temps
26.8s
Tokens
2,475 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114

Comparaison rapide

Changer la paire de comparaison