Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs OpenAI: GPT-5.4 Mini

Résumé

Comparaison benchmark Kimi K2.6 vs GPT-5.4 Mini : Kimi K2.6 mène au score moyen avec 5.8 vs 5.3. GPT-5.4 Mini a le coût de benchmark le plus bas avec $0.038 vs $0.079. GPT-5.4 Mini est plus rapide avec 1.13s vs 13.27s, avec des taux de réussite de 36.5% vs 30.2%.

Modèle recommandé: GPT-5.4 Mini - Son score reste proche du meilleur score ici (5.3 vs 5.8) tout en coûtant environ 2.1x moins que Kimi K2.6.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-17

Métrique Kimi K2.6 Kimi K2.6 none Sortie: 2026-04-20 Disponible gratuitement GPT-5.4 Mini GPT-5.4 Mini none Sortie: 2026-03-17
Score 5.8 5.3
Rang #110 #123
Fiabilité 10.0 10.0
Cohérence 9.2 8.8
Tests corrects
Taux de réussite par tentative 36.5% 30.2%
Tests instables 2 3
Exécutions totales 63 63
Coût par résultat 1.267 0.743
Coût total $0.079 $0.038
Prix d'entrée $0.680 / 1M $0.750 / 1M
Prix de sortie $3.410 / 1M $4.500 / 1M
Total des jetons d'entrée 32,916 34,244
Jetons de sortie 16,410 2,541
Jetons de raisonnement 0 0
Temps de réponse (moy.) 13.27s 1.13s
Temps de réponse (max) 238.89s 2.52s
Temps de réponse (total) 278.57s 23.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 MoonshotAI: Kimi K2.6

none
Cost
$0.020
Time
127.4s
Tokens
4,429 tok

#123 GPT-5.4 Mini

none
Cost
$0.010
Time
11.7s
Tokens
2,151 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 606 654 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 11,019 298 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 7,140 222 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 723 88 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 477 174 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 660 101 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
GPT-5.4 Mini 5.4 10.0 33.3% 0 836ms 642 305 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 5,477 255 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 1.33s 195 43 0

Comparaison rapide

Changer la paire de comparaison