Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs MoonshotAI: Kimi K2.6

Résumé

Comparaison benchmark Claude Opus 4.6 vs Kimi K2.6 : Kimi K2.6 mène au score moyen avec 7.8 vs 7.7. Kimi K2.6 a le coût de benchmark le plus bas avec $0.888 vs $2.053. Claude Opus 4.6 est plus rapide avec 25.89s vs 71.67s, avec des taux de réussite de 61.9% vs 65.1%.

Modèle recommandé: Kimi K2.6 - Il obtient le meilleur score ici (7.8) tout en coûtant environ 2.3x moins que Claude Opus 4.6.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-07-02

Métrique Claude Opus 4.6 Claude Opus 4.6 medium Sortie: 2026-02-05 Kimi K2.6 Kimi K2.6 medium Sortie: 2026-04-20 Disponible gratuitement
Score 7.7 7.8
Rang #40 #36
Fiabilité 10.0 10.0
Cohérence 8.8 8.6
Tests corrects
Taux de réussite par tentative 61.9% 65.1%
Tests instables 3 3
Exécutions totales 63 63
Coût par résultat 17.103 8.358
Coût total $2.053 $0.888
Prix d'entrée $5.000 / 1M $0.660 / 1M
Prix de sortie $25.000 / 1M $3.410 / 1M
Total des jetons d'entrée 53,227 29,450
Jetons de sortie 47,446 102,923
Jetons de raisonnement 24,000 254,094
Temps de réponse (moy.) 25.89s 71.67s
Temps de réponse (max) 83.40s 406.78s
Temps de réponse (total) 362.49s 1433.36s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 Claude Opus 4.6

medium
SVG invalide
Coût
$0.000
Temps
300.0s
Tokens
0 tok

#36 MoonshotAI: Kimi K2.6

medium
Coût
$0.013
Temps
103.4s
Tokens
3,620 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 618 7,115 8,934
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 11,271 711 13,876
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 7,014 316 11,305
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 326 47,035 98,262
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 477 3,981 4,472
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 669 3,977 5,269
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
Kimi K2.6 6.0 7.4 55.6% 1 25.06s 651 13,860 17,599
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 5,286 248 1,011
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 213 15,710 16,177

Comparaison rapide

Changer la paire de comparaison