Navigation
Advertise here

Kimi K2.6 vs Step 3.5 Flash (medium)

Kimi K2.6 mène au score moyen avec 5.5 vs 5.4. Step 3.5 Flash (medium) a le coût de benchmark le plus bas avec $0.105 vs $0.222. Kimi K2.6 est plus rapide avec 26.34s vs 190.48s, avec des taux de réussite de 30.4% vs 49.3%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-10-02

Modèles comparés

Rang
#268
Total des jetons de sortie
64,022
Temps de réponse (moy.)
26.34s
Coût total
$0.222
Rang
#279
Total des jetons de sortie
607,130
Temps de réponse (moy.)
190.48s
Coût total
$0.105
Modèle recommandé Kimi K2.6

Il obtient le meilleur score ici (5.5) et répond environ 7.2x plus vite que Step 3.5 Flash (medium).

Comparaison détaillée

Métrique Kimi K2.6 Kimi K2.6 none Sortie: 2026-04-20 Step 3.5 Flash Step 3.5 Flash medium Sortie: 2026-02-01
Score 5.5 5.4
Rang #268 #279
Fiabilité 10.0 10.0
Cohérence 9.0 8.3
Tentatives 69/69 66/69
Tests corrects
Taux de réussite par tentative 30.4% 49.3%
Tests instables 3 3
Exécutions totales 69 66
Coût par résultat 6.999 1.047
Coût total $0.222 $0.105
Prix d'entrée $0.435 / 1M $0.100 / 1M
Prix de sortie $1.828 / 1M $0.300 / 1M
Prix de lecture du cache $0.074 / 1M N/D
Prix d’écriture du cache N/D N/D
Total des jetons d'entrée 241,357 139,086
Jetons de sortie 64,022 193,584
Jetons de raisonnement 0 413,546
Temps de réponse (moy.) 26.34s 190.48s
Temps de réponse (max) 238.89s 1597.85s
Temps de réponse (total) 605.78s 3238.23s
Paramètres 1T au total (32B actifs) 196B au total (11B actifs)
Disponibilité Poids disponibles Open source

Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#268 MoonshotAI: Kimi K2.6

none
Coût
$0.020
Temps
127.4s
Tokens
4,429 tok

#279 Step 3.5 Flash

medium
Coût
$0.008
Temps
277.1s
Tokens
23,695 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429

Comparaison rapide

Changer la paire de comparaison

Step 3.5 FlashmediumvsMiMo-V2.6-FlashnoneEmber-1nonevsStep 3.5 FlashmediumStep 3.5 FlashmediumvsHy4 previewlowKimi K2.6nonevsNemotron 3 SupermediumDisponible gratuitementGPT-5.6 LunanonevsStep 3.5 FlashmediumGranite 4.2 8BlowvsStep 3.5 FlashmediumKimi K2.5nonevsStep 3.5 FlashmediumQwen3.8 27BnoneDisponible gratuitementvsStep 3.5 FlashmediumSeed-2.0-CodenonevsStep 3.5 FlashmediumLaguna XS 2.1noneDisponible gratuitementvsStep 3.5 FlashmediumQwen3.6 35B A3BnonevsStep 3.5 FlashmediumNorth Mini CodemediumDisponible gratuitementvsKimi K2.6none