Navigation
Advertise here

KAT Coder AIR V2.5 (low) vs Qwen3.5-9B

KAT Coder AIR V2.5 (low) mène au score moyen avec 5.0 vs 4.9. Qwen3.5-9B a le coût de benchmark le plus bas avec $0.041 vs $0.046. KAT Coder AIR V2.5 (low) est plus rapide avec 10.21s vs 37.19s, avec des taux de réussite de 42.0% vs 18.8%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-10-01

Modèles comparés

Rang
#301
Total des jetons de sortie
60,414
Temps de réponse (moy.)
10.21s
Coût total
$0.046
Rang
#309
Total des jetons de sortie
70,427
Temps de réponse (moy.)
37.19s
Coût total
$0.041
Modèle recommandé KAT Coder AIR V2.5 (low)

Il obtient le meilleur score ici (5.0) et répond environ 3.6x plus vite que Qwen3.5-9B.

Comparaison détaillée

Métrique KAT Coder AIR V2.5 KAT Coder AIR V2.5 low Sortie: 2026-07-14 Qwen3.5-9B Qwen3.5-9B none Sortie: 2026-03-02
Score 5.0 4.9
Rang #301 #309
Fiabilité 9.9 9.8
Cohérence 7.8 9.7
Tentatives 69/69 69/69
Tests corrects
Taux de réussite par tentative 42.0% 18.8%
Tests instables 6 1
Exécutions totales 69 69
Coût par résultat 0.649 1.022
Coût total $0.046 $0.041
Prix d'entrée $0.000 / 1M $0.100 / 1M
Prix de sortie $0.000 / 1M $0.150 / 1M
Total des jetons d'entrée 61,094 307,670
Jetons de sortie 6,532 70,427
Jetons de raisonnement 53,882 0
Temps de réponse (moy.) 10.21s 37.19s
Temps de réponse (max) 86.23s 433.02s
Temps de réponse (total) 234.86s 855.27s
Paramètres ~35B au total (~3B actifs) 9B
Disponibilité Source fermée Open source

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#301 KAT Coder AIR V2.5

low
Coût
$0.004
Temps
29.9s
Tokens
6,008 tok

#309 Qwen3.5-9B

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Coût
$0.000
Temps
300.0s
Tokens
0 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
KAT Coder AIR V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

Comparaison rapide

Changer la paire de comparaison