- Rang
- #350
- Total des jetons de sortie
- 133,268
- Temps de réponse (moy.)
- 84.66s
- Coût total
- $0.037
Granite 4.2 8B vs KAT Coder AIR V2.5 (default)
Le score moyen est pratiquement à égalité avec 4.4 vs 4.4. Granite 4.2 8B a le coût de benchmark le plus bas avec $0.037 vs $0.070. KAT Coder AIR V2.5 (default) est plus rapide avec 11.96s vs 84.66s, avec des taux de réussite de 15.9% vs 34.8%.
Modèles comparés
- Rang
- #348
- Total des jetons de sortie
- 97,752
- Temps de réponse (moy.)
- 11.96s
- Coût total
- $0.070
Modèle recommandé
KAT Coder AIR V2.5 (default)
Il obtient le meilleur score ici (4.4) et répond environ 7.1x plus vite que Granite 4.2 8B.
Comparaison détaillée
| Métrique | Granite 4.2 8B Granite 4.2 8B none | KAT Coder AIR V2.5 KAT Coder AIR V2.5 default |
|---|---|---|
| Score | 4.4 | 4.4 |
| Rang | #350 | #348 |
| Fiabilité | 9.1 | 10.0 |
| Cohérence | 9.3 | 7.4 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 15.9% | 34.8% |
| Tests instables | 2 | 7 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 1.206 | 1.382 |
| Coût total | $0.037 | $0.070 |
| Prix d'entrée | $0.060 / 1M | $0.150 / 1M |
| Prix de sortie | $0.250 / 1M | $0.600 / 1M |
| Prix de lecture du cache | $0.015 / 1M | N/D |
| Prix d’écriture du cache | N/D | N/D |
| Total des jetons d'entrée | 226,872 | 69,376 |
| Jetons de sortie | 133,268 | 7,792 |
| Jetons de raisonnement | 0 | 89,960 |
| Temps de réponse (moy.) | 84.66s | 11.96s |
| Temps de réponse (max) | 747.17s | 121.05s |
| Temps de réponse (total) | 1947.17s | 275.18s |
| Paramètres | 8B | ~35B au total (~3B actifs) |
| Disponibilité | Open source | Source fermée |
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#350 IBM: Granite 4.2 8B
none
Provider returned error
- Coût
- $0.000
- Temps
- 0.2s
- Tokens
- 0 tok
#348 KAT Coder AIR V2.5
default- Coût
- $0.002
- Temps
- 14.5s
- Tokens
- 2,619 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 5.0 | 10.0 | 0.0% | 0 | 49.21s | 169,086 | 2,463 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.07s | 0 | 0 | 0 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 4.9 | 8.1 | 33.3% | 1 | 17.77s | 669 | 6,026 | 0 | |
| KAT Coder AIR V2.5 | 5.3 | 5.6 | 50.0% | 2 | 2.68s | 672 | 686 | 2,358 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 5.5 | 10.0 | 33.3% | 0 | 105.60s | 8,358 | 47,944 | 0 | |
| KAT Coder AIR V2.5 | 3.3 | 9.6 | 0.0% | 0 | 14.31s | 6,472 | 2,032 | 14,886 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 424.28s | 30,500 | 29,755 | 0 | |
| KAT Coder AIR V2.5 | 3.8 | 1.6 | 50.0% | 2 | 73.00s | 43,170 | 2,531 | 48,237 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 2.9 | 5.8 | 16.7% | 1 | 1.05s | 7,629 | 237 | 0 | |
| KAT Coder AIR V2.5 | 6.3 | 5.8 | 66.7% | 1 | 2.66s | 7,776 | 280 | 988 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 53.62s | 696 | 38,145 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 8.33s | 780 | 1,399 | 10,258 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 5.0 | 10.0 | 0.0% | 0 | 770ms | 534 | 153 | 0 | |
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 12.02s | 516 | 141 | 515 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 79.50s | 375 | 1,275 | 0 | |
| KAT Coder AIR V2.5 | 9.9 | 10.0 | 100.0% | 0 | 1.75s | 699 | 90 | 768 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 107.60s | 472 | 6,964 | 0 | |
| KAT Coder AIR V2.5 | 2.9 | 4.4 | 22.2% | 2 | 1.84s | 696 | 284 | 971 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 1.39s | 8,331 | 291 | 0 | |
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 5.13s | 8,391 | 330 | 1,230 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 14.60s | 222 | 15 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 17.96s | 204 | 19 | 9,749 |
Comparaison rapide
Changer la paire de comparaison
Trinity Large PreviewdefaultDisponible gratuitementvsGranite 4.2 8BnoneKAT Coder AIR V2.5defaultvsNemotron 3 SupernoneDisponible gratuitementCobuddymediumDisponible gratuitementvsGranite 4.2 8BnoneCobuddymediumDisponible gratuitementvsKAT Coder AIR V2.5defaultMercury 2nonevsKAT Coder AIR V2.5defaultGranite 4.2 8BnonevsRing 2.6 1tdefaultGranite 4.2 8BnonevsLing 2.6 FlashdefaultGranite 4.2 8BnonevsMiniMax M2.5mediumKAT Coder AIR V2.5defaultvsNemotron 3.5 LightninglowDisponible gratuitementKAT Coder AIR V2.5defaultvsMiniMax M2.5mediumKAT Coder AIR V2.5defaultvsLaguna S 2.1lowDisponible gratuitementGranite 4.2 8BnonevsNemotron 3.5 LightninglowDisponible gratuitement