- Rang
- #320
- Total des jetons de sortie
- 57,866
- Temps de réponse (moy.)
- 22.44s
- Coût total
- $0.121
DeepSeek V3.2 vs Granite 4.2 8B (high)
Le score moyen est pratiquement à égalité avec 4.6 vs 4.7. DeepSeek V3.2 a le coût de benchmark le plus bas avec $0.121 vs $0.161. DeepSeek V3.2 est plus rapide avec 22.44s vs 235.35s, avec des taux de réussite de 34.8% vs 37.7%.
Modèles comparés
- Rang
- #318
- Total des jetons de sortie
- 661,367
- Temps de réponse (moy.)
- 235.35s
- Coût total
- $0.161
Modèle recommandé
DeepSeek V3.2
Il obtient le meilleur score ici (4.6) et répond environ 10.5x plus vite que Granite 4.2 8B (high).
Comparaison détaillée
| Métrique | DeepSeek V3.2 DeepSeek V3.2 none | Granite 4.2 8B Granite 4.2 8B high |
|---|---|---|
| Score | 4.6 | 4.7 |
| Rang | #320 | #318 |
| Fiabilité | 10.0 | 8.2 |
| Cohérence | 8.2 | 6.4 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 34.8% | 37.7% |
| Tests instables | 5 | 10 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 1.943 | 2.751 |
| Coût total | $0.121 | $0.161 |
| Prix d'entrée | $0.280 / 1M | $0.060 / 1M |
| Prix de sortie | $0.420 / 1M | $0.250 / 1M |
| Total des jetons d'entrée | 342,158 | 282,658 |
| Jetons de sortie | 57,866 | 198,563 |
| Jetons de raisonnement | 0 | 462,804 |
| Temps de réponse (moy.) | 22.44s | 235.35s |
| Temps de réponse (max) | 122.50s | 685.87s |
| Temps de réponse (total) | 516.03s | 5413.09s |
| Paramètres | 671B au total (37B actifs) | 8B |
| Disponibilité | Open source | Open source |
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#320 DeepSeek V3.2
none- Coût
- $0.002
- Temps
- 7.0s
- Tokens
- 1,046 tok
#318 IBM: Granite 4.2 8B
high
Provider returned error
- Coût
- $0.000
- Temps
- 0.2s
- Tokens
- 0 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 122.50s | 206,327 | 15,767 | 0 | |
| Granite 4.2 8B | 5.0 | 10.0 | 0.0% | 0 | 223.46s | 239,380 | 17,480 | 31,672 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.2 | 8.0 | 8.3% | 1 | 9.35s | 494 | 1,073 | 0 | |
| Granite 4.2 8B | 6.9 | 5.8 | 75.0% | 2 | 205.31s | 507 | 8,350 | 12,250 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.1 | 6.9 | 11.1% | 1 | 14.54s | 7,279 | 4,528 | 0 | |
| Granite 4.2 8B | 3.8 | 4.3 | 33.3% | 2 | 515.34s | 7,047 | 42,438 | 154,749 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 4.8 | 10.0 | 0.0% | 0 | 113.53s | 109,626 | 33,819 | 0 | |
| Granite 4.2 8B | 5.0 | 6.8 | 33.3% | 1 | 570.43s | 18,410 | 16,478 | 60,329 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 6.3 | 5.8 | 66.7% | 1 | 9.42s | 7,890 | 1,710 | 0 | |
| Granite 4.2 8B | 3.8 | 5.8 | 33.3% | 1 | 56.55s | 6,779 | 1,368 | 3,999 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 1.48s | 675 | 23 | 0 | |
| Granite 4.2 8B | 2.9 | 7.2 | 11.1% | 1 | 167.15s | 498 | 81,004 | 122,013 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 4.7 | 1.6 | 66.7% | 1 | 9.32s | 314 | 43 | 0 | |
| Granite 4.2 8B | 5.5 | 10.0 | 0.0% | 0 | 16.37s | 534 | 5,762 | 5,800 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 1.52s | 627 | 66 | 0 | |
| Granite 4.2 8B | 6.4 | 5.8 | 66.7% | 1 | 87.47s | 483 | 2,191 | 13,223 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 7.6 | 7.2 | 77.8% | 1 | 6.91s | 424 | 298 | 0 | |
| Granite 4.2 8B | 2.9 | 4.4 | 22.2% | 2 | 202.69s | 467 | 14,348 | 19,827 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 11.85s | 8,319 | 522 | 0 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 15.08s | 8,331 | 893 | 4,841 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 17.23s | 183 | 17 | 0 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 252.49s | 222 | 8,251 | 34,101 |
Comparaison rapide
Changer la paire de comparaison
Granite 4.2 8BhighvsLaguna S 2.1noneDisponible gratuitementNorth Mini CodenoneDisponible gratuitementvsGranite 4.2 8BhighGranite 4.2 8BhighvsQwen3 Coder NextmediumDeepSeek V3.2nonevsQwen3 Coder NextmediumDeepSeek V3.2nonevsLaguna S 2.1lowDisponible gratuitementGranite 4.2 8BhighvsNemotron 3.5 LightningmediumDisponible gratuitementGranite 4.2 8BhighvsMercury 2.5 PreviewnoneDeepSeek V3.2nonevsNemotron 3.5 LightninglowDisponible gratuitementGranite 4.2 8BhighvsGPT-5.4 NanononeGranite 4.2 8BhighvsLaguna S 2.1lowDisponible gratuitementDeepSeek V3.2nonevsNemotron 3.5 LightningmediumDisponible gratuitementGranite 4.2 8BhighvsNemotron 3.5 LightninglowDisponible gratuitement