#106 SpaceXAI: Grok 4.7
xhigh- Coût
- $0.235
- Temps
- 544.2s
- Tokens
- 39,247 tok
Résumé
Grok 4.7 obtient 7.5 sur AI BENCHY et se classe #106. Il affiche une fiabilité de 9.6, un taux de réussite de 77.3%, un coût total de $2.625 et un temps de réponse moyen de 115.74s.
Ce qui rend Grok 4.7 unique : Il se distingue surtout en Astuces anti-IA, où il se classe #3, tandis que Programmation est son point le plus faible avec #16. Il utilise beaucoup plus de tokens de raisonnement que la moyenne, ce qui peut expliquer des runs plus lents ou plus coûteux.
Date de recherche : 2026-09-21
Meilleure estimation fondée sur les informations publiques ; le fournisseur n’a pas communiqué toutes les valeurs.
7.5
Cohérence
7.7
9.6
$2.625
Total des jetons de sortie
505,069
Total des jetons d'entrée
124,896
Prix d'entrée
$1.600 / 1M
Prix de sortie
$4.800 / 1M
Tests instables
6
Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Choisissez d'abord le premier modèle, puis cliquez sur un second modèle pour ouvrir une page côte à côte.
| Catégorie | Score | Cohérence | Tests corrects |
|---|---|---|---|
| Astuces anti-IA | 8.7 | 7.9 | |
| Programmation | 5.3 | 4.5 | |
| Combiné | 10.0 | 10.0 | |
| Analyse et extraction des données | 10.0 | 10.0 | |
| Spécifique au domaine | 3.5 | 4.4 | |
| Intelligence générale | 4.7 | 1.6 | |
| Suivi des instructions | 9.8 | 10.0 | |
| Résolution d'énigmes | 10.0 | 10.0 | |
| Appel d'outils | 10.0 | 10.0 | |
| Culture générale | 3.0 | 10.0 |