Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs StepFun: Step 3.7 Flash

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Sortie: 2026-02-19 Step 3.7 Flash Step 3.7 Flash high Sortie: 2026-05-29
Score 9.4 7.0
Rang #4 #71
Fiabilité 10.0 10.0
Cohérence 10.0 8.2
Tests corrects
Taux de réussite par tentative 90.5% 63.5%
Tests instables 0 4
Exécutions totales 63 63
Coût par résultat 5.546 10.434
Coût total $1.054 $1.148
Prix d'entrée $2.000 / 1M $0.200 / 1M
Prix de sortie $12.000 / 1M $1.150 / 1M
Total des jetons d'entrée 41,617 38,391
Jetons de sortie 1,977 991,355
Jetons de raisonnement 78,896 0
Temps de réponse (moy.) 20.14s 64.46s
Temps de réponse (max) 88.68s 364.99s
Temps de réponse (total) 281.92s 1353.57s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 498 112 3,218
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 17,240 432 9,281
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 7,265 279 3,904
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 635 18 12,424
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 490 108 1,179
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 621 72 2,236
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.90s 570 235 3,128
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 6,018 274 982
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.27s 156 12 1,297
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

Comparaison rapide

Changer la paire de comparaison