Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Modèles comparés

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-03-21

Métrique GPT-5.4 Nano GPT-5.4 Nano medium Sortie: 2026-03-17 GPT-5.4 Mini GPT-5.4 Mini medium Sortie: 2026-03-17 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Sortie: 2026-03-03 Gemini 3 Flash Preview Gemini 3 Flash Preview medium Sortie: 2025-12-17
Score 7.4 7.1 8.1 10.0
Rang #30 #36 #14 #1
Cohérence 9.0 7.2 10.0 10.0
Tests corrects
Taux de réussite par tentative 66.7% 68.6% 70.6% 100.0%
Tests instables 2 6 0 0
Exécutions totales 51 51 51 51
Coût par résultat 0.769 3.610 0.413 0.972
Coût total $0.077 $0.289 $0.050 $0.166
Prix d'entrée $0.200 / 1M $0.750 / 1M $0.250 / 1M $0.500 / 1M
Prix de sortie $1.250 / 1M $4.500 / 1M $1.500 / 1M $3.000 / 1M
Jetons de sortie 2,474 1,708 1,737 1,640
Jetons de raisonnement 54,516 58,019 26,346 48,270
Temps de réponse (moy.) 11.08s 15.66s 3.70s 11.39s
Temps de réponse (max) 94.06s 102.91s 14.93s 50.16s
Temps de réponse (total) 188.39s 266.14s 62.97s 113.86s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Gemini 3.1 Flash Lite Preview 9.1 10.0 75.0% 0 2.33s 570 4,305
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.13s 305 3,490
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 14.93s 327 7,347
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.29s 279 2,952
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.72s 279 5,333
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 4.21s 18 5,325
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.16s 96 1,488
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.91s 72 2,121
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Puzzle Solving Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 4.0 7.1 22.2% 1 3.65s 640 1,356
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
Gemini 3.1 Flash Lite Preview 7.7 10.0 66.7% 0 3.58s 141 1,896
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.80s 234 912
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130

Comparaison rapide

Changer la paire de comparaison