Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.3 Chat

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-16

Métrique Gemini 2.5 Flash Gemini 2.5 Flash medium Sortie: 2025-06-17 GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03
Score 8.2 7.7
Rang #15 #35
Cohérence 9.5 8.6
Tests corrects
Taux de réussite par tentative 75.9% 68.5%
Tests instables 1 3
Exécutions totales 54 54
Coût par résultat 2.454 3.082
Coût total $0.319 $0.340
Prix d'entrée $0.300 / 1M $1.750 / 1M
Prix de sortie $2.500 / 1M $14.000 / 1M
Jetons de sortie 1,898 20,784
Jetons de raisonnement 122,273 0
Temps de réponse (moy.) 12.12s 5.88s
Temps de réponse (max) 95.48s 18.33s
Temps de réponse (total) 218.12s 105.90s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 10.0 10.0 100.0% 0 16.23s 522 10,350
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0

Comparaison rapide

Changer la paire de comparaison