Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.3 Chat

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-05-22

Métrique Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Sortie: 2026-03-03 GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03
Score 7.6 7.4
Rang #41 #52
Fiabilité 10.0 10.0
Cohérence 10.0 8.4
Tests corrects
Taux de réussite par tentative 65.0% 68.3%
Tests instables 0 4
Exécutions totales 60 60
Coût par résultat 0.186 3.342
Coût total $0.025 $0.401
Prix d'entrée $0.250 / 1M $1.750 / 1M
Prix de sortie $1.500 / 1M $14.000 / 1M
Jetons de sortie 2,280 24,689
Jetons de raisonnement 8,829 0
Temps de réponse (moy.) 3.01s 6.10s
Temps de réponse (max) 11.91s 18.33s
Temps de réponse (total) 60.27s 121.99s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 6.8 10.0 50.0% 0 1.56s 654 723
GPT-5.3 Chat 6.9 6.2 66.7% 1 10.52s 4,772 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.29s 1,455 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 1.35s 9 420
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 569 0

Comparaison rapide

Changer la paire de comparaison