Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.3-Codex

Gemini 3.1 Pro Preview (medium) mène au score moyen avec 9.2 vs 8.9. GPT-5.3-Codex (medium) a le coût de benchmark le plus bas avec $0.920 vs $1.361. GPT-5.3-Codex (medium) est plus rapide avec 16.96s vs 21.47s, avec des taux de réussite de 90.9% vs 83.3%.

Modèle recommandéGPT-5.3-Codex (medium)Il offre le meilleur compromis global: score compétitif (8.9), coût inférieur à Gemini 3.1 Pro Preview (medium) et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-07-25

Métrique	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Sortie: 2026-02-19	GPT-5.3-Codex GPT-5.3-Codex medium Sortie: 2026-02-05

Métrique	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Sortie: 2026-02-19	GPT-5.3-Codex GPT-5.3-Codex medium Sortie: 2026-02-05
Score	9.2	8.9
Rang	#10	#18
Fiabilité	10.0	10.0
Cohérence	10.0	8.6
Tests corrects
Taux de réussite par tentative	90.9%	83.3%
Tests instables	0	4
Exécutions totales	66	66
Coût par résultat	6.801	5.748
Coût total	$1.361	$0.920
Prix d'entrée	$2.000 / 1M	$1.750 / 1M
Prix de sortie	$12.000 / 1M	$14.000 / 1M
Total des jetons d'entrée	92,287	81,268
Jetons de sortie	5,232	6,251
Jetons de raisonnement	92,726	49,274
Temps de réponse (moy.)	21.47s	16.96s
Temps de réponse (max)	88.68s	100.93s
Temps de réponse (total)	322.08s	373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium

Coût: $0.115
Temps: 87.2s
Tokens: 9,629 tok

#18 GPT-5.3-Codex

medium

Coût: $0.049
Temps: 54.9s
Tokens: 3,580 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Catégorie:

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	498	112	3,218
GPT-5.3-Codex	8.7	7.9	91.7%	1		4.16s	606	240	1,722

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	7.9	9.9	66.7%	0		40.17s	8,124	435	41,247
GPT-5.3-Codex	10.0	10.0	100.0%	0		19.50s	7,302	535	10,890

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	9.8	10.0	100.0%	0		40.39s	67,910	3,687	23,111
GPT-5.3-Codex	10.0	10.0	100.0%	0		26.04s	57,988	4,258	5,816

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	7,265	279	3,904
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.07s	7,140	234	728

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	635	18	12,424
GPT-5.3-Codex	5.9	7.2	55.6%	1		64.31s	813	64	25,308

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	490	108	1,179
GPT-5.3-Codex	4.6	10.0	0.0%	0		4.87s	477	187	331

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	621	72	2,236
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.04s	660	93	693

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		6.90s	570	235	3,128
GPT-5.3-Codex	9.0	7.9	88.9%	1		5.05s	642	356	1,593

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	6,018	274	982
GPT-5.3-Codex	10.0	10.0	100.0%	0		6.37s	5,445	254	492

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		6.27s	156	12	1,297
GPT-5.3-Codex	2.8	1.6	33.3%	1		14.43s	195	30	1,701

Comparaison rapide

Changer la paire de comparaison

GPT-5.3-CodexmediumvsGrok 4.5high Claude Opus 5highvsGemini 3.1 Pro Previewmedium Gemini 3.5 FlashlowvsGPT-5.3-Codexmedium Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.6 Solhigh Gemini 3.1 Pro PreviewmediumvsGPT-5.6 Sollow Claude Opus 5highvsGPT-5.3-Codexmedium Gemini 3.1 Pro PreviewmediumvsGrok 4.5high Claude Opus 5lowvsGPT-5.3-Codexmedium Gemini 3.6 FlashlowvsGPT-5.3-Codexmedium GPT-5.3-CodexmediumvsGrok 4.5low Gemini 3.5 FlashhighvsGPT-5.3-Codexmedium