AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Google: Gemini 3.1 Flash Lite

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-05-28

Métrique	Claude Opus 4.8 Claude Opus 4.8 none Sortie: 2026-05-28	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Sortie: 2026-05-08

Métrique	Claude Opus 4.8 Claude Opus 4.8 none Sortie: 2026-05-28	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Sortie: 2026-05-08
Score	7.3	7.4
Rang	#63	#54
Fiabilité	10.0	10.0
Cohérence	9.2	9.2
Tests corrects
Taux de réussite par tentative	65.0%	65.0%
Tests instables	2	2
Exécutions totales	60	60
Coût par résultat	4.324	0.217
Coût total	$0.519	$0.026
Prix d'entrée	$5.000 / 1M	$0.250 / 1M
Prix de sortie	$25.000 / 1M	$1.500 / 1M
Jetons de sortie	8,098	2,726
Jetons de raisonnement	0	8,951
Temps de réponse (moy.)	3.51s	1.92s
Temps de réponse (max)	17.73s	5.66s
Temps de réponse (total)	70.19s	38.45s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	6.5	10.0	50.0%	0		3.40s	1,472	0
Gemini 3.1 Flash Lite	7.3	6.2	75.0%	2		1.84s	1,013	1,548

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	6.8	10.0	50.0%	0		3.59s	1,323	0
Gemini 3.1 Flash Lite	6.8	10.0	50.0%	0		1.71s	465	763

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	9.5	10.0	100.0%	0		17.73s	3,259	0
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		4.48s	348	975

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	7.3	5.8	83.3%	1		1.77s	308	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.44s	291	697

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	5.3	7.2	44.4%	1		1.66s	61	0
Gemini 3.1 Flash Lite	5.3	10.0	33.3%	0		1.52s	15	1,214

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	10.0	10.0	100.0%	0		3.48s	230	0
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		1.37s	69	438

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	9.9	10.0	100.0%	0		1.37s	95	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.52s	72	760

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	7.7	10.0	66.7%	0		2.74s	783	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.40s	210	1,191

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	10.0	10.0	100.0%	0		5.35s	355	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		5.66s	234	945

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	3.0	10.0	0.0%	0		3.41s	212	0
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		1.46s	9	420

Comparaison rapide

Changer la paire de comparaison

Gemini 3.1 Flash LitelowvsGLM 5.1medium Gemini 3.1 Flash LitelowvsGPT-5.3 Chatnone Claude Opus 4.8nonevsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash LitelowvsMiMo-V2.5medium Gemini 3.1 Flash LitelowvsKimi K2.6mediumDisponible gratuitement Claude Opus 4.8nonevsRing-2.6-1Tmedium Claude Opus 4.8nonevsGPT-5.4 Minimedium Gemini 3.1 Flash LitelowvsStep 3.5 Flashmedium Claude Opus 4.8nonevsGPT-5.2medium Gemini 3.1 Flash LitelowvsGLM 5V Turbomedium Claude Opus 4.8nonevsGLM 5V Turbomedium Claude Opus 4.8nonevsGPT-5.4 Nanomedium