Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.3 Chat

Claude Opus 4.6 (medium) mène au score moyen avec 7.7 vs 7.5. GPT-5.3 Chat a le coût de benchmark le plus bas avec $0.571 vs $3.059. GPT-5.3 Chat est plus rapide avec 6.88s vs 34.27s, avec des taux de réussite de 63.6% vs 68.2%.

Modèle recommandéGPT-5.3 ChatSon score reste proche du meilleur score ici (7.5 vs 7.7) tout en coûtant environ 5.4x moins que Claude Opus 4.6 (medium).

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-07-25

Métrique	Claude Opus 4.6 Claude Opus 4.6 medium Sortie: 2026-02-05	GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03

Métrique	Claude Opus 4.6 Claude Opus 4.6 medium Sortie: 2026-02-05	GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03
Score	7.7	7.5
Rang	#50	#62
Fiabilité	10.0	10.0
Cohérence	8.8	8.2
Tests corrects
Taux de réussite par tentative	63.6%	68.2%
Tests instables	3	5
Exécutions totales	66	66
Coût par résultat	23.524	4.387
Coût total	$3.059	$0.571
Prix d'entrée	$5.000 / 1M	$1.750 / 1M
Prix de sortie	$25.000 / 1M	$14.000 / 1M
Total des jetons d'entrée	108,615	78,990
Jetons de sortie	72,286	30,854
Jetons de raisonnement	28,315	0
Temps de réponse (moy.)	34.27s	6.88s
Temps de réponse (max)	151.51s	18.33s
Temps de réponse (total)	513.99s	151.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Claude Opus 4.6

medium

SVG invalide

Coût: $0.000
Temps: 300.0s
Tokens: 0 tok

#62 GPT-5.3 Chat

none

Coût: $0.008
Temps: 8.1s
Tokens: 634 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Catégorie:

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	6.4	5.8	66.7%	2		7.45s	840	986	1,071
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	5.7	7.1	44.4%	1		30.10s	8,522	13,057	4,121
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	10.0	10.0	100.0%	0		114.08s	76,073	33,018	9,509
GPT-5.3 Chat	10.0	10.0	100.0%	0		15.07s	55,800	6,851	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	10.0	10.0	100.0%	0		7.37s	8,676	691	757
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	3.0	10.0	0.0%	0		83.40s	674	14,642	8,687
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	10.0	10.0	100.0%	0		5.04s	564	188	292
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	10.0	10.0	100.0%	0		2.43s	792	266	467
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	7.7	10.0	66.7%	0		4.71s	816	532	630
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	10.0	10.0	100.0%	0		9.73s	11,454	861	329
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.6	3.0	10.0	0.0%	0		63.24s	204	8,045	2,452
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0

Comparaison rapide

Changer la paire de comparaison

Claude Opus 4.6mediumvsGPT-5.6 Lunahigh Kimi K2.7 CodemediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.6mediumvsDeepSeek V4 Flashhigh Nemotron 3 UltramediumDisponible gratuitementvsGPT-5.3 Chatnone Claude Opus 4.6mediumvsDeepSeek V4 Prohigh GPT-5.3 ChatnonevsQwen3.5-27Bmedium GPT-5.3 ChatnonevsGrok Build 0.1medium LongCat 2.0mediumvsGPT-5.3 Chatnone MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3 Flash PreviewlowvsGPT-5.3 Chatnone KAT-Coder-Pro V2.5lowvsGPT-5.3 Chatnone