Navigation
AI BENCHY
Comparer Graphiques Méthodologie
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs OpenAI: GPT-5.2

Comparer:

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-03-06

Métrique DeepSeek: DeepSeek V3.2 none Sortie: 2025-12-01 OpenAI: GPT-5.2 medium Sortie: 2025-12-11
Rang #33 #27
Score moy. 5.5 6.5
Cohérence 8.4 7.9
Coût par résultat 0.220 3.125
Coût total $0.016 $0.313
Tests corrects
Taux de réussite par tentative 54.2% 75.0%
Tests instables 3 4
Exécutions totales 48 48
Jetons de sortie 7,823 2,220
Jetons de raisonnement 0 16,811
Temps de réponse (moy.) 12.86s 15.33s
Temps de réponse (max) 115.89s 77.80s
Temps de réponse (total) 205.78s 138.01s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score moy. vs Temps de réponse (moy.)

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 10.0 9.7 0.0% 0 8.79s 1,411 0
OpenAI: GPT-5.2 7.0 7.3 77.8% 1 14.34s 549 2,002
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 8.0 10.0 0.0% 0 115.89s 2,887 0
OpenAI: GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 5.4 5.8 66.7% 1 9.42s 1,710 0
OpenAI: GPT-5.2 9.9 10.0 100.0% 0 3.15s 234 420
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 10.0 7.2 22.2% 1 1.61s 24 0
OpenAI: GPT-5.2 4.0 7.2 55.6% 1 77.80s 42 10,342
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 10.0 10.0 100.0% 0 2.86s 67 0
OpenAI: GPT-5.2 10.0 9.7 0.0% 0 4.32s 162 269
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 66 0
OpenAI: GPT-5.2 9.5 10.0 100.0% 0 3.12s 94 614
Puzzle Solving Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 7.7 7.5 88.9% 1 7.37s 1,136 0
OpenAI: GPT-5.2 7.0 7.3 77.8% 1 5.47s 609 938
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
DeepSeek: DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 522 0
OpenAI: GPT-5.2 10.0 1.6 66.7% 1 10.30s 239 469

Comparaison rapide

Changer la paire de comparaison