Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5.4

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-03

Métrique Seed-2.0-Lite Seed-2.0-Lite medium Sortie: 2026-02-14 GPT-5.4 GPT-5.4 medium Sortie: 2026-03-05
Score 8.1 7.9
Rang #20 #27
Fiabilité 10.0 10.0
Cohérence 8.9 8.5
Tests corrects
Taux de réussite par tentative 75.0% 75.0%
Tests instables 3 4
Exécutions totales 60 60
Coût par résultat 1.166 8.765
Coût total $0.152 $1.140
Prix d'entrée $0.250 / 1M $2.500 / 1M
Prix de sortie $2.000 / 1M $15.000 / 1M
Total des jetons d'entrée 43,785 31,489
Jetons de sortie 3,224 2,221
Jetons de raisonnement 67,040 68,486
Temps de réponse (moy.) 36.67s 22.31s
Temps de réponse (max) 168.71s 100.41s
Temps de réponse (total) 733.46s 446.17s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 8.3 10.0 75.0% 0 17.99s 942 996 7,142
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 7.0 9.7 50.0% 0 107.65s 5,292 452 20,524
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 16,254 506 4,299
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 8,562 246 1,742
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 843 15 23,897
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 582 304 1,620
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 834 71 1,480
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 9.0 7.9 88.9% 1 10.23s 894 403 3,285
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 9,306 222 1,011
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Lite 3.0 10.0 0.0% 0 48.32s 276 9 2,040
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

Comparaison rapide

Changer la paire de comparaison