Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Code — high vs medium

Le score moyen est pratiquement à égalité avec 6.9 vs 6.9. medium a le coût de benchmark le plus bas avec $1.049 vs $1.312. medium est plus rapide avec 93.60s vs 127.79s, avec des taux de réussite de 71.2% vs 71.2%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-08-12

Rang
#123
Total des jetons de sortie
423,424
Temps de réponse (moy.)
127.79s
Coût total
$1.312
Rang
#124
Total des jetons de sortie
336,696
Temps de réponse (moy.)
93.60s
Coût total
$1.049
Modèle recommandé medium

Il obtient le meilleur score de cette comparaison (6.9) et le meilleur équilibre global entre coût et temps de réponse sur les 2 modèles.

Comparaison détaillée

Métrique Seed-2.0-Code Seed-2.0-Code high Sortie: 2026-08-12 Seed-2.0-Code Seed-2.0-Code medium Sortie: 2026-08-12
Score 6.9 6.9
Rang #123 #124
Fiabilité 6.0 4.7
Cohérence 7.0 6.7
Tentatives 66/66 66/66
Tests corrects
Taux de réussite par tentative 71.2% 71.2%
Tests instables 8 9
Exécutions totales 66 66
Coût par résultat 11.921 10.482
Coût total $1.312 $1.049
Prix d'entrée $0.500 / 1M $0.500 / 1M
Prix de sortie $3.000 / 1M $3.000 / 1M
Total des jetons d'entrée 81,961 76,027
Jetons de sortie 7,187 7,268
Jetons de raisonnement 416,237 329,428
Temps de réponse (moy.) 127.79s 93.60s
Temps de réponse (max) 675.30s 626.58s
Temps de réponse (total) 2811.27s 2059.27s
Paramètres ~200B au total (~20B actifs) ~200B au total (~20B actifs)
Disponibilité Source fermée Source fermée

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 Seed-2.0-Code

high
Coût
$0.037
Temps
183.6s
Tokens
12,388 tok

#124 Seed-2.0-Code

medium
Coût
$0.026
Temps
122.8s
Tokens
8,630 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Code 5.9 4.4 66.7% 2 266.74s 6,750 432 124,956
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062

Comparaison rapide

Changer la paire de comparaison