Navigation
Advertise here

Seed-2.0-Mini (medium) vs Mistral Large 4 (high)

Le score moyen est pratiquement à égalité avec 7.5 vs 7.5. Seed-2.0-Mini (medium) a le coût de benchmark le plus bas avec $0.140 vs $1.391. Seed-2.0-Mini (medium) est plus rapide avec 91.67s vs 263.69s, avec des taux de réussite de 59.4% vs 65.2%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-10-06

Modèles comparés

Rang
#125
Total des jetons de sortie
271,559
Temps de réponse (moy.)
91.67s
Coût total
$0.140
Rang
#126
Total des jetons de sortie
590,306
Temps de réponse (moy.)
263.69s
Coût total
$1.391
Modèle recommandé Seed-2.0-Mini (medium)

Il obtient le meilleur score ici (7.5) tout en coûtant environ 9.9x moins que Mistral Large 4 (high).

Comparaison détaillée

Métrique Seed-2.0-Mini Seed-2.0-Mini medium Sortie: 2026-02-14 Mistral Large 4 Mistral Large 4 high Sortie: 2026-10-06
Score 7.5 7.5
Rang #125 #126
Fiabilité 9.4 9.0
Cohérence 9.0 7.9
Tentatives 69/69 69/69
Tests corrects
Taux de réussite par tentative 59.4% 65.2%
Tests instables 3 6
Exécutions totales 69 69
Coût par résultat 1.167 11.590
Coût total $0.140 $1.391
Prix d'entrée $0.100 / 1M $0.680 / 1M
Prix de sortie $0.400 / 1M $2.090 / 1M
Prix de lecture du cache N/D $0.070 / 1M
Prix d’écriture du cache N/D N/D
Total des jetons d'entrée 313,368 230,895
Jetons de sortie 12,289 161,281
Jetons de raisonnement 259,270 510,655
Temps de réponse (moy.) 91.67s 263.69s
Temps de réponse (max) 301.78s 1727.29s
Temps de réponse (total) 1833.43s 6064.89s
Paramètres ~50B au total (~5B actifs) 1.05T au total (49B actifs)
Disponibilité Source fermée Source fermée

Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Seed-2.0-Mini

medium
Coût
$0.002
Temps
161.7s
Tokens
4,379 tok

#126 Mistral Large 4

high
Coût
$0.007
Temps
53.3s
Tokens
3,333 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694

Comparaison rapide

Changer la paire de comparaison