Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modèles comparés

Comparaison benchmark Nemotron 3 Super (medium) vs Qwen3.5-122B-A10B (medium) vs Elephant Alpha (medium) vs gpt-oss-120b (medium): Qwen3.5-122B-A10B (medium) mène sur Score avec 7.1. Qwen3.5-122B-A10B (medium) mène sur Fiabilité avec 10.0. Elephant Alpha (medium) a le Coût total le plus bas à $0.000. Elephant Alpha (medium) est le plus rapide à 1.27s.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-09-04

Rang
#217
Total des jetons de sortie
115,574
Temps de réponse (moy.)
52.31s
Coût total
$0.050
Rang
#127
Total des jetons de sortie
487,519
Temps de réponse (moy.)
65.67s
Coût total
$1.207
Rang
#295
Total des jetons de sortie
2,596
Temps de réponse (moy.)
1.27s
Coût total
$0.000
Rang
#189
Total des jetons de sortie
98,282
Temps de réponse (moy.)
20.81s
Coût total
$0.020
Modèle recommandé gpt-oss-120b (medium)

Il offre le meilleur compromis global: score compétitif (6.1), coût inférieur à les autres modèles de cette comparaison et temps de réponse équilibré.

Comparaison détaillée

Métrique Nemotron 3 Super Nemotron 3 Super medium Sortie: 2026-03-11 Disponible gratuitement Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Sortie: 2026-02-24 Elephant Alpha Elephant Alpha medium Sortie: 2026-04-14 gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05
Score 5.7 7.1 4.3 6.1
Rang #217 #127 #295 #189
Fiabilité 9.1 10.0 N/D 10.0
Cohérence 8.9 8.5 9.2 8.0
Tentatives 66/66 66/66 63/66 66/66
Tests corrects
Taux de réussite par tentative 40.9% 71.2% 28.8% 50.0%
Tests instables 3 4 1 5
Exécutions totales 66 66 63 66
Coût par résultat 0.004 8.446 0.000 0.224
Coût total $0.050 $1.207 $0.000 $0.020
Prix d'entrée $0.085 / 1M $0.290 / 1M $0.000 / 1M $0.037 / 1M
Prix de sortie $0.400 / 1M $2.400 / 1M $0.000 / 1M $0.170 / 1M
Total des jetons d'entrée 81,438 124,780 33,744 108,767
Jetons de sortie 17,674 47,694 2,596 29,378
Jetons de raisonnement 97,900 439,825 0 68,904
Temps de réponse (moy.) 52.31s 65.67s 1.27s 20.81s
Temps de réponse (max) 431.98s 519.30s 3.70s 68.16s
Temps de réponse (total) 1046.21s 1444.68s 22.82s 332.88s
Paramètres 120B au total (12B actifs) 122B au total (10B actifs) 104B au total (7.4B actifs) 117B au total (5.1B actifs)
Disponibilité Poids disponibles Open source Open source Open source

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#217 Nemotron 3 Super

medium
Coût
$0.000
Temps
272.6s
Tokens
5,296 tok

#127 Qwen3.5-122B-A10B

medium
Coût
$0.019
Temps
48.7s
Tokens
6,034 tok

#295 Elephant Alpha

medium
Elephant Alpha was a stealth model revealed on April 21st as Ling-2.6-flash. Find it here: https://openrouter.ai/inclusionai/ling-2.6-flash:free
Coût
$0.000
Temps
0.1s
Tokens
0 tok

#189 gpt-oss-120b

medium
Coût
$0.001
Temps
26.7s
Tokens
555 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Nemotron 3 Super 3.1 10.0 0.0% 0 147.32s 2,275 797 4,424
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Elephant Alpha 3.7 7.8 11.1% 1 1.30s 813 365 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

Comparaison rapide

Changer la paire de comparaison