AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Grok 4.20 Beta

Résumé

Comparaison benchmark Nemotron 3 Ultra 550b A55b vs Grok 4.20 Beta : Grok 4.20 Beta mène au score moyen avec 8.5 vs 7.5. Nemotron 3 Ultra 550b A55b a le coût de benchmark le plus bas avec $0.177 vs $0.750. Grok 4.20 Beta est plus rapide avec 9.75s vs 15.05s, avec des taux de réussite de 69.8% vs 81.5%.

Modèle recommandé: Nemotron 3 Ultra 550b A55b - Il offre le meilleur compromis global: score compétitif (7.5), coût inférieur à Grok 4.20 Beta et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-10

Métrique	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Sortie: 2026-06-04 Disponible gratuitement	Grok 4.20 Beta Grok 4.20 Beta medium Sortie: 2026-03-12

Métrique	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Sortie: 2026-06-04 Disponible gratuitement	Grok 4.20 Beta Grok 4.20 Beta medium Sortie: 2026-03-12
Score	7.5	8.5
Rang	#42	#14
Fiabilité	9.7	N/D
Cohérence	8.8	9.5
Tests corrects
Taux de réussite par tentative	69.8%	81.5%
Tests instables	3	1
Exécutions totales	63	52
Coût par résultat	0.000	4.505
Coût total	$0.177	$0.750
Prix d'entrée	$0.500 / 1M	$5.805 / 1M
Prix de sortie	$2.500 / 1M	$5.805 / 1M
Total des jetons d'entrée	46,813	35,955
Jetons de sortie	18,002	1,647
Jetons de raisonnement	53,091	91,565
Temps de réponse (moy.)	15.05s	9.75s
Temps de réponse (max)	43.93s	31.36s
Temps de réponse (total)	316.09s	175.48s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Nemotron 3 Ultra 550b A55b

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#14 Grok 4.20 Beta

medium

Cost: $0.034
Time: 91.0s
Tokens: 13,523 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Grok 4.20 Beta	8.7	7.9	91.7%	1		3.16s	2,010	268	7,583

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Grok 4.20 Beta	10.0	10.0	100.0%	0		31.36s	360	81	3,987

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Grok 4.20 Beta	10.0	10.0	100.0%	0		20.93s	12,909	227	12,212

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Grok 4.20 Beta	10.0	10.0	100.0%	0		4.01s	7,761	180	5,281

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Grok 4.20 Beta	5.3	10.0	33.3%	0		21.33s	1,764	251	40,255

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Grok 4.20 Beta	10.0	10.0	100.0%	0		5.78s	825	72	3,440

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Grok 4.20 Beta	9.8	10.0	100.0%	0		4.89s	1,362	57	7,123

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Grok 4.20 Beta	10.0	10.0	100.0%	0		3.52s	1,689	328	6,300

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Grok 4.20 Beta	3.0	10.0	0.0%	0		12.39s	7,275	183	5,384

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Grok 4.20 Beta	-	-	-	-	-	-	-	-	-

Comparaison rapide

Changer la paire de comparaison