Navigation
Advertise here

GPT-6 Luna vs Qwen3.5-122B-A10B

Qwen3.5-122B-A10B mène au score moyen avec 5.7 vs 5.6. GPT-6 Luna a le coût de benchmark le plus bas avec $0.012 vs $0.247. Qwen3.5-122B-A10B est plus rapide avec 12.93s vs 19.08s, avec des taux de réussite de 42.4% vs 33.3%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-09-23

Modèles comparés

Rang
#260
Total des jetons de sortie
5,508
Temps de réponse (moy.)
19.08s
Coût total
$0.012
Rang
#255
Total des jetons de sortie
88,459
Temps de réponse (moy.)
12.93s
Coût total
$0.247
Modèle recommandé GPT-6 Luna

Son score reste proche du meilleur score ici (5.6 vs 5.7) tout en coûtant environ 21.5x moins que Qwen3.5-122B-A10B.

Comparaison détaillée

Métrique GPT-6 Luna GPT-6 Luna none Sortie: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Sortie: 2026-02-24
Score 5.6 5.7
Rang #260 #255
Fiabilité 9.9 10.0
Cohérence 8.1 9.3
Tentatives 66/66 66/66
Tests corrects
Taux de réussite par tentative 42.4% 33.3%
Tests instables 5 2
Exécutions totales 66 66
Coût par résultat 0.164 4.182
Coût total $0.012 $0.247
Prix d'entrée $0.100 / 1M $0.260 / 1M
Prix de sortie $0.500 / 1M $2.080 / 1M
Total des jetons d'entrée 87,216 241,575
Jetons de sortie 5,508 88,459
Jetons de raisonnement 0 0
Temps de réponse (moy.) 19.08s 12.93s
Temps de réponse (max) 98.62s 212.63s
Temps de réponse (total) 419.83s 284.39s
Paramètres ~400B au total (~17B actifs) 122B au total (10B actifs)
Disponibilité Source fermée Open source

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#260 GPT-6 Luna

none
Coût
$0.002
Temps
26.0s
Tokens
3,235 tok

#255 Qwen3.5-122B-A10B

none
Coût
$0.016
Temps
44.5s
Tokens
6,431 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

Comparaison rapide

Changer la paire de comparaison