Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Laguna XS 2.1 (medium) vs Qwen3.5-27B

Qwen3.5-27B mène au score moyen avec 6.6 vs 6.5. Qwen3.5-27B a le coût de benchmark le plus bas avec $0.058 vs $0.068. Qwen3.5-27B est plus rapide avec 4.77s vs 48.18s, avec des taux de réussite de 45.5% vs 45.5%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-08-29

Rang
#155
Total des jetons de sortie
522,480
Temps de réponse (moy.)
48.18s
Coût total
$0.068
Rang
#148
Total des jetons de sortie
24,323
Temps de réponse (moy.)
4.77s
Coût total
$0.058
Modèle recommandé Qwen3.5-27B

Il obtient le meilleur score ici (6.6) et répond environ 10.1x plus vite que Laguna XS 2.1 (medium).

Comparaison détaillée

Métrique Laguna XS 2.1 Laguna XS 2.1 medium Sortie: 2026-07-02 Disponible gratuitement Qwen3.5-27B Qwen3.5-27B none Sortie: 2026-02-24
Score 6.5 6.6
Rang #155 #148
Fiabilité 10.0 10.0
Cohérence 9.2 9.3
Tentatives 66/66 66/66
Tests corrects
Taux de réussite par tentative 45.5% 45.5%
Tests instables 2 2
Exécutions totales 66 66
Coût par résultat 0.745 0.678
Coût total $0.068 $0.058
Prix d'entrée $0.060 / 1M $0.195 / 1M
Prix de sortie $0.120 / 1M $1.560 / 1M
Total des jetons d'entrée 118,998 102,325
Jetons de sortie 30,750 24,323
Jetons de raisonnement 491,730 0
Temps de réponse (moy.) 48.18s 4.77s
Temps de réponse (max) 422.72s 69.46s
Temps de réponse (total) 1059.93s 105.00s
Paramètres 33B au total (3B actifs) 27B
Disponibilité Poids disponibles Open source

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 Laguna XS 2.1

medium
Coût
$0.001
Temps
30.6s
Tokens
4,678 tok

#148 Qwen3.5-27B

none
Coût
$0.007
Temps
42.9s
Tokens
4,273 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

Comparaison rapide

Changer la paire de comparaison