Navigation
AI BENCHY
Advertise here

Trinity Large Preview vs Ling 3.0 Tiny (medium)

Trinity Large Preview mène au score moyen avec 4.8 vs 3.8. Ling 3.0 Tiny (medium) a le coût de benchmark le plus bas avec $0.000 vs $0.008. Trinity Large Preview est plus rapide avec 2.98s vs 68.74s, avec des taux de réussite de 21.2% vs 24.2%.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-08-07

Rang
#218
Total des jetons de sortie
2,169
Temps de réponse (moy.)
2.98s
Coût total
$0.008
Rang
#244
Total des jetons de sortie
1,021,580
Temps de réponse (moy.)
68.74s
Coût total
$0.000
Modèle recommandé Trinity Large Preview

Il obtient le meilleur score ici (4.8) et répond environ 23.1x plus vite que Ling 3.0 Tiny (medium).

Comparaison détaillée

Métrique Trinity Large Preview Trinity Large Preview none Sortie: 2026-01-27 Ling 3.0 Tiny Ling 3.0 Tiny medium Sortie: 2026-08-07 Disponible gratuitement
Score 4.8 3.8
Rang #218 #244
Fiabilité 10.0 9.7
Cohérence 8.9 8.9
Couverture du benchmark 21/22 tests · 63/66 tentatives 22/22 tests · 66/66 tentatives
Tests corrects
Taux de réussite par tentative 21.2% 24.2%
Tests instables 2 3
Exécutions totales 63 66
Coût par résultat 0.017 0.000
Coût total $0.008 $0.000
Prix d'entrée $0.243 / 1M $0.000 / 1M
Prix de sortie $0.243 / 1M $0.000 / 1M
Total des jetons d'entrée 29,828 104,078
Jetons de sortie 2,169 153,908
Jetons de raisonnement 0 867,672
Temps de réponse (moy.) 2.98s 68.74s
Temps de réponse (max) 14.34s 262.20s
Temps de réponse (total) 56.57s 1512.22s

Génération showcase de modèles

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#218 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
Coût
$0.000
Temps
0.0s
Tokens
0 tok

#244 Ling 3.0 Tiny

medium
SVG invalide
Coût
$0.000
Temps
177.4s
Tokens
6,873 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006

Comparaison rapide

Changer la paire de comparaison

Ling 3.0 TinymediumDisponible gratuitementvsgpt-oss-120bnoneDisponible gratuitementTrinity Large PreviewnonevsQwen3 Coder NextmediumTrinity Large PreviewnonevsCobuddymediumTrinity Large PreviewnonevsMiniMax M2.5mediumGranite 4.1 8BnonevsLing 3.0 TinymediumDisponible gratuitementTrinity Large PreviewnonevsLaguna S 2.1lowDisponible gratuitementTrinity Large PreviewnonevsMiniMax M2.7mediumLing 3.0 TinymediumDisponible gratuitementvsGrok 4.20noneTrinity Large PreviewnonevsMistral Small 4mediumTrinity Large PreviewnonevsGLM 4.7 FlashmediumTrinity Large PreviewnonevsLaguna S 2.1highDisponible gratuitementTrinity Large PreviewnonevsKAT-Coder-Air V2.5low