Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Trinity Large Preview vs DeepSeek: DeepSeek V3.2

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-03

Metrică Trinity Large Preview Trinity Large Preview none Lansare: 2026-01-27 DeepSeek V3.2 DeepSeek V3.2 none Lansare: 2025-12-01
Scor 4.7 5.4
Rang #148 #130
Fiabilitate 10.0 10.0
Consistență 9.3 7.5
Teste corecte
Rată de trecere pe încercare 23.3% 41.7%
Teste instabile 2 6
Rulări totale 60 60
Cost per rezultat 0.017 0.296
Cost total $0.008 $0.017
Preț de intrare $0.243 / 1M $0.229 / 1M
Preț de ieșire $0.243 / 1M $0.344 / 1M
Total tokenuri de intrare 29,828 53,408
Tokenuri de ieșire 2,169 11,159
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 2.98s 14.43s
Timp de răspuns (maxim) 14.34s 115.89s
Timp de răspuns (total) 56.57s 288.55s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
DeepSeek V3.2 3.2 8.0 8.3% 1 9.35s 494 1,073 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
DeepSeek V3.2 3.1 5.4 16.7% 1 20.87s 4,690 4,522 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 29,843 2,887 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 7,890 1,710 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
DeepSeek V3.2 2.9 7.2 11.1% 1 4.17s 624 21 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
DeepSeek V3.2 4.7 1.6 66.7% 1 9.32s 314 43 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 627 66 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
DeepSeek V3.2 7.6 7.2 77.8% 1 6.91s 424 298 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 8,319 522 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
DeepSeek V3.2 3.0 10.0 0.0% 0 17.23s 183 17 0

Comparație rapidă

Schimbă perechea de comparație