Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs HY3 Preview

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-23

Metrică Claude Sonnet 4.6 Claude Sonnet 4.6 medium Lansare: 2026-02-17 HY3 Preview HY3 Preview low Lansare: 2026-04-22 Disponibil gratuit
Scor 8.0 8.1
Rang #30 #22
Consistență 9.5 9.5
Teste corecte
Rată de trecere pe încercare 74.1% 75.9%
Teste instabile 1 1
Rulări totale 54 50
Cost per rezultat 8.930 0.000
Cost total $1.161 $0.000
Preț de intrare $3.000 / 1M $0.000 / 1M
Preț de ieșire $15.000 / 1M $0.000 / 1M
Tokenuri de ieșire 42,068 65,778
Tokenuri de raționament 26,784 0
Timp de răspuns (mediu) 12.66s 23.98s
Timp de răspuns (maxim) 46.35s 78.74s
Timp de răspuns (total) 126.62s 407.72s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
HY3 Preview 10.0 10.0 100.0% 0 16.61s 7,905 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
HY3 Preview 10.0 10.0 100.0% 0 27.94s 7,907 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
HY3 Preview 10.0 10.0 100.0% 0 78.74s 12,975 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
HY3 Preview 6.5 10.0 50.0% 0 5.85s 1,022 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
HY3 Preview 5.9 7.2 55.6% 1 40.44s 23,121 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
HY3 Preview 10.0 10.0 100.0% 0 16.44s 2,185 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
HY3 Preview 10.0 10.0 100.0% 0 15.98s 2,475 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
HY3 Preview 5.3 10.0 33.3% 0 13.73s 6,985 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
HY3 Preview 10.0 10.0 100.0% 0 17.84s 1,203 0

Comparație rapidă

Schimbă perechea de comparație