AI BENCHY
Advertise here
#48

Claude Fable 5.1

Anthropic Lansare: 2026-09-02 Testat la: 2026-09-02 02:04 anthropic/claude-fable-5.1::medium
~9.5T în total (~878B activi)MoEÎnchisEstimat
(high) (medium) (low)

Rezumat

Claude Fable 5.1 obține 8.3 pe AI BENCHY și este pe #48. Are fiabilitate 10.0, rată de reușită 81.8%, cost total $2.909 și timp mediu de răspuns 11.67s.

Ce face Claude Fable 5.1 unic: Se remarcă cel mai mult la Specific domeniului, unde este pe #1, iar Programare este zona cea mai slabă, la #17. Este vizibil rapid față de modele similare.

Date despre model

Documentat la 2026-09-02

Estimat
Parametri
~9.5T în total (~878B activi)
Arhitectură
MoE
Disponibilitate
Închis
Licență
-

Cea mai bună estimare bazată pe informații publice; furnizorul nu a dezvăluit toate valorile.

Scor

8.3

Consistență

7.8

Total tokenuri de ieșire

31,152

Total tokenuri de intrare

135,112

Preț de intrare

$10.000 / 1M

Preț de ieșire

$50.000 / 1M

Teste corecte

Teste greșite: 7

Rată de trecere pe încercare: 81.8%

Teste instabile

6

Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).

Timp de răspuns (mediu)

11.67s

Timp de răspuns (maxim): 36.59s

Timp de răspuns (total): 256.73s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Claude Fable 5.1

medium
Cost
$0.244
Timp
65.9s
Tokenuri
5,025 tok

Grafice

Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Comparație rapidă

Defalcare pe categorii

Categorie Scor Consistență Teste corecte
Trucuri anti-AI 8.2 7.9
Programare 7.0 5.0
Combinat 10.0 10.0
Parsare și extragere de date 10.0 10.0
Specific domeniului 7.7 10.0
Inteligență generală 10.0 10.0
Respectarea instrucțiunilor 7.3 5.8
Rezolvare de puzzle-uri 7.6 7.2
Apelare instrumente 10.0 10.0
Cultură generală 2.8 1.6

Modele comparate