AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#328

Jev 1.13

Typesafe Lansare: 2026-09-18 Testat la: 2026-09-18 02:12 typesafe/jev-1.13::none
-AltulÎnchis

Rezumat

Jev 1.13 obține 3.2 pe AI BENCHY și este pe #328. Are fiabilitate 10.0, rată de reușită 27.3%, cost total $0.003 și timp mediu de răspuns 698ms.

Ce face Jev 1.13 unic: Se remarcă cel mai mult la Specific domeniului, unde este pe #5, iar Trucuri anti-AI este zona cea mai slabă, la #25. Costul total al benchmarkului este neobișnuit de mic pentru acest nivel de scor. Este vizibil rapid față de modele similare.

Date despre model

Documentat la 2026-09-18

Parametri
-
Arhitectură
Altul
Disponibilitate
Închis
Licență
-

Scor

3.2

Consistență

5.5

Total tokenuri de ieșire

18,927

Total tokenuri de intrare

67,092

Preț de intrare

$0.042 / 1M

Preț de ieșire

$0.000 / 1M

Teste corecte

Teste greșite: 6

Rată de trecere pe încercare: 27.3%

Acoperire benchmark: 36/66 încercări. Adaptoarele oferă variantele de răspuns. Acceptă 12/22 teste. Celelalte teste sunt incompatibile, nu eșuate. Scorul folosește suita completă.

Teste instabile

0

Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).

Timp de răspuns (mediu)

698ms

Timp de răspuns (maxim): 1.08s

Timp de răspuns (total): 8.38s

Grafice

Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Comparație rapidă

Defalcare pe categorii

Categorie Scor Consistență Teste corecte
Trucuri anti-AI 4.0 7.5
Programare 2.2 6.7
Combinat 0.0 0.0
Parsare și extragere de date 10.0 10.0
Specific domeniului 7.7 10.0
Inteligență generală 0.0 0.0
Respectarea instrucțiunilor 1.5 5.0
Rezolvare de puzzle-uri 3.3 3.3
Apelare instrumente 0.0 0.0
Cultură generală 0.0 0.0

Modele comparate