AI BENCHY
Advertise here
#208

Laguna M.1

Poolside Lansare: 2026-04-28 Testat la: 2026-05-08 15:31 poolside/laguna-m.1::medium
(medium) (none)

Rezumat

Laguna M.1 obține 4.7 pe AI BENCHY și este pe #208. Are fiabilitate 10.0, rată de reușită 45.5%, cost total $0.033 și timp mediu de răspuns 14.73s.

Ce face Laguna M.1 unic: Se remarcă cel mai mult la Parsare și extragere de date, unde este pe #1, iar Programare este zona cea mai slabă, la #11.

Model arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.

Scor

4.7

Consistență

7.9

Cost total (preț curent)

$0.033 ↕ New

Testat la: $0.000

Total tokenuri de ieșire

58,087

Total tokenuri de intrare

44,969

Preț de intrare

$0.200 / 1M

Preț de ieșire

$0.400 / 1M

Teste corecte

Teste greșite: 10

Rată de trecere pe încercare: 45.5%

Teste instabile

2

Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).

Timp de răspuns (mediu)

14.73s

Timp de răspuns (maxim): 53.14s

Timp de răspuns (total): 220.93s

Istoric prețuri

Date istorice de preț pentru acest model de la OpenRouter.

Dată Preț de intrare Preț de ieșire
2026-06-04 15:40 $0.000 / 1M $0.000 / 1M
2026-06-29 01:00 $0.200 / 1M $0.400 / 1M

Grafice

Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Categorie Scor Consistență Teste corecte
Trucuri anti-AI 6.5 10.0
Programare 1.5 4.0
Combinat 1.5 5.0
Parsare și extragere de date 10.0 10.0
Specific domeniului 5.3 7.2
Inteligență generală 3.0 10.0
Respectarea instrucțiunilor 10.0 10.0
Rezolvare de puzzle-uri 5.3 10.0
Apelare instrumente 10.0 10.0
Cultură generală 3.0 10.0

Modele comparate