Navigare
AI BENCHY
Advertise here

OpenAI: GPT-5.4 Nano vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) conduce la scorul mediu cu 5.0 vs 4.8. GPT-5.4 Nano are costul de benchmark mai mic, $0.041 vs $0.091. GPT-5.4 Nano este mai rapid cu 2.57s vs 85.35s, cu rate de reușită de 28.8% vs 25.8%.

Model recomandatGPT-5.4 NanoScorul rămâne aproape de cel mai bun scor de aici (4.8 vs 5.0) și costă de aproximativ 2.2x mai puțin decât Laguna S 2.1 (low).

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-22

Metrică GPT-5.4 Nano GPT-5.4 Nano none Lansare: 2026-03-17 Laguna S 2.1 Laguna S 2.1 low Lansare: 2026-07-21 Disponibil gratuit
Scor 4.8 5.0
Rang #189 #181
Fiabilitate 10.0 9.9
Consistență 8.2 7.8
Teste corecte
Rată de trecere pe încercare 28.8% 25.8%
Teste instabile 5 6
Rulări totale 66 66
Cost per rezultat 1.011 3.022
Cost total $0.041 $0.091
Preț de intrare $0.200 / 1M $0.100 / 1M
Preț de ieșire $1.250 / 1M $0.200 / 1M
Total tokenuri de intrare 115,924 118,746
Tokenuri de ieșire 13,794 67,823
Tokenuri de raționament 0 383,885
Timp de răspuns (mediu) 2.57s 85.35s
Timp de răspuns (maxim) 25.50s 814.73s
Timp de răspuns (total) 56.51s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#189 GPT-5.4 Nano

none
Cost
$0.008
Timp
46.1s
Tokenuri
5,735 tok

#181 Laguna S 2.1

low
Cost
$0.001
Timp
6.6s
Tokenuri
1,314 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

Comparație rapidă

Schimbă perechea de comparație