Urambazaji
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs xAI: Grok 4.20

Laguna S 2.1 (low) inaongoza kwa average score: 5.0 vs 4.1. Grok 4.20 ina gharama ya chini ya benchmark: $0.057 vs $0.091. Grok 4.20 ni ya haraka zaidi: 1.11s vs 85.35s, na pass rates 25.8% vs 27.3%.

Muundo unaopendekezwaLaguna S 2.1 (low)It has the strongest score in this comparison (5.0) and the best overall balance of cost and response time across all 2 models.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-25

Kipimo Laguna S 2.1 Laguna S 2.1 low Toleo: 2026-07-21 Inapatikana bure Grok 4.20 Grok 4.20 none Toleo: 2026-03-31
Alama 5.0 4.1
Nafasi #187 #213
Uaminifu 9.9 Haipo
Uthabiti 7.8 8.1
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 25.8% 27.3%
Majaribio yasiyo thabiti 6 0
Jumla ya uendeshaji 66 54
Gharama kwa matokeo 3.022 1.570
Jumla ya gharama $0.091 $0.057
Bei ya ingizo $0.100 / 1M $1.250 / 1M
Bei ya toleo $0.200 / 1M $2.500 / 1M
Jumla ya tokeni za ingizo 118,746 41,313
Tokeni za matokeo 67,823 1,923
Tokeni za hoja 383,885 0
Muda wa majibu (wastani) 85.35s 1.11s
Muda wa majibu (upeo) 814.73s 6.04s
Muda wa majibu (jumla) 1877.64s 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Laguna S 2.1

low
Gharama
$0.001
Muda
6.6s
Tokeni
1,314 tok

#213 xAI: Grok 4.20

none
Gharama
$0.004
Muda
6.5s
Tokeni
1,367 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho