Urambazaji
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.8 vs OpenAI: GPT-5.4

Claude Opus 4.8 (medium) inaongoza kwa average score: 8.8 vs 8.5. GPT-5.4 (medium) ina gharama ya chini ya benchmark: $1.533 vs $1.931. Claude Opus 4.8 (medium) ni ya haraka zaidi: 12.49s vs 23.10s, na pass rates 84.9% vs 77.3%.

Muundo unaopendekezwaClaude Opus 4.8 (medium)It has the best score here (8.8), while responding about 1.9x faster than GPT-5.4 (medium).

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-22

Kipimo Claude Opus 4.8 Claude Opus 4.8 medium Toleo: 2026-05-28 GPT-5.4 GPT-5.4 medium Toleo: 2026-03-05
Alama 8.8 8.5
Nafasi #17 #21
Uaminifu 10.0 10.0
Uthabiti 9.6 8.6
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 84.9% 77.3%
Majaribio yasiyo thabiti 1 4
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 10.724 10.220
Jumla ya gharama $1.931 $1.533
Bei ya ingizo $5.000 / 1M $2.500 / 1M
Bei ya toleo $25.000 / 1M $15.000 / 1M
Jumla ya tokeni za ingizo 138,451 81,127
Tokeni za matokeo 40,766 6,155
Tokeni za hoja 9,075 82,515
Muda wa majibu (wastani) 12.49s 23.10s
Muda wa majibu (upeo) 70.54s 100.41s
Muda wa majibu (jumla) 274.72s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Claude Opus 4.8

medium
Gharama
$0.057
Muda
23.1s
Tokeni
2,412 tok

#21 GPT-5.4

medium
Gharama
$0.214
Muda
199.6s
Tokeni
14,349 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Claude Opus 4.8 10.0 10.0 100.0% 0 15.33s 10,590 9,945 1,381
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho