Urambazaji
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.3-Codex

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-04-16

Kipimo Claude Opus 4.7 Claude Opus 4.7 medium Toleo: 2026-04-16 GPT-5.3-Codex GPT-5.3-Codex medium Toleo: 2026-02-05
Alama 9.2 8.6
Nafasi #3 #7
Uthabiti 10.0 8.7
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 88.9% 83.3%
Majaribio yasiyo thabiti 0 3
Jumla ya uendeshaji 54 54
Gharama kwa matokeo 2.790 4.405
Jumla ya gharama $0.447 $0.573
Bei ya ingizo $5.000 / 1M $1.750 / 1M
Bei ya toleo $25.000 / 1M $14.000 / 1M
Tokeni za matokeo 5,375 2,279
Tokeni za hoja 1,341 35,179
Muda wa majibu (wastani) 3.53s 15.38s
Muda wa majibu (upeo) 21.45s 100.93s
Muda wa majibu (jumla) 60.03s 276.91s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
GPT-5.3-Codex 10.0 10.0 100.0% 0 8.95s 491 1,530
Mchanganyiko Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Uchanganuzi na uchimbaji wa data Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Mahususi kwa domeni Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Akili ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Ufuataji wa maagizo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Utatuzi wa mafumbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
Mwito wa zana Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho