नेव्हिगेशन
AI BENCHY
Advertise here

Anthropic: Claude Fable 5 vs OpenAI: GPT-5.4

Claude Fable 5 (medium) average score मध्ये पुढे आहे: 8.6 vs 8.5. GPT-5.4 (medium) चा benchmark खर्च कमी आहे: $1.533 vs $3.478. Claude Fable 5 (medium) वेगवान आहे: 17.20s vs 23.10s, pass rates 78.8% vs 77.3%.

शिफारस केलेले मॉडेलGPT-5.4 (medium)Its score stays close to the best score here (8.5 vs 8.6), while costing about 2.3x less than Claude Fable 5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-18

मेट्रिक Claude Fable 5 Claude Fable 5 medium प्रकाशन: 2026-06-10 GPT-5.4 GPT-5.4 medium प्रकाशन: 2026-03-05
स्कोअर 8.6 8.5
क्रमांक #17 #18
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.8% 77.3%
अस्थिर चाचण्या 1 4
एकूण रन 66 66
प्रति निकाल खर्च 20.459 10.220
एकूण खर्च $3.478 $1.533
इनपुट किंमत $10.000 / 1M $2.500 / 1M
आउटपुट किंमत $50.000 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 89,643 81,127
आउटपुट टोकन्स 41,360 6,155
रिझनिंग टोकन्स 10,269 82,515
प्रतिसाद वेळ (सरासरी) 17.20s 23.10s
प्रतिसाद वेळ (कमाल) 80.80s 100.41s
प्रतिसाद वेळ (एकूण) 378.41s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Claude Fable 5

medium
खर्च
$0.606
वेळ
156.7s
टोकन्स
12,264 tok

#18 GPT-5.4

medium
खर्च
$0.214
वेळ
199.6s
टोकन्स
14,349 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

झटपट तुलना

तुलना जोडी बदला