नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Fable 5 vs Anthropic: Claude Opus 4.7

Claude Opus 4.7 (medium) average score मध्ये पुढे आहे: 8.7 vs 8.6. Claude Opus 4.7 (medium) चा benchmark खर्च कमी आहे: $1.477 vs $3.478. Claude Opus 4.7 (medium) वेगवान आहे: 7.61s vs 17.20s, pass rates 78.8% vs 83.3%.

शिफारस केलेले मॉडेलClaude Opus 4.7 (medium)It has the best score here (8.7), while costing about 2.4x less than Claude Fable 5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Fable 5 Claude Fable 5 medium प्रकाशन: 2026-06-10 Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16
स्कोअर 8.6 8.7
क्रमांक #22 #20
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.8% 83.3%
अस्थिर चाचण्या 1 1
एकूण रन 66 66
प्रति निकाल खर्च 20.459 8.201
एकूण खर्च $3.478 $1.477
इनपुट किंमत $10.000 / 1M $5.000 / 1M
आउटपुट किंमत $50.000 / 1M $25.000 / 1M
एकूण इनपुट टोकन्स 89,643 145,252
आउटपुट टोकन्स 41,360 24,948
रिझनिंग टोकन्स 10,269 5,042
प्रतिसाद वेळ (सरासरी) 17.20s 7.61s
प्रतिसाद वेळ (कमाल) 80.80s 65.40s
प्रतिसाद वेळ (एकूण) 378.41s 159.91s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Fable 5

medium
खर्च
$0.606
वेळ
156.7s
टोकन्स
12,264 tok

#20 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114

झटपट तुलना

तुलना जोडी बदला