नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.7 (medium) vs GPT-5.6 Terra (medium)

GPT-5.6 Terra (medium) average score मध्ये पुढे आहे: 8.2 vs 8.1. GPT-5.6 Terra (medium) चा benchmark खर्च कमी आहे: $0.483 vs $3.636. GPT-5.6 Terra (medium) वेगवान आहे: 8.93s vs 14.12s, pass rates 81.2% vs 71.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#93
एकूण आउटपुट टोकन्स
57,978
प्रतिसाद वेळ (सरासरी)
14.12s
एकूण खर्च
$3.636
क्रमांक
#89
एकूण आउटपुट टोकन्स
33,189
प्रतिसाद वेळ (सरासरी)
8.93s
एकूण खर्च
$0.483
शिफारस केलेले मॉडेल GPT-5.6 Terra (medium)

It has the best score here (8.2), while costing about 7.5x less than Claude Opus 4.7 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 GPT-5.6 Terra GPT-5.6 Terra medium प्रकाशन: 2026-07-09
स्कोअर 8.1 8.2
क्रमांक #93 #89
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 9.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.2% 71.0%
अस्थिर चाचण्या 2 2
एकूण रन 69 69
प्रति निकाल खर्च 20.200 5.768
एकूण खर्च $3.636 $0.483
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $25.000 / 1M $12.000 / 1M
कॅश वाचण्याची किंमत $0.500 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत $6.250 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 437,293 172,507
आउटपुट टोकन्स 29,102 5,824
रिझनिंग टोकन्स 28,876 27,365
प्रतिसाद वेळ (सरासरी) 14.12s 8.93s
प्रतिसाद वेळ (कमाल) 150.60s 54.74s
प्रतिसाद वेळ (एकूण) 310.55s 205.39s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~1T एकूण (~60B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#89 GPT-5.6 Terra

medium
खर्च
$0.035
वेळ
16.3s
टोकन्स
2,418 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527

तुलना जोडी बदला