नेविगेशन
Advertise here

Claude Opus 4.8 (medium) vs GPT-5.6 Terra (high)

GPT-5.6 Terra (high) average score में आगे है: 8.3 vs 8.3. GPT-5.6 Terra (high) की benchmark लागत कम है: $1.116 vs $3.490. GPT-5.6 Terra (high) तेज है: 13.62s vs 16.72s, pass rates 82.6% vs 69.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#80
कुल आउटपुट टोकन
67,842
प्रतिक्रिया समय (औसत)
16.72s
कुल लागत
$3.490
रैंक
#76
कुल आउटपुट टोकन
60,065
प्रतिक्रिया समय (औसत)
13.62s
कुल लागत
$1.116
अनुशंसित मॉडल GPT-5.6 Terra (high)

It has the best score here (8.3), while costing about 3.1x less than Claude Opus 4.8 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 medium रिलीज़: 2026-05-28 GPT-5.6 Terra GPT-5.6 Terra high रिलीज़: 2026-07-09
स्कोर 8.3 8.3
रैंक #80 #76
विश्वसनीयता 10.0 10.0
संगति 9.0 9.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 82.6% 69.6%
अस्थिर टेस्ट 3 2
कुल रन 69 69
प्रति परिणाम लागत 20.527 8.674
कुल लागत $3.490 $1.116
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $12.000 / 1M
कुल इनपुट टोकन 360,294 197,239
आउटपुट टोकन 43,441 6,083
रीजनिंग टोकन 24,401 53,982
प्रतिक्रिया समय (औसत) 16.72s 13.62s
प्रतिक्रिया समय (अधिकतम) 99.37s 91.49s
प्रतिक्रिया समय (कुल) 384.66s 313.21s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1T कुल (~60B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Claude Opus 4.8

medium
लागत
$0.057
समय
23.1s
टोकन
2,412 tok

#76 GPT-5.6 Terra

high
लागत
$0.055
समय
30.2s
टोकन
3,748 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 10.0 10.0 100.0% 0 15.33s 10,590 9,945 1,381
GPT-5.6 Terra 7.6 7.2 77.8% 1 9.14s 7,302 370 6,087

त्वरित तुलना

तुलना जोड़ी बदलें