नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 (low) vs GPT-5.6 Terra (medium)

GPT-5.6 Terra (medium) average score में आगे है: 7.8 vs 7.8. GPT-5.6 Terra (medium) की benchmark लागत कम है: $0.523 vs $2.089. GPT-5.6 Terra (medium) तेज है: 6.85s vs 12.88s, pass rates 80.3% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#70
कुल आउटपुट टोकन
52,237
प्रतिक्रिया समय (औसत)
12.88s
कुल लागत
$2.089
रैंक
#66
कुल आउटपुट टोकन
30,349
प्रतिक्रिया समय (औसत)
6.85s
कुल लागत
$0.523
अनुशंसित मॉडल GPT-5.6 Terra (medium)

It has the best score here (7.8), while costing about 4.0x less than Claude Opus 4.8 (low).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 low रिलीज़: 2026-05-28 GPT-5.6 Terra GPT-5.6 Terra medium रिलीज़: 2026-07-09
स्कोर 7.8 7.8
रैंक #70 #66
विश्वसनीयता 10.0 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 69.7%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 13.054 4.603
कुल लागत $2.089 $0.523
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $12.000 / 1M
कुल इनपुट टोकन 156,522 79,184
आउटपुट टोकन 43,056 4,878
रीजनिंग टोकन 9,181 25,471
प्रतिक्रिया समय (औसत) 12.88s 6.85s
प्रतिक्रिया समय (अधिकतम) 127.97s 41.68s
प्रतिक्रिया समय (कुल) 283.32s 150.65s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1T कुल (~60B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Claude Opus 4.8

low
लागत
$0.031
समय
14.1s
टोकन
1,345 tok

#66 GPT-5.6 Terra

medium
लागत
$0.035
समय
16.3s
टोकन
2,418 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527

त्वरित तुलना

तुलना जोड़ी बदलें