नेविगेशन
Advertise here

Claude Opus 5 vs GPT-5.6 Terra (low)

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. GPT-5.6 Terra (low) की benchmark लागत कम है: $0.420 vs $1.550. GPT-5.6 Terra (low) तेज है: 5.45s vs 7.65s, pass rates 57.6% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#97
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#99
कुल आउटपुट टोकन
21,586
प्रतिक्रिया समय (औसत)
5.45s
कुल लागत
$0.420
अनुशंसित मॉडल GPT-5.6 Terra (low)

Its score stays close to the best score here (7.5 vs 7.5), while costing about 3.7x less than Claude Opus 5.

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 GPT-5.6 Terra GPT-5.6 Terra low रिलीज़: 2026-07-09
स्कोर 7.5 7.5
रैंक #97 #99
विश्वसनीयता 10.0 10.0
संगति 9.6 7.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 74.2%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 12.912 3.954
कुल लागत $1.550 $0.420
इनपुट कीमत $5.000 / 1M $2.000 / 1M
आउटपुट कीमत $25.000 / 1M $12.000 / 1M
कुल इनपुट टोकन 185,547 80,304
आउटपुट टोकन 24,866 4,714
रीजनिंग टोकन 0 16,872
प्रतिक्रिया समय (औसत) 7.65s 5.45s
प्रतिक्रिया समय (अधिकतम) 47.72s 19.85s
प्रतिक्रिया समय (कुल) 168.35s 119.83s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1T कुल (~60B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#99 GPT-5.6 Terra

low
लागत
$0.034
समय
16.8s
टोकन
2,348 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821

त्वरित तुलना

तुलना जोड़ी बदलें