नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.6 Terra

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. GPT-5.6 Terra (low) की benchmark लागत कम है: $0.519 vs $1.550. GPT-5.6 Terra (low) तेज है: 5.31s vs 7.60s, pass rates 57.6% vs 74.2%.

अनुशंसित मॉडलGPT-5.6 Terra (low)Its score stays close to the best score here (7.5 vs 7.5), while costing about 3.0x less than Claude Opus 5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 GPT-5.6 Terra GPT-5.6 Terra low रिलीज़: 2026-07-09
स्कोर 7.5 7.5
रैंक #59 #63
विश्वसनीयता 10.0 10.0
संगति 9.6 7.9
सही परीक्षण
प्रति प्रयास पास दर 57.6% 74.2%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 12.912 3.989
कुल लागत $1.550 $0.519
इनपुट कीमत $5.000 / 1M $2.500 / 1M
आउटपुट कीमत $25.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 185,550 80,295
आउटपुट टोकन 24,866 4,714
रीजनिंग टोकन 0 16,469
प्रतिक्रिया समय (औसत) 7.60s 5.31s
प्रतिक्रिया समय (अधिकतम) 47.72s 19.85s
प्रतिक्रिया समय (कुल) 167.28s 116.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#63 GPT-5.6 Terra

low
लागत
$0.034
समय
16.8s
टोकन
2,348 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821

त्वरित तुलना

तुलना जोड़ी बदलें