नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.6 Terra

GPT-5.6 Terra (medium) average score में आगे है: 7.8 vs 7.7. GPT-5.6 Terra (medium) की benchmark लागत कम है: $0.676 vs $3.059. GPT-5.6 Terra (medium) तेज है: 7.11s vs 34.27s, pass rates 63.6% vs 69.7%.

अनुशंसित मॉडलGPT-5.6 Terra (medium)It has the best score here (7.8), while costing about 4.5x less than Claude Opus 4.6 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 4.6 Claude Opus 4.6 medium रिलीज़: 2026-02-05 GPT-5.6 Terra GPT-5.6 Terra medium रिलीज़: 2026-07-09
स्कोर 7.7 7.8
रैंक #50 #46
विश्वसनीयता 10.0 10.0
संगति 8.8 9.3
सही परीक्षण
प्रति प्रयास पास दर 63.6% 69.7%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 23.524 4.825
कुल लागत $3.059 $0.676
इनपुट कीमत $5.000 / 1M $2.500 / 1M
आउटपुट कीमत $25.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 108,615 79,175
आउटपुट टोकन 72,286 4,878
रीजनिंग टोकन 28,315 26,952
प्रतिक्रिया समय (औसत) 34.27s 7.11s
प्रतिक्रिया समय (अधिकतम) 151.51s 41.68s
प्रतिक्रिया समय (कुल) 513.99s 156.42s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Claude Opus 4.6

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#46 GPT-5.6 Terra

medium
लागत
$0.035
समय
16.3s
टोकन
2,418 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527

त्वरित तुलना

तुलना जोड़ी बदलें