नेविगेशन
Advertise here

GPT-5.6 Terra (medium) vs Grok 4.5 (high)

average score लगभग बराबर है: 8.2 vs 8.2. GPT-5.6 Terra (medium) की benchmark लागत कम है: $0.744 vs $2.571. GPT-5.6 Terra (medium) तेज है: 8.93s vs 72.50s, pass rates 71.0% vs 82.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#84
कुल आउटपुट टोकन
33,189
प्रतिक्रिया समय (औसत)
8.93s
कुल लागत
$0.744
रैंक
#82
कुल आउटपुट टोकन
333,632
प्रतिक्रिया समय (औसत)
72.50s
कुल लागत
$2.571
अनुशंसित मॉडल GPT-5.6 Terra (medium)

It has the best score here (8.2), while costing about 3.5x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra medium रिलीज़: 2026-07-09 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 8.2 8.2
रैंक #84 #82
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 71.0% 82.6%
अस्थिर टेस्ट 2 3
कुल रन 69 69
प्रति परिणाम लागत 5.768 15.123
कुल लागत $0.744 $2.571
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $12.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 172,507 342,124
आउटपुट टोकन 5,824 7,135
रीजनिंग टोकन 27,365 326,497
प्रतिक्रिया समय (औसत) 8.93s 72.50s
प्रतिक्रिया समय (अधिकतम) 54.74s 676.83s
प्रतिक्रिया समय (कुल) 205.39s 1667.51s
पैरामीटर ~1T कुल (~60B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 GPT-5.6 Terra

medium
लागत
$0.035
समय
16.3s
टोकन
2,418 tok

#82 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें