नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Terra (high) vs Qwen3.7 Plus (medium)

GPT-5.6 Terra (high) average score में आगे है: 8.0 vs 7.9. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.277 vs $0.836. GPT-5.6 Terra (high) तेज है: 11.22s vs 53.51s, pass rates 68.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#57
कुल आउटपुट टोकन
56,088
प्रतिक्रिया समय (औसत)
11.22s
कुल लागत
$0.836
रैंक
#62
कुल आउटपुट टोकन
187,337
प्रतिक्रिया समय (औसत)
53.51s
कुल लागत
$0.277
अनुशंसित मॉडल GPT-5.6 Terra (high)

It has the best score here (8.0), while responding about 4.8x faster than Qwen3.7 Plus (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra high रिलीज़: 2026-07-09 Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03
स्कोर 8.0 7.9
रैंक #57 #62
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 75.8%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 7.293 2.134
कुल लागत $0.836 $0.277
इनपुट कीमत $2.000 / 1M $0.320 / 1M
आउटपुट कीमत $12.000 / 1M $1.280 / 1M
कुल इनपुट टोकन 81,056 115,242
आउटपुट टोकन 5,055 6,163
रीजनिंग टोकन 51,033 181,174
प्रतिक्रिया समय (औसत) 11.22s 53.51s
प्रतिक्रिया समय (अधिकतम) 91.49s 315.30s
प्रतिक्रिया समय (कुल) 246.77s 1177.25s
पैरामीटर ~1T कुल (~60B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 GPT-5.6 Terra

high
लागत
$0.055
समय
30.2s
टोकन
3,748 tok

#62 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Terra 7.6 7.2 77.8% 1 9.14s 7,302 370 6,087
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

त्वरित तुलना

तुलना जोड़ी बदलें