नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Terra (medium) vs Qwen3.8 27B (medium)

GPT-5.6 Terra (medium) average score में आगे है: 7.8 vs 7.8. स्थानीय हार्डवेयर की लागत नहीं मापी गई, इसलिए लागत की तुलना उपलब्ध नहीं है। GPT-5.6 Terra (medium) तेज है: 6.85s vs 33.05s, pass rates 69.7% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#66
कुल आउटपुट टोकन
30,349
प्रतिक्रिया समय (औसत)
6.85s
कुल लागत
$0.262
रैंक
#68
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
लागू नहीं
अनुशंसित मॉडल GPT-5.6 Terra (medium)

It has the best score here (7.8), while responding about 4.8x faster than Qwen3.8 27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra medium रिलीज़: 2026-07-09 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.8 7.8
रैंक #66 #68
विश्वसनीयता 10.0 9.6
संगति 9.3 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 66.7%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 4.603 लागू नहीं
कुल लागत $0.262 लागू नहीं
इनपुट कीमत $1.000 / 1M लागू नहीं
आउटपुट कीमत $6.000 / 1M लागू नहीं
कुल इनपुट टोकन 79,184 98,266
आउटपुट टोकन 4,878 1,861
रीजनिंग टोकन 25,471 134,301
प्रतिक्रिया समय (औसत) 6.85s 33.05s
प्रतिक्रिया समय (अधिकतम) 41.68s 214.63s
प्रतिक्रिया समय (कुल) 150.65s 694.04s
पैरामीटर ~1T कुल (~60B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 GPT-5.6 Terra

medium
लागत
$0.035
समय
16.3s
टोकन
2,418 tok

#68 Qwen3.8 27B

medium
लागत
लागू नहीं
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Opus 4.8lowvsGPT-5.6 TerramediumGPT-5.6 TerramediumvsQwen3.7 FlashhighKimi K3maxvsGPT-5.6 TerramediumSeed-2.0-CodelowvsGPT-5.6 TerramediumDeepSeek V4 ProhighvsQwen3.8 27BmediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BmediumGPT-5.6 TerramediumvsGLM 5.2high