नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Terra (medium) vs Qwen3.8 27B (medium)

GPT-5.6 Terra (medium) average score मध्ये पुढे आहे: 7.8 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. GPT-5.6 Terra (medium) वेगवान आहे: 6.85s vs 33.05s, pass rates 69.7% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#66
एकूण आउटपुट टोकन्स
30,349
प्रतिसाद वेळ (सरासरी)
6.85s
एकूण खर्च
$0.262
क्रमांक
#68
एकूण आउटपुट टोकन्स
136,162
प्रतिसाद वेळ (सरासरी)
33.05s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल GPT-5.6 Terra (medium)

It has the best score here (7.8), while responding about 4.8x faster than Qwen3.8 27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra medium प्रकाशन: 2026-07-09 Qwen3.8 27B Qwen3.8 27B medium प्रकाशन: 2026-08-14
स्कोअर 7.8 7.8
क्रमांक #66 #68
विश्वसनीयता 10.0 9.6
सुसंगतता 9.3 9.7
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 66.7%
अस्थिर चाचण्या 2 1
एकूण रन 66 66
प्रति निकाल खर्च 4.603 लागू नाही
एकूण खर्च $0.262 लागू नाही
इनपुट किंमत $1.000 / 1M लागू नाही
आउटपुट किंमत $6.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 79,184 98,266
आउटपुट टोकन्स 4,878 1,861
रिझनिंग टोकन्स 25,471 134,301
प्रतिसाद वेळ (सरासरी) 6.85s 33.05s
प्रतिसाद वेळ (कमाल) 41.68s 214.63s
प्रतिसाद वेळ (एकूण) 150.65s 694.04s
पॅरामीटर्स ~1T एकूण (~60B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 GPT-5.6 Terra

medium
खर्च
$0.035
वेळ
16.3s
टोकन्स
2,418 tok

#68 Qwen3.8 27B

medium
खर्च
लागू नाही
वेळ
43.4s
टोकन्स
2,956 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Opus 4.8lowvsGPT-5.6 TerramediumGPT-5.6 TerramediumvsQwen3.7 FlashhighKimi K3maxvsGPT-5.6 TerramediumSeed-2.0-CodelowvsGPT-5.6 TerramediumDeepSeek V4 ProhighvsQwen3.8 27BmediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BmediumGPT-5.6 TerramediumvsGLM 5.2high