नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Terra (low) vs Qwen3.7 Max

average score जवळपास समान आहे: 7.5 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.420. Qwen3.7 Max वेगवान आहे: 4.56s vs 5.45s, pass rates 74.2% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#84
एकूण आउटपुट टोकन्स
21,586
प्रतिसाद वेळ (सरासरी)
5.45s
एकूण खर्च
$0.420
क्रमांक
#92
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while costing about 2.1x less than GPT-5.6 Terra (low).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra low प्रकाशन: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 7.5 7.4
क्रमांक #84 #92
विश्वसनीयता 10.0 9.9
सुसंगतता 7.9 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 74.2% 68.2%
अस्थिर चाचण्या 6 0
एकूण रन 66 66
प्रति निकाल खर्च 3.954 1.581
एकूण खर्च $0.420 $0.197
इनपुट किंमत $2.000 / 1M $1.475 / 1M
आउटपुट किंमत $12.000 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 80,304 95,992
आउटपुट टोकन्स 4,714 12,446
रिझनिंग टोकन्स 16,872 0
प्रतिसाद वेळ (सरासरी) 5.45s 4.56s
प्रतिसाद वेळ (कमाल) 19.85s 72.30s
प्रतिसाद वेळ (एकूण) 119.83s 100.30s
पॅरामीटर्स ~1T एकूण (~60B सक्रिय) ~1T एकूण (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 GPT-5.6 Terra

low
खर्च
$0.034
वेळ
16.8s
टोकन्स
2,348 tok

#92 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला