नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Terra (low) vs Qwen3.7 Max

average score लगभग बराबर है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.420. Qwen3.7 Max तेज है: 4.56s vs 5.45s, pass rates 74.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#84
कुल आउटपुट टोकन
21,586
प्रतिक्रिया समय (औसत)
5.45s
कुल लागत
$0.420
रैंक
#92
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while costing about 2.1x less than GPT-5.6 Terra (low).

विस्तृत तुलना

मेट्रिक GPT-5.6 Terra GPT-5.6 Terra low रिलीज़: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.5 7.4
रैंक #84 #92
विश्वसनीयता 10.0 9.9
संगति 7.9 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 74.2% 68.2%
अस्थिर टेस्ट 6 0
कुल रन 66 66
प्रति परिणाम लागत 3.954 1.581
कुल लागत $0.420 $0.197
इनपुट कीमत $2.000 / 1M $1.475 / 1M
आउटपुट कीमत $12.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 80,304 95,992
आउटपुट टोकन 4,714 12,446
रीजनिंग टोकन 16,872 0
प्रतिक्रिया समय (औसत) 5.45s 4.56s
प्रतिक्रिया समय (अधिकतम) 19.85s 72.30s
प्रतिक्रिया समय (कुल) 119.83s 100.30s
पैरामीटर ~1T कुल (~60B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 GPT-5.6 Terra

low
लागत
$0.034
समय
16.8s
टोकन
2,348 tok

#92 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें