नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 (low) vs GPT-5.6 Sol (medium)

average score लगभग बराबर है: 9.3 vs 9.4. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.723 vs $1.257. GPT-5.5 (low) तेज है: 10.15s vs 12.63s, pass rates 86.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#10
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
रैंक
#8
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.723
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 1.7x less than GPT-5.5 (low).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.3 9.4
रैंक #10 #8
विश्वसनीयता 10.0 10.0
संगति 10.0 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 90.9%
अस्थिर टेस्ट 0 3
कुल रन 66 66
प्रति परिणाम लागत 6.614 8.025
कुल लागत $1.257 $0.723
इनपुट कीमत $5.000 / 1M $2.500 / 1M
आउटपुट कीमत $30.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 80,067 79,006
आउटपुट टोकन 5,378 4,696
रीजनिंग टोकन 23,162 30,281
प्रतिक्रिया समय (औसत) 10.15s 12.63s
प्रतिक्रिया समय (अधिकतम) 56.19s 79.40s
प्रतिक्रिया समय (कुल) 223.24s 277.88s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें