नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol average score में आगे है: 6.9 vs 6.7. Gemini 3.5 Flash-Lite (low) की benchmark लागत कम है: $0.145 vs $0.524. GPT-5.6 Sol तेज है: 2.16s vs 2.25s, pass rates 66.7% vs 59.1%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (low)Its score stays close to the best score here (6.7 vs 6.9), while costing about 3.6x less than GPT-5.6 Sol.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite low रिलीज़: 2026-07-21 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 6.7 6.9
रैंक #95 #87
विश्वसनीयता 10.0 10.0
संगति 8.2 9.0
सही परीक्षण
प्रति प्रयास पास दर 66.7% 59.1%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 1.201 4.761
कुल लागत $0.145 $0.524
इनपुट कीमत $0.300 / 1M $5.000 / 1M
आउटपुट कीमत $2.500 / 1M $30.000 / 1M
कुल इनपुट टोकन 144,622 78,593
आउटपुट टोकन 15,302 4,357
रीजनिंग टोकन 24,971 0
प्रतिक्रिया समय (औसत) 2.25s 2.16s
प्रतिक्रिया समय (अधिकतम) 13.50s 12.81s
प्रतिक्रिया समय (कुल) 49.58s 47.62s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.5 Flash-Lite

low
लागत
$0.008
समय
7.7s
टोकन
3,056 tok

#87 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash-Lite 4.1 7.9 11.1% 1 672ms 8,136 463 0
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें