नेविगेशन
Advertise here

Gemini 3 Flash Preview (low) vs GPT-5.2 Chat

GPT-5.2 Chat average score में आगे है: 7.0 vs 6.9. Gemini 3 Flash Preview (low) की benchmark लागत कम है: $0.254 vs $0.594. GPT-5.2 Chat तेज है: 7.43s vs 8.51s, pass rates 72.5% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#160
कुल आउटपुट टोकन
42,400
प्रतिक्रिया समय (औसत)
8.51s
कुल लागत
$0.254
रैंक
#153
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.594
अनुशंसित मॉडल Gemini 3 Flash Preview (low)

Its score stays close to the best score here (6.9 vs 7.0), while costing about 2.3x less than GPT-5.2 Chat.

विस्तृत तुलना

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview low रिलीज़: 2025-12-17 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 6.9 7.0
रैंक #160 #153
विश्वसनीयता 10.0 10.0
संगति 9.3 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 72.5% 66.7%
अस्थिर टेस्ट 2 4
कुल रन 69 69
प्रति परिणाम लागत 1.582 4.564
कुल लागत $0.254 $0.594
इनपुट कीमत $0.500 / 1M $1.750 / 1M
आउटपुट कीमत $3.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 251,677 101,104
आउटपुट टोकन 11,196 29,742
रीजनिंग टोकन 31,204 0
प्रतिक्रिया समय (औसत) 8.51s 7.43s
प्रतिक्रिया समय (अधिकतम) 52.64s 38.52s
प्रतिक्रिया समय (कुल) 195.76s 163.35s
पैरामीटर ~500B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 Gemini 3 Flash Preview

low
लागत
$0.007
समय
12.1s
टोकन
2,289 tok

#153 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 5.8 7.2 44.4% 1 6.00s 8,122 456 7,421
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें