नेविगेशन
AI BENCHY
Advertise here

Gemini 3.5 Flash (low) vs GPT-5.3-Codex (medium)

GPT-5.3-Codex (medium) average score में आगे है: 8.9 vs 8.8. Gemini 3.5 Flash (low) की benchmark लागत कम है: $0.449 vs $0.988. Gemini 3.5 Flash (low) तेज है: 5.76s vs 16.91s, pass rates 84.9% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#24
कुल आउटपुट टोकन
35,195
प्रतिक्रिया समय (औसत)
5.76s
कुल लागत
$0.449
रैंक
#22
कुल आउटपुट टोकन
60,374
प्रतिक्रिया समय (औसत)
16.91s
कुल लागत
$0.988
अनुशंसित मॉडल Gemini 3.5 Flash (low)

Its score stays close to the best score here (8.8 vs 8.9), while costing about 2.2x less than GPT-5.3-Codex (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash low रिलीज़: 2026-05-19 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 8.8 8.9
रैंक #24 #22
विश्वसनीयता 10.0 10.0
संगति 9.3 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 84.9% 83.3%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 2.492 6.171
कुल लागत $0.449 $0.988
इनपुट कीमत $1.500 / 1M $1.750 / 1M
आउटपुट कीमत $9.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 87,826 81,187
आउटपुट टोकन 2,239 6,258
रीजनिंग टोकन 32,956 54,116
प्रतिक्रिया समय (औसत) 5.76s 16.91s
प्रतिक्रिया समय (अधिकतम) 53.55s 100.93s
प्रतिक्रिया समय (कुल) 126.71s 372.03s
पैरामीटर ~500B कुल (~20B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Gemini 3.5 Flash

low
लागत
$0.068
समय
39.1s
टोकन
7,588 tok

#22 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 7.8 10.0 66.7% 0 6.71s 8,118 458 13,420
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें