नेविगेशन
AI BENCHY
Advertise here

Gemini 3.5 Flash Lite (high) vs GPT-5.3-Codex (medium)

GPT-5.3-Codex (medium) average score में आगे है: 8.9 vs 8.8. Gemini 3.5 Flash Lite (high) की benchmark लागत कम है: $0.200 vs $0.920. Gemini 3.5 Flash Lite (high) तेज है: 10.84s vs 16.96s, pass rates 86.4% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#21
कुल आउटपुट टोकन
75,922
प्रतिक्रिया समय (औसत)
10.84s
कुल लागत
$0.200
रैंक
#19
कुल आउटपुट टोकन
55,525
प्रतिक्रिया समय (औसत)
16.96s
कुल लागत
$0.920
अनुशंसित मॉडल Gemini 3.5 Flash Lite (high)

Its score stays close to the best score here (8.8 vs 8.9), while costing about 4.6x less than GPT-5.3-Codex (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite high रिलीज़: 2026-07-21 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 8.8 8.9
रैंक #21 #19
विश्वसनीयता 10.0 10.0
संगति 10.0 8.6
सही परीक्षण
प्रति प्रयास पास दर 86.4% 83.3%
अस्थिर टेस्ट 0 4
कुल रन 22 66
प्रति परिणाम लागत 1.048 5.748
कुल लागत $0.200 $0.920
इनपुट कीमत $0.300 / 1M $1.750 / 1M
आउटपुट कीमत $2.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 30,858 81,268
आउटपुट टोकन 2,072 6,251
रीजनिंग टोकन 73,850 49,274
प्रतिक्रिया समय (औसत) 10.84s 16.96s
प्रतिक्रिया समय (अधिकतम) 50.65s 100.93s
प्रतिक्रिया समय (कुल) 238.40s 373.19s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Gemini 3.5 Flash Lite

high
लागत
$0.025
समय
36.8s
टोकन
9,964 tok

#19 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash Lite 7.8 10.0 66.7% 0 15.51s 2,712 143 19,439
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें