नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.3-Codex

सारांश

GPT-5.3-Codex (medium) average score में आगे है: 8.9 vs 6.4. Gemini 3.1 Flash Lite Preview की benchmark लागत कम है: $0.018 vs $0.740. Gemini 3.1 Flash Lite Preview तेज है: 1.21s vs 16.22s, pass rates 60.3% vs 82.5%.

अनुशंसित मॉडलGPT-5.3-Codex (medium)It has the strongest score in this comparison (8.9) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-14

मेट्रिक Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none रिलीज़: 2026-03-03 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 6.4 8.9
रैंक #102 #13
विश्वसनीयता 10.0 10.0
संगति 9.7 8.5
सही परीक्षण
प्रति प्रयास पास दर 60.3% 82.5%
अस्थिर टेस्ट 1 4
कुल रन 63 63
प्रति परिणाम लागत 0.148 4.932
कुल लागत $0.018 $0.740
इनपुट कीमत $0.250 / 1M $1.750 / 1M
आउटपुट कीमत $1.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 37,582 34,299
आउटपुट टोकन 5,547 2,357
रीजनिंग टोकन 0 46,189
प्रतिक्रिया समय (औसत) 1.21s 16.22s
प्रतिक्रिया समय (अधिकतम) 3.39s 100.93s
प्रतिक्रिया समय (कुल) 25.45s 340.67s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Gemini 3.1 Flash Lite Preview

none
लागत
$0.003
समय
4.7s
टोकन
1,827 tok

#13 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें