نیویگیشن
AI BENCHY
Advertise here

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.2 Chat

Gemini 3.1 Pro Preview (medium) average score میں آگے ہے: 9.2 vs 8.0. GPT-5.2 Chat کی benchmark لاگت کم ہے: $0.604 vs $1.361. GPT-5.2 Chat تیز ہے: 7.65s vs 21.47s، pass rates 90.9% vs 74.2%.

تجویز کردہ ماڈلGemini 3.1 Pro Preview (medium)It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

میٹرک Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium اجرا: 2026-02-19 GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11
اسکور 9.2 8.0
درجہ #10 #37
اعتماد پذیری 10.0 10.0
تسلسل 10.0 8.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 90.9% 74.2%
غیر مستحکم ٹیسٹ 0 4
کل رنز 66 66
فی نتیجہ لاگت 6.801 4.308
کل لاگت $1.361 $0.604
ان پٹ قیمت $2.000 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $12.000 / 1M $14.000 / 1M
کل ان پٹ ٹوکنز 92,287 101,248
آؤٹ پٹ ٹوکنز 5,232 30,424
ریزننگ ٹوکنز 92,726 0
ردِعمل کا وقت (اوسط) 21.47s 7.65s
ردِعمل کا وقت (زیادہ سے زیادہ) 88.68s 38.52s
ردِعمل کا وقت (کل) 322.08s 168.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium
لاگت
$0.115
وقت
87.2s
ٹوکنز
9,629 tok

#37 GPT-5.2 Chat

none
لاگت
$0.010
وقت
15.3s
ٹوکنز
797 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں