AI BENCHY
Advertise here
#74

Gemini 3.5 Flash

Google प्रकाशन: 2026-05-19 चाचणी तारीख: 2026-06-04 14:01 google/gemini-3.5-flash::minimal

सारांश

Gemini 3.5 Flash AI BENCHY वर 6.8 स्कोर करते आणि #74 वर आहे. याची reliability 10.0, pass rate 68.3%, एकूण खर्च $0.108, आणि सरासरी response time 1.57s आहे.

Gemini 3.5 Flash खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर सूचनांचे पालन हा सर्वात कमकुवत भाग आहे, rank #11. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

सुसंगतता

9.6

एकूण आउटपुट टोकन्स

5,277

एकूण इनपुट टोकन्स

39,847

इनपुट किंमत

$1.500 / 1M

आउटपुट किंमत

$9.000 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 7

प्रति प्रयत्न पास दर: 68.3%

अस्थिर चाचण्या

1

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

1.57s

प्रतिसाद वेळ (कमाल): 5.51s

प्रतिसाद वेळ (एकूण): 33.02s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Gemini 3.5 Flash

minimal
खर्च
$0.041
वेळ
20.4s
टोकन्स
4,608 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-06-04 14:01 नवीन चाचणी जोडली 7.7 10.0 $0.108 सध्याची रन
2026-05-22 00:28 सूट बदलला 7.9 10.0 $0.103 तुलना करा
2026-05-19 23:35 पहिला रन 8.1 10.0 $0.070 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

रन तुलना

रनस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-06-04 14:01 · सध्याची रन6.89.610.014/2115,27739,847$0.1081.57s
2026-05-22 00:28 · सूट बदलला7.99.610.014/2015,2710$0.1031.58s
फरक-1.10.00.000+6+39847+$0.005-5ms

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-06-04 15:40 $1.500 / 1M $9.000 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 6.5 10.0
कोडिंग 5.6 9.9
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 10.0 10.0
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 6.4 5.8
कोडी सोडवणे 10.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स