AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#74

Gemini 3.5 Flash

Google प्रकाशन: 2026-05-19 चाचणी तारीख: 2026-06-04 14:01 google/gemini-3.5-flash::minimal

सारांश

Gemini 3.5 Flash AI BENCHY वर 6.8 स्कोर करते आणि #74 वर आहे. याची reliability 10.0, pass rate 68.3%, एकूण खर्च $0.108, आणि सरासरी response time 1.57s आहे.

Gemini 3.5 Flash खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर सूचनांचे पालन हा सर्वात कमकुवत भाग आहे, rank #11. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

सुसंगतता

9.6

एकूण आउटपुट टोकन्स

5,277

एकूण इनपुट टोकन्स

39,847

इनपुट किंमत

$1.500 / 1M

आउटपुट किंमत

$9.000 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 7

प्रति प्रयत्न पास दर: 68.3%

अस्थिर चाचण्या

1

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

1.57s

प्रतिसाद वेळ (कमाल): 5.51s

प्रतिसाद वेळ (एकूण): 33.02s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Gemini 3.5 Flash

minimal
खर्च
$0.041
वेळ
20.4s
टोकन्स
4,608 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-06-04 14:01 नवीन चाचणी जोडली 7.7 10.0 $0.108 सध्याची रन
2026-05-22 00:28 सूट बदलला 7.9 10.0 $0.103 तुलना करा
2026-05-19 23:35 पहिला रन 8.1 10.0 $0.070 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-06-04 15:40 $1.500 / 1M $9.000 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 6.5 10.0
कोडिंग 5.6 9.9
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 10.0 10.0
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 6.4 5.8
कोडी सोडवणे 10.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स