AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#18

Gemini 3.1 Flash Lite Preview

Google प्रकाशन: 2026-03-03 चाचणी तारीख: 2026-04-11 01:44 google/gemini-3.1-flash-lite-preview::medium
~150B एकूण (~10B सक्रिय)MoEबंद स्रोतअंदाजित
(high) (medium) (low) (none)

सारांश

Gemini 3.1 Flash Lite Preview AI BENCHY वर 8.2 स्कोर करते आणि #18 वर आहे. याची reliability लागू नाही, pass rate 72.2%, एकूण खर्च $0.055, आणि सरासरी response time 3.74s आहे.

Gemini 3.1 Flash Lite Preview खास का आहे: या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

ओळख नोंद

Gemini 3.1 Flash Lite Preview हे Google: Gemini 3.1 Flash Lite ची प्रीव्ह्यू आवृत्ती होती.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

अंदाजित
पॅरामीटर्स
~150B एकूण (~10B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
परवाना
-

सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.

सुसंगतता

10.0

विश्वसनीयता

लागू नाही

एकूण आउटपुट टोकन्स

31,198

एकूण इनपुट टोकन्स

0

इनपुट किंमत

$0.250 / 1M

आउटपुट किंमत

$1.500 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 5

प्रति प्रयत्न पास दर: 72.2%

अस्थिर चाचण्या

0

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

3.74s

प्रतिसाद वेळ (कमाल): 14.93s

प्रतिसाद वेळ (एकूण): 67.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Gemini 3.1 Flash Lite Preview

medium
खर्च
$0.003
वेळ
5.2s
टोकन्स
1,944 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-08-14 02:44 पुन्हा चाचणी 7.4 10.0 $0.117 तुलना करा
2026-07-16 22:53 नवीन चाचणी जोडली 7.3 10.0 $0.115 तुलना करा
2026-06-04 14:00 नवीन चाचणी जोडली 7.5 10.0 $0.068 तुलना करा
2026-05-22 00:28 सूट बदलला 7.7 10.0 $0.063 तुलना करा
2026-04-11 01:44 पहिली नोंदलेली रन 8.2 लागू नाही $0.055 सध्याची रन

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-04-11 01:44 · पहिली नोंदलेली रन54/54 प्रयत्न8.210.0लागू नाही13/18031,1980$0.0553.74s
2026-06-04 14:00 · नवीन चाचणी जोडली63/63 प्रयत्न7.510.010.013/21038,95437,786$0.0683.96s
फरक+0.70.000-7756-37786-$0.014-216ms

बेंचमार्क कव्हरेज वेगळे आहे: 54/54 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 63/63 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 9.1 10.0
कोडिंग 10.0 10.0
संयुक्त 10.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 10.0 10.0
कोडी सोडवणे 7.7 10.0
टूल कॉलिंग 10.0 10.0

तुलना केलेली मॉडेल्स