#60 MiMo-V2-Omni
none- खर्च
- $0.000
- वेळ
- 0.1s
- टोकन्स
- 0 tok
सारांश
Mimo V2 Omni AI BENCHY वर 6.5 स्कोर करते आणि #60 वर आहे. याची reliability लागू नाही, pass rate 44.4%, एकूण खर्च $0.007, आणि सरासरी response time 1.99s आहे.
Mimo V2 Omni खास का आहे: या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
संग्रहित मॉडेल: हे मॉडेल आता अपडेट केले जाणार नाही आणि नवीन चाचण्यांवर तपासले जाणार नाही.
6.5
सुसंगतता
10.0
लागू नाही
$0.007
एकूण आउटपुट टोकन्स
868
एकूण इनपुट टोकन्स
0
इनपुट किंमत
$0.400 / 1M
आउटपुट किंमत
$2.000 / 1M
अस्थिर चाचण्या
0
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
रन इतिहास
| चाचणी तारीख | स्कोअर | विश्वसनीयता | बरोबर चाचण्या | एकूण खर्च | तुलना करा |
|---|---|---|---|---|---|
| 2026-06-04 13:47 नवीन चाचणी जोडली | 5.5 | 10.0 | $0.021 ↓ | तुलना करा | |
| 2026-05-22 00:20 सूट बदलला | 6.2 | 10.0 | $0.023 | तुलना करा | |
| 2026-05-08 15:32 सूट बदलला | 6.3 | 10.0 | $0.020 | तुलना करा | |
| 2026-04-11 01:44 पहिली नोंदलेली रन | 6.5 | लागू नाही | $0.007 | सध्याची रन |
रन तुलना
| रन | बेंचमार्क कव्हरेज | स्कोअर | सुसंगतता | विश्वसनीयता | बरोबर चाचण्या | अस्थिर चाचण्या | एकूण आउटपुट टोकन्स | एकूण इनपुट टोकन्स | एकूण खर्च | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-04-11 01:44 · पहिली नोंदलेली रन | 18/18 चाचण्या · 20/54 प्रयत्न | 6.5 | 10.0 | लागू नाही | 8/18 | 0 | 868 | 0 | $0.007 | 1.99s |
| 2026-05-08 15:32 · सूट बदलला | 19/19 चाचण्या · 49/57 प्रयत्न | 6.3 | 9.7 | 10.0 | 8/19 | 1 | 2,254 | 0 | $0.020 | 2.37s |
| फरक | — | +0.1 | +0.3 | 0 | -1 | -1386 | 0 | -$0.013 | -381ms |
बेंचमार्क कव्हरेज वेगळे आहे: 18/18 चाचण्या · 20/54 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 19/19 चाचण्या · 49/57 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.
या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| अँटी-एआय युक्त्या | 4.8 | 10.0 | |
| कोडिंग | 6.6 | 10.0 | |
| संयुक्त | 3.0 | 10.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 4.5 | 10.0 | |
| सूचनांचे पालन | 6.5 | 10.0 | |
| कोडी सोडवणे | 8.0 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 |