- क्रमांक
- #390
- एकूण आउटपुट टोकन्स
- 0
- प्रतिसाद वेळ (सरासरी)
- 495ms
- एकूण खर्च
- $0.005
GPT-6 Luna Decisions (default) vs Tev1 4B Experimental (default)
GPT-6 Luna Decisions (default) average score मध्ये पुढे आहे: 2.4 vs 1.0. Tev1 4B Experimental (default) चा benchmark खर्च कमी आहे: $0.002 vs $0.005. GPT-6 Luna Decisions (default) वेगवान आहे: 495ms vs 498ms, pass rates 13.0% vs 13.0%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #397
- एकूण आउटपुट टोकन्स
- 96
- प्रतिसाद वेळ (सरासरी)
- 498ms
- एकूण खर्च
- $0.002
शिफारस केलेले मॉडेल
GPT-6 Luna Decisions (default)
It has the strongest score in this comparison (2.4) and the best overall balance of cost and response time across all 2 models.
तपशीलवार तुलना
| मेट्रिक | GPT-6 Luna Decisions GPT-6 Luna Decisions default | Tev1 4B Experimental Tev1 4B Experimental default |
|---|---|---|
| स्कोअर | 2.4 | 1.0 |
| क्रमांक | #390 | #397 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 5.2 | 3.0 |
| प्रयत्न | 36/69 | 21/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 13.0% | 13.0% |
| अस्थिर चाचण्या | 0 | 0 |
| एकूण रन | 36 | 21 |
| प्रति निकाल खर्च | 0.159 | 0.048 |
| एकूण खर्च | $0.005 | $0.002 |
| इनपुट किंमत | $0.100 / 1M | $0.042 / 1M |
| आउटपुट किंमत | $0.000 / 1M | $0.000 / 1M |
| कॅश वाचण्याची किंमत | $0.000 / 1M | लागू नाही |
| कॅश लिहिण्याची किंमत | $0.000 / 1M | लागू नाही |
| एकूण इनपुट टोकन्स | 47,583 | 33,864 |
| आउटपुट टोकन्स | 0 | 96 |
| रिझनिंग टोकन्स | 0 | 0 |
| प्रतिसाद वेळ (सरासरी) | 495ms | 498ms |
| प्रतिसाद वेळ (कमाल) | 842ms | 602ms |
| प्रतिसाद वेळ (एकूण) | 5.94s | 3.49s |
| पॅरामीटर्स | ~400B एकूण (~17B सक्रिय) | 4B |
| उपलब्धता | बंद स्रोत | वेट्स उपलब्ध |
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
| स्वायत्त एजंट कार्ये | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| अँटी-एआय युक्त्या | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.3 | 7.5 | 0.0% | 0 | 436ms | 6,279 | 0 | 0 | |
| Tev1 4B Experimental | 2.5 | 2.5 | 25.0% | 0 | 602ms | 507 | 6 | 0 |
| कोडिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.5 | 6.7 | 0.0% | 0 | 447ms | 22,197 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| संयुक्त | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| डेटा पार्सिंग आणि निष्कर्षण | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 10.0 | 10.0 | 100.0% | 0 | 411ms | 10,998 | 0 | 0 | |
| Tev1 4B Experimental | 3.0 | 10.0 | 0.0% | 0 | 509ms | 25,317 | 30 | 0 |
| डोमेन-विशिष्ट | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 5.3 | 10.0 | 33.3% | 0 | 554ms | 3,063 | 0 | 0 | |
| Tev1 4B Experimental | 6.7 | 6.7 | 66.7% | 0 | 440ms | 1,086 | 12 | 0 |
| Samanya Buddhimatta | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| सूचनांचे पालन | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.5 | 5.0 | 0.0% | 0 | 842ms | 4,440 | 0 | 0 | |
| Tev1 4B Experimental | 1.5 | 5.0 | 0.0% | 0 | 555ms | 6,411 | 42 | 0 |
| कोडी सोडवणे | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.7 | 3.3 | 0.0% | 0 | 414ms | 606 | 0 | 0 | |
| Tev1 4B Experimental | 1.7 | 3.3 | 0.0% | 0 | 432ms | 543 | 6 | 0 |
| टूल कॉलिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| सामान्य ज्ञान | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
झटपट तुलना
तुलना जोडी बदला
Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsTev1 4B ExperimentaldefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneLing 3.0 TinymediumvsGPT-6 Luna DecisionsdefaultLing 3.0 TinylowvsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsGPT-6 Luna DecisionsdefaultNemotron 3.5 Lightningnoneमोफत उपलब्धvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsQwen3.5-9Bmedium