AI BENCHY
Advertise here
#104

Grok 4.1 Fast

X AI प्रकाशन: 2025-11-19 चाचणी तारीख: 2026-04-11 01:44 x-ai/grok-4.1-fast::none
~500B एकूण (~50B सक्रिय)MoEबंद स्रोतअंदाजित
(medium) (none)

सारांश

Grok 4.1 Fast AI BENCHY वर 4.5 स्कोर करते आणि #104 वर आहे. याची reliability लागू नाही, pass rate 24.1%, एकूण खर्च $0.009, आणि सरासरी response time 1.76s आहे.

Grok 4.1 Fast खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #2 आहे; तर अँटी-एआय युक्त्या हा सर्वात कमकुवत भाग आहे, rank #18. या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

संग्रहित मॉडेल: हे मॉडेल आता अपडेट केले जाणार नाही आणि नवीन चाचण्यांवर तपासले जाणार नाही.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

अंदाजित
पॅरामीटर्स
~500B एकूण (~50B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
परवाना
-

सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.

सुसंगतता

8.7

विश्वसनीयता

लागू नाही

एकूण आउटपुट टोकन्स

1,721

एकूण इनपुट टोकन्स

0

इनपुट किंमत

$0.200 / 1M

आउटपुट किंमत

$0.500 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 15

प्रति प्रयत्न पास दर: 24.1%

अस्थिर चाचण्या

3

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

1.76s

प्रतिसाद वेळ (कमाल): 5.51s

प्रतिसाद वेळ (एकूण): 19.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 xAI: Grok 4.1 Fast

none
Grok 4.1 Fast is deprecated. xAI recommends switching to Grok 4.3 (https://openrouter.ai/x-ai/grok-4.3)
खर्च
$0.000
वेळ
0.1s
टोकन्स
0 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-05-08 13:50 पुन्हा चाचणी 3.8 10.0 $0.008 तुलना करा
2026-05-08 13:50 पुन्हा चाचणी 3.8 10.0 $0.008 तुलना करा
2026-05-08 13:50 पुन्हा चाचणी 4.4 10.0 $0.008 तुलना करा
2026-05-08 13:50 पुन्हा चाचणी 4.4 10.0 $0.009 तुलना करा
2026-05-08 13:50 सूट बदलला 4.4 10.0 $0.009 तुलना करा
2026-04-11 01:44 पहिली नोंदलेली रन 4.5 लागू नाही $0.009 सध्याची रन

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-04-11 01:44 · पहिली नोंदलेली रन54/54 प्रयत्न4.58.7लागू नाही3/1831,7210$0.0091.76s
2026-05-08 13:50 · पुन्हा चाचणी57/57 प्रयत्न4.48.810.03/1931,7330$0.0091.67s
फरक+0.1-0.100-120-$0.001+86ms

बेंचमार्क कव्हरेज वेगळे आहे: 54/54 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 57/57 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 3.2 10.0
कोडिंग 5.3 3.4
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.9 7.2
Samanya Buddhimatta 4.4 9.9
सूचनांचे पालन 3.0 10.0
कोडी सोडवणे 3.2 10.0
टूल कॉलिंग 2.8 1.6

तुलना केलेली मॉडेल्स