Advertise here
#104

Grok 4.1 Fast

X AI रिलीज़: 2025-11-19 परीक्षण किया गया: 2026-04-11 01:44 x-ai/grok-4.1-fast::none
~500B कुल (~50B सक्रिय)MoEबंद स्रोतअनुमानित
(medium) (none)

सारांश

Grok 4.1 Fast AI BENCHY पर 4.5 स्कोर करता है और #104 पर है। इसकी reliability लागू नहीं, pass rate 24.1%, कुल लागत $0.009, और औसत response time 1.76s है।

Grok 4.1 Fast को अलग क्या बनाता है: यह डोमेन-विशिष्ट में सबसे अलग दिखता है, जहाँ इसकी रैंक #3 है; जबकि एंटी-एआई ट्रिक्स इसकी सबसे कमजोर जगह है, जहाँ यह #18 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है। यह समान मॉडलों की तुलना में काफ़ी तेज है।

संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।

मॉडल विवरण

शोध की तारीख: 2026-08-12

अनुमानित
पैरामीटर
~500B कुल (~50B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
लाइसेंस
-

सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।

संगति

8.7

विश्वसनीयता

लागू नहीं

कुल आउटपुट टोकन

1,721

कुल इनपुट टोकन

0

इनपुट कीमत

$0.200 / 1M

आउटपुट कीमत

$0.500 / 1M

कैश पढ़ने की कीमत

लागू नहीं

कैश लिखने की कीमत

लागू नहीं

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

सही परीक्षण

गलत टेस्ट: 15

प्रति प्रयास पास दर: 24.1%

अस्थिर टेस्ट

3

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

1.76s

प्रतिक्रिया समय (अधिकतम): 5.51s

प्रतिक्रिया समय (कुल): 19.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 xAI: Grok 4.1 Fast

none
Grok 4.1 Fast is deprecated. xAI recommends switching to Grok 4.3 (https://openrouter.ai/x-ai/grok-4.3)
लागत
$0.000
समय
0.1s
टोकन
0 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-08 13:50 दोबारा परीक्षण 3.8 10.0 $0.008 ↓ तुलना करें
2026-05-08 13:50 दोबारा परीक्षण 3.8 10.0 $0.008 ↓ तुलना करें
2026-05-08 13:50 दोबारा परीक्षण 4.4 10.0 $0.008 ↓ तुलना करें
2026-05-08 13:50 दोबारा परीक्षण 4.4 10.0 $0.009 तुलना करें
2026-05-08 13:50 सूट बदला गया 4.4 10.0 $0.009 तुलना करें
2026-04-11 01:44 पहला दर्ज रन 4.5 लागू नहीं $0.009 वर्तमान रन

रन तुलना

रनबेंचमार्क कवरेजस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-04-11 01:44 · पहला दर्ज रन54/54 प्रयास4.58.7लागू नहीं3/1831,7210$0.0091.76s
2026-05-08 13:50 · सूट बदला गया57/57 प्रयास4.48.810.03/1931,7330$0.0091.67s
अंतर—+0.1-0.100-120-$0.001+86ms

बेंचमार्क कवरेज अलग है: 54/54 प्रयास (लक्ष्य: प्रति टेस्ट 3 दोहराव) बनाम 57/57 प्रयास (लक्ष्य: प्रति टेस्ट 3 दोहराव)। कुल और दोहराव-संवेदनशील मेट्रिक सीधे तुलना योग्य नहीं हैं।

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 3.2 10.0
कोडिंग 5.3 3.4
संयुक्त 3.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.9 7.2
Samanya Buddhimatta 4.4 9.9
निर्देश पालन 3.0 10.0
पहेली समाधान 3.2 10.0
टूल कॉलिंग 2.8 1.6

तुलना किए गए मॉडल