नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

StepFun: Step 3.7 Flash vs xAI: Grok 4.3

सारांश

Step 3.7 Flash vs Grok 4.3 benchmark तुलना: Grok 4.3 average score मध्ये पुढे आहे: 7.7 vs 7.1. Grok 4.3 चा benchmark खर्च कमी आहे: $0.614 vs $1.148. Grok 4.3 वेगवान आहे: 47.51s vs 64.46s, pass rates 63.5% vs 71.4%.

शिफारस केलेले मॉडेल: Grok 4.3 - It has the best score here (7.7), while costing about 1.9x less than Step 3.7 Flash.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-12

मेट्रिक Step 3.7 Flash Step 3.7 Flash high प्रकाशन: 2026-05-29 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.1 7.7
क्रमांक #63 #40
विश्वसनीयता 10.0 10.0
सुसंगतता 8.2 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.5% 71.4%
अस्थिर चाचण्या 4 4
एकूण रन 63 63
प्रति निकाल खर्च 10.434 4.724
एकूण खर्च $1.148 $0.614
इनपुट किंमत $0.200 / 1M $1.250 / 1M
आउटपुट किंमत $1.150 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 38,391 44,472
आउटपुट टोकन्स 991,355 1,981
रिझनिंग टोकन्स 0 221,382
प्रतिसाद वेळ (सरासरी) 64.46s 47.51s
प्रतिसाद वेळ (कमाल) 364.99s 216.69s
प्रतिसाद वेळ (एकूण) 1353.57s 997.68s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#63 Step 3.7 Flash

high
Cost
$0.007
Time
63.6s
Tokens
6,030 tok

#40 xAI: Grok 4.3

medium
Cost
$0.009
Time
19.0s
Tokens
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
Grok 4.3 10.0 10.0 100.0% 0 8.83s 2,010 88 8,207
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
Grok 4.3 10.0 10.0 100.0% 0 63.99s 12,909 234 15,301
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
Grok 4.3 10.0 10.0 100.0% 0 18.97s 7,761 180 9,546
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Grok 4.3 5.3 7.2 44.4% 1 181.74s 1,764 14 111,300
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
Grok 4.3 5.4 2.5 66.7% 1 24.70s 825 70 5,020
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
Grok 4.3 9.8 10.0 100.0% 0 18.58s 1,362 57 8,713
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
Grok 4.3 5.9 7.2 55.6% 1 22.52s 1,689 128 14,468
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
Grok 4.3 10.0 10.0 100.0% 0 17.66s 7,263 168 4,615
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0
Grok 4.3 3.0 10.0 0.0% 0 44.47s 549 14 12,986

झटपट तुलना

तुलना जोडी बदला