नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3 Flash Preview vs StepFun: Step 3.7 Flash

सारांश

Gemini 3 Flash Preview vs Step 3.7 Flash benchmark तुलना: Step 3.7 Flash average score में आगे है: 7.7 vs 6.9. Gemini 3 Flash Preview की benchmark लागत कम है: $0.025 vs $0.341. Gemini 3 Flash Preview तेज है: 1.65s vs 15.74s, pass rates 66.7% vs 68.3%.

अनुशंसित मॉडल: Gemini 3 Flash Preview - Its score stays close to the best score here (6.9 vs 7.7), while costing about 14.1x less than Step 3.7 Flash.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemini 3 Flash Preview Gemini 3 Flash Preview none रिलीज़: 2025-12-17 Step 3.7 Flash Step 3.7 Flash low रिलीज़: 2026-05-29
स्कोर 6.9 7.7
रैंक #67 #39
विश्वसनीयता 10.0 10.0
संगति 9.2 8.4
सही परीक्षण
प्रति प्रयास पास दर 66.7% 68.3%
अस्थिर टेस्ट 2 4
कुल रन 63 63
प्रति परिणाम लागत 0.186 2.840
कुल लागत $0.025 $0.341
इनपुट कीमत $0.500 / 1M $0.200 / 1M
आउटपुट कीमत $3.000 / 1M $1.150 / 1M
कुल इनपुट टोकन 37,011 40,101
आउटपुट टोकन 1,885 289,325
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.65s 15.74s
प्रतिक्रिया समय (अधिकतम) 3.56s 124.75s
प्रतिक्रिया समय (कुल) 23.07s 330.63s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Gemini 3 Flash Preview

none
लागत
$0.003
समय
5.6s
टोकन
981 tok

#39 Step 3.7 Flash

low
अमान्य SVG
लागत
$0.004
समय
25.3s
टोकन
3,072 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 498 214 0
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 5.5 10.0 33.3% 0 1.80s 8,122 453 0
Step 3.7 Flash 8.2 7.2 88.9% 1 9.46s 7,437 18,685 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 12,862 350 0
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 7,263 279 0
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 643 18 0
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 490 104 0
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 619 74 0
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.05s 574 144 0
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 5,784 234 0
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 156 15 0
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

त्वरित तुलना

तुलना जोड़ी बदलें