नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemini 3.1 Flash Lite vs StepFun: Step 3.5 Flash

सारांश

Gemini 3.1 Flash Lite vs Step 3.5 Flash benchmark तुलना: Step 3.5 Flash average score में आगे है: 6.6 vs 6.4. Gemini 3.1 Flash Lite की benchmark लागत कम है: $0.028 vs $0.070. Gemini 3.1 Flash Lite तेज है: 1.89s vs 72.53s, pass rates 61.9% vs 54.0%.

अनुशंसित मॉडल: Gemini 3.1 Flash Lite - Its score stays close to the best score here (6.4 vs 6.6), while costing about 2.5x less than Step 3.5 Flash.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low रिलीज़: 2026-05-08 Step 3.5 Flash Step 3.5 Flash medium रिलीज़: 2026-02-01
स्कोर 6.4 6.6
रैंक #85 #80
विश्वसनीयता 10.0 10.0
संगति 9.3 8.9
सही परीक्षण
प्रति प्रयास पास दर 61.9% 54.0%
अस्थिर टेस्ट 2 1
कुल रन 63 60
प्रति परिणाम लागत 0.227 0.198
कुल लागत $0.028 $0.070
इनपुट कीमत $0.250 / 1M $0.090 / 1M
आउटपुट कीमत $1.500 / 1M $0.300 / 1M
कुल इनपुट टोकन 36,892 34,431
आउटपुट टोकन 2,732 91,587
रीजनिंग टोकन 9,260 195,973
प्रतिक्रिया समय (औसत) 1.89s 72.53s
प्रतिक्रिया समय (अधिकतम) 5.66s 453.94s
प्रतिक्रिया समय (कुल) 39.62s 1015.47s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Gemini 3.1 Flash Lite

low
लागत
$0.003
समय
4.0s
टोकन
1,479 tok

#80 Step 3.5 Flash

medium
लागत
$0.008
समय
277.1s
टोकन
23,695 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 500 1,013 1,548
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 12,870 348 975
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 7,453 291 697
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 639 15 1,214
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 492 69 438
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 619 72 760
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 570 210 1,191
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 5,457 234 945
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 160 9 420
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

त्वरित तुलना

तुलना जोड़ी बदलें