নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Grok 4.20 Beta

সারাংশ

Gemini 3 Flash Preview vs Grok 4.20 Beta benchmark তুলনা: Gemini 3 Flash Preview average score-এ এগিয়ে: 9.8 vs 5.8. Grok 4.20 Beta-এর benchmark খরচ কম: $0.087 vs $0.667. Grok 4.20 Beta দ্রুত: 1.19s vs 18.64s, pass rates 98.4% vs 37.0%.

প্রস্তাবিত মডেল: Grok 4.20 Beta - It offers the best overall trade-off: a competitive score (5.8), lower cost than Gemini 3 Flash Preview, and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক Gemini 3 Flash Preview Gemini 3 Flash Preview medium প্রকাশ: 2025-12-17 Grok 4.20 Beta Grok 4.20 Beta none প্রকাশ: 2026-03-12
স্কোর 9.8 5.8
র‍্যাঙ্ক #1 #107
নির্ভরযোগ্যতা 10.0 প্রযোজ্য নয়
ধারাবাহিকতা 9.7 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 98.4% 37.0%
অস্থির টেস্ট 1 1
মোট রান 63 52
প্রতি ফলাফলে খরচ 3.335 1.510
মোট খরচ $0.667 $0.087
ইনপুট মূল্য $0.500 / 1M $2.041 / 1M
আউটপুট মূল্য $3.000 / 1M $2.041 / 1M
মোট ইনপুট টোকেন 37,017 40,597
আউটপুট টোকেন 2,006 1,657
রিজনিং টোকেন 214,153 0
প্রতিক্রিয়া সময় (গড়) 18.64s 1.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 117.26s 6.48s
প্রতিক্রিয়া সময় (মোট) 391.35s 21.43s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#1 Gemini 3 Flash Preview

medium
Cost
$0.010
Time
17.9s
Tokens
3,236 tok

#107 Grok 4.20 Beta

none
Invalid SVG
Cost
$0.004
Time
8.5s
Tokens
1,672 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 1,986 251 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 358 74 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 17,673 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 7,749 197 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 1,746 160 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 819 87 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
Grok 4.20 Beta 6.3 10.0 50.0% 0 649ms 1,350 60 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
Grok 4.20 Beta 7.7 10.0 66.7% 0 586ms 1,671 357 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 7,245 189 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
Grok 4.20 Beta - - - - - - - - -

দ্রুত তুলনা

তুলনার জুটি বদলান