নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: gpt-oss-120b

সারাংশ

Gemini 3 Flash Preview vs gpt-oss-120b benchmark তুলনা: Gemini 3 Flash Preview average score-এ এগিয়ে: 6.9 vs 6.7. gpt-oss-120b-এর benchmark খরচ কম: $0.013 vs $0.025. Gemini 3 Flash Preview দ্রুত: 1.65s vs 22.28s, pass rates 66.7% vs 52.4%.

প্রস্তাবিত মডেল: Gemini 3 Flash Preview - It has the best score here (6.9), while responding about 13.5x faster than gpt-oss-120b.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Gemini 3 Flash Preview Gemini 3 Flash Preview none প্রকাশ: 2025-12-17 gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05 বিনামূল্যে উপলভ্য
স্কোর 6.9 6.7
র‍্যাঙ্ক #68 #78
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 52.4%
অস্থির টেস্ট 2 5
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.186 0.141
মোট খরচ $0.025 $0.013
ইনপুট মূল্য $0.500 / 1M $0.039 / 1M
আউটপুট মূল্য $3.000 / 1M $0.180 / 1M
মোট ইনপুট টোকেন 37,011 39,084
আউটপুট টোকেন 1,885 20,013
রিজনিং টোকেন 0 50,233
প্রতিক্রিয়া সময় (গড়) 1.65s 22.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 3.56s 68.16s
প্রতিক্রিয়া সময় (মোট) 23.07s 311.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Gemini 3 Flash Preview

none
Cost
$0.003
Time
5.6s
Tokens
981 tok

#78 gpt-oss-120b

medium
Cost
$0.001
Time
26.7s
Tokens
555 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 498 214 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 5.5 10.0 33.3% 0 1.80s 8,122 453 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 12,862 350 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 7,263 279 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 643 18 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 490 104 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 619 74 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.05s 574 144 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 5,784 234 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 156 15 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

দ্রুত তুলনা

তুলনার জুটি বদলান