নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: gpt-oss-120b

সারাংশ

Gemini 3.5 Flash vs gpt-oss-120b benchmark তুলনা: Gemini 3.5 Flash average score-এ এগিয়ে: 6.8 vs 6.7. gpt-oss-120b-এর benchmark খরচ কম: $0.013 vs $0.108. Gemini 3.5 Flash দ্রুত: 1.57s vs 22.28s, pass rates 68.3% vs 52.4%.

প্রস্তাবিত মডেল: gpt-oss-120b - Its score stays close to the best score here (6.7 vs 6.8), while costing about 8.8x less than Gemini 3.5 Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Gemini 3.5 Flash Gemini 3.5 Flash minimal প্রকাশ: 2026-05-19 gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05 বিনামূল্যে উপলভ্য
স্কোর 6.8 6.7
র‍্যাঙ্ক #71 #78
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.3% 52.4%
অস্থির টেস্ট 1 5
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.767 0.141
মোট খরচ $0.108 $0.013
ইনপুট মূল্য $1.500 / 1M $0.039 / 1M
আউটপুট মূল্য $9.000 / 1M $0.180 / 1M
মোট ইনপুট টোকেন 39,847 39,084
আউটপুট টোকেন 5,277 20,013
রিজনিং টোকেন 0 50,233
প্রতিক্রিয়া সময় (গড়) 1.57s 22.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 5.51s 68.16s
প্রতিক্রিয়া সময় (মোট) 33.02s 311.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Gemini 3.5 Flash

minimal
Cost
$0.041
Time
20.4s
Tokens
4,608 tok

#78 gpt-oss-120b

medium
Cost
$0.001
Time
26.7s
Tokens
555 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 6.5 10.0 50.0% 0 892ms 492 405 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 5.6 9.9 33.3% 0 2.75s 8,122 3,456 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 3.0 10.0 0.0% 0 3.56s 15,780 404 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.66s 7,548 279 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 899ms 633 12 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 922ms 486 117 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 6.4 5.8 66.7% 1 893ms 615 76 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.45s 558 282 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.79s 5,457 234 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 3.0 10.0 0.0% 0 1.76s 156 12 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

দ্রুত তুলনা

তুলনার জুটি বদলান