নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.1 Flash Lite vs OpenAI: gpt-oss-120b

average score প্রায় সমান: 6.1 vs 6.1. gpt-oss-120b (medium)-এর benchmark খরচ কম: $0.019 vs $0.046. Gemini 3.1 Flash Lite দ্রুত: 1.75s vs 21.91s, pass rates 50.0% vs 50.0%.

প্রস্তাবিত মডেলGemini 3.1 Flash LiteIt has the best score here (6.1), while responding about 12.5x faster than gpt-oss-120b (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-18

মেট্রিক Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none প্রকাশ: 2026-05-08 gpt-oss-120b gpt-oss-120b medium প্রকাশ: 2025-08-05
স্কোর 6.1 6.1
র‍্যাঙ্ক #118 #117
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 50.0% 50.0%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.507 0.221
মোট খরচ $0.046 $0.019
ইনপুট মূল্য $0.250 / 1M $0.037 / 1M
আউটপুট মূল্য $1.500 / 1M $0.170 / 1M
মোট ইনপুট টোকেন 118,050 108,747
আউটপুট টোকেন 10,723 29,772
রিজনিং টোকেন 0 68,044
প্রতিক্রিয়া সময় (গড়) 1.75s 21.91s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 16.25s 68.16s
প্রতিক্রিয়া সময় (মোট) 38.60s 328.70s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Gemini 3.1 Flash Lite

none
খরচ
$0.001
সময়
4.5s
টোকেন
727 tok

#117 gpt-oss-120b

medium
খরচ
$0.001
সময়
26.7s
টোকেন
555 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 938ms 8,128 666 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

দ্রুত তুলনা

তুলনার জুটি বদলান