নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Opus 4.7 vs Google: Gemini 3.5 Flash-Lite

Claude Opus 4.7 (medium) average score-এ এগিয়ে: 8.7 vs 8.1. Gemini 3.5 Flash-Lite (high)-এর benchmark খরচ কম: $0.584 vs $1.477. Claude Opus 4.7 (medium) দ্রুত: 7.61s vs 9.48s, pass rates 83.3% vs 81.8%.

প্রস্তাবিত মডেলClaude Opus 4.7 (medium)It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high প্রকাশ: 2026-07-21
স্কোর 8.7 8.1
র‍্যাঙ্ক #18 #31
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 7.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 81.8%
অস্থির টেস্ট 1 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.201 4.169
মোট খরচ $1.477 $0.584
ইনপুট মূল্য $5.000 / 1M $0.300 / 1M
আউটপুট মূল্য $25.000 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 145,252 105,138
আউটপুট টোকেন 24,948 8,315
রিজনিং টোকেন 5,042 212,507
প্রতিক্রিয়া সময় (গড়) 7.61s 9.48s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 65.40s 43.93s
প্রতিক্রিয়া সময় (মোট) 159.91s 208.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Opus 4.7

medium
খরচ
$0.059
সময়
26.8s
টোকেন
2,475 tok

#31 Gemini 3.5 Flash-Lite

high
খরচ
$0.023
সময়
23.6s
টোকেন
9,128 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603

দ্রুত তুলনা

তুলনার জুটি বদলান