#36
Gemini 2.5 Flash
Google · اجرا: 2025-06-17 · google/gemini-2.5-flash::none
اوسط اسکور
5.34
فی نتیجہ لاگت
0.107
تسلسل
9.40
کل لاگت
$0.007
درست ٹیسٹس
6
کوئی ٹیسٹ تبھی مکمل کامیاب شمار ہوگا جب اس کے تمام رنز کامیاب ہوں
غلط ٹیسٹس
8
فی کوشش کامیابی کی شرح: 47.6%
غیر مستحکم ٹیسٹ
1
ردِعمل کا وقت: اوسط 698ms · کل 9.78s · زیادہ سے زیادہ 1.91s
غلط جواب: 6
ہدایات پر عمل نہیں کیا: 2
اسکور کے لحاظ سے سرفہرست ماڈلز
پہلا ماڈل منتخب کریں، پھر دوسرا ماڈل کلک کریں تاکہ سائیڈ بائی سائیڈ صفحہ کھلے۔
فوری موازنہ
Gemini 2.5 FlashnonevsMiniMax M2.5mediumGemini 2.5 FlashnonevsQwen3.5-122B-A10BnoneGemini 2.5 Flashnonevsgpt-oss-120bmediumمفت دستیابGemini 2.5 FlashnonevsGPT-4o-mininoneGemini 2.5 FlashnonevsGPT-5 MinimediumGemini 2.5 FlashnonevsDeepSeek V3.2noneGemini 2.5 FlashnonevsGemini 3 Flash PreviewmediumGemini 2.5 FlashnonevsGemini 3.1 Pro PreviewmediumGemini 2.5 FlashnonevsStep 3.5 Flashmediumمفت دستیاب
زمرہ وار تفصیل
| زمرہ | اوسط اسکور | تسلسل | درست ٹیسٹس |
|---|---|---|---|
| Anti-AI Tricks | 1.00 | 10.00 | 0/3 |
| Data parsing and extraction | 9.88 | 10.00 | 2/2 |
| Domain specific | 4.00 | 7.21 | 1/3 |
| Instructions following | 8.00 | 9.99 | 1/2 |
| Puzzle Solving | 4.67 | 10.00 | 1/3 |
| Tool Calling | 10.00 | 10.00 | 1/1 |