- র্যাঙ্ক
- #28
- মোট আউটপুট টোকেন
- 125,316
- প্রতিক্রিয়া সময় (গড়)
- 38.97s
- মোট খরচ
- $4.163
GPT-5.5 (medium) vs Pareto
GPT-5.5 (medium) average score-এ এগিয়ে: 9.0 vs 8.9. Pareto-এর benchmark খরচ কম: $1.172 vs $4.163. Pareto দ্রুত: 31.51s vs 38.97s, pass rates 87.9% vs 86.4%.
তুলনা করা মডেল
- র্যাঙ্ক
- #34
- মোট আউটপুট টোকেন
- 119,230
- প্রতিক্রিয়া সময় (গড়)
- 31.51s
- মোট খরচ
- $1.172
প্রস্তাবিত মডেল
Pareto
Its score stays close to the best score here (8.9 vs 9.0), while costing about 3.6x less than GPT-5.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | GPT-5.5 GPT-5.5 medium | Pareto Pareto none |
|---|---|---|
| স্কোর | 9.0 | 8.9 |
| র্যাঙ্ক | #28 | #34 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 8.9 | 9.2 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 87.9% | 86.4% |
| অস্থির টেস্ট | 3 | 2 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 23.127 | 6.506 |
| মোট খরচ | $4.163 | $1.172 |
| ইনপুট মূল্য | $5.000 / 1M | $2.500 / 1M |
| আউটপুট মূল্য | $30.000 / 1M | $7.500 / 1M |
| মোট ইনপুট টোকেন | 80,668 | 110,734 |
| আউটপুট টোকেন | 5,617 | 119,230 |
| রিজনিং টোকেন | 119,699 | 0 |
| প্রতিক্রিয়া সময় (গড়) | 38.97s | 31.51s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 332.10s | 143.33s |
| প্রতিক্রিয়া সময় (মোট) | 857.43s | 693.29s |
| প্যারামিটার | ~1.5T মোট (~100B সক্রিয়) | - |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#28 GPT-5.5
medium- খরচ
- $0.112
- সময়
- 71.9s
- টোকেন
- 3,807 tok
#34 Pareto
none- খরচ
- $0.034
- সময়
- 170.7s
- টোকেন
- 4,581 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Seed 2.1 TurbohighvsParetononeMuse Spark 1.3highvsParetononeClaude Fable 5.1highvsGPT-5.5mediumGPT-5.3-CodexmediumvsParetononeGPT-5.5mediumvsGrok 4.5highQwen3.8 Max (0902)highvsParetononeGPT-5.5mediumvsQwen3.8 Max (0902)highParetononevsGrok 4.5highMuse Spark 1.3highvsGPT-5.5mediumGemini 3.5 FlashlowvsParetononeQwen3.8 MaxmediumvsParetononeSeed 2.1 TurbolowvsGPT-5.5medium