নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Fable 5 vs StepFun: Step 3.7 Flash

সারাংশ

Claude Fable 5 vs Step 3.7 Flash benchmark তুলনা: Claude Fable 5 average score-এ এগিয়ে: 9.2 vs 7.7. Step 3.7 Flash-এর benchmark খরচ কম: $0.341 vs $3.165. Step 3.7 Flash দ্রুত: 15.74s vs 17.01s, pass rates 82.5% vs 68.3%.

প্রস্তাবিত মডেল: Step 3.7 Flash - It offers the best overall trade-off: a competitive score (7.7), lower cost than Claude Fable 5, and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Claude Fable 5 Claude Fable 5 medium প্রকাশ: 2026-06-10 Step 3.7 Flash Step 3.7 Flash low প্রকাশ: 2026-05-29
স্কোর 9.2 7.7
র‍্যাঙ্ক #9 #42
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 82.5% 68.3%
অস্থির টেস্ট 1 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 18.614 2.840
মোট খরচ $3.165 $0.341
ইনপুট মূল্য $10.000 / 1M $0.200 / 1M
আউটপুট মূল্য $50.000 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 58,383 40,101
আউটপুট টোকেন 41,340 289,325
রিজনিং টোকেন 10,269 0
প্রতিক্রিয়া সময় (গড়) 17.01s 15.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 80.80s 124.75s
প্রতিক্রিয়া সময় (মোট) 357.17s 330.63s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 Claude Fable 5

medium
Cost
$0.606
Time
156.7s
Tokens
12,264 tok

#42 Step 3.7 Flash

low
Invalid SVG
Cost
$0.004
Time
25.3s
Tokens
3,072 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 6.20s 834 530 402
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
Step 3.7 Flash 8.2 7.2 88.9% 1 9.46s 7,437 18,685 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 33.70s 20,937 2,353 1,599
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 7.18s 10,503 521 363
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 5.3 7.2 44.4% 1 53.40s 975 25,215 5,001
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 7.42s 708 366 144
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 5.90s 909 139 202
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 7.7 10.0 66.7% 0 5.18s 894 402 324
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 10.0 10.0 100.0% 0 16.96s 11,775 729 344
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Fable 5 3.0 10.0 0.0% 0 25.64s 258 3,702 572
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

দ্রুত তুলনা

তুলনার জুটি বদলান