نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Fable 5 vs StepFun: Step 3.7 Flash

خلاصہ

Claude Fable 5 vs Step 3.7 Flash benchmark موازنہ: Claude Fable 5 average score میں آگے ہے: 9.2 vs 7.7. Step 3.7 Flash کی benchmark لاگت کم ہے: $0.341 vs $3.165. Step 3.7 Flash تیز ہے: 15.74s vs 17.01s، pass rates 82.5% vs 68.3%.

تجویز کردہ ماڈل: Step 3.7 Flash - It offers the best overall trade-off: a competitive score (7.7), lower cost than Claude Fable 5, and balanced response time.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Claude Fable 5 Claude Fable 5 medium اجرا: 2026-06-10 Step 3.7 Flash Step 3.7 Flash low اجرا: 2026-05-29
اسکور 9.2 7.7
درجہ #9 #42
اعتماد پذیری 10.0 10.0
تسلسل 9.6 8.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 82.5% 68.3%
غیر مستحکم ٹیسٹ 1 4
کل رنز 63 63
فی نتیجہ لاگت 18.614 2.840
کل لاگت $3.165 $0.341
ان پٹ قیمت $10.000 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $50.000 / 1M $1.150 / 1M
کل ان پٹ ٹوکنز 58,383 40,101
آؤٹ پٹ ٹوکنز 41,340 289,325
ریزننگ ٹوکنز 10,269 0
ردِعمل کا وقت (اوسط) 17.01s 15.74s
ردِعمل کا وقت (زیادہ سے زیادہ) 80.80s 124.75s
ردِعمل کا وقت (کل) 357.17s 330.63s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 Claude Fable 5

medium
Cost
$0.606
Time
156.7s
Tokens
12,264 tok

#42 Step 3.7 Flash

low
Invalid SVG
Cost
$0.004
Time
25.3s
Tokens
3,072 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 6.20s 834 530 402
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
Step 3.7 Flash 8.2 7.2 88.9% 1 9.46s 7,437 18,685 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 33.70s 20,937 2,353 1,599
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 7.18s 10,503 521 363
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 5.3 7.2 44.4% 1 53.40s 975 25,215 5,001
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 7.42s 708 366 144
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 5.90s 909 139 202
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 7.7 10.0 66.7% 0 5.18s 894 402 324
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 10.0 10.0 100.0% 0 16.96s 11,775 729 344
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Fable 5 3.0 10.0 0.0% 0 25.64s 258 3,702 572
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں