نیویگیشن
AI BENCHY
Advertise here

Claude Opus 4.8 (low) vs Seed-2.0-Code (low)

average score تقریباً برابر ہے: 7.8 vs 7.7. Seed-2.0-Code (low) کی benchmark لاگت کم ہے: $0.681 vs $2.077. Claude Opus 4.8 (low) تیز ہے: 12.74s vs 65.89s، pass rates 80.3% vs 80.3%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-12

درجہ
#65
کل آؤٹ پٹ ٹوکنز
51,758
ردِعمل کا وقت (اوسط)
12.74s
کل لاگت
$2.077
درجہ
#66
کل آؤٹ پٹ ٹوکنز
212,558
ردِعمل کا وقت (اوسط)
65.89s
کل لاگت
$0.681
تجویز کردہ ماڈل Claude Opus 4.8 (low)

It has the best score here (7.8), while responding about 5.2x faster than Seed-2.0-Code (low).

تفصیلی موازنہ

میٹرک Claude Opus 4.8 Claude Opus 4.8 low اجرا: 2026-05-28 Seed-2.0-Code Seed-2.0-Code low اجرا: 2026-08-12
اسکور 7.8 7.7
درجہ #65 #66
اعتماد پذیری 10.0 5.7
تسلسل 8.9 7.5
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 80.3% 80.3%
غیر مستحکم ٹیسٹ 3 7
کل رنز 66 66
فی نتیجہ لاگت 12.979 5.235
کل لاگت $2.077 $0.681
ان پٹ قیمت $5.000 / 1M $0.500 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $3.000 / 1M
کل ان پٹ ٹوکنز 156,525 85,648
آؤٹ پٹ ٹوکنز 43,141 8,142
ریزننگ ٹوکنز 8,617 204,416
ردِعمل کا وقت (اوسط) 12.74s 65.89s
ردِعمل کا وقت (زیادہ سے زیادہ) 127.97s 485.92s
ردِعمل کا وقت (کل) 280.29s 1449.53s
پیرامیٹرز ~5T کل (~500B فعال) ~200B کل (~20B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 Claude Opus 4.8

low
لاگت
$0.031
وقت
14.1s
ٹوکنز
1,345 tok

#66 Seed-2.0-Code

low
Provider returned error
لاگت
$0.000
وقت
0.3s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
Seed-2.0-Code 7.0 5.0 77.8% 2 109.70s 7,948 455 55,759

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں