نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs ByteDance Seed: Seed-2.0-Mini

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک Anthropic: Claude Sonnet 4.6 medium اجرا: ریلیز کی تاریخ نامعلوم ByteDance Seed: Seed-2.0-Mini medium اجرا: 2026-02-26
درجہ #8 #18
اسکور 7.43 6.13
تسلسل 9.40 8.91
فی نتیجہ لاگت 8.105 0.177
کل لاگت $0.811 $0.013
درست ٹیسٹس
غلط ٹیسٹس 4 7
فی کوشش کامیابی کی شرح 73.8% 59.5%
غیر مستحکم ٹیسٹ 1 2
آؤٹ پٹ ٹوکنز 29,098 1,353
ریزننگ ٹوکنز 20,435 24,362

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 7.00 10.00 66.7% 0 1,031 1,093
ByteDance Seed: Seed-2.0-Mini 7.00 9.99 66.7% 0 354 9,352
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 727 907
ByteDance Seed: Seed-2.0-Mini 9.88 10.00 100.0% 0 246 2,743
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 1.00 7.21 11.1% 1 25,790 16,919
ByteDance Seed: Seed-2.0-Mini 1.00 10.00 0.0% 0 0 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 316 523
ByteDance Seed: Seed-2.0-Mini 8.00 9.99 50.0% 0 69 2,050
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 579 642
ByteDance Seed: Seed-2.0-Mini 5.33 4.91 77.8% 2 462 4,982
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Sonnet 4.6 10.00 10.00 100.0% 0 655 351
ByteDance Seed: Seed-2.0-Mini 10.00 10.00 100.0% 0 222 5,235

موازنہ کی جوڑی تبدیل کریں