نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs Google: Gemini 3 Flash Preview

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک Anthropic: Claude Opus 4.6 medium اجرا: ریلیز کی تاریخ نامعلوم Google: Gemini 3 Flash Preview low اجرا: ریلیز کی تاریخ نامعلوم
درجہ #20 #6
اسکور 6.07 8.36
تسلسل 8.80 9.40
فی نتیجہ لاگت 10.992 0.602
کل لاگت $0.880 $0.067
درست ٹیسٹس
غلط ٹیسٹس 6 3
فی کوشش کامیابی کی شرح 61.9% 81.0%
غیر مستحکم ٹیسٹ 2 1
آؤٹ پٹ ٹوکنز 19,576 1,170
ریزننگ ٹوکنز 11,081 18,372

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 4.00 4.41 55.6% 2 897 1,000
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 275 2,476
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 10.00 10.00 100.0% 0 668 763
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 305 3,004
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 1.00 10.00 0.0% 0 16,328 7,928
Google: Gemini 3 Flash Preview 4.00 7.21 44.4% 1 12 6,410
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 9.50 9.99 100.0% 0 266 468
Google: Gemini 3 Flash Preview 7.50 9.99 50.0% 0 71 2,752
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 7.00 10.00 66.7% 0 556 593
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 273 3,315
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Anthropic: Claude Opus 4.6 10.00 10.00 100.0% 0 861 329
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 234 415

موازنہ کی جوڑی تبدیل کریں