नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Opus 4.7 vs Google: Gemini 3.6 Flash

Gemini 3.6 Flash (high) average score मध्ये पुढे आहे: 9.7 vs 8.7. Claude Opus 4.7 (medium) चा benchmark खर्च कमी आहे: $1.477 vs $1.785. Claude Opus 4.7 (medium) वेगवान आहे: 7.61s vs 14.88s, pass rates 83.3% vs 98.5%.

शिफारस केलेले मॉडेलGemini 3.6 Flash (high)It has the strongest score in this comparison (9.7) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 Gemini 3.6 Flash Gemini 3.6 Flash high प्रकाशन: 2026-07-21
स्कोअर 8.7 9.7
क्रमांक #18 #2
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 98.5%
अस्थिर चाचण्या 1 1
एकूण रन 66 66
प्रति निकाल खर्च 8.201 8.497
एकूण खर्च $1.477 $1.785
इनपुट किंमत $5.000 / 1M $1.500 / 1M
आउटपुट किंमत $25.000 / 1M $7.500 / 1M
एकूण इनपुट टोकन्स 145,252 87,819
आउटपुट टोकन्स 24,948 5,750
रिझनिंग टोकन्स 5,042 214,596
प्रतिसाद वेळ (सरासरी) 7.61s 14.88s
प्रतिसाद वेळ (कमाल) 65.40s 88.00s
प्रतिसाद वेळ (एकूण) 159.91s 327.37s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#2 Gemini 3.6 Flash

high
खर्च
$0.069
वेळ
44.0s
टोकन्स
9,251 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Gemini 3.6 Flash 10.0 10.0 100.0% 0 26.73s 8,136 448 60,606

झटपट तुलना

तुलना जोडी बदला