नेव्हिगेशन
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.7 vs Google: Gemini 3.5 Flash-Lite

Claude Opus 4.7 (medium) average score मध्ये पुढे आहे: 8.7 vs 8.1. Gemini 3.5 Flash-Lite (high) चा benchmark खर्च कमी आहे: $0.584 vs $1.477. Claude Opus 4.7 (medium) वेगवान आहे: 7.61s vs 9.48s, pass rates 83.3% vs 81.8%.

शिफारस केलेले मॉडेलClaude Opus 4.7 (medium)It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high प्रकाशन: 2026-07-21
स्कोअर 8.7 8.1
क्रमांक #18 #31
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 7.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 81.8%
अस्थिर चाचण्या 1 7
एकूण रन 66 66
प्रति निकाल खर्च 8.201 4.169
एकूण खर्च $1.477 $0.584
इनपुट किंमत $5.000 / 1M $0.300 / 1M
आउटपुट किंमत $25.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 145,252 105,138
आउटपुट टोकन्स 24,948 8,315
रिझनिंग टोकन्स 5,042 212,507
प्रतिसाद वेळ (सरासरी) 7.61s 9.48s
प्रतिसाद वेळ (कमाल) 65.40s 43.93s
प्रतिसाद वेळ (एकूण) 159.91s 208.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#31 Gemini 3.5 Flash-Lite

high
खर्च
$0.023
वेळ
23.6s
टोकन्स
9,128 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603

झटपट तुलना

तुलना जोडी बदला