नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.7 (medium) vs Gemini 3.1 Flash Lite Preview (low)

Claude Opus 4.7 (medium) average score में आगे है: 8.7 vs 6.5. Gemini 3.1 Flash Lite Preview (low) की benchmark लागत कम है: $0.646 vs $1.477. Claude Opus 4.7 (medium) तेज है: 7.61s vs 16.70s, pass rates 83.3% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#20
कुल आउटपुट टोकन
29,990
प्रतिक्रिया समय (औसत)
7.61s
कुल लागत
$1.477
रैंक
#114
कुल आउटपुट टोकन
412,200
प्रतिक्रिया समय (औसत)
16.70s
कुल लागत
$0.646
अनुशंसित मॉडल Claude Opus 4.7 (medium)

It has the best score here (8.7), while responding about 2.2x faster than Gemini 3.1 Flash Lite Preview (low).

विस्तृत तुलना

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium रिलीज़: 2026-04-16 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low रिलीज़: 2026-03-03
स्कोर 8.7 6.5
रैंक #20 #114
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
सही परीक्षण
प्रति प्रयास पास दर 83.3% 59.1%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 8.201 4.969
कुल लागत $1.477 $0.646
इनपुट कीमत $5.000 / 1M $0.250 / 1M
आउटपुट कीमत $25.000 / 1M $1.500 / 1M
कुल इनपुट टोकन 145,252 110,185
आउटपुट टोकन 24,948 14,717
रीजनिंग टोकन 5,042 397,483
प्रतिक्रिया समय (औसत) 7.61s 16.70s
प्रतिक्रिया समय (अधिकतम) 65.40s 309.35s
प्रतिक्रिया समय (कुल) 159.91s 367.47s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 4.7

medium
लागत
$0.059
समय
26.8s
टोकन
2,475 tok

#114 Gemini 3.1 Flash Lite Preview

low
लागत
$0.002
समय
3.7s
टोकन
1,203 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 1.39s 8,138 660 1,060

त्वरित तुलना

तुलना जोड़ी बदलें