नेविगेशन
AI BENCHY
Advertise here

Anthropic: Claude Fable 5 vs Google: Gemini 3.5 Flash-Lite

Claude Fable 5 (medium) average score में आगे है: 8.6 vs 8.1. Gemini 3.5 Flash-Lite (high) की benchmark लागत कम है: $0.584 vs $3.478. Gemini 3.5 Flash-Lite (high) तेज है: 9.48s vs 17.20s, pass rates 78.8% vs 81.8%.

अनुशंसित मॉडलGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.6), while costing about 6.0x less than Claude Fable 5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Fable 5 Claude Fable 5 medium रिलीज़: 2026-06-10 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high रिलीज़: 2026-07-21
स्कोर 8.6 8.1
रैंक #22 #34
विश्वसनीयता 10.0 10.0
संगति 9.6 7.5
सही परीक्षण
प्रति प्रयास पास दर 78.8% 81.8%
अस्थिर टेस्ट 1 7
कुल रन 66 66
प्रति परिणाम लागत 20.459 4.169
कुल लागत $3.478 $0.584
इनपुट कीमत $10.000 / 1M $0.300 / 1M
आउटपुट कीमत $50.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 89,643 105,138
आउटपुट टोकन 41,360 8,315
रीजनिंग टोकन 10,269 212,507
प्रतिक्रिया समय (औसत) 17.20s 9.48s
प्रतिक्रिया समय (अधिकतम) 80.80s 43.93s
प्रतिक्रिया समय (कुल) 378.41s 208.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Fable 5

medium
लागत
$0.606
समय
156.7s
टोकन
12,264 tok

#34 Gemini 3.5 Flash-Lite

high
लागत
$0.023
समय
23.6s
टोकन
9,128 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603

त्वरित तुलना

तुलना जोड़ी बदलें