नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5 (medium) vs Qwen3.8 Max (low)

Qwen3.8 Max (low) average score में आगे है: 8.7 vs 8.6. Qwen3.8 Max (low) की benchmark लागत कम है: $0.687 vs $3.478. Claude Fable 5 (medium) तेज है: 17.20s vs 21.19s, pass rates 78.8% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-04

रैंक
#25
कुल आउटपुट टोकन
51,629
प्रतिक्रिया समय (औसत)
17.20s
कुल लागत
$3.478
रैंक
#23
कुल आउटपुट टोकन
81,411
प्रतिक्रिया समय (औसत)
21.19s
कुल लागत
$0.687
अनुशंसित मॉडल Qwen3.8 Max (low)

It has the best score here (8.7), while costing about 5.1x less than Claude Fable 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5 Claude Fable 5 medium रिलीज़: 2026-06-10 Qwen3.8 Max Qwen3.8 Max low रिलीज़: 2026-08-04
स्कोर 8.6 8.7
रैंक #25 #23
विश्वसनीयता 10.0 10.0
संगति 9.6 9.0
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 78.8% 84.9%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 20.459 4.041
कुल लागत $3.478 $0.687
इनपुट कीमत $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $50.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 89,643 99,172
आउटपुट टोकन 41,360 6,132
रीजनिंग टोकन 10,269 75,279
प्रतिक्रिया समय (औसत) 17.20s 21.19s
प्रतिक्रिया समय (अधिकतम) 80.80s 155.75s
प्रतिक्रिया समय (कुल) 378.41s 466.14s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Claude Fable 5

medium
लागत
$0.606
समय
156.7s
टोकन
12,264 tok

#23 Qwen3.8 Max

low
लागत
$0.026
समय
68.5s
टोकन
4,280 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

त्वरित तुलना

तुलना जोड़ी बदलें