नेविगेशन
Advertise here

Claude Fable 5.1 (medium) vs GPT-6 Luna (high)

average score लगभग बराबर है: 8.3 vs 8.3. GPT-6 Luna (high) की benchmark लागत कम है: $0.054 vs $2.909. Claude Fable 5.1 (medium) तेज है: 11.67s vs 17.53s, pass rates 81.8% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#74
कुल आउटपुट टोकन
31,152
प्रतिक्रिया समय (औसत)
11.67s
कुल लागत
$2.909
रैंक
#73
कुल आउटपुट टोकन
91,405
प्रतिक्रिया समय (औसत)
17.53s
कुल लागत
$0.054
अनुशंसित मॉडल GPT-6 Luna (high)

It has the best score here (8.3), while costing about 54.1x less than Claude Fable 5.1 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 medium रिलीज़: 2026-09-02 GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23
स्कोर 8.3 8.3
रैंक #74 #73
विश्वसनीयता 10.0 10.0
संगति 7.8 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 75.8%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 19.392 0.359
कुल लागत $2.909 $0.054
इनपुट कीमत $10.000 / 1M $0.100 / 1M
आउटपुट कीमत $50.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 135,112 80,441
आउटपुट टोकन 7,594 4,761
रीजनिंग टोकन 23,558 86,644
प्रतिक्रिया समय (औसत) 11.67s 17.53s
प्रतिक्रिया समय (अधिकतम) 36.59s 106.93s
प्रतिक्रिया समय (कुल) 256.73s 385.74s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Fable 5.1

medium
लागत
$0.244
समय
65.9s
टोकन
5,025 tok

#73 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

त्वरित तुलना

तुलना जोड़ी बदलें