नेविगेशन
Advertise here

Claude Fable 5.1 (high) vs GPT-5.6 Terra (low)

average score लगभग बराबर है: 7.9 vs 7.9. GPT-5.6 Terra (low) की benchmark लागत कम है: $0.645 vs $3.471. GPT-5.6 Terra (low) तेज है: 7.58s vs 13.30s, pass rates 85.5% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#98
कुल आउटपुट टोकन
40,466
प्रतिक्रिया समय (औसत)
13.30s
कुल लागत
$3.471
रैंक
#95
कुल आउटपुट टोकन
24,213
प्रतिक्रिया समय (औसत)
7.58s
कुल लागत
$0.645
अनुशंसित मॉडल GPT-5.6 Terra (low)

It has the best score here (7.9), while costing about 5.4x less than Claude Fable 5.1 (high).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 high रिलीज़: 2026-09-02 GPT-5.6 Terra GPT-5.6 Terra low रिलीज़: 2026-07-09
स्कोर 7.9 7.9
रैंक #98 #95
विश्वसनीयता 10.0 10.0
संगति 9.7 8.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 85.5% 75.4%
अस्थिर टेस्ट 1 6
कुल रन 69 69
प्रति परिणाम लागत 18.264 5.277
कुल लागत $3.471 $0.645
इनपुट कीमत $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $50.000 / 1M $12.000 / 1M
कुल इनपुट टोकन 144,676 176,890
आउटपुट टोकन 8,184 5,688
रीजनिंग टोकन 32,282 18,525
प्रतिक्रिया समय (औसत) 13.30s 7.58s
प्रतिक्रिया समय (अधिकतम) 40.17s 54.57s
प्रतिक्रिया समय (कुल) 305.83s 174.39s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1T कुल (~60B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Claude Fable 5.1

high
लागत
$0.384
समय
102.5s
टोकन
7,824 tok

#95 GPT-5.6 Terra

low
लागत
$0.034
समय
16.8s
टोकन
2,348 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821

त्वरित तुलना

तुलना जोड़ी बदलें