AI BENCHY
Advertise here
#132

GLM 5 Turbo

Z.ai रिलीज़: 2026-03-15 परीक्षण किया गया: 2026-06-04 13:05 z-ai/glm-5-turbo::none
(medium) (none)

सारांश

GLM 5 Turbo AI BENCHY पर 5.2 स्कोर करता है और #132 पर है। इसकी reliability 10.0, pass rate 31.8%, कुल लागत $0.047, और औसत response time 2.82s है।

संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।

संगति

9.3

कुल लागत (वर्तमान कीमत)

$0.047 ↑ +17.9%

परीक्षण के समय: $0.040

कुल आउटपुट टोकन

1,815

कुल इनपुट टोकन

32,525

इनपुट कीमत

$1.200 / 1M

आउटपुट कीमत

$4.000 / 1M

सही परीक्षण

गलत टेस्ट: 15

प्रति प्रयास पास दर: 31.8%

अस्थिर टेस्ट

2

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

2.82s

प्रतिक्रिया समय (अधिकतम): 8.21s

प्रतिक्रिया समय (कुल): 59.29s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 GLM 5 Turbo

none
लागत
$0.047
समय
129.2s
टोकन
11,775 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-06-04 13:05 दोबारा परीक्षण 5.1 10.0 $0.047 तुलना करें
2026-06-04 13:05 नया टेस्ट जोड़ा गया 5.2 10.0 $0.047 वर्तमान रन
2026-05-21 23:41 सूट बदला गया 5.3 10.0 $0.037 तुलना करें
2026-04-11 01:19 पहला दर्ज रन 5.5 लागू नहीं $0.032 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-06-04 13:05 · नया टेस्ट जोड़ा गया5.29.310.06/2121,81532,525$0.0472.82s
2026-05-21 23:41 · सूट बदला गया5.39.310.06/2021,8090$0.0372.83s
अंतर-0.10.00.000+6+32525+$0.011-6ms

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-06-04 14:42 $1.200 / 1M $4.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 3.0 10.0
कोडिंग 3.9 7.8
संयुक्त 3.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 4.2 9.9
निर्देश पालन 6.5 10.0
पहेली समाधान 5.5 7.4
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल