#23 xAI: Grok 4.5
medium- लागत
- $0.044
- समय
- 59.4s
- टोकन
- 7,512 tok
सारांश
Grok 4.5 AI BENCHY पर 8.3 स्कोर करता है और #23 पर है। इसकी reliability 9.6, pass rate 77.8%, कुल लागत $1.327, और औसत response time 63.50s है।
शोध की तारीख: 2026-08-12
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
8.3
संगति
8.9
9.6
$1.327
कुल आउटपुट टोकन
203,365
कुल इनपुट टोकन
53,198
इनपुट कीमत
$2.000 / 1M
आउटपुट कीमत
$6.000 / 1M
कैश पढ़ने की कीमत
लागू नहीं
कैश लिखने की कीमत
लागू नहीं
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
अस्थिर टेस्ट
3
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
रन इतिहास
| परीक्षण किया गया | स्कोर | विश्वसनीयता | सही परीक्षण | कुल लागत | तुलना करें |
|---|---|---|---|---|---|
| 2026-08-14 03:04 दोबारा परीक्षण | 8.5 | 10.0 | $2.042 | तुलना करें | |
| 2026-07-16 23:09 नया टेस्ट जोड़ा गया | 8.3 | 10.0 | $1.928 | तुलना करें | |
| 2026-07-08 23:28 दोबारा परीक्षण | 8.3 | 9.9 | $1.696 | तुलना करें | |
| 2026-07-08 21:34 पहला रन | 8.3 | 9.6 | $1.327 | वर्तमान रन |
कीमत का इतिहास
OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।
| तारीख | इनपुट कीमत | आउटपुट कीमत | कैश पढ़ने की कीमत | कैश लिखने की कीमत |
|---|---|---|---|---|
| 2026-07-08 21:47 | $2.000 / 1M | $6.000 / 1M | लागू नहीं | लागू नहीं |
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| एंटी-एआई ट्रिक्स | 10.0 | 10.0 | |
| कोडिंग | 7.6 | 7.2 | |
| संयुक्त | 10.0 | 10.0 | |
| डेटा पार्सिंग और निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 2.9 | 7.2 | |
| Samanya Buddhimatta | 6.5 | 3.4 | |
| निर्देश पालन | 9.8 | 10.0 | |
| पहेली समाधान | 10.0 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |