AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#199

North Mini Code

Cohere रिलीज़: 2026-06-18 परीक्षण किया गया: 2026-07-16 23:19 cohere/north-mini-code::none
(medium) (none)

सारांश

North Mini Code AI BENCHY पर 5.1 स्कोर करता है और #199 पर है। इसकी reliability 8.7, pass rate 18.2%, कुल लागत $0.000, और औसत response time 29.95s है।

North Mini Code को अलग क्या बनाता है: यह संयुक्त में सबसे अलग दिखता है, जहाँ इसकी रैंक #3 है; जबकि एंटी-एआई ट्रिक्स इसकी सबसे कमजोर जगह है, जहाँ यह #14 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है।

संगति

9.9

कुल आउटपुट टोकन

26,786

कुल इनपुट टोकन

130,492

इनपुट कीमत

$0.000 / 1M

आउटपुट कीमत

$0.000 / 1M

सही परीक्षण

गलत टेस्ट: 18

प्रति प्रयास पास दर: 18.2%

बेंचमार्क कवरेज: 22/22 टेस्ट · 60/66 प्रयास

अस्थिर टेस्ट

0

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

29.95s

प्रतिक्रिया समय (अधिकतम): 159.85s

प्रतिक्रिया समय (कुल): 658.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 North Mini Code

none
लागत
$0.000
समय
266.1s
टोकन
63,551 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-07-16 23:19 नया टेस्ट जोड़ा गया 5.1 8.7 $0.000 वर्तमान रन
2026-06-18 09:42 पहला रन 5.1 8.5 $0.000 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-06-18 09:34 $0.000 / 1M $0.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 3.0 10.0
कोडिंग 3.9 10.0
संयुक्त 3.2 9.3
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 3.9 9.6
निर्देश पालन 6.5 10.0
पहेली समाधान 3.5 10.0
टूल कॉलिंग 9.5 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल